Masz 60-stronicową umowę i zanim udostępnisz ją drugiej stronie, musisz usunąć każde wystąpienie imienia i nazwiska klienta, jego adresu, numerów kont i wszelkich innych poufnych informacji. Nazwa pojawia się 47 razy na 30 różnych stronach. Ręczne znajdowanie i redagowanie każdego wystąpienia zajęłoby godzinę i prawie na pewno przegapiłeś kilka. Funkcja wyszukiwania i redagowania wykonuje tę pracę w ciągu kilku sekund, znajdując wszystkie dopasowania i redagując je wszystkie w jednej operacji.
Redakcja oparta na wyszukiwaniu to najskuteczniejszy sposób oczyszczenia dokumentu, gdy dokładnie wiesz, które słowa, wyrażenia lub wzorce należy usunąć. Łączy w sobie wyszukiwanie tekstu z trwałym usuwaniem treści, a jeśli zostanie wykonane prawidłowo, gwarantuje, że w dokumencie nie pozostanie żadna instancja docelowego tekstu.

Czym różni się redakcja PDF od rysowania czarnej ramki na tekście
Częstym i niebezpiecznym błędem jest mylenie redakcji z rysunkiem. Niektórzy otwierają plik PDF, rysują czarny prostokąt nad poufnym tekstem i zakładają, że tekst jest ukryty. Tak nie jest. Czarny prostokąt to adnotacja umieszczona na górze strony. Oryginalny tekst nadal znajduje się w pliku znajdującym się pod nim. Każdy, kto otworzy plik PDF w przeglądarce, która może ukryć adnotacje, lub skopiuje i wklei tekst ze strony, będzie mógł odzyskać rzekomo zredagowane informacje. Ten błąd doprowadził do naruszeń danych w świecie rzeczywistym, gdzie pisma sądowe, dokumenty rządowe i ujawnienia korporacyjne nieumyślnie ujawniały zredagowane informacje, ponieważ autor zamiast narzędzia redakcyjnego użył narzędzia do rysowania.
Prawdziwa redakcja PDF trwale usuwa dane tekstowe i graficzne z pliku. Po zastosowaniu redakcji narzędzie usuwa podstawową zawartość ze strumieni danych pliku PDF i umieszcza w jej miejsce nieprzezroczystą nakładkę. Oryginalne informacje zniknęły. Nie można go odzyskać poprzez ukrycie adnotacji, skopiowanie tekstu lub sprawdzenie wewnętrznej struktury pliku. W przypadku każdego dokumentu, w którym stawką jest prywatność lub poufność, jedyną akceptowalną metodą jest prawdziwa redakcja.
Spróbuj zredagować plik PDF
Nie wymaga instalacji. Działa bezpośrednio w Twojej przeglądarce.
Krok po kroku: Znajdowanie i redagowanie każdego wystąpienia słowa
Otwórz plik PDF w narzędziu obsługującym redagowanie oparte na wyszukiwaniu. Narzędzie do redakcji zawiera funkcję wyszukiwania i redagowania. Wpisz słowo lub frazę, którą chcesz znaleźć. Narzędzie przeszukuje cały dokument i wyświetla listę wszystkich wystąpień wraz z numerem strony, otaczającym kontekstem i podglądem dopasowania. Przejrzyj listę, aby potwierdzić, że chcesz zredagować wszystkie wystąpienia. Czasami słowo pojawia się zarówno jako informacja poufna, jak i jako termin ogólny. Jeśli nazwisko klienta to „Rice” a w dokumencie omówiono także ryż towarowy, należy sprawdzić każde dopasowanie indywidualnie, zamiast redagować je wszystkie na ślepo.
Po przejrzeniu dopasowań wybierz te, które chcesz zredagować. Możesz wybrać pojedyncze dopasowania, wszystkie dopasowania na określonej stronie lub wszystkie dopasowania w dokumencie. Zastosuj redakcję. Narzędzie trwale usuwa zaznaczony tekst i umieszcza nad każdą lokalizacją czarną ramkę lub wybrany przez Ciebie znak redakcyjny. Zapisz zredagowany plik pod nową nazwą. Oryginalny, niezredagowany plik należy przechowywać bezpiecznie i oddzielnie od wersji zredagowanej. Redakcja jest nieodwracalna i o to właśnie chodzi. Nie możesz przypadkowo wysłać niezredagowanej wersji, jeśli masz tylko wersję zredagowaną.
Wzorce redagowania: adresy e-mail, numery telefonów i numery identyfikacyjne
Oprócz dokładnych słów wiele scenariuszy redakcyjnych obejmuje wzorce. Każdy adres e-mail w dokumencie musi zostać usunięty. Każdy numer ubezpieczenia społecznego w formacie 123-45-6789 należy usunąć. Każdy numer karty kredytowej w formacie 16-cyfrowym należy usunąć. Zaawansowane narzędzia redakcyjne obsługują wyrażenia regularne, czyli wyrażenia regularne, które definiują wzorce, a nie dokładny tekst. Wyrażenie regularne takie jak \b[A-Za-z0-9._%+-]+@[A-Za-z0-9.-]+\.[A-Z|a-z]{2,}\b pasuje do adresów e-mail. Wyrażenie regularne takie jak \b\d{3}-\d{2}-\d{4}\b odpowiada numerom ubezpieczenia społecznego.
Redakcja oparta na wzorcach ma potężną moc, ale wymaga ostrożności. Zbyt szerokie wyrażenie regularne będzie pasować do tekstu, którego nie zamierzałeś redagować. Zbyt wąskie wyrażenie regularne pominie wystąpienia, które nie pasują dokładnie do wzorca. Po przeprowadzeniu redakcji opartej na wzorcach ręcznie przejrzyj każde dopasowanie przed zastosowaniem. Wyrażenie regularne znajduje kandydatów. Ludzki osąd decyduje, którzy kandydaci faktycznie zawierają wrażliwe informacje. WukongPDF Edytor PDF obsługuje zarówno wyszukiwanie dokładnego dopasowania, jak i wyszukiwanie redakcji w oparciu o wzorce, z interfejsem przeglądu dopasowań, który pokazuje każde dopasowanie w kontekście przed zatwierdzeniem redakcji.
Sprawdzanie, czy redakcja była kompletna
Po redakcji zweryfikuj wyniki za pomocą dwóch testów. Najpierw wizualnie zeskanuj dokument. Zredagowane obszary powinny być wyraźnie oznaczone wybraną przez Ciebie nakładką, czarną skrzynką, białą skrzynką lub niestandardowym tekstem, np. [USUNIĘTO]. Żaden wrażliwy tekst nie powinien być widoczny. Po drugie, spróbuj wyodrębnić tekst. W dowolnej przeglądarce plików PDF naciśnij Ctrl-A, aby zaznaczyć cały tekst na stronie, a następnie skopiuj go i wklej do edytora tekstu. Wklejony tekst nie powinien zawierać żadnych przeredagowanych informacji. Jeśli w wklejonym wyniku pojawi się zredagowany tekst, oznacza to, że redakcja nie została prawidłowo zastosowana, nakładka została umieszczona jako adnotacja, a nie jako trwałe usunięcie treści, a dokument nie jest bezpieczny.
Po trzecie, przeszukaj zredagowany plik PDF pod kątem zredagowanych terminów. Naciśnij Ctrl-F i wyszukaj wrażliwe słowo lub frazę. Wyszukiwanie powinno zwrócić zero wyników. Jeśli znajdzie jakieś dopasowania, redakcja je pominęła, co może się zdarzyć, jeśli tekst był przechowywany jako obraz, a nie jako tekst do zaznaczenia, lub jeśli tekst pojawia się w polu metadanych dokumentu, a nie w treści strony. W przypadku tekstu opartego na obrazie uruchom OCR na zredagowanym pliku i przeszukaj dane wyjściowe OCR. Jeśli funkcja OCR rozpozna rzekomo zredagowany tekst, oznacza to, że obraz nie został zredagowany, a jedynie warstwa tekstowa. Należy zredagować także warstwę obrazu. Narzędzie redakcyjne WukongPDF PDF Privacy redaguje jednocześnie warstwę tekstową i warstwę obrazu, zamykając tę powszechną lukę.
Redukcja zeskanowanych dokumentów i plików PDF zawierających wyłącznie obrazy
Zeskanowane pliki PDF stanowią wyjątkowe wyzwanie redakcyjne, ponieważ tekst stanowi część obrazu, a nie oddzielną warstwę tekstową. Redakcja oparta na wyszukiwaniu nie może znaleźć słów w obrazach. Brak tekstu do przeszukania. Aby zredagować zeskanowany dokument, należy najpierw uruchomić OCR w celu utworzenia warstwy tekstowej z możliwością przeszukiwania, następnie przeszukać tę warstwę tekstową w celu znalezienia i zaznaczenia obszarów redakcji, a następnie zastosować redakcję do obrazu bazowego. Warstwa tekstowa określa, gdzie na stronie znajdują się poufne informacje. Następnie narzędzie redakcyjne trwale usuwa te obszary pikseli z obrazu.
Po zredagowaniu zeskanowanego dokumentu uruchom ponownie OCR na zredagowanej wersji i sprawdź, czy nowo rozpoznany tekst nie zawiera zredagowanych informacji. Ta podwójna weryfikacja OCR wychwytuje najczęstszy błąd redakcji zeskanowanego dokumentu: silnik OCR znalazł tekst, oznaczyłeś go do redakcji, ale prostokąt redakcji był nieco przesunięty i nie zakrywał w pełni pikseli tekstu, pozostawiając widoczne fragmenty znaków. Wystarczy kilka pikseli litery, aby zdeterminowana osoba zrekonstruowała oryginalne słowo. Powiększ do 200% zredagowanych obszarów i potwierdź pełne pokrycie na poziomie pikseli.
Oprócz słów i wzorców dokładny przebieg redakcji powinien również sprawdzać metadane dokumentu. Plik PDF, który został perfekcyjnie zredagowany na każdej stronie, może nadal powodować wyciek poufnych informacji poprzez właściwości dokumentu: pole autora może zawierać imię i nazwisko osoby, której informacje zostały zredagowane, tytuł może zawierać poufną nazwę projektu, a pole słów kluczowych może zawierać terminy, które powinny zostać usunięte. Po zredagowaniu treści strony otwórz właściwości dokumentu i wyczyść pola Autor, Temat, Tytuł i Słowa kluczowe. Jeśli plik PDF zawiera osadzone załączniki w postaci plików, co czasami ma miejsce w przypadku raportów zawierających pomocnicze arkusze kalkulacyjne lub pliki danych, załączniki te należy zredagować lub usunąć osobno. Redakcja na poziomie strony nie ma na nie wpływu. Kompleksowa lista kontrolna redakcyjna obejmuje trzy warstwy: zawartość strony, pola metadanych i pliki osadzone. Pominięcie którejkolwiek z tych warstw może spowodować utratę ochrony zastosowanej w pozostałych dwóch.
Spróbuj zredagować plik PDF
Nie wymaga instalacji. Działa bezpośrednio w Twojej przeglądarce.
