Sie haben einen 60-seitigen Vertrag, und bevor Sie ihn mit der anderen Partei teilen, müssen Sie alle Stellen des Namens, der Adresse, der Kontonummern und aller anderen vertraulichen Informationen Ihres Kunden entfernen. Der Name erscheint 47 Mal auf 30 verschiedenen Seiten. Das manuelle Auffinden und Schwärzen jedes Vorkommens würde eine Stunde dauern, und Sie würden mit ziemlicher Sicherheit einige übersehen. Eine Such- und Schwärzungsfunktion erledigt die Aufgabe in Sekundenschnelle, findet jede Übereinstimmung und schwärzt sie alle in einem Vorgang.
Die suchbasierte Schwärzung ist die effizienteste Möglichkeit, ein Dokument zu bereinigen, wenn Sie genau wissen, welche Wörter, Phrasen oder Muster entfernt werden müssen. Es kombiniert die Textsuche mit der dauerhaften Entfernung von Inhalten und stellt bei korrekter Durchführung sicher, dass keine Instanz des Zieltexts im Dokument verbleibt.

Wie sich die PDF-Schwärzung vom Zeichnen einer Blackbox über Text unterscheidet
Ein häufiger und gefährlicher Fehler ist die Verwechslung von Redaktion und Zeichnung. Manche Leute öffnen ein PDF, zeichnen ein schwarzes Rechteck über sensiblen Text und gehen davon aus, dass der Text ausgeblendet ist. Das ist es nicht. Das schwarze Rechteck ist eine Anmerkung, die über der Seite liegt. Der Originaltext befindet sich noch in der Datei darunter. Wer das PDF in einem Viewer öffnet, der Anmerkungen ausblenden kann, oder wer den Text von der Seite kopiert und einfügt, kann die vermeintlich redigierten Informationen wiederherstellen. Dieser Fehler hat in der Praxis zu Datenschutzverletzungen geführt, bei denen in Gerichtsakten, Regierungsdokumenten und Unternehmensoffenlegungen unbeabsichtigt geschwärzte Informationen offengelegt wurden, weil der Autor ein Zeichenwerkzeug anstelle eines Schwärzungswerkzeugs verwendet hatte.
True PDF Redaction entfernt die Text- und Bilddaten dauerhaft aus der Datei. Wenn Sie eine Schwärzung anwenden, löscht das Tool den zugrunde liegenden Inhalt aus den Datenströmen der PDF-Datei und platziert an seiner Stelle eine undurchsichtige Überlagerung. Die ursprünglichen Informationen sind verschwunden. Es kann nicht durch Ausblenden von Anmerkungen, Kopieren von Text oder Überprüfen der internen Struktur der Datei wiederhergestellt werden. Für jedes Dokument, bei dem Datenschutz oder Vertraulichkeit auf dem Spiel stehen, ist die echte Schwärzung die einzig akzeptable Methode.
Versuchen Sie es mit Redact PDF
Keine Installation erforderlich. Funktioniert direkt in Ihrem Browser.
Schritt-für-Schritt: Jedes Vorkommen eines Wortes finden und redigieren
Öffnen Sie die PDF-Datei in einem Tool, das suchbasierte Schwärzung unterstützt. Ein Schwärzungstool umfasst eine Such- und Schwärzungsfunktion. Geben Sie das Wort oder die Phrase ein, die Sie suchen möchten. Das Tool durchsucht das gesamte Dokument und listet jedes Vorkommen mit der Seitenzahl, dem umgebenden Kontext und einer Vorschau der Übereinstimmung auf. Überprüfen Sie die Liste, um zu bestätigen, dass Sie alle Instanzen schwärzen möchten. Manchmal erscheint ein Wort sowohl als vertrauliche Information als auch als allgemeiner Begriff. Wenn der Nachname des Kunden "Rice" Da in dem Dokument auch die Ware Reis besprochen wird, müssen Sie jede Übereinstimmung einzeln überprüfen, anstatt sie alle blind zu redigieren.
Nachdem Sie die Übereinstimmungen überprüft haben, wählen Sie diejenigen aus, die Sie schwärzen möchten. Sie können einzelne Übereinstimmungen, alle Übereinstimmungen auf einer bestimmten Seite oder alle Übereinstimmungen im Dokument auswählen. Wenden Sie die Schwärzung an. Das Tool entfernt den ausgewählten Text dauerhaft und platziert über jeder Stelle ein schwarzes Kästchen oder eine von Ihnen gewählte Schwärzungsmarkierung. Speichern Sie die geschwärzte Datei unter einem neuen Namen. Die ursprüngliche, nicht redigierte Datei sollte sicher und getrennt von der redigierten Version gespeichert werden. Die Schwärzung ist irreversibel, und das ist der Punkt. Sie können nicht versehentlich die ungeschwärzte Version senden, wenn Sie nur die geschwärzte Version haben.
Schwärzungsmuster: E-Mail-Adressen, Telefonnummern und ID-Nummern
Über genaue Wörter hinaus beinhalten viele Redaktionsszenarien Muster. Jede E-Mail-Adresse in einem Dokument muss entfernt werden. Jede Sozialversicherungsnummer im Format 123-45-6789 muss entfernt werden. Jede Kreditkartennummer im 16-stelligen Format muss entfernt werden. Erweiterte Schwärzungstools unterstützen reguläre Ausdrücke oder Regex, die Muster und nicht genauen Text definieren. Ein regulärer Ausdruck wie \b[A-Za-z0-9._%+-]+@[A-Za-z0-9.-]+\.[A-Z|a-z]{2,}\b stimmt mit E-Mail-Adressen überein. Ein regulärer Ausdruck wie \b\d{3}-\d{2}-\d{4}\b stimmt mit Sozialversicherungsnummern überein.
Die musterbasierte Schwärzung ist leistungsstark, erfordert jedoch Vorsicht. Eine zu weit gefasste Regex findet den Text, den Sie nicht redigieren wollten. Bei einem zu engen regulären Ausdruck werden Instanzen übersehen, die nicht genau zum Muster passen. Nachdem Sie eine musterbasierte Schwärzung durchgeführt haben, überprüfen Sie jede Übereinstimmung manuell, bevor Sie sie anwenden. Der reguläre Ausdruck findet Kandidaten. Das menschliche Urteilsvermögen entscheidet darüber, welche Kandidaten tatsächlich sensible Informationen enthalten. WukongPDFs PDF-Editor unterstützt sowohl die Suche nach exakten Übereinstimmungen als auch die musterbasierte Suche nach Schwärzungen mit einer Schnittstelle zur Übereinstimmungsüberprüfung, die jede Übereinstimmung im Kontext anzeigt, bevor Sie die Schwärzung festschreiben.
Überprüfen, ob die Schwärzung vollständig war
Überprüfen Sie die Ergebnisse nach der Schwärzung mit zwei Tests. Scannen Sie zunächst das Dokument visuell. Die geschwärzten Bereiche sollten deutlich mit dem von Ihnen gewählten Overlay, Blackbox, Whitebox oder benutzerdefiniertem Text wie [ZENSIERT] gekennzeichnet sein. Es sollte kein sensibler Text sichtbar sein. Versuchen Sie zweitens, den Text zu extrahieren. Drücken Sie in einem beliebigen PDF-Viewer Strg-A, um den gesamten Text auf einer Seite auszuwählen, kopieren Sie ihn dann und fügen Sie ihn in einen Texteditor ein. Der eingefügte Text sollte keine redigierten Informationen enthalten. Wenn geschwärzter Text in der eingefügten Ausgabe erscheint, wurde die Schwärzung nicht ordnungsgemäß angewendet, die Überlagerung wurde als Anmerkung und nicht als dauerhafte Inhaltsentfernung platziert und das Dokument ist nicht sicher.
Drittens durchsuchen Sie das redigierte PDF nach den redigierten Begriffen. Drücken Sie Strg-F und suchen Sie nach dem sensiblen Wort oder der sensiblen Phrase. Die Suche sollte keine Ergebnisse liefern. Wenn Übereinstimmungen gefunden werden, wurden diese bei der Schwärzung übersehen. Dies kann passieren, wenn der Text als Bild und nicht als auswählbarer Text gespeichert wurde oder wenn der Text in einem Dokumentmetadatenfeld und nicht im Seiteninhalt erscheint. Führen Sie für bildbasierten Text OCR für die redigierte Datei aus und durchsuchen Sie die OCR-Ausgabe. Wenn die OCR den vermeintlich geschwärzten Text erkennt, wurde nicht das Bild, sondern nur die Textebene geschwärzt, und Sie müssen auch die Bildebene schwärzen. Das Schwärzungstool PDF Privacy von WukongPDF schwärzt sowohl die Textebene als auch die Bildebene gleichzeitig und schließt so diese gemeinsame Lücke.
Schwärzen gescannter Dokumente und reiner Bild-PDFs
Gescannte PDFs stellen eine einzigartige Schwärzungsherausforderung dar, da der Text Teil eines Bildes und keine separate Textebene ist. Bei der suchbasierten Schwärzung können keine Wörter in Bildern gefunden werden. Es gibt keinen zu durchsuchenden Text. Um ein gescanntes Dokument zu schwärzen, müssen Sie zunächst OCR ausführen, um eine durchsuchbare Textebene zu erstellen, dann diese Textebene durchsuchen, um die Schwärzungsbereiche zu finden und zu markieren, und dann die Schwärzung auf das darunter liegende Bild anwenden. Die Textebene identifiziert, wo sich die vertraulichen Informationen auf der Seite befinden. Das Schwärzungstool entfernt diese Pixelbereiche dann dauerhaft aus dem Bild.
Nachdem Sie ein gescanntes Dokument geschwärzt haben, führen Sie die OCR erneut für die geschwärzte Version aus und stellen Sie sicher, dass der neu erkannte Text die geschwärzten Informationen nicht enthält. Diese doppelte OCR-Überprüfung erkennt den häufigsten Fehlermodus bei der Schwärzung gescannter Dokumente: Die OCR-Engine hat den Text gefunden, Sie haben ihn zur Schwärzung markiert, aber das Schwärzungsrechteck war leicht falsch ausgerichtet und deckte die Textpixel nicht vollständig ab, sodass Zeichenfragmente sichtbar blieben. Ein paar Pixel eines Buchstabens reichen aus, damit ein entschlossener Mensch das ursprüngliche Wort rekonstruieren kann. Zoomen Sie auf redigierte Bereiche auf 200 % und bestätigen Sie die vollständige Abdeckung auf Pixelebene.
Über Wörter und Muster hinaus sollten bei einer gründlichen Redaktion auch die Metadaten des Dokuments überprüft werden. Bei einer PDF-Datei, die auf jeder Seite perfekt geschwärzt wurde, können über die Dokumenteigenschaften immer noch vertrauliche Informationen verloren gehen: Das Feld „Autor“ könnte den Namen der Person enthalten, deren Informationen geschwärzt wurden, der Titel könnte einen vertraulichen Projektnamen enthalten und im Feld „Schlüsselwörter“ könnten Begriffe aufgeführt sein, die hätten entfernt werden sollen. Öffnen Sie nach dem Redigieren des Seiteninhalts die Dokumenteigenschaften und löschen Sie die Felder „Autor“, „Betreff“, „Titel“ und „Schlüsselwörter“. Wenn das PDF eingebettete Dateianhänge enthält, was manchmal bei Berichten vorkommt, die unterstützende Tabellenkalkulationen oder Datendateien enthalten, müssen diese Anhänge separat geschwärzt oder entfernt werden. Sie sind von der Schwärzung auf Seitenebene nicht betroffen. Eine umfassende Redaktionscheckliste deckt drei Ebenen ab: Seiteninhalt, Metadatenfelder und eingebettete Dateien. Das Fehlen einer dieser Schichten kann den Schutz der beiden anderen zunichte machen.
Versuchen Sie es mit Redact PDF
Keine Installation erforderlich. Funktioniert direkt in Ihrem Browser.
