Hai un contratto di 60 pagine e prima di condividerlo con l'altra parte, devi rimuovere ogni istanza del nome del tuo cliente, del suo indirizzo, dei suoi numeri di conto e di qualsiasi altra informazione riservata. Il nome appare 47 volte su 30 pagine diverse. Trovare e correggere manualmente ogni occorrenza richiederebbe un'ora e quasi sicuramente ne perderesti alcuni. Una funzione di ricerca e oscuramento svolge il lavoro in pochi secondi, trovando tutte le corrispondenze e oscurandole tutte in un'unica operazione.
La redazione basata sulla ricerca è il modo più efficace per disinfettare un documento quando si sa esattamente quali parole, frasi o schemi devono essere rimossi. Combina la ricerca di testo con la rimozione permanente del contenuto e, se eseguita correttamente, garantisce che nessuna istanza del testo di destinazione sopravviva nel documento.

Differenza tra l'oscuramento PDF e il disegno di una casella nera sul testo
Un errore comune e pericoloso è confondere la redazione con il disegno. Alcune persone aprono un PDF, disegnano un rettangolo nero sul testo sensibile e presumono che il testo sia nascosto. Non lo è. Il rettangolo nero è un'annotazione posizionata sopra la pagina. Il testo originale è ancora nel file sottostante. Chiunque apra il PDF in un visualizzatore in grado di nascondere le annotazioni o copi e incolli il testo dalla pagina può recuperare le informazioni presumibilmente oscurate. Questo errore ha portato a violazioni dei dati nel mondo reale in cui documenti giudiziari, documenti governativi e divulgazioni aziendali hanno inavvertitamente esposto informazioni oscurate perché l'autore ha utilizzato uno strumento di disegno anziché uno strumento di oscuramento.
Vero Modifica PDF rimuove in modo permanente i dati di testo e immagine dal file. Quando applichi la redazione, lo strumento elimina il contenuto sottostante dai flussi di dati del PDF e al suo posto inserisce una sovrapposizione opaca. Le informazioni originali sono scomparse. Non può essere recuperato nascondendo annotazioni, copiando testo o esaminando la struttura interna del file. Per qualsiasi documento in cui è in gioco la privacy o la riservatezza, la vera oscurazione è l'unico metodo accettabile.
Prova Redige PDF
Nessuna installazione necessaria. Funziona direttamente nel tuo browser.
Passo dopo passo: trovare e redigere ogni occorrenza di una parola
Aprire il PDF in uno strumento che supporti la redazione basata sulla ricerca. Uno strumento di oscuramento include una funzionalità di ricerca e oscuramento. Digita la parola o la frase che desideri trovare. Lo strumento ricerca nell'intero documento ed elenca ogni occorrenza, con il numero di pagina, il contesto circostante e un'anteprima della corrispondenza. Esamina l'elenco per confermare che desideri oscurare tutte le istanze. A volte una parola appare sia come informazione sensibile che come termine generico. Se il cognome del cliente è "Rice" e il documento tratta anche della merce riso, è necessario rivedere ogni partita individualmente anziché redigerle tutte alla cieca.
Dopo aver esaminato le corrispondenze, seleziona quelle che desideri oscurare. Puoi scegliere singole corrispondenze, tutte le corrispondenze su una pagina specifica o tutte le corrispondenze nel documento. Applicare la redazione. Lo strumento rimuove in modo permanente il testo selezionato e posiziona una casella nera o un segno di redazione prescelto su ciascuna posizione. Salvare il file oscurato con un nuovo nome. Il file originale non oscurato deve essere archiviato in modo sicuro e separato dalla versione oscurata. La redazione è irreversibile, questo è il punto. Non puoi inviare accidentalmente la versione non oscurata se disponi solo della versione oscurata.
Modelli di oscuramento: indirizzi email, numeri di telefono e numeri ID
Al di là delle parole esatte, molti scenari di redazione implicano modelli. Ogni indirizzo email in un documento deve essere rimosso. Ogni numero di previdenza sociale nel formato 123-45-6789 deve essere rimosso. Ogni numero di carta di credito in formato a 16 cifre deve essere rimosso. Gli strumenti di redazione avanzati supportano le espressioni regolari, o regex, che definiscono modelli anziché testo esatto. Una regex come \b[A-Za-z0-9._%+-]+@[A-Za-z0-9.-]+\.[A-Z|a-z]{2,}\b corrisponde agli indirizzi email. Una regex come \b\d{3}-\d{2}-\d{4}\b corrisponde ai numeri di previdenza sociale.
La redazione basata su modelli è potente ma richiede cautela. Una regex troppo ampia corrisponderà al testo che non intendevi oscurare. Una regex troppo stretta mancherà le istanze che non si adattano esattamente al modello. Dopo aver eseguito una redazione basata su modelli, rivedere manualmente ogni corrispondenza prima dell'applicazione. La regex trova i candidati. Il giudizio umano decide quali candidati contengono effettivamente informazioni sensibili. Editor PDF di WukongPDF supporta sia la ricerca di corrispondenze esatte sia la ricerca di redazione basata su pattern, con un'interfaccia di revisione delle corrispondenze che mostra ciascuna corrispondenza nel contesto prima di commettere la redazione.
Verifica che l'oscuramento sia stato completato
Dopo la redazione, verificare i risultati con due test. Per prima cosa, scansiona visivamente il documento. Le aree oscurate devono essere chiaramente contrassegnate con la sovrapposizione scelta, una casella nera, una casella bianca o un testo personalizzato come [REDATTO]. Nessun testo sensibile dovrebbe essere visibile. Secondo, prova a estrarre il testo. In qualsiasi visualizzatore PDF, premi Ctrl-A per selezionare tutto il testo su una pagina, quindi copialo e incollalo in un editor di testo. Il testo incollato non deve contenere informazioni oscurate. Se nell'output incollato viene visualizzato testo oscurato, la oscurazione non è stata applicata correttamente, la sovrapposizione è stata inserita come annotazione anziché come rimozione permanente del contenuto e il documento non è sicuro.
In terzo luogo, cerca i termini oscurati nel PDF oscurato. Premi Ctrl-F e cerca la parola o la frase sensibile. La ricerca dovrebbe restituire zero risultati. Se trova delle corrispondenze, significa che la redazione le ha mancate, il che può accadere se il testo è stato archiviato come immagine anziché come testo selezionabile o se il testo appare in un campo di metadati del documento anziché nel contenuto della pagina. Per il testo basato su immagini, esegui l'OCR sul file oscurato e cerca l'output dell'OCR. Se l'OCR riconosce il testo presumibilmente oscurato, l'immagine non è stata oscurata, lo è stato solo il livello del testo ed è necessario oscurare anche il livello dell'immagine. Lo strumento di redazione PDF Privacy di WukongPDF oscura contemporaneamente sia il livello del testo che quello dell'immagine, colmando questa lacuna comune.
Oscuramento di documenti scansionati e PDF di sole immagini
I PDF scansionati rappresentano una sfida unica in termini di redazione perché il testo fa parte di un'immagine, non di un livello di testo separato. La redazione basata sulla ricerca non riesce a trovare le parole nelle immagini. Non c'è testo da cercare. Per oscurare un documento scansionato, è necessario prima eseguire l'OCR per creare un livello di testo ricercabile, quindi cercare quel livello di testo per trovare e contrassegnare le aree di oscuramento, quindi applicare la oscuramento all'immagine sottostante. Il livello di testo identifica la posizione delle informazioni sensibili nella pagina. Lo strumento di redazione rimuove quindi in modo permanente quelle regioni di pixel dall'immagine.
Dopo aver oscurato un documento scansionato, eseguire nuovamente l'OCR sulla versione oscurata e verificare che il testo appena riconosciuto non contenga le informazioni oscurate. Questa verifica con doppio OCR rileva la modalità di errore più comune nella redazione di documenti scansionati: il motore OCR ha trovato il testo, lo hai contrassegnato per la redazione, ma il rettangolo di redazione era leggermente disallineato e non copriva completamente i pixel del testo, lasciando visibili frammenti di caratteri. Bastano pochi pixel di una lettera perché una persona determinata possa ricostruire la parola originale. Ingrandisci al 200% le aree oscurate e conferma la copertura completa a livello di pixel.
Oltre alle parole e agli schemi, un passaggio di redazione approfondito dovrebbe anche controllare i metadati del documento. Un PDF che è stato perfettamente oscurato su ogni pagina può comunque far trapelare informazioni sensibili attraverso le proprietà del documento: il campo dell'autore potrebbe contenere il nome della persona le cui informazioni sono state oscurate, il titolo potrebbe contenere un nome di progetto riservato e il campo delle parole chiave potrebbe elencare termini che avrebbero dovuto essere rimossi. Dopo aver oscurato il contenuto della pagina, apri le proprietà del documento e cancella i campi Autore, Oggetto, Titolo e Parole chiave. Se il PDF contiene allegati di file incorporati, cosa che a volte accade con report che includono fogli di calcolo o file di dati di supporto, tali allegati devono essere oscurati o rimossi separatamente. Non sono interessati dalla redazione a livello di pagina. Un elenco di controllo di redazione completo copre tre livelli: contenuto della pagina, campi di metadati e file incorporati. La mancanza di uno qualsiasi di questi livelli può annullare la protezione applicata agli altri due.
Prova Redige PDF
Nessuna installazione necessaria. Funziona direttamente nel tuo browser.
