Puoi oscurare un numero di previdenza sociale da un PDF utilizzando lo strumento di oscuramento del tuo editor PDF. Vedi apparire la casella nera, salva il file e invialo. Il destinatario converte il PDF in Word per la modifica e trova il numero di previdenza sociale completamente visibile nel documento convertito, come se l'oscuramento non fosse mai avvenuto. Questo non è un bug. È il comportamento previsto della maggior parte degli strumenti di redazione quando il documento subisce una conversione di formato e ha causato vere e proprie violazioni dei dati.
Nel 2024, l'Ufficio del Commissario per l'informazione del Regno Unito ha riferito che l'oscuramento improprio dei PDF era la terza causa più comune di violazione dei dati che coinvolgevano documenti governativi (ICO, "Data Security Incident Trends", 2024). La causa principale più frequente non è stata la mancata revisione, ma l'incapacità di verificare che la revisione sopravvivesse all'intero ciclo di vita del documento, comprese eventuali conversioni di formato che avrebbe potuto subire a valle.

Come funziona una corretta redazione PDF a livello di dati
Redazione PDF corretta è fondamentalmente diverso dal disegnare una casella nera sul testo. Quando utilizzi un vero strumento di redazione, accadono due cose: il testo visibile viene coperto da un rettangolo nero e il contenuto del testo sottostante viene rimosso dal livello di testo del PDF. I caratteri stessi vengono eliminati dal flusso di dati del file. Un'applicazione di lettura non ha nulla da visualizzare sotto la scatola nera perché lì non c'è nulla.
Quando disegni un rettangolo nero sul testo utilizzando gli strumenti di annotazione e lo chiami oscurato, hai fatto ciò che i professionisti della sicurezza chiamano oscuramento cosmetico. Il testo è ancora presente nel livello dati del PDF, completamente intatto ed estraibile. Chiunque può selezionare il testo, copiarlo, incollarlo altrove e leggere ogni parola sotto la casella nera. Converti il PDF in qualsiasi altro formato e lo strumento di conversione leggerà il testo sottostante, non la sovrapposizione visiva. La redazione svanisce perché non è mai stata reale in primo luogo.
La distinzione tra oscuramento reale e fittizio è così critica che le agenzie governative e gli studi legali ora la includono nella formazione obbligatoria per il personale che gestisce documenti sensibili. Una singola istanza giudiziaria, una risposta FOIA o una richiesta normativa redatta in modo improprio può esporre dati personali su vasta scala e le conseguenze legali e reputazionali superano di gran lunga i pochi secondi in più necessari per utilizzare strumenti di redazione adeguati.
Uno scenario particolarmente pericoloso si verifica quando un documento passa attraverso più mani. La persona A applica la corretta oscuramento, la persona B apre il file e vede le caselle nere, presuppone che l'oscuramento sia completo e lo inoltra. Ma se la Persona A utilizzasse uno strumento di redazione cosmetica senza rendersene conto, la fiducia della Persona B nelle scatole nere sarebbe malriposta. Questo problema di catena di fiducia è il motivo per cui le organizzazioni dovrebbero standardizzarsi su un unico strumento di redazione verificato e formare tutto il personale per utilizzarlo correttamente.
Una variante particolarmente insidiosa della redazione cosmetica è la redazione white-box. Alcuni utenti disegnano un rettangolo bianco sul testo, presupponendo che il bianco su bianco renda il testo invisibile. Ciò non riesce perché la selezione del testo o la conversione del documento rivela il testo sottostante e il software di lettura dello schermo lo legge ad alta voce indipendentemente dal colore visivo. La redazione della scatola bianca non è affatto una redazione.
Prova Redige PDF
Nessuna installazione necessaria. Funziona direttamente nel tuo browser.
Cosa succede alla redazione durante la conversione del formato
La conversione del formato crea un nuovo documento leggendo il PDF di origine e scrivendo il suo contenuto in un formato diverso. Lo strumento di conversione analizza la struttura del PDF ed estrae testo, immagini e informazioni sul layout. Per la conversione Formato PDF la questione cruciale è quale contenuto testuale trova lo strumento di conversione nelle aree oscurate.
Se la redazione era autentica e il testo è stato rimosso dal flusso di contenuti del PDF, lo strumento di conversione non trova nulla in quelle aree e non scrive nulla. Il documento di output non contiene testo nel punto in cui si trovavano le revisioni. Se la redazione era cosmetica, una scatola nera sovrapposta con il testo ancora presente sotto, lo strumento di conversione trova il testo e lo scrive doverosamente nel documento di output. La scatola nera è un elemento visivo, non un elemento di dati, e la maggior parte degli strumenti di conversione ignora le sovrapposizioni visive durante l'estrazione del contenuto testuale.
WukongPDF fornisce uno strumento di redazione che rimuove il contenuto a livello di dati, non solo a livello visivo. Quando si applica la redazione tramite uno strumento Sicurezza PDF opportunamente implementato che opera sul flusso di testo del documento, le informazioni rimosse non possono riapparire attraverso la conversione del formato perché semplicemente i dati non esistono più nel file.
Alcuni convertitori da PDF a Word tentano specificamente di preservare le annotazioni, comprese le caselle di commento, le evidenziazioni e le forme disegnate. Se come annotazione è stata applicata una redazione cosmetica, il convertitore potrebbe riprodurre fedelmente il rettangolo nero come forma di Word. Ma poiché il testo sottostante non è mai stato rimosso, il documento Word mostrerà sia il rettangolo nero che il testo sottostante, che è selezionabile, copiabile e completamente visibile a chiunque sposti o elimini il rettangolo.
La conversione del formato non è l'unico percorso attraverso il quale il contenuto oscurato può fuoriuscire. È sufficiente selezionare tutto il testo in un PDF con revisioni cosmetiche e incollarlo in un editor di testo per rivelare il contenuto oscurato. La ricerca di un termine oscurato nel PDF utilizzando la funzione Trova lo localizzerà anche se è visivamente coperto. I lettori di schermo e gli strumenti di accessibilità leggono il livello di testo sottostante. Tutti questi percorsi di estrazione alternativi ignorano la sovrapposizione visiva su cui si basa la redazione cosmetica.
Redazione basata su OCR e problema della ricomparsa del testo
I PDF scansionati aggiungono un ulteriore livello di complessità alla redazione. Un documento scansionato è essenzialmente una fotografia di un pezzo di carta. Il testo non viene memorizzato come caratteri ma come pixel in un'immagine. Gli strumenti di redazione standard che operano sui livelli di testo non possono rimuovere il testo da un'immagine, quindi disegnano invece riquadri neri sull'immagine. Questa è una redazione cosmetica per necessità, non per scelta.
Per oscurare correttamente un PDF scansionato, è necessario uno strumento che modifichi i dati effettivi dell'immagine, sostituendo i valori dei pixel nell'area oscurata con nero pieno. Dopo che l'immagine è stata modificata, esegui l'OCR sul documento per creare un livello di testo solo per il contenuto non oscurato. Se esegui l'OCR prima di oscurare, il testo OCR per il contenuto oscurato si trova nel livello di testo e verrà estratto da qualsiasi strumento di conversione del formato.
Un errore comune con la redazione dei PDF scansionati è quello di eseguire prima l'OCR per rendere il documento ricercabile, quindi applicare i segni di redazione, quindi salvare nuovamente. Questa sequenza lascia intatto il livello di testo generato dall'OCR sotto i segni di redazione. Qualsiasi successiva conversione o estrazione del testo recupererà il testo oscurato dal livello OCR. La sequenza corretta è: oscurare prima i pixel dell'immagine, quindi eseguire l'OCR dell'immagine pulita. Questo ordinamento garantisce che il livello di testo non contenga mai il contenuto redatto.
Come verificare che la redazione sopravviva alla conversione
L'unico modo per essere certi che la tua redazione sia permanente è testarla. Dopo aver oscurato un PDF, convertilo in un file di testo semplice e cerca i contenuti oscurati. Se il file di testo contiene i dati oscurati, l'oscuramento non è stato efficace. Una verifica più rapida consiste nel selezionare tutto il testo nel PDF dopo la redazione e incollarlo in un editor di testo. Se il buffer di incollamento contiene testo oscurato, l'oscuramento era cosmetico.
Per i PDF scansionati, converti una pagina in un formato immagine come PNG ed esamina visivamente le aree oscurate con uno zoom elevato. Se è possibile vedere qualsiasi traccia del contenuto originale attraverso la sovrapposizione nera, in particolare su schermi con elevata luminosità o durante la stampa, l'oscuramento è insufficiente. Un singolo pixel di contenuto visibile a volte può essere sufficiente per ricostruire l'informazione originale.
Crea un elenco di controllo di verifica che includa ciascuno di questi passaggi e richiedilo come parte del processo di rilascio dei documenti. I pochi minuti necessari per verificare la redazione sono trascurabili rispetto alle ore, ai giorni o ai mesi di riparazione che seguono una violazione dei dati causata da una redazione non riuscita. Questo passaggio non è facoltativo per qualsiasi organizzazione che gestisce dati personali o informazioni riservate.
Redazione dei metadati: il livello spesso trascurato
Anche quando il testo visibile viene oscurato correttamente, un PDF può comunque far trapelare informazioni sensibili attraverso i suoi metadati. I metadati PDF includono il titolo del documento, il nome dell'autore, la data di creazione, la cronologia delle modifiche e talvolta i nomi delle persone che hanno rivisto o firmato il documento. Gli strumenti di conversione del formato in genere preservano i metadati quando possibile, quindi i metadati oscurati sopravvivono alla conversione con la stessa certezza del contenuto del documento previsto.
Uno studio del 2025 condotto dal SANS Institute ha analizzato 500 PDF oscurati disponibili al pubblico provenienti da siti Web governativi e ha rilevato che il 12% conteneva informazioni sensibili nei campi dei metadati che non erano stati ripuliti (SANS Institute, "Hidden Data in Publicly Released Documents", 2025). In diversi casi, le informazioni oscurate nel corpo del documento potrebbero essere sottoposte a riferimenti incrociati e confermate utilizzando metadati non oscurati. Pulire i metadati prima del rilascio è importante quanto oscurare i contenuti visibili.
Lo stesso processo di verifica dovrebbe essere applicato a qualsiasi documento sottoposto a conversione, indipendentemente da come viene eseguita la conversione. Se il tuo flusso di lavoro include una fase di conversione automatizzata, crea un controllo di verifica della redazione in tale automazione anziché fare affidamento su controlli manuali a campione. Uno script che cerca nell'output convertito termini oscurati noti può individuare errori che la revisione manuale potrebbe non rilevare.
Integrare la verifica della redazione nella lista di controllo standard per la revisione dei documenti garantisce che questo passaggio critico per la sicurezza non venga mai saltato.
Prova Redige PDF
Nessuna installazione necessaria. Funziona direttamente nel tuo browser.
