Vous créez un PDF dans Microsoft Word, le joignez à un e-mail et l'envoyez à un client. Ce que vous ne réalisez peut-être pas, c'est que le fichier transporte un bagage invisible : votre nom, le nom de votre entreprise, la date et l'heure de création du document, la version du logiciel que vous avez utilisée et peut-être même le chemin d'accès au fichier sur votre ordinateur, révélant les noms de serveurs internes ou les structures de dossiers. Si le document contient des images, ces images peuvent contenir des coordonnées GPS indiquant exactement l'endroit où la photo a été prise.
Les métadonnées PDF sont l'équivalent numérique de l'écriture de notes dans les marges d'un document imprimé. Il n'est pas visible sur la page, mais quiconque sait regarder peut le lire. Pour la plupart des documents courants, ces informations sont inoffensives. Pour les contrats, les documents juridiques, les rapports confidentiels et tout document où la confidentialité est importante, l'exposition des métadonnées peut constituer un problème sérieux. Le supprimer avant le partage prend moins d’une minute. Un éditeur PDF doté de capacités de nettoyage des métadonnées simplifie le processus.

Quelles sont les métadonnées présentes dans un PDF typique
Un PDF stocke les métadonnées à deux endroits. Le dictionnaire d'informations sur le document contient des champs définis par l'application créatrice : titre, auteur, sujet, mots clés, créateur (l'application qui a créé le fichier), producteur (l'application qui l'a modifié en dernier lieu), date de création et date de modification. Ces champs sont facilement visualisés en ouvrant les propriétés du document dans n'importe quelle visionneuse PDF. Sur un document bureautique typique, Auteur contient le nom de la personne qui a créé le fichier extrait de son profil logiciel, qui peut être son nom complet ou un nom d'utilisateur.
La plate-forme de métadonnées extensible, ou XMP, est une deuxième couche de métadonnées plus détaillée intégrée dans la structure interne du PDF. XMP peut contenir tout ce que contient le dictionnaire d'informations sur le document, ainsi que des champs supplémentaires : informations sur les droits d'auteur, historique des révisions, heure d'édition, coordonnées GPS des images intégrées et champs de métadonnées personnalisées ajoutés par le logiciel de création. Les données XMP sont stockées au format XML et peuvent être bien plus étendues que ne le suggèrent les propriétés de base du document. Un PDF qui semble propre dans la boîte de dialogue Propriétés du document peut toujours contenir des métadonnées XMP étendues.
Les images intégrées dans le PDF ajoutent leurs propres métadonnées, notamment les données EXIF des photos numériques et des captures d'écran. EXIF peut inclure le modèle de l'appareil photo, la date et l'heure auxquelles la photo a été prise, les coordonnées GPS de l'emplacement et le logiciel utilisé pour éditer l'image. Une photo d'un prototype de produit insérée dans une proposition PDF peut révéler l'emplacement exact des installations de recherche de l'entreprise grâce à ses balises GPS. C'est le genre de fuite d'informations involontaire que la suppression du PDF Metadata empêche.
Essayez de protéger le PDF
Aucune installation nécessaire. Fonctionne directement dans votre navigateur.
Comment afficher et supprimer des métadonnées à l'aide d'Adobe Acrobat Pro
Ouvrez le PDF dans Adobe Acrobat Pro. Accédez à Fichier, Propriétés et cliquez sur l'onglet Description. Ceci affiche les champs du dictionnaire d'informations sur le document. Vous pouvez effacer manuellement chaque champ en sélectionnant le texte et en le supprimant. Toutefois, la suppression des champs dans Propriétés ne supprime pas les métadonnées XMP ni les données masquées. Il efface uniquement les champs de métadonnées visibles.
Pour une suppression complète des métadonnées, utilisez la fonctionnalité Sanitize Document d’Acrobat. Accédez à Outils, Rédiger et sélectionnez Désinfecter le document. Cet outil supprime toutes les métadonnées, y compris XMP, les propriétés du document, les commentaires, les couches masquées, les pièces jointes intégrées et le texte masqué. Il aplatit également les champs du formulaire et supprime JavaScript. Sanitize Document est une option nucléaire en un clic pour la confidentialité des documents. Il supprime tout ce qui n'est pas visible dans le contenu de la page. Le compromis est que cela supprime également des fonctionnalités : les champs de formulaire ne pourront plus être remplis, les liens pourront être supprimés et tous les fichiers intégrés seront supprimés. Utilisez Sanitize Document lorsque la confidentialité est la priorité la plus élevée et que les fonctionnalités peuvent être sacrifiées. Utilisez l'édition manuelle des métadonnées lorsque vous devez supprimer des informations d'identification tout en préservant les fonctionnalités interactives du document.
Comment supprimer les métadonnées à l'aide d'outils basés sur le navigateur
WukongPDF assure le nettoyage des métadonnées via son éditeur de propriétés de document. Ouvrez le PDF, accédez au panneau des propriétés et effacez les champs Auteur, Titre, Sujet et Mots-clés. Pour un nettoyage plus approfondi, les outils PDF Privacy peuvent supprimer les métadonnées XMP et les données EXIF incorporées des images dans le PDF. Le fichier nettoyé est téléchargé en tant que nouveau PDF, laissant l'original intact. Cette approche est accessible depuis n'importe quel navigateur sur n'importe quel système d'exploitation et ne nécessite aucune installation de logiciel.
L'approche PDF Metadata basée sur un navigateur est particulièrement utile lorsque vous recevez un PDF de quelqu'un d'autre et que vous devez le transférer sans exposer ses métadonnées au prochain destinataire. Ouvrez le fichier au WukongPDF, nettoyez les métadonnées, téléchargez la version nettoyée et transférez-la. Le nom de l'expéditeur d'origine, la version du logiciel et l'historique des modifications sont supprimés avant que le document ne progresse plus loin dans la chaîne de distribution.
Suppression des données de localisation GPS des images contenues dans des PDF
Les données EXIF incorporées dans les images PDF sont particulièrement dangereuses car elles sont invisibles pour tout visualiseur de métadonnées PDF standard. En ouvrant le fichier, les propriétés ne vous montreront pas les coordonnées GPS. Vous avez besoin d'un outil qui recherche et supprime spécifiquement les données EXIF des images intégrées. Certains outils de suppression EXIF dédiés peuvent traiter un PDF, extraire chaque image, supprimer ses données EXIF et réintégrer l'image nettoyée. Cela préserve l'apparence visuelle du document tout en supprimant les données de localisation masquées.
Le flux de travail le plus sûr pour les documents contenant beaucoup d'images consiste à supprimer les données EXIF des images avant de les insérer dans le document source. Sous Windows, cliquez avec le bouton droit sur un fichier image, sélectionnez Propriétés, accédez à l'onglet Détails et cliquez sur Supprimer les propriétés et les informations personnelles. Sur Mac, utilisez l'onglet Outils, Afficher l'inspecteur et GPS de l'application Aperçu pour afficher et supprimer les données de localisation. La suppression d'EXIF au niveau de l'image garantit qu'aucun PDF que vous créez à partir de ces images ne contiendra d'informations de localisation, quel que soit l'outil de création de PDF que vous utilisez.
Quand la suppression des métadonnées est la plus importante
Certaines professions et situations rendent la suppression des métadonnées obligatoire plutôt que facultative. Les cabinets d'avocats qui déposent des documents auprès des tribunaux sont censés supprimer les métadonnées qui pourraient révéler le produit du travail de l'avocat, les communications des clients ou l'historique des révisions internes. De nombreux tribunaux exigent désormais des fichiers PDF sans métadonnées dans le cadre de leurs normes techniques de dépôt électronique. Les agences gouvernementales publiant des documents en vertu des lois sur la liberté d'information doivent supprimer les métadonnées qui pourraient identifier des membres individuels du personnel ou des processus internes. Les journalistes partageant des documents provenant de sources doivent supprimer les métadonnées qui pourraient révéler l'identité ou l'emplacement de la source.
Pour les documents commerciaux, le risque est plus subtil. Une proposition envoyée à un client peut contenir des métadonnées montrant qu'elle a été créée à partir d'un modèle initialement créé pour un autre client, avec le nom de ce client intégré dans les propriétés du document. Un contrat négocié entre deux entreprises peut comporter un historique de révision montrant les positions de négociation antérieures. Ces expositions ne sont pas malveillantes, mais elles peuvent être évitées. Prendre l'habitude de nettoyer les métadonnées PDF Security avant de partager un document en externe est une pratique PDF Security qui élimine toute une catégorie d'embarras et de responsabilité potentiels.
Essayez de protéger le PDF
Aucune installation nécessaire. Fonctionne directement dans votre navigateur.
