Tips & Tricks

Comment réparer un PDF où tout le texte apparaît sous forme de rectangles vides en raison d'un échec de substitution de police

Vous ouvrez un PDF et au lieu de mots, chaque page est remplie de rectangles vides, de petits carrés ou de rangées de symboles d'espace réservé identiques là où le texte devrait se trouver. La structure du document est intacte. La mise en page semble correcte. Mais chaque lettre, chiffre et signe de ponctuation a été remplacé par une boîte creuse. Il s'agit d'un échec de substitution de police et cela signifie que le PDF tente d'afficher du texte en utilisant une police qui n'est pas disponible pour le lecteur PDF. Les données texte sont toujours dans le fichier. Il n'a pas été supprimé ou corrompu. Le problème réside entièrement dans la couche de rendu, ce qui le rend réparable.

How to Repair a PDF Where All Text Appears as Empty Rectangles Due to Font Substitution Failure

Qu'est-ce qui fait que la substitution de polices produit des rectangles vides

La cause est plus simple que ne le suggère le symptôme.

Chaque PDF contient des instructions sur la façon d'afficher le texte. Chaque morceau de texte fait référence à une police spécifique qui était soit intégrée dans le PDF lors de sa création, soit censée être disponible sur le système où il sera visualisé. Lorsque la police est intégrée, le PDF contient une copie des données de police et tout lecteur PDF peut afficher le texte correctement, quelles que soient les polices installées sur le périphérique de visualisation. Lorsque la police n'est pas intégrée, le lecteur PDF doit trouver une police correspondante sur le système local. Si aucune correspondance n’existe, le lecteur remplace une police de secours. La plupart du temps, cela fonctionne correctement : le texte s'affiche dans une police légèrement différente mais lisible.

L’échec du rectangle vide se produit lorsque le mécanisme de substitution lui-même tombe en panne. Cela peut se produire pour plusieurs raisons. Le PDF peut faire référence à une police en utilisant un nom interne qui ne correspond à aucun nom de police standard reconnu par le système d'exploitation. La police peut être une police personnalisée ou propriétaire avec un codage de caractères que les polices de secours standard ne peuvent pas mapper. Le fichier PDF peut contenir une intégration de police endommagée ou incomplète dans laquelle les données de police ont été incluses mais ont été corrompues lors du transfert de fichier, laissant le lecteur incapable de le décoder. Dans chaque cas, le lecteur sait que le texte doit apparaître à un emplacement spécifique, mais il n'a pas de données de glyphe à restituer, il dessine donc le symbole universel pour les caractères manquants : un rectangle vide (ISO, 'ISO 32000-2:2020, Font Handling in PDF', 2020).

WukongPDF

Essayez de réparer le PDF

Aucune installation nécessaire. Fonctionne directement dans votre navigateur.

Commencer →

Vérifier si la police est intégrée ou manquante

La première étape du diagnostic consiste à déterminer si le PDF contient des polices intégrées et, si tel est le cas, si elles sont intactes. Ouvrez le PDF dans une visionneuse pouvant afficher les propriétés du document, telle qu'Adobe Acrobat. Accédez à Fichier, Propriétés, Polices. La liste des polices affiche toutes les polices référencées par le document et si chacune d'entre elles est incorporée ou sous-ensemble incorporé. Une police incorporée affiche son nom complet suivi de (Embedded) ou (Embedded Subset). Une police non intégrée affiche uniquement le nom de la police sans indicateur d'intégration. Si les polices utilisées par le texte manquant sont répertoriées comme non intégrées, le problème est que ces polices ne sont pas installées sur le périphérique de visualisation.

Si les polices sont répertoriées comme incorporées mais que le texte s'affiche toujours sous forme de rectangles, les données de police incorporées sont probablement endommagées. Cela peut se produire lorsqu'un PDF est transféré via une connexion réseau peu fiable, stocké sur un périphérique de stockage défaillant ou traité par un logiciel qui ne prend pas entièrement en charge le format d'intégration de polices utilisé. Les données de police sont présentes dans le fichier mais ne peuvent pas être décodées. Le panneau des propriétés du document peut toujours afficher la police comme incorporée car la déclaration d'incorporation est intacte même si les données binaires de la police sont corrompues.

Réparation des problèmes de polices non intégrées

Pour les PDF dans lesquels les polices n'ont jamais été intégrées, la méthode de réparation consiste soit à installer les polices manquantes sur le périphérique de visualisation, soit à recréer le PDF avec les polices intégrées. L'installation de polices fonctionne lorsque vous savez quelles polices manquent et que vous pouvez les obtenir légalement. Ceci est pratique lorsque la police manquante est une police commerciale courante comme Helvetica ou Times New Roman que vous possédez déjà mais que vous n'avez pas installée sur l'appareil actuel. C'est moins pratique lorsque la police manquante est une police d'entreprise personnalisée ou une police sous licence coûteuse.

L'outil Repair PDF de WukongPDF peut retraiter un PDF qui souffre de problèmes d'affichage des polices en analysant l'encodage du texte et les références de police dans le fichier. Pour les polices non intégrées largement disponibles, l'outil peut remplacer une correspondance étroite qui préserve le contenu du texte et son apparence approximative. Pour les documents où le texte original doit être conservé exactement, recréer le PDF à partir du document source avec l'intégration des polices activée est la solution la plus fiable à long terme. La plupart des traitements de texte et des applications de conception disposent d'un paramètre intitulé Intégrer les polices ou Intégrer tous les caractères dans leur boîte de dialogue d'exportation PDF. L'activation de ce paramètre empêche la substitution de polices de devenir un problème.

Récupération de texte à partir de PDF avec des polices intégrées corrompues

Lorsque les polices intégrées sont corrompues, les données textuelles restent généralement intactes même si elles ne peuvent pas être affichées. Les codes de caractères qui spécifient quelles lettres apparaissent où sont stockés séparément des données de glyphe de police qui indiquent au moteur de rendu comment dessiner ces lettres. Vous pouvez extraire le contenu du texte du PDF même lorsque le rendu visuel échoue. Copiez la zone de texte apparemment vide en cliquant dessus et en la faisant glisser. Même si rien n'est visible, le texte peut être sélectionné. Collez-le dans un éditeur de texte. Si du texte lisible apparaît, les données du texte sont intactes et seul le rendu de la police est cassé.

Si le copier-coller produit des caractères tronqués, l'encodage de la police peut être non standard. Dans ce cas, utilisez la fonction d'extraction de texte PDF dans un outil PDF dédié, qui tente de décoder le texte à l'aide de plusieurs schémas de codage. Le texte extrait peut ensuite être placé dans un nouveau document avec des polices correctement intégrées. Le PDF original sert de référence visuelle pour la mise en page tandis que le texte extrait fournit le contenu de la version réparée. Cette récupération en deux étapes préserve à la fois l'information et sa présentation.

Prévenir les problèmes de police dans les PDF que vous créez

La prévention la plus efficace consiste à toujours intégrer des polices lors de la création de fichiers PDF. Dans Microsoft Word, l'option se trouve dans Fichier, Options, Enregistrer, sous Préserver la fidélité lors du partage de ce document. Cochez Incorporer les polices dans le fichier. Dans Adobe InDesign et les applications de mise en page similaires, la boîte de dialogue d'exportation PDF comprend une section d'incorporation de polices dans laquelle vous pouvez spécifier les polices à intégrer. L'intégration du jeu de caractères complet plutôt que d'un sous-ensemble garantit que même si le document est modifié ultérieurement et que des caractères extérieurs au sous-ensemble d'origine sont utilisés, ils s'afficheront correctement.

Pour les PDF reçus de tiers, traitez les problèmes de rendu des polices comme un problème réparable plutôt que comme un dommage permanent. Le texte est presque certainement toujours dans le dossier. L'approche Fix PDF consiste à diagnostiquer si les polices sont manquantes ou corrompues, à extraire le texte récupérable et à installer les polices manquantes ou à reconstruire le document avec les polices intégrées. Un PDF rempli de rectangles vides semble alarmant, mais le contenu derrière ces rectangles est généralement intact et peut être récupéré en suivant les bonnes étapes.

Substitution de polices dans les scripts non latins et spécialisés

Les échecs de substitution de polices sont particulièrement fréquents avec les écritures non latines telles que le chinois, le japonais, le coréen, l'arabe et le cyrillique. Ces systèmes d'écriture utilisent des jeux de caractères bien plus grands que l'alphabet latin, et les polices qui les prennent en charge sont en conséquence plus grandes, ce qui les rend plus susceptibles d'être sous-ensembles ou omises lors de la création d'un PDF. Un PDF créé sur un système prenant en charge entièrement les polices CJK peut s'afficher sous forme de rectangles vides sur un système dépourvu de ces polices. Il en va de même pour les jeux de caractères spécialisés utilisés en mathématiques, en notation musicale et en linguistique. Les documents utilisant ces scripts doivent toujours avoir des polices entièrement intégrées, et non des sous-ensembles, pour garantir la compatibilité multiplateforme.

Lors de la réception d'un PDF contenant des polices non latines manquantes, l'installation de la police spécifique est souvent la seule solution fiable. Les algorithmes de substitution de polices conçus pour les écritures latines fonctionnent mal sur les jeux de caractères non latins car les formes des glyphes sont trop différentes pour une substitution significative. Identifier la police exacte utilisée dans le document original, l'obtenir auprès d'une source légitime et l'installer sur le système de visualisation redonne au document son apparence prévue. L'écosystème PDF Fonts prend entièrement en charge Unicode, mais cette prise en charge dépend des polices disponibles pour le moteur de rendu. Une police manquante est une lacune qu’aucune substitution intelligente ne peut combler complètement pour les systèmes d’écriture complexes.

Le problème du rectangle vide est l’un des problèmes PDF les plus alarmants visuellement qu’un utilisateur puisse rencontrer, mais il est également l’un des plus systématiquement réparables. Contrairement à la corruption structurelle dans laquelle le fichier ne peut pas être ouvert du tout, un échec de rendu des polices signifie que la structure du fichier est intacte et que son contenu est présent. Le moteur de rendu ne peut tout simplement pas dessiner ce qu'il sait devoir être là. En abordant le problème de manière méthodique, en vérifiant l'état d'intégration, en identifiant les polices manquantes et en récupérant le contenu du texte, vous transformez un PDF qui semble détruit en un PDF entièrement utilisable et lisible. L'apparence de destruction est une illusion créée par la couche de rendu. Les données en dessous sont presque toujours récupérables avec les étapes de diagnostic et les outils de réparation appropriés.

Les rectangles vides là où devrait se trouver le texte sont alarmants la première fois que vous les rencontrez. Après avoir compris le mécanisme de substitution de polices qui les sous-tend, ils deviennent un problème technique gérable avec un chemin de diagnostic clair et des correctifs fiables. La panique s’estompe et la résolution des problèmes commence.

WukongPDF

Essayez de réparer le PDF

Aucune installation nécessaire. Fonctionne directement dans votre navigateur.

Commencer →