Abres un PDF que ayer era perfectamente legible. Hoy en día, cada página muestra símbolos aleatorios en lugar de texto. Las letras han sido reemplazadas por cuadros cuadrados, signos de interrogación, signos más o cadenas de caracteres completamente ajenos como "%$#@!" donde deberían estar las oraciones. La estructura del documento está intacta. Las páginas están ahí. Las imágenes están bien. Pero cada palabra en cada página se ha transformado en un galimatías.
Se trata de una falla en la codificación de fuentes y es uno de los problemas de PDF más alarmantes porque parece que el archivo se ha dañado sin posibilidad de recuperación. En la mayoría de los casos, el contenido está intacto. El PDF utiliza códigos de caracteres que el espectador no puede asignar a las formas de letras correctas. La solución generalmente implica reparar la codificación de la fuente, instalar la fuente que falta o volver a renderizar el PDF a través de un motor que resuelva la codificación correctamente.

Las tres causas más comunes de texto galimatías en archivos PDF
Causa uno: faltan fuentes sin respaldo incorporado. El PDF se creó utilizando una fuente que no estaba incrustada en el archivo y su sistema no tiene esa fuente instalada. El visor de PDF intenta sustituir una fuente diferente, pero el sustituto utiliza una codificación de caracteres diferente. El código de carácter que significaba "A" en la fuente original significa algo más en la fuente sustituta. El espectador reproduce fielmente el carácter sustituto, razón por la cual cada letra de la página se reemplaza por un símbolo diferente.
Causa dos: datos de fuente dañados dentro del PDF. La fuente está incrustada, pero los datos de la fuente incrustada están dañados. Esto puede suceder cuando un PDF se descarga parcialmente, se transfiere a través de un sistema de correo electrónico que modifica datos binarios o se almacena en un dispositivo de almacenamiento defectuoso. Los datos de fuente están presentes pero contienen errores que hacen que el motor de renderizado malinterprete los códigos de caracteres. El texto parece aleatorio, pero en realidad es un resultado determinista de una entrada corrupta. Cada vez que abre el archivo, el mismo texto aparece como el mismo galimatías porque la corrupción está en los datos de fuente almacenados, no en un error de representación transitorio.
Causa tres: codificación de caracteres incorrecta especificada en el PDF. El PDF contiene una entrada /Encoding que le indica al espectador cómo asignar códigos de caracteres a glifos, pero la codificación especificada no coincide con la forma en que se escribió realmente el texto. Esto sucede con mayor frecuencia con archivos PDF creados con software antiguo o no estándar que escribió el texto usando una codificación pero declaró una codificación diferente en los metadatos del archivo. El espectador aplica la codificación declarada y produce galimatías. Si, en cambio, aplicara la codificación real que utilizó el creador, el texto se mostraría correctamente. Esta discrepancia entre la codificación declarada y real es la más solucionable de las tres causas porque los datos del texto están intactos. Sólo las instrucciones del mapeo son incorrectas.
Pruebe reparar PDF
No se necesita instalación. Funciona directamente en su navegador.
Cómo diagnosticar qué problema tiene su PDF
Una serie rápida de pruebas reduce la causa. Primero, abra el PDF en un visor diferente. Si se muestra correctamente en Adobe Acrobat pero muestra galimatías en su navegador, el problema es el procesador de PDF del navegador, no el archivo. Instale la fuente que falta o utilice un visor diferente. Si el PDF muestra galimatías en todos los visores, el problema está en el archivo mismo.
En segundo lugar, verifique la lista Fuentes PDF en las propiedades del documento. En Acrobat, vaya a Archivo, Propiedades, Fuentes. Si la lista de fuentes muestra fuentes marcadas como no incrustadas y esas fuentes no están instaladas en su sistema, tiene un problema de fuente faltante. Instale la fuente o abra el archivo en un sistema que la tenga. Si la lista de fuentes muestra fuentes incrustadas pero el texto aún es un galimatías, es probable que los datos de las fuentes incrustadas estén dañados.
En tercer lugar, intente seleccionar y copiar el texto galimatías. Pégalo en un editor de texto. Si el texto pegado es el texto original correcto, los caracteres se almacenan correctamente en el PDF pero la asignación de visualización no funciona. Esto indica una discrepancia en la declaración de codificación. Los datos del texto son buenos. El espectador simplemente lo muestra mal. Si el texto pegado también es un galimatías, los datos de los caracteres en sí están dañados, lo cual es un problema más profundo.
Cómo arreglar un PDF que muestra símbolos aleatorios
Para las fuentes que faltan, instale la fuente requerida en su sistema. El nombre de la fuente aparece en las propiedades del documento. Muchas fuentes están disponibles para su descarga gratuita y se pueden comprar e instalar fuentes comerciales. Una vez instalada la fuente, vuelva a abrir el PDF. El texto debería reproducirse correctamente. Si instalar la fuente no es práctico, abra el PDF en un visor que tenga una mejor sustitución de fuentes, como Adobe Acrobat en lugar de un visor de navegador, o use WukongPDF para volver a renderizar el PDF con fuentes incrustadas. El proceso de renderizado resuelve todas las referencias de fuentes e incrusta las formas reales de los caracteres, produciendo un PDF autónomo que se mostrará correctamente en cualquier sistema.
Para las fuentes incrustadas dañadas, la solución es reparar o reemplazar los datos de la fuente. La herramienta PDF Repair de WukongPDF puede detectar secuencias de fuentes corruptas e intentar reconstruirlas a partir de los datos supervivientes. Si la fuente es parcialmente recuperable, la herramienta extrae las partes intactas y reconstruye un subconjunto de fuentes funcional. Esto no siempre tiene éxito. Si la corrupción es extensa, el texto puede ser total o parcialmente irrecuperable y el único recurso es localizar el documento fuente original y recrear el PDF.
Para las discrepancias en la codificación, la solución más confiable en todos los casos es imprimir el PDF en un nuevo PDF. Abra el archivo en cualquier visor que lo muestre correctamente, incluso si solo un visor en una computadora específica lo muestra correctamente, y use la función Imprimir en PDF para crear un nuevo archivo. El proceso de impresión vuelve a representar cada carácter utilizando la representación de fuente actual del sistema, integrando efectivamente las formas correctas de los caracteres en el nuevo PDF como datos de fuente incrustados. La discrepancia en la codificación se resuelve porque el nuevo PDF utiliza una codificación estándar con fuentes incrustadas. Esta solución conserva la apariencia visual del texto, pero puede perder la codificación de caracteres subyacente, lo que importa si es necesario buscar o extraer el texto más adelante. Para documentos donde la capacidad de búsqueda es importante, utilice una herramienta dedicada Fix PDF que repara la codificación preservando la capa de texto.
Prevención de problemas de codificación de fuentes en archivos PDF que cree
Incruste siempre fuentes al crear archivos PDF. Esta configuración única evita la gran mayoría de los problemas de texto galimatías. En cada aplicación que exporta a PDF, Word, InDesign, Illustrator, PowerPoint, existe una opción para incrustar fuentes. Encuéntralo. Habilítelo. El PDF resultante será un poco más grande, normalmente de 50 KB a 200 KB por fuente, pero se mostrará correctamente en todos los sistemas y en todos los visores, ahora y en el futuro.
Utilice codificaciones estándar. Evite codificaciones de caracteres personalizadas a menos que tenga un motivo específico y comprenda las implicaciones. Todos los visualizadores de PDF comprenden la codificación estándar de PDF, WinAnsiEncoding para escritura latina e Identity-H para Unicode. Las codificaciones personalizadas pueden ser entendidas por el software que las creó y nada más. Una codificación estándar con fuentes integradas es la combinación más portátil y confiable para texto PDF que sigue siendo legible en todas las plataformas y a lo largo del tiempo.
Si encuentra texto sin sentido en un PDF creado por una aplicación antigua o especializada, como un generador de informes de mainframe, un sistema de contabilidad heredado o un módulo de salida de un instrumento científico, el problema de codificación puede estar en la tabla de asignación de caracteres del PDF en lugar de en las fuentes faltantes. Estos sistemas a veces producen archivos PDF donde el texto se almacena utilizando una codificación de símbolo personalizada que asigna códigos de caracteres a posiciones de glifos en una fuente en lugar de valores Unicode. Cuando un espectador moderno intenta extraer el texto como Unicode, el mapeo falla y el resultado es un galimatías. La solución para estos archivos es utilizar una herramienta de reparación de PDF que pueda detectar codificaciones no estándar y reemplazarlas con asignaciones Unicode estándar o extraer el texto como códigos de caracteres sin formato y reconstruir la codificación a partir de los datos de la fuente. Esta es una operación de reparación especializada más allá de lo que manejan las herramientas PDF de uso general y, por lo general, requiere una herramienta con soporte explícito para la reparación de codificación heredada.
Pruebe reparar PDF
No se necesita instalación. Funciona directamente en su navegador.
