Tips & Tricks

Como reparar um PDF que abre corretamente, mas é impresso com texto distorcido ou ausente

Um PDF que abre instantaneamente e exibe todas as páginas perfeitamente na tela, mas produz páginas com caracteres distorcidos, letras faltantes, símbolos sobrepostos ou áreas totalmente em branco quando enviado para uma impressora física, apresenta uma incompatibilidade de renderização de fonte entre o pipeline de renderização de tela e o pipeline de renderização de impressão. A estrutura do documento como um todo está intacta. Os fluxos de conteúdo são válidos e analisáveis. O visualizador na tela pode localizar e desenhar cada glifo corretamente. Entretanto, as informações que a impressora precisa para renderizar o mesmo texto fielmente estão ausentes do arquivo, estão presentes, mas são internamente inconsistentes ou são incompatíveis com o subsistema de manipulação de fontes da impressora. Uma abordagem direcionada de Repair PDF que aborda a incorporação de fontes específicas e as camadas de descritores de fontes resolve a causa mais comum desse sintoma de maneira confiável, muitas vezes sem exigir que o documento seja reconstruído a partir dos arquivos de origem originais.

Esse problema é frustrante porque o documento parece perfeitamente correto durante todo o processo de edição e revisão na tela. O autor vê o texto correto e assume que o arquivo está pronto para distribuição. Somente o destinatário, ou o autor, no último minuto, ao imprimir uma cópia impressa para uma reunião ou submissão, descobre que o material impresso está ilegível. A discrepância entre tela e impressão não é aleatória. Ele segue um conjunto previsível de causas enraizadas na forma como o formato PDF lida com os dados de fonte, e cada causa tem uma correção correspondente.

How to Repair a PDF That Opens Correctly but Prints With Garbled or Missing Text

Por que um PDF pode ser exibido corretamente na tela, mas falha quando impresso

O mecanismo de renderização de tela e o mecanismo de renderização de impressão dentro de um aplicativo consumidor de PDF usam dois caminhos diferentes de resolução de fonte. Um renderizador de tela pode retornar normalmente para uma fonte substituta do sistema quando a fonte incorporada original estiver danificada, ausente ou apenas parcialmente incorporada. Ele pode aproximar formas de glifos e larguras de caracteres o suficiente para que o texto pareça aceitável em uma tela de resolução baixa a média. Uma impressora, especialmente uma impressora PostScript que interpreta a linguagem de descrição de página nativamente, requer o subconjunto de fontes original totalmente incorporado com seus dados de glifo completos e métricas de descritor de fonte, ou uma correspondência próxima de fontes do sistema, além de tabelas de descritores de fontes definidas com precisão, incluindo a matriz de largura de caracteres, a caixa delimitadora da fonte, a altura da tampa, as larguras da haste e os pares de kerning.

A especificação PDF define três estratégias distintas para lidar com fontes (Adobe, "PDF Reference 1.7", 2006). Fontes totalmente incorporadas incluem todo o binário do programa de fontes no arquivo PDF. As fontes incorporadas de subconjunto incluem apenas os caracteres específicos realmente usados no documento, identificados por seus pontos de código Unicode. As fontes referenciadas não incluem nenhum dado de fonte; eles nomeiam uma fonte de sistema padrão por seu nome BaseFont e dependem do visualizador ou da impressora para fornecer uma fonte correspondente no momento da exibição ou impressão. As fontes referenciadas são de longe a fonte mais comum de incompatibilidades de texto entre tela e impressão porque a coleção de fontes instaladas na impressora quase sempre difere da coleção de fontes do visualizador em pelo menos alguns tipos de letra.

WukongPDF

Experimente reparar PDF

Nenhuma instalação necessária. Funciona diretamente no seu navegador.

Começar agora →

Verifique quais fontes estão incorporadas e quais são meramente referenciadas

A primeira etapa do diagnóstico é abrir o PDF em qualquer visualizador que possa relatar o status de incorporação de cada fonte usada no documento. No Adobe Acrobat Reader ou Acrobat Pro, vá para Arquivo, Propriedades e clique na guia Fontes. A guia lista todas as fontes que aparecem em qualquer lugar do documento. Ao lado de cada nome de fonte, o status de incorporação é mostrado. Uma fonte listada com o status "Incorporado" tem seu programa de glifo completo armazenado dentro do PDF. "Subconjunto incorporado" significa que apenas os caracteres específicos usados no texto do documento estão presentes, o que é normal e suficiente para a maioria dos documentos. Uma fonte listada sem qualquer indicador de incorporação, mostrando apenas o nome da fonte e um tipo como "Tipo 1" ou "TrueType" é uma fonte referenciada sem nenhum dado incorporado.

Se a guia Fontes revelar uma ou mais fontes referenciadas, essas fontes serão as principais suspeitas da distorção da impressão. Uma ferramenta Fix PDF ou comprovação que pode localizar fontes de sistema correspondentes, extrair as formas de glifo necessárias apenas para os caracteres usados no documento e incorporar esses glifos como um novo subconjunto de fontes dentro do PDF resolve o problema de impressão. O subconjunto incorporado fornece à impressora todos os glifos necessários, eliminando a dependência da coleção de fontes da própria impressora.

Imprimir o documento como uma imagem para ignorar todo o processamento de fontes

Quando os dados da fonte estão realmente ausentes ou corrompidos e nem a incorporação nem o reparo são imediatamente viáveis, a impressão do PDF como uma sequência de imagens raster ignora totalmente o subsistema de fontes da impressora. Na caixa de diálogo Imprimir do Adobe Acrobat Reader, clique no botão Avançado e marque a opção “Imprimir como imagem”. Essa configuração instrui o Acrobat a renderizar internamente cada página em um bitmap de alta resolução e, em seguida, transmitir apenas os dados de bitmap para a impressora, em vez de enviar os comandos de desenho vetorial originais e os operadores de posicionamento de texto. A saída impressa será totalmente legível, mas o texto em tamanhos de pontos pequenos, como notas de rodapé, rótulos de eixo ou letras miúdas, poderá apresentar uma ligeira suavização nas bordas dos caracteres devido à etapa de rasterização.

A tabela abaixo resume as vantagens de diferentes configurações de resolução de impressão como imagem:

Configuração de resoluçãoQualidade do texto de saídaTamanho aproximado do carretel por páginaMais adequado para
300 DPIBom geral, leve suavização visível em serifas abaixo de 8 pontosAproximadamente 8 MB para uma página de cartaDocumentos de escritório padrão, relatórios internos, rascunhos
600 DPIExcelente, quase indistinguível do verdadeiro texto vetorialAproximadamente 30 MB para uma página de cartaContratos, arquivamentos legais, documentos com notas de rodapé ou texto pequeno
1200 DPIIndistinguível da saída vetorial originalAproximadamente 120 MB para uma página de cartaProvas de impressão profissionais, cópias de preservação com qualidade de arquivo

Converta o PDF para uma versão nivelada com fontes rasterizadas permanentemente

Para uma correção permanente que produza um documento independente que será impresso de forma idêntica em qualquer impressora, qualquer sistema operacional e qualquer visualizador de PDF, converta o PDF inteiro para uma versão em que todo o texto tenha sido rasterizado em alta resolução. Isso produz um novo arquivo PDF onde cada página é armazenada como uma imagem de alta resolução e não há dependências de fonte de qualquer tipo restantes na saída. A desvantagem é que o texto se torna não pesquisável e não selecionável, e o tamanho do arquivo aumenta em comparação com o documento original baseado em vetor.

Ghostscript, o processador de PDF de linha de comando gratuito, realiza essa conversão com eficiência. O comando `gs -o output.pdf -sDEVICE=pdfwrite -dPDFSETTINGS=/printer -dEmbedAllFonts=true -dSubsetFonts=true input.pdf` usa a predefinição da impressora, que rasteriza o texto enquanto preserva a qualidade da imagem em 300 DPI. Para maior fidelidade, a predefinição de pré-impressão mantém 300 DPI para imagens coloridas e em tons de cinza e deixa o texto como dados vetoriais onde os dados da fonte são válidos. Se os dados da fonte estiverem corrompidos, adicione o sinalizador `-dNoOutputFonts` ao comando Ghostscript para forçar a rasterização completa do texto, independentemente da validade da fonte.

Reparar tabelas de fontes danificadas usando uma ferramenta de pré-impressão de PDF

Quando as tabelas métricas internas de uma fonte estão corrompidas em vez de ausentes, uma ferramenta de reparo de comprovação pode corrigir as tabelas sem rasterizar o texto. Um programa de fontes contém diversas tabelas de dados internos. O "cmap" tabela mapeia códigos de caracteres Unicode para índices de glifos dentro da fonte. Uma tabela cmap corrompida faz com que a impressora selecione e desenhe o formato de glifo errado para um determinado código de caractere, produzindo caracteres ilegíveis aparentemente aleatórios. O "hmtx" tabela armazena as métricas horizontais, incluindo a largura de avanço de cada glifo. Uma tabela hmtx corrompida faz com que os caracteres se sobreponham, colidam ou fiquem espaçados em distâncias irregulares. As ferramentas de comprovação podem detectar corrupção em ambas as tabelas e reconstruí-las a partir da parte válida dos dados de fonte incorporados ou substituir uma fonte de sistema correspondente e regenerar tabelas limpas a partir do substituto.

Módulos de simulação profissionais no Adobe Acrobat Pro na seção "Correções de PDF" categoria e em callas pdfToolbox fornecem operações de reparo de tabela de fontes com um clique. A ferramenta Repair PDF de WukongPDF inclui diagnósticos automatizados de fontes que detectam incorporação ausente, corrupção de cmap e inconsistências de hmtx em uma única passagem de análise. Os serviços de reparo baseados em navegador incluem cada vez mais a reconstrução de subconjuntos de fontes como parte de seu pipeline de reparo automatizado padrão, tornando o reparo de tabelas de fontes acessível sem software de desktop ou experiência em linha de comando.

Teste a saída reparada em vários tipos de impressoras e drivers

Um PDF impresso corretamente em uma impressora jato de tinta doméstica usando um driver PCL padrão ainda pode produzir texto distorcido em uma impressora a laser de escritório que usa um driver PostScript ou em uma impressora digital de produção que usa um processador de imagem raster proprietário. Diferentes tipos de impressoras interpretam dados de fontes com diferentes níveis de tolerância para tabelas de fontes fora do padrão ou ligeiramente malformadas. As impressoras PostScript tendem a ser mais rigorosas quanto à conformidade das fontes do que as impressoras PCL e rejeitarão ou renderizarão incorretamente as fontes que um driver PCL aceita silenciosamente com substituição.

Após concluir o reparo, imprima uma única página de teste em cada tipo de impressora que o documento provavelmente encontrará. Se o documento precisar ser impresso de forma confiável em uma ampla variedade de modelos de impressoras desconhecidos, como um formulário que os destinatários imprimirão em suas próprias impressoras de escritório ou domésticas, a impressão baseada em imagem ou a abordagem de rasterização completa será a escolha mais segura e universalmente compatível. A ligeira compensação na nitidez do texto é compensada pela certeza de que cada destinatário verá resultados legíveis, independentemente do hardware da impressora.

Quando um PDF abre e é exibido corretamente na tela, mas produz texto distorcido, ausente ou ilegível quando impresso, a causa quase sempre está enraizada na camada de manipulação de fontes do documento. Verifique primeiro o status de incorporação da fonte nas propriedades do documento. Se as fontes referenciadas estiverem presentes, use uma ferramenta de comprovação ou reparo para incorporá-las como subconjuntos. Imprimir como imagem fornece uma solução alternativa imediata que ignora totalmente o processamento de fontes. A conversão para um PDF permanentemente achatado com texto rasterizado produz um arquivo portátil e preparado para o futuro que será impresso de forma idêntica em qualquer lugar. O reparo de tabelas de fontes danificadas no nível estrutural preserva a capacidade de pesquisa do texto e mantém o tamanho dos arquivos pequenos. A combinação de uma rápida verificação de diagnóstico seguida pelo reparo direcionado que corresponde ao problema específico da fonte restaura a saída impressa exatamente como você vê na tela.

WukongPDF

Experimente reparar PDF

Nenhuma instalação necessária. Funciona diretamente no seu navegador.

Começar agora →