Tips & Tricks

Jak naprawić plik PDF, który otwiera się poprawnie, ale drukuje z zniekształconym lub brakującym tekstem

W pliku PDF, który otwiera się natychmiast i doskonale wyświetla każdą stronę na ekranie, ale po wysłaniu do fizycznej drukarki powstają strony zawierające zniekształcone znaki, brakujące litery, nakładające się symbole lub całkowicie puste obszary, występuje niezgodność renderowania czcionek pomiędzy potokiem renderowania ekranu a potokiem renderowania wydruku. Struktura dokumentu jako całość jest nienaruszona. Strumienie treści są prawidłowe i można je analizować. Przeglądarka ekranowa może poprawnie zlokalizować i narysować każdy glif. Jednak informacje potrzebne drukarce do wiernego renderowania tego samego tekstu albo nie są obecne w pliku, są obecne, ale wewnętrznie niespójne, albo są niezgodne z podsystemem obsługi czcionek drukarki. Ukierunkowane podejście Napraw PDF, które uwzględnia określone osadzanie czcionek i warstwy deskryptorów czcionek, niezawodnie rozwiązuje najczęstszą przyczynę tego objawu, często bez konieczności odbudowy dokumentu z oryginalnych plików źródłowych.

Ten problem jest frustrujący, ponieważ dokument wygląda doskonale podczas całego procesu edycji i recenzowania na ekranie. Autor widzi poprawny tekst i zakłada, że plik jest gotowy do dystrybucji. Tylko odbiorca lub autor w ostatniej chwili podczas drukowania wersji papierowej na spotkanie lub przesłanie odkrywa, że wydruk jest nieczytelny. Rozbieżność między ekranem a wydrukiem nie jest przypadkowa. Wynika to z przewidywalnego zestawu przyczyn zakorzenionych w sposobie, w jaki format PDF obsługuje dane czcionek, a każda przyczyna ma odpowiednią poprawkę.

How to Repair a PDF That Opens Correctly but Prints With Garbled or Missing Text

Dlaczego plik PDF może wyświetlać się poprawnie na ekranie, ale nie można go wydrukować

Silnik renderujący ekran i silnik renderujący wydruk w aplikacji konsumenckiej PDF korzystają z dwóch różnych ścieżek rozdzielczości czcionek. Moduł renderujący ekran może z wdziękiem powrócić do zastępczej czcionki systemowej, gdy oryginalna osadzona czcionka jest uszkodzona, brakuje jej lub jest osadzona tylko częściowo. Może przybliżać kształty glifów i szerokości znaków na tyle blisko, że tekst wydaje się akceptowalny na wyświetlaczu o niskiej i średniej rozdzielczości. Drukarka, zwłaszcza drukarka PostScript, która natywnie interpretuje język opisu strony, wymaga albo oryginalnego, w pełni osadzonego podzbioru czcionek z pełnymi danymi glifów i metrykami deskryptorów czcionek, albo bliskiego dopasowania czcionek systemowych plus dokładnie zdefiniowanych tabel deskryptorów czcionek, w tym tablicy szerokości znaków, ramki ograniczającej czcionkę, wysokości czapki, szerokości łodyg i par kerningu.

Specyfikacja PDF definiuje trzy różne strategie obsługi czcionek (Adobe, „PDF Reference 1.7”, 2006). W pełni osadzone czcionki obejmują cały plik binarny programu czcionek w pliku PDF. Czcionki osadzone w podzbiorze obejmują tylko określone znaki faktycznie używane w dokumencie, identyfikowane przez ich punkty kodowe Unicode. Czcionki, do których istnieją odniesienia, nie zawierają żadnych danych czcionek; nazywają standardową czcionkę systemową nazwą BaseFont i zależą od przeglądarki lub drukarki, która dostarczy pasującą czcionkę podczas wyświetlania lub drukowania. Czcionki odniesienia są zdecydowanie najczęstszym źródłem niezgodności tekstu na ekranie i na wydruku, ponieważ zbiór czcionek zainstalowanych w drukarce prawie zawsze różni się od zbioru czcionek przeglądarki co najmniej kilkoma krojami.

WukongPDF

Spróbuj naprawić plik PDF

Nie wymaga instalacji. Działa bezpośrednio w Twojej przeglądarce.

Zacznij teraz →

Sprawdź, które czcionki są osadzone, a które stanowią jedynie odniesienia

Pierwszym krokiem diagnostycznym jest otwarcie pliku PDF w dowolnej przeglądarce, która może zgłosić stan osadzenia każdej czcionki użytej w dokumencie. W programie Adobe Acrobat Reader lub Acrobat Pro przejdź do opcji Plik, Właściwości i kliknij kartę Czcionki. Na karcie znajdują się wszystkie czcionki występujące w dowolnym miejscu dokumentu. Obok nazwy każdej czcionki wyświetlany jest stan osadzania. Czcionka na liście ze statusem „Osadzona” ma swój kompletny program glifów przechowywany w pliku PDF. „Osadzony podzbiór” oznacza, że obecne są tylko określone znaki użyte w tekście dokumentu, co jest normalne i wystarczające w przypadku większości dokumentów. Czcionka wymieniona bez żadnego wskaźnika osadzania, wyświetlająca tylko nazwę czcionki i typ, np. „Typ 1”; lub „TrueType”; jest czcionką referencyjną bez żadnych osadzonych danych.

Jeśli na karcie Czcionki widoczna jest jedna lub więcej czcionek, do których następuje odniesienie, czcionki te są głównymi podejrzanymi o zniekształcenie druku. A Napraw PDF lub narzędzie do wstępnej analizy, które może zlokalizować pasujące czcionki systemowe, wyodrębnić wymagane kształty glifów tylko dla znaków używanych w dokumencie i osadzić te glify jako nowy podzbiór czcionek w pliku PDF, rozwiązuje problem drukowania. Wbudowany podzbiór zapewnia drukarce każdy potrzebny glif, eliminując zależność od własnej kolekcji czcionek drukarki.

Wydrukuj dokument jako obraz, aby pominąć przetwarzanie czcionek

Jeśli rzeczywiście brakuje danych czcionek lub są one uszkodzone i osadzenie ani naprawa nie są natychmiast możliwe, wydrukowanie pliku PDF jako sekwencji obrazów rastrowych całkowicie omija podsystem czcionek drukarki. W oknie dialogowym Drukuj programu Adobe Acrobat Reader kliknij przycisk Zaawansowane i zaznacz opcję „Drukuj jako obraz”. To ustawienie powoduje, że program Acrobat wewnętrznie renderuje każdą stronę do postaci mapy bitowej o wysokiej rozdzielczości, a następnie przesyła do drukarki tylko dane mapy bitowej, zamiast wysyłać oryginalne polecenia rysowania wektorowego i operatory umieszczania tekstu. Wydruk będzie w pełni czytelny, ale tekst o małych rozmiarach, np. przypisy, etykiety osi lub drobny druk, może wykazywać lekkie zmiękczenie na krawędziach znaków w wyniku etapu rasteryzacji.

Poniższa tabela podsumowuje kompromisy wynikające z różnych ustawień rozdzielczości drukowania jako obrazu:

Ustawienie rozdzielczościJakość tekstu wyjściowegoPrzybliżony rozmiar szpuli na stronęNajlepiej nadaje się do
300 DPIOgólnie dobry, lekkie zmiękczenie widoczne na szeryfach poniżej 8 pktOkoło 8 MB na stronę z listemStandardowe dokumenty biurowe, raporty wewnętrzne, projekty
600 DPIZnakomity, prawie nie do odróżnienia od prawdziwego tekstu wektorowegoOkoło 30 MB na stronę z listemUmowy, zgłoszenia prawne, dokumenty z przypisami lub małym tekstem
1200 DPINie do odróżnienia od oryginalnego wyjścia wektorowegoOkoło 120 MB na stronę z listemProfesjonalne wydruki próbne, kopie zabezpieczające o jakości archiwalnej

Konwertuj plik PDF na wersję spłaszczoną z trwale zrasteryzowanymi czcionkami

Aby uzyskać trwałą poprawkę, która tworzy samodzielny dokument, który można wydrukować identycznie na dowolnej drukarce, w dowolnym systemie operacyjnym i dowolnej przeglądarce plików PDF, przekonwertuj cały plik PDF do wersji, w której cały tekst został zrasteryzowany w wysokiej rozdzielczości. Spowoduje to utworzenie nowego pliku PDF, w którym każda strona zostanie zapisana jako obraz o wysokiej rozdzielczości, a w wynikach nie pozostaną żadne zależności dotyczące czcionek. Kompromis polega na tym, że tekstu nie można przeszukiwać ani zaznaczać, a rozmiar pliku wzrasta w porównaniu z oryginalnym dokumentem wektorowym.

Ghostscript, darmowy procesor PDF z wiersza poleceń, skutecznie przeprowadza tę konwersję. Polecenie `gs -o Output.pdf -sDEVICE=pdfwrite -dPDFSETTINGS=/printer -dEmbedAllFonts=true -dSubsetFonts=true input.pdf` wykorzystuje ustawienie wstępne drukarki, które rasteryzuje tekst przy zachowaniu jakości obrazu przy rozdzielczości 300 DPI. Aby uzyskać wyższą wierność, ustawienie prepress utrzymuje rozdzielczość 300 DPI dla obrazów kolorowych i w skali szarości oraz pozostawia tekst jako dane wektorowe, jeśli obowiązują dane czcionki. Jeśli wiadomo, że dane czcionki są uszkodzone, dodaj flagę `-dNoOutputFonts` do polecenia Ghostscript, aby wymusić pełną rasteryzację tekstu niezależnie od ważności czcionki.

Napraw uszkodzone tabele czcionek za pomocą narzędzia do wstępnej analizy plików PDF

Kiedy wewnętrzne tabele metryczne czcionki są raczej uszkodzone niż ich brak, narzędzie do naprawy wstępnej może naprawić tabele bez rasteryzacji tekstu. Program obsługujący czcionki zawiera kilka wewnętrznych tabel danych. „Cmapa” tabela odwzorowuje kody znaków Unicode na indeksy glifów wewnątrz czcionki. Uszkodzona tabela cmap powoduje, że drukarka wybiera i rysuje nieprawidłowy kształt glifu dla danego kodu znaku, tworząc pozornie losowe, zniekształcone znaki. „hmtx” tabela przechowuje metryki poziome, w tym szerokość każdego glifu. Uszkodzona tabela hmtx powoduje, że znaki nakładają się, kolidują lub są rozmieszczone w nieregularnych odstępach. Narzędzia do wstępnej analizy mogą wykryć uszkodzenia w obu tabelach i albo odbudować je na podstawie prawidłowej części osadzonych danych czcionki, albo zastąpić pasującą czcionkę systemową i ponownie wygenerować czyste tabele na podstawie zamiennika.

Profesjonalne moduły inspekcji wstępnej w programie Adobe Acrobat Pro w ramach „Poprawek plików PDF” kategorii i w callas pdfToolbox umożliwiają operację naprawy tabeli czcionek jednym kliknięciem. Narzędzie WukongPDF Napraw PDF zawiera automatyczną diagnostykę czcionek, która wykrywa brakujące osadzenia, uszkodzenia cmap i niespójności hmtx w jednym przebiegu analizy. Usługi naprawy oparte na przeglądarce coraz częściej obejmują odbudowę podzbioru czcionek w ramach standardowego procesu naprawy automatycznej, dzięki czemu naprawa tabeli czcionek jest dostępna bez oprogramowania komputerowego lub znajomości wiersza poleceń.

Przetestuj naprawione wydruki na wielu typach drukarek i sterownikach

Plik PDF, który zostanie poprawnie wydrukowany na domowej drukarce atramentowej przy użyciu standardowego sterownika PCL, może nadal generować zniekształcony tekst na biurowej drukarce laserowej korzystającej ze sterownika PostScript lub na produkcyjnej maszynie cyfrowej korzystającej z zastrzeżonego procesora obrazu rastrowego. Różne typy drukarek interpretują dane czcionek z różnymi poziomami tolerancji w przypadku niestandardowych lub lekko zniekształconych tabel czcionek. Drukarki PostScript są zwykle bardziej rygorystyczne pod względem zgodności czcionek niż drukarki PCL i odrzucają lub źle renderują czcionki, które sterownik PCL po cichu akceptuje z podstawieniem.

Po zakończeniu naprawy wydrukuj jedną stronę testową na każdym typie drukarki, z którą dokument może się spotkać. Jeśli dokument musi być drukowany niezawodnie na wielu różnych nieznanych modelach drukarek, np. w formie formularza, który odbiorcy będą drukować na własnej drukarce biurowej lub domowej, bezpieczniejszym i bardziej uniwersalnym wyborem będzie drukowanie oparte na obrazach lub metoda pełnej rasteryzacji. Niewielki kompromis w ostrości tekstu jest równoważony przez pewność, że każdy odbiorca zobaczy czytelny wydruk, niezależnie od sprzętu drukarki.

Kiedy plik PDF otwiera się i wyświetla poprawnie na ekranie, ale po wydrukowaniu tekst jest zniekształcony, brakujący lub nieczytelny, przyczyną prawie zawsze jest warstwa obsługująca czcionki w dokumencie. Najpierw sprawdź stan osadzania czcionki we właściwościach dokumentu. Jeśli obecne są czcionki odniesienia, użyj narzędzia do wstępnej kontroli lub naprawy, aby osadzić je jako podzbiory. Drukuj jako obraz zapewnia natychmiastowe rozwiązanie, które całkowicie pomija przetwarzanie czcionek. Konwersja na trwale spłaszczony plik PDF z tekstem rastrowym daje przenośny, przyszłościowy plik, który będzie drukowany identycznie wszędzie. Naprawa uszkodzonych tabel czcionek na poziomie strukturalnym pozwala zachować możliwość wyszukiwania tekstu i utrzymuje małe rozmiary plików. Połączenie szybkiej diagnostyki i ukierunkowanej naprawy dopasowanej do konkretnego problemu z czcionką przywraca na wydruku dokładnie taki wygląd, jaki widzisz na ekranie.

WukongPDF

Spróbuj naprawić plik PDF

Nie wymaga instalacji. Działa bezpośrednio w Twojej przeglądarce.

Zacznij teraz →