Others

Dlaczego po otwarciu mojego pliku PDF zamiast normalnego tekstu pojawiają się losowe symbole lub bełkot?

Otwierasz plik PDF, który wczoraj był doskonale czytelny. Obecnie na każdej stronie zamiast tekstu pojawiają się losowe symbole. Litery zostały zastąpione kwadratowymi ramkami, znakami zapytania, znakami plus lub ciągami zupełnie niezwiązanych ze sobą znaków, np. „%$#@!” gdzie powinny być zdania. Struktura dokumentu jest nienaruszona. Strony są tam. Obrazy są w porządku. Ale każde słowo na każdej stronie zostało przekształcone w bełkot.

Jest to awaria kodowania czcionki i jest to jeden z najbardziej niepokojących problemów z plikami PDF, ponieważ wygląda na to, że plik został uszkodzony i nie da się go odzyskać. W większości przypadków zawartość jest nienaruszona. W pliku PDF używane są kody znaków, których przeglądarka nie może przypisać do odpowiednich kształtów liter. Poprawka zwykle polega na naprawieniu kodowania czcionki, zainstalowaniu brakującej czcionki lub ponownym wyrenderowaniu pliku PDF za pomocą silnika, który poprawnie rozpoznaje kodowanie.

Why Does My PDF Show Random Symbols or Gibberish Instead of Normal Text When I Open It

Trzy najczęstsze przyczyny bełkotliwego tekstu w plikach PDF

Przyczyna pierwsza: brakujące czcionki bez wbudowanego źródła zastępczego. Plik PDF został utworzony przy użyciu czcionki, która nie została osadzona w pliku, a Twój system nie ma zainstalowanej tej czcionki. Przeglądarka plików PDF próbuje zastąpić inną czcionkę, ale substytut używa innego kodowania znaków. Kod znaku oznaczający „A” w oryginalnej czcionce oznacza coś innego w czcionce zastępczej. Widz wiernie oddaje znak zastępczy, dlatego każda litera na stronie zostaje zastąpiona innym symbolem.

Przyczyna druga: uszkodzone dane czcionek w pliku PDF. Czcionka jest osadzona, ale osadzone dane czcionki są uszkodzone. Może się to zdarzyć, gdy plik PDF zostanie częściowo pobrany, przesłany za pośrednictwem systemu poczty elektronicznej modyfikującego dane binarne lub zapisany na uszkodzonym urządzeniu pamięci masowej. Dane czcionki są obecne, ale zawierają błędy, które powodują błędną interpretację kodów znaków przez silnik renderujący. Tekst wygląda losowo, ale w rzeczywistości jest to deterministyczny wynik uszkodzonych danych wejściowych. Za każdym razem, gdy otwierasz plik, ten sam tekst pojawia się jako ten sam bełkot, ponieważ uszkodzenie dotyczy przechowywanych danych czcionek, a nie przejściowego błędu renderowania.

Przyczyna trzecia: nieprawidłowe kodowanie znaków określone w pliku PDF. Plik PDF zawiera wpis /Encoding, który informuje przeglądarkę, jak mapować kody znaków na glify, ale określone kodowanie nie odpowiada faktycznemu zapisowi tekstu. Dzieje się tak najczęściej w przypadku plików PDF utworzonych przez starsze lub niestandardowe oprogramowanie, które napisało tekst przy użyciu jednego kodowania, ale zadeklarowało inne kodowanie w metadanych pliku. Przeglądarka stosuje zadeklarowane kodowanie i produkuje bełkot. Jeśli zamiast tego zastosowałby faktyczne kodowanie użyte przez twórcę, tekst zostałby wyrenderowany poprawnie. Ta rozbieżność między zadeklarowanym a rzeczywistym kodowaniem jest najłatwiejszą do naprawienia z trzech przyczyn, ponieważ dane tekstowe są nienaruszone. Tylko instrukcje mapowania są błędne.

WukongPDF

Spróbuj naprawić plik PDF

Nie wymaga instalacji. Działa bezpośrednio w Twojej przeglądarce.

Zacznij teraz →

Jak zdiagnozować problem występujący w pliku PDF

Szybki zestaw testów zawęża przyczynę. Najpierw otwórz plik PDF w innej przeglądarce. Jeśli wyświetla się poprawnie w programie Adobe Acrobat, ale w przeglądarce wyświetla bełkot, problemem jest moduł renderowania plików PDF w przeglądarce, a nie plik. Zainstaluj brakującą czcionkę lub użyj innej przeglądarki. Jeśli w każdej przeglądarce plik PDF wyświetla bełkot, problem leży w samym pliku.

Następnie sprawdź listę Czcionki PDF we właściwościach dokumentu. W programie Acrobat przejdź do Plik, Właściwości, Czcionki. Jeśli na liście czcionek znajdują się czcionki oznaczone jako nieosadzone, a czcionki te nie są zainstalowane w systemie, oznacza to, że występuje problem z brakującą czcionką. Zainstaluj czcionkę lub otwórz plik w systemie, który ją posiada. Jeśli na liście czcionek znajdują się czcionki osadzone, ale tekst nadal jest bełkotliwy, dane czcionek osadzonych są prawdopodobnie uszkodzone.

Po trzecie, spróbuj wybrać i skopiować bełkotliwy tekst. Wklej go do edytora tekstu. Jeśli wklejony tekst jest oryginalnym, poprawnym tekstem, znaki są poprawnie przechowywane w pliku PDF, ale mapowanie wyświetlania jest uszkodzone. Oznacza to niezgodność deklaracji kodowania. Dane tekstowe są dobre. Widz po prostu źle to pokazuje. Jeśli wklejony tekst również jest bełkotliwy, same dane znakowe są uszkodzone, co stanowi głębszy problem.

Jak naprawić plik PDF zawierający losowe symbole

W przypadku brakujących czcionek zainstaluj wymaganą czcionkę w systemie. Nazwa czcionki jest podana we właściwościach dokumentu. Wiele czcionek jest dostępnych do bezpłatnego pobrania, a czcionki komercyjne można kupić i zainstalować. Po zainstalowaniu czcionki otwórz ponownie plik PDF. Tekst powinien zostać poprawnie wyświetlony. If installing the font is not practical, open the PDF in a viewer that has better font substitution, such as Adobe Acrobat rather than a browser viewer, or use WukongPDF to re-render the PDF with embedded fonts. The re-rendering process resolves all font references and embeds the actual character shapes, producing a self-contained PDF that will display correctly on any system.

W przypadku uszkodzonych czcionek osadzonych rozwiązaniem jest naprawa lub wymiana danych czcionek. Narzędzie PDF Repair WukongPDF może wykryć uszkodzone strumienie czcionek i podjąć próbę ich odbudowania na podstawie zachowanych danych. Jeśli czcionkę można częściowo odzyskać, narzędzie wyodrębnia nienaruszone fragmenty i rekonstruuje działający podzbiór czcionek. Nie zawsze kończy się to sukcesem. Jeśli uszkodzenie jest rozległe, tekstu może być częściowo lub całkowicie nie do odzyskania, a jedynym rozwiązaniem jest zlokalizowanie oryginalnego dokumentu źródłowego i odtworzenie pliku PDF.

W przypadku rozbieżności w kodowaniu najbardziej niezawodnym rozwiązaniem we wszystkich przypadkach jest wydrukowanie pliku PDF do nowego pliku PDF. Otwórz plik w dowolnej przeglądarce, która wyświetla go poprawnie, nawet jeśli tylko jedna przeglądarka na jednym komputerze renderuje go poprawnie, a następnie użyj funkcji Drukuj do pliku PDF, aby utworzyć nowy plik. Proces drukowania ponownie renderuje każdy znak, korzystając z bieżącego renderowania czcionek systemu, skutecznie wypiekając prawidłowe kształty znaków w nowym pliku PDF jako osadzone dane czcionek. Niezgodność kodowania została rozwiązana, ponieważ nowy plik PDF wykorzystuje standardowe kodowanie z osadzonymi czcionkami. Ta poprawka zachowuje wizualny wygląd tekstu, ale może utracić podstawowe kodowanie znaków, co ma znaczenie, jeśli tekst ma być później przeszukiwalny lub wyodrębniany. W przypadku dokumentów, w których liczy się możliwość przeszukiwania, użyj dedykowanego narzędzia Fix PDF, które naprawia kodowanie, zachowując warstwę tekstową.

Zapobieganie problemom z kodowaniem czcionek w tworzonych plikach PDF

Always embed fonts when creating PDFs. To pojedyncze ustawienie zapobiega większości problemów z bełkotliwym tekstem. W każdej aplikacji eksportującej do formatu PDF, Word, InDesign, Illustrator, PowerPoint istnieje możliwość osadzania czcionek. Znajdź to. Włącz to. Wynikowy plik PDF będzie nieco większy, zazwyczaj od 50 KB do 200 KB na czcionkę, ale będzie poprawnie wyświetlany w każdym systemie i w każdej przeglądarce, teraz i w przyszłości.

Użyj standardowych kodowań. Unikaj niestandardowego kodowania znaków, chyba że masz konkretny powód i rozumiesz konsekwencje. Standardowe kodowanie PDF, WinAnsiEncoding dla alfabetów łacińskich i Identity-H dla Unicode, jest zrozumiałe dla każdej przeglądarki plików PDF. Niestandardowe kodowania mogą być rozumiane przez oprogramowanie, które je utworzyło i nic więcej. Standardowe kodowanie z osadzonymi czcionkami to najbardziej przenośna i niezawodna kombinacja tekstu PDF, który pozostaje czytelny na wszystkich platformach i przez długi czas.

Jeśli w pliku PDF utworzonym przez starszą lub wyspecjalizowaną aplikację, na przykład generator raportów na komputerze mainframe, starszy system księgowy lub moduł wyjściowy instrumentu naukowego, napotkasz bełkotliwy tekst, przyczyną problemu z kodowaniem może być tabela mapowania znaków pliku PDF, a nie brakujące czcionki. Systemy te czasami tworzą pliki PDF, w których tekst jest przechowywany przy użyciu niestandardowego kodowania symboli, które odwzorowuje kody znaków na pozycje glifów w czcionce, a nie na wartości Unicode. Kiedy współczesna przeglądarka próbuje wyodrębnić tekst w formacie Unicode, mapowanie kończy się niepowodzeniem, a wyniki są bełkotliwe. Rozwiązaniem dla tych plików jest użycie narzędzia do naprawy plików PDF, które może wykryć niestandardowe kodowanie i zastąpić je standardowymi mapowaniami Unicode lub wyodrębnić tekst jako surowe kody znaków i odbudować kodowanie na podstawie danych czcionki. Jest to specjalistyczna operacja naprawy wykraczająca poza możliwości zwykłych narzędzi PDF i zazwyczaj wymaga narzędzia z wyraźną obsługą naprawy starszego kodowania.

WukongPDF

Spróbuj naprawić plik PDF

Nie wymaga instalacji. Działa bezpośrednio w Twojej przeglądarce.

Zacznij teraz →