Tips & Tricks

So bearbeiten Sie die strukturelle Lesereihenfolge einer getaggten PDF-Datei, ohne vorhandene Metadaten zur Barrierefreiheit zu entfernen

How to Edit the Structural Reading Order of a Tagged PDF Without Stripping Existing Accessibility Metadata

Wie PDF-Tags die Lesereihenfolge steuern und warum sie unterbrochen wird

Eine ordnungsgemäß strukturierte PDF-Datei ordnet jeden Inhalt, Überschriften, Absätze, Bilder und Tabellen, einer Position in einem logischen Inhaltsbaum zu, der von PDF-Tags verwaltet wird. Die Lesereihenfolge wird durch die Reihenfolge der Knoten in diesem Baum bestimmt, nicht durch die visuelle Position auf der Seite. Wenn ein PDF-Editor Inhalte hinzufügt, entfernt oder neu anordnet, ohne den Tag-Baum zu aktualisieren, weichen die visuelle Reihenfolge und die Tag-Reihenfolge voneinander ab.

Diese Abweichung tritt am häufigsten auf, wenn Seiten aus verschiedenen Quelldokumenten zusammengeführt werden, von denen jedes über ein eigenes Tagging-Schema verfügt. Ein aus drei mit Tags versehenen PDFs zusammengestellter Bericht kann drei separate Tag-Bäume enthalten, die nicht in der richtigen Reihenfolge miteinander verbunden sind. Der Bildschirmleser springt vom Ende des Tag-Baums des ersten Dokuments zum Anfang des zweiten Dokuments und überspringt visuell alle dazwischen liegenden Inhalte. Das Ergebnis ist ein Dokument, das auf dem Bildschirm korrekt aussieht, für die unterstützende Technologie jedoch wie eine unzusammenhängende Folge von Fragmenten gelesen wird.

Eine weitere häufige Ursache sind Inhalte, die nach dem ersten Tagging-Vorgang hinzugefügt werden. Wenn jemand ein Standardbearbeitungstool verwendet, um einen Absatz oder ein Bild in eine mit Tags versehene PDF-Datei einzufügen, platziert der Editor das neue Objekt auf der Seite, registriert es jedoch nicht im vorhandenen Tag-Baum. Der neue Inhalt wird für Screenreader unsichtbar. Unterdessen spiegelt der Tag-Baum immer noch den Status des Dokuments vor der Bearbeitung wider. Über mehrere Bearbeitungszyklen hinweg vergrößert sich die Lücke zwischen dem visuellen Dokument und seiner Tag-Struktur, und jede weitere Bearbeitung erhöht das Risiko einer Nichteinhaltung der Barrierefreiheit.

Die praktischen Folgen von Tag-Reihenfolge-Problemen gehen über Benutzer von Bildschirmleseprogrammen hinaus. Content-Reflow-Engines, die PDF-Layouts für mobile Bildschirme anpassen, sind für die Sequenzierung ebenfalls auf den Tag-Baum angewiesen. Ein Dokument mit der richtigen visuellen Reihenfolge, aber einer durcheinandergebrachten Tag-Reihenfolge wird auf dem Telefonbildschirm zu einem unlesbaren Durcheinander werden, wobei Absätze an scheinbar zufälligen Positionen erscheinen. Suchmaschinen, die PDF-Inhalte indizieren, stützen sich in ähnlicher Weise auf die Tag-Struktur, um die Dokumenthierarchie zu verstehen. Daher können Probleme bei der Tag-Reihenfolge die SEO für öffentlich veröffentlichte PDFs beeinträchtigen.

WukongPDF

Versuchen Sie es mit „PDF bearbeiten“.

Keine Installation erforderlich. Funktioniert direkt in Ihrem Browser.

Jetzt starten →

Der Unterschied zwischen dem Neuanordnen von Tags und dem Neutaggen einer PDF-Datei

Das Neuanordnen vorhandener Tags ist eine gezielte Lösung. Beim Retagging handelt es sich um eine vollständige Neuerstellung. Das Verständnis des Unterschieds entscheidet darüber, ob Sie die bereits in das Dokument investierte Arbeit erhalten oder verlieren.

AspektTags neu anordnenVollständiges Retagging
UmfangPasst die Reihenfolge der vorhandenen Tag-Baumknoten anErstellt den gesamten Tag-Baum von Grund auf neu
Vorhandene MetadatenKonserviert; Alle Alternativtexte, Überschriftenebenen und Tabellenüberschriften bleiben erhaltenVerloren; alles muss manuell neu eingegeben werden
ZeitbedarfMinuten für ein typisches DokumentStunden für ein komplexes Dokument mit mehreren Abschnitten
Risiko für ComplianceNiedrig, wenn mit dem Tag-Baum-Panel fertig istHoch; Ein einziges fehlendes Element verstößt gegen die PDF/UA-Konformität
Am besten fürDokumente, in denen Tags vorhanden sind, deren Reihenfolge jedoch falsch istScans ohne Tags oder vollständig beschädigte Tag-Strukturen
Post-Edit-ValidierungSchneller Check; Nur neu angeordnete Abschnitte müssen überprüft werdenVollständige Dokumentenprüfung erforderlich; Jeder Tag muss verifiziert werden

Die Neuordnung von Tags ist der bevorzugte Ansatz für Dokumente, die bereits über eine funktionale Tag-Struktur verfügen. Das vollständige Neu-Tagging sollte Scans ohne Tags und Dokumenten vorbehalten sein, bei denen der Tag-Baum so beschädigt ist, dass die Neuordnung einzelner Knoten länger dauern würde als ein Neuanfang. Der Hauptunterschied besteht darin, dass bei der Neuordnung benutzerdefinierter Alt-Text auf Bildern, Zuweisungen auf Überschriftenebene, Definitionen des Tabellenkopfbereichs und Sprachattributmarkierungen erhalten bleiben, während beim Neu-Taggen alles gelöscht wird und eine manuelle Neueingabe erforderlich ist.

Tools, die die Neuordnung von Tags ohne Metadatenverlust unterstützen

Nicht jeder PDF-Editor verarbeitet Tag-Bäume sicher. In der folgenden Tabelle werden gängige Werkzeugtypen nach ihrem Tag-Erhaltungsverhalten kategorisiert.

WerkzeugtypZugriff auf den Tag-BaumSicher zum NachbestellenRisikostufe
Dedizierte BarrierefreiheitsprüferVollständiger Lese-/SchreibzugriffJaNiedrig
Professionelle PDF-Suiten (Acrobat Pro)Vollständiger Lese-/SchreibzugriffJa, mit Tag-PanelNiedrig
Browserbasierte EditorenKeinerNEIN; Entfernt beim Speichern alle TagsHoch
Exporteure von Office-SuitenErstellt beim Export neue TagsNicht anwendbar; ersetzt TagsMedium
Open-Source-BefehlszeilentoolsTeilweise gelesen; begrenztes SchreibenBedingtMedium

Browserbasierte PDF-Editoren sind die Kategorie mit dem höchsten Risiko für getaggte Dokumente. Ihre Rendering-Engines analysieren die Tag-Baumstruktur nicht, sodass jeder Speichervorgang von einem browserbasierten Tool den gesamten Tag-Baum ohne Warnung verwirft. Wenn Ihre Organisation browserbasierte Tools für schnelle Bearbeitungen verwendet, legen Sie eine Richtlinie fest, nach der mit Tags versehene Dokumente ausschließlich über Desktop-Anwendungen verarbeitet werden dürfen, die die logische Struktur bewahren.

Schritt-für-Schritt: Tags neu anordnen, ohne die Barrierefreiheit zu beeinträchtigen

Ein systematischer Ansatz zur Neuordnung von Tags verhindert den Verlust von Metadaten, der ein Dokument für Benutzer unterstützender Technologien unbrauchbar macht. Bei den folgenden Schritten wird davon ausgegangen, dass Sie eine mit Tags versehene PDF-Datei mit falscher Lesereihenfolge haben und die Reihenfolge korrigieren müssen, während alle vorhandenen Metadaten zur Barrierefreiheit erhalten bleiben.

Schritt eins: Öffnen Sie das Tag-Navigationsfeld in Ihrem PDF-Editor und erweitern Sie den vollständigen Tag-Baum. Bevor Sie Änderungen vornehmen, exportieren Sie den aktuellen Baum als Referenz oder machen Sie einen Screenshot davon. Diese Sicherung ist wichtig, denn wenn die Neuordnung fehlschlägt, müssen Sie den ursprünglichen Zustand kennen, um die Änderungen rückgängig zu machen. Das Arbeiten ohne Referenzexemplar ist die häufigste Ursache für irreversible Etikettenschäden.

Schritt zwei: Identifizieren Sie genau, welche Knoten nicht in der richtigen Reihenfolge sind. Tags können auf Seitenebene falsch angeordnet sein, wenn eine ganze Seite an der falschen Position erscheint, oder auf Inhaltsebene, wenn einzelne Absätze und Bilder innerhalb einer Seite in der falschen Reihenfolge sind. Eine Fehlordnung auf Inhaltsebene innerhalb einer einzelnen Seite kommt häufiger vor und lässt sich leichter beheben als eine Fehlordnung auf Seitenebene, was häufig auf ein tiefer liegendes strukturelles Problem im Dokumentzusammenstellungsprozess hinweist.

Schritt drei: Ziehen Sie die nicht positionierten Tags per Drag-and-Drop in die richtige Reihenfolge innerhalb der Baumstruktur. Die meisten professionellen Tools unterstützen die direkte Neuanordnung im Tag-Panel. Führen Sie nach jedem Umzug eine schnelle Barrierefreiheitsprüfung durch, um sicherzustellen, dass die Änderung wirksam wurde und keine neuen Probleme verursacht hat. Füllen Sie jeweils einen Abschnitt aus, anstatt das gesamte Dokument auf einmal neu anzuordnen. Dieser inkrementelle Ansatz begrenzt den Umfang eines Fehlers auf einen einzelnen Abschnitt.

Schritt vier: Nachdem Sie alle Abschnitte neu angeordnet haben, führen Sie eine vollständige Validierung der Barrierefreiheit durch. Der Prüfer sollte im Vergleich zum Status vor der Bearbeitung keine neuen Fehler melden. Wenn neue Fehler auftreten, insbesondere fehlender Alt-Text oder fehlerhafte Tabellenkopfzuordnungen, machen Sie den letzten Neuordnungsschritt rückgängig und überprüfen Sie die betroffenen Tags manuell, bevor Sie es erneut versuchen. Ein Validierungsdurchlauf, der neue Fehler einführt, zeigt an, dass ein Tag aus seinem erforderlichen übergeordneten Container verschoben wurde.

Schritt fünf: Testen Sie das neu angeordnete Dokument zusätzlich zur automatischen Validierung mit einem echten Bildschirmlesegerät. Automatisierte Tools überprüfen die strukturelle Korrektheit. Nur ein Live-Screenreader-Test bestätigt, dass die Lesereihenfolge für einen menschlichen Zuhörer natürlich klingt. Spielen Sie das gesamte Dokument in normaler Geschwindigkeit durch und notieren Sie sich alle Abschnitte, in denen der Kommentar unerwartet springt, sich wiederholt oder den Inhalt überspringt.

Häufige Fehler bei der Neuordnung von Tags, die Metadaten beschädigen

Mehrere Fehler bei der Tag-Neuordnung können dazu führen, dass Metadaten zur Barrierefreiheit stillschweigend entfernt werden, ohne dass Fehlermeldungen ausgelöst werden. Das Bewusstsein für diese Fallstricke verringert das Risiko unentdeckter Compliance-Verstöße.

Durch Ziehen eines Inhaltselements außerhalb seines übergeordneten Containerknotens wird die Hierarchiebeziehung unterbrochen. Ein Absatz-Tag muss innerhalb des übergeordneten Abschnitts- oder Artikel-Tags bleiben. Wenn Sie es versehentlich auf die Stammebene ziehen, wird die Dokumentstruktur flacher und Bildschirmleser verlieren die Möglichkeit, abschnittsweise zu navigieren. Stellen Sie immer sicher, dass jedes Inhalts-Tag nach der Neuordnung in seinem richtigen übergeordneten Element verschachtelt bleibt.

Ein weiterer häufiger Fehler besteht darin, Tabellenzellen einzeln neu anzuordnen, anstatt die gesamte Tabellenzeile zu verschieben. PDF-Tabellen-Tags verwenden eine strikte Hierarchie: Tabelle enthält TableRow enthält TableDataCell. Durch das Verschieben einer einzelnen Zelle aus dieser Struktur wird die Tabellenzuordnung für Bildschirmleseprogramme aufgehoben. Verschieben Sie beim Neuanordnen von Tabelleninhalten immer komplette Zeilen oder die gesamte Tabellenstruktur als Einheit.

Das Ignorieren von Artefakt-Tags während der Neuordnung führt zu falschen Ergebnissen bei Barrierefreiheitsprüfungen. Artefakt-Tags kennzeichnen dekorative Inhalte, fortlaufende Überschriften und Seitenzahlen, die vor Bildschirmleseprogrammen verborgen bleiben sollen. Wenn durch die Neuordnung versehentlich ein Artefakt zu einem Inhalts-Tag heraufgestuft wird, liest der Screenreader Seitenzahlen und dekorative Elemente in der Mitte der Absätze laut vor, was das Hörerlebnis erheblich beeinträchtigt.

Überprüfen der Lesereihenfolge nach der Tag-Neuordnung

Die Überprüfung nach der Nachbestellung sollte sowohl automatisierte als auch manuelle Methoden verwenden. Automatisierte Prüfer bestätigen die strukturelle Gültigkeit, können jedoch nicht beurteilen, ob die Lesereihenfolge natürlich klingt. Verwenden Sie die integrierte Vorlesefunktion in Ihrem PDF-Viewer oder einen speziellen Bildschirmleser im Testmodus, um das gesamte Dokument von Anfang bis Ende anzuhören.

Testen Sie nach Möglichkeit mit zwei verschiedenen Screenreader-Anwendungen. JAWS und NVDA unter Windows oder VoiceOver auf dem Mac analysieren Tag-Bäume mit geringfügigen Unterschieden in der Art und Weise, wie sie mit mehrdeutigen Tag-Strukturen umgehen. Ein Dokument, das in einem Screenreader korrekt gelesen wird, kann in einem anderen dennoch Bestellprobleme aufweisen. Leserübergreifende Tests sind die beste Möglichkeit, Grenzfälle zu erkennen, bevor das Dokument den Endbenutzer erreicht.

Für große Organisationen, die regelmäßig mit getaggten PDFs arbeiten, unterstützen die Bearbeitungstools von WukongPDF tagerhaltende Arbeitsabläufe, mit denen Sie Inhalte ändern und Seiten neu anordnen können, ohne die Barrierefreiheitsstruktur zu beeinträchtigen. Dieser Ansatz vermeidet den manuellen Neuordnungsschritt für neue Dokumente vollständig, reduziert das Risiko eines Metadatenverlusts während des Dokumentlebenszyklus und stellt sicher, dass jede bearbeitete Datei von der Erstellung bis zur endgültigen Verteilung den Barrierefreiheitsstandards entspricht. Teams, die die tagerhaltende Bearbeitung von Anfang an übernehmen, verbringen deutlich weniger Zeit mit der Verbesserung der Barrierefreiheit als Teams, die Tags nachträglich in bearbeitete Dokumente einbauen.

WukongPDF

Versuchen Sie es mit „PDF bearbeiten“.

Keine Installation erforderlich. Funktioniert direkt in Ihrem Browser.

Jetzt starten →