Een PDF-producthandleiding is een op zichzelf staand document. Een onderling verbonden set HTML-pagina's is een navigeerbare website. Door de eerste naar de laatste te converteren, wordt de inhoud vindbaar via zoekmachines, toegankelijk op elk apparaat met een browser en gemakkelijk bijgewerkt zonder het hele document opnieuw te genereren. Bij de conversie van PDF Export naar HTML blijft de inhoud behouden en wordt web-native navigatie toegevoegd die een statische PDF niet kan bieden.
De conversie omvat meer dan alleen het opslaan van de PDF als HTML. Elk hoofdstuk of hoofdgedeelte wordt zijn eigen HTML-pagina. Interne kruisverwijzingen worden hyperlinks tussen pagina's. De inhoudsopgave wordt een navigatiezijbalk of menu. Paginanummers worden vervangen door benoemde ankers. Het resultaat is een documentatiewebsite die is ontstaan als pdf-handleiding.
De Web naar PDF-tools van WukongPDF werken bidirectioneel en ondersteunen zowel het genereren van PDF's op basis van webinhoud als de webklare export van PDF's.

De HTML-structuur plannen vanuit de PDF
Voordat u gaat converteren, wijst u de PDF-structuur toe aan een webstructuur. Bepaal waar elke HTML-pagina zal beginnen en eindigen. Een PDF-handleiding van 100 pagina's met 10 hoofdstukken wordt ongeveer 10 tot 12 HTML-pagina's, waarbij de inleiding, elk hoofdstuk en de bijlagen als afzonderlijke pagina's bestaan. De mapping zorgt ervoor dat de conversie een logische webnavigatiestructuur oplevert in plaats van één HTML-bestand per PDF-pagina.
Identificeer de interne kruisverwijzingen in de PDF die hyperlinks zullen worden. Een zin die u leest, zie Hoofdstuk 5 voor details in de PDF, wordt een klikbare link naar de HTML-pagina van Hoofdstuk 5. De inhoudsopgaven worden navigatielinks. De indexitems worden koppelingen naar de secties waarnaar wordt verwezen. Door deze kruisverwijzingsstructuur tijdens de conversie te behouden, blijft de bruikbaarheid van het document behouden.
Probeer PDF naar Word
Geen installatie nodig. Werkt rechtstreeks in uw browser.
Methode 1: Exporteren naar HTML via Microsoft Word
Converteer de PDF naar Word-indeling met behulp van de functie Exporteren naar Word van Acrobat Pro of een online converter. Open de resulterende DOCX in Microsoft Word. Gebruik de kopstijlen van Word om een consistente kophiërarchie in het hele document te garanderen. Elke kop 1 wordt een potentieel breekpunt voor een HTML-pagina.
Ga in Word naar Bestand, Opslaan als en kies Webpagina, gefilterd in de vervolgkeuzelijst voor indelingen. De gefilterde HTML-optie produceert schonere HTML zonder de Office-specifieke opmaak die de standaard webpagina-optie opblaast. Word slaat het document op als één HTML-bestand met ingesloten afbeeldingen. Voor uitvoer van meerdere pagina's splitst u het Word-document op in afzonderlijke bestanden per hoofdstuk en slaat u ze allemaal op als HTML.
Methode 2: speciale PDF-naar-HTML-converters
Verschillende tools zijn gespecialiseerd in het converteren van PDF's naar gestructureerde HTML. De optie Exporteren naar HTML van Adobe Acrobat Pro onder Bestand, Exporteren levert behoorlijke resultaten op voor eenvoudige lay-outs. De uitvoer behoudt de tekstopmaak, de plaatsing van afbeeldingen en de basistabelstructuren. Links binnen de PDF worden geconverteerd naar HTML-hyperlinks.
Voor complexere PDF's produceren gespecialiseerde conversieservices en open-sourcetools zoals pdf2htmlEX een uitvoer met hogere betrouwbaarheid. pdf2htmlEX converteert elke PDF-pagina naar een HTML-pagina met nauwkeurig gepositioneerde tekst en afbeeldingen, waarbij de exacte visuele lay-out behouden blijft. Het nadeel is dat de HTML op de lay-out is gericht in plaats van semantisch gestructureerd, waardoor het moeilijker te bewerken en te onderhouden is dan HTML die is opgebouwd uit gestructureerde inhoud.
Methode 3: Handmatig HTML opnieuw opbouwen voor de beste kwaliteit
Als het om documentworkflows gaat, levert het extraheren van de inhoud en het opnieuw opbouwen ervan in HTML het beste resultaat op voor een handleiding waarbij kwaliteit en onderhoudbaarheid van belang zijn. Extraheer alle tekst uit de PDF met behulp van de technieken die worden beschreven in het hoofdstuk over schone alinea-extractie. Extraheer alle afbeeldingen met hun volledige resolutie. Gebruik een statische sitegenerator of een eenvoudige HTML-sjabloon om de pagina's samen te stellen.
In de praktijk kost de handmatige herbouwaanpak in eerste instantie meer tijd, maar levert HTML op die schoon, semantisch en gemakkelijk bij te werken is. Wanneer het product verandert en de handleiding moet worden herzien, gaat het bewerken van een goed gestructureerde HTML-pagina sneller dan het opnieuw exporteren en opnieuw converteren van de hele PDF. De initiële investering in schone HTML betaalt zich terug tijdens elke volgende updatecyclus.
Internavigatie tussen pagina's creëren
Nadat u elke sectie naar een eigen HTML-pagina heeft geconverteerd, bouwt u de navigatie tussen pagina's op. Voeg de links Vorige en Volgende toe aan de boven- en onderkant van elke pagina. Bouw een navigatiezijbalk op basis van de inhoudsopgave. Voeg broodkruimelnavigatie toe die de huidige paginapositie in de documenthiërarchie toont.
Als we dit praktisch bekijken, verandert de inter-navigatie in de praktijk een verzameling op zichzelf staande HTML-pagina's in een samenhangend webdocument. Een lezer die vanuit een zoekmachineresultaat op een pagina terechtkomt, kan naar aangrenzende pagina's navigeren zonder terug te keren naar de zoekresultaten. De navigatiestructuur respecteert de reis van de lezer door de inhoud.
De geconverteerde HTML in de loop van de tijd behouden
De geconverteerde HTML-pagina's zijn levende documenten die moeten worden bijgewerkt wanneer de bron-PDF verandert. Zet een proces op voor het synchroniseren van updates. Wanneer de PDF-handleiding is herzien, identificeert u welke secties zijn gewijzigd en werkt u alleen die HTML-pagina's bij in plaats van de hele site opnieuw te genereren.
Bewaar de HTML-bron in versiebeheer naast de PDF-bron. Elke revisie van beide formaten wordt bijgehouden en de relatie tussen PDF-secties en HTML-pagina's wordt gedocumenteerd. De versiebeheerrepository fungeert als de enige bron van waarheid voor zowel de PDF- als de HTML-versie van de handleiding.
Door een PDF-handleiding om te zetten in onderling gekoppelde HTML-pagina's wordt het bereik van het document uitgebreid naar internetzoekopdrachten, mobiele apparaten en gebruikers die de voorkeur geven aan browsergebaseerd lezen. De conversie is een eenmalige investering die zorgt voor een voortdurende aanwezigheid op het internet voor inhoud die voorheen alleen als downloadbaar bestand bestond.
| Conversiebenadering | Inspanning | Uitvoerkwaliteit |
|---|---|---|
| Exporteren naar HTML via Word | Laag | Schoon, maar kan complexe opmaak verliezen |
| Speciale PDF-naar-HTML-tool | Medium | Goed lay-outbehoud |
| Handmatig opnieuw opbouwen in HTML | Hoog | Beste kwaliteit, meeste controle |
Als het om documentworkflows gaat, overbrugt de conversie van PDF naar HTML voor productdocumentatieteams de kloof tussen printgeoriënteerde auteursworkflows en de webgebaseerde levering die moderne gebruikers verwachten. De PDF blijft de gezaghebbende gedrukte versie. De HTML biedt de toegankelijke, doorzoekbare, koppelbare webversie.
De geconverteerde HTML responsief maken voor mobiele apparaten
Bij de meeste tools maakt de initiële HTML-uitvoer van een PDF-conversie doorgaans gebruik van lay-outs met een vaste breedte die overeenkomen met de afmetingen van de PDF-pagina. Op telefoons en tablets werkt dit niet goed. Voeg na de conversie responsieve CSS toe die de inhoud opnieuw plaatst voor verschillende schermbreedtes. Een eenvoudige responsieve wrapper met een maximale breedte en flexibele afbeeldingen past de geconverteerde inhoud aan mobiele schermen aan.
Responsief ontwerp is een van de belangrijkste voordelen van HTML ten opzichte van PDF voor het leveren van inhoud. Een PDF die op een telefoon wordt bekeken, vereist knijpen en zoomen om te kunnen lezen. Een HTML-pagina met responsief ontwerp herformatteert tekst automatisch naar een leesbaar formaat. De responsieve conversiestap voegt waarde toe naast de basisformaatconversie.
Metagegevens van zoekmachines verbeteren de vindbaarheid van geconverteerde HTML-pagina's:
Normaal gesproken profiteren de geconverteerde HTML-pagina's van metagegevens die niet nodig waren in de PDF. Voeg title-tags, metabeschrijvingen en Open Graph-tags toe aan elke pagina. De HTML-titel moet overeenkomen met de sectiekop. De metabeschrijving moet de sectie-inhoud samenvatten in 150 tot 160 tekens. Deze toevoegingen maken de geconverteerde inhoud vindbaar via zoekmachines.
Voor documentatiesets met meerdere pagina's voegt u een sitemap.xml-bestand toe met daarin alle HTML-pagina's. Dien de sitemap in bij zoekmachines. Interne links tussen pagina's moeten beschrijvende ankertekst gebruiken die relevante trefwoorden bevat. De SEO-toevoegingen transformeren de geconverteerde HTML van een statische documentdump in een voor zoekopdrachten geoptimaliseerde webbron.
Omgaan met afbeeldingen en afbeeldingen tijdens HTML-conversie
Afbeeldingen die in de PDF zijn ingesloten, moeten worden uitgepakt en opgeslagen als afzonderlijke afbeeldingsbestanden voor de HTML-pagina's. Acrobat Pro Export to HTML extraheert afbeeldingen automatisch en plaatst ze in een submap. De HTML verwijst naar de afbeeldingen met relatieve paden. Zorg ervoor dat de afbeeldingsmap met de HTML-bestanden meegaat bij het uploaden naar een webserver.
Bij documentverwerking is de beeldkwaliteit van PDF-extractie voor handleidingen met diagrammen, schermafbeeldingen of foto's over het algemeen voldoende voor weergave op het web. PDF-afbeeldingen hebben doorgaans een afdrukresolutie, die hoger is dan nodig is voor schermen. De HTML-export kan afbeeldingen automatisch downsamplen. Controleer de resolutie van de uitvoerafbeelding en pas de exportinstellingen aan als afbeeldingen korrelig of te groot lijken.
In de regel bedient de onderling gekoppelde HTML-versie van een pdf-handleiding een publiek dat met de pdf alleen niet kan worden bereikt. Gebruikers van zoekmachines die via een zoekopdracht een specifiek gedeelte vinden. Mobiele lezers die responsieve tekst nodig hebben. Gebruikers met ondersteunende technologie die beter werkt met HTML dan met PDF. De HTML-versie vergroot het bereik van het document zonder de PDF te vervangen als de gezaghebbende gedrukte versie.
Met betrekking tot documentatie die zowel het gedrukte als het webpubliek bedient, biedt het behouden van de PDF als master en het genereren van HTML als distributieformaat het beste van twee werelden. De PDF behoudt de afdrukgetrouwheid. De HTML biedt webtoegankelijkheid. Beide komen voort uit dezelfde gezaghebbende inhoud.
Wat de documentworkflows betreft, produceert de hier beschreven PDF-naar-HTML-conversieworkflow voor de meeste documenten uitvoer die zowel menselijke lezers als zoekmachines dient. De HTML-versie is vindbaar, navigeerbaar en toegankelijk op manieren die het PDF-origineel niet kan evenaren. De twee formaten vullen elkaar aan, waarbij de PDF als gezaghebbende versie dient en de HTML als toegankelijk distributieformaat.
Wat de documentatieteams betreft, voldoet het aanbieden van inhoud in zowel PDF- als HTML-formaten aan de behoeften van alle gebruikers: degenen die liever downloaden en afdrukken, en degenen die liever online lezen en zoeken. De benadering met twee formaten maximaliseert de toegankelijkheid en het bereik van documentatie-inhoud voor alle doelgroepvoorkeuren, van degenen die moeten afdrukken en annoteren tot degenen die online zoeken en lezen.
Probeer PDF naar Word
Geen installatie nodig. Werkt rechtstreeks in uw browser.
