Het vertalen van een technische handleiding van 200 pagina's van de ene taal naar de andere is niet hetzelfde als het vertalen van een brief van 2 pagina's. De lengte introduceert uitdagingen die korte documenten nooit aan het licht brengen: consistentie van terminologie over honderden pagina's, behoud van de kophiërarchie en kruisverwijzingen, het omgaan met figuren en tabellen met ingebedde tekst, en de enorme verwerkingstijd die nodig is om een document te vertalen dat maanden in beslag nam.
Lange documenten versterken elke vertaalonvolkomenheid. Een term die inconsistent is vertaald op pagina 7 en pagina 143 brengt de lezer in verwarring.
Een Translate PDF-workflow voor lange documenten vereist het opsplitsen van de taak in beheersbare secties, het opstellen van een terminologiewoordenlijst vóór het vertalen, en het verifiëren van de consistentie tussen secties na het opnieuw samenstellen. De PDF Converter van WukongPDF verzorgt de extractiestap, en de onderstaande workflow behandelt de unieke uitdagingen die lengte met zich meebrengt.

Waarom lange documenten een andere vertaalaanpak nodig hebben
Korte documenten kunnen in één keer worden vertaald. De vertaler kan de context van het hele document in zijn hoofd houden, onthouden hoe een specifieke term op pagina 1 is vertaald en deze consequent toepassen op pagina 3. Een handleiding van 200 pagina's tart deze aanpak. Geen enkele menselijke vertaler kan elke termvertaling over 200 pagina's onthouden. Geen enkel machinevertaalsysteem kan een perfecte consistentie handhaven zonder dat een terminologiedatabase de juiste vertaling voor elke domeinspecifieke term levert.
Lange documenten hebben doorgaans ook een complexe interne structuur. Kruisverwijzingen die zeggen: zie Paragraaf 4.2 moeten worden bijgewerkt zodat ze overeenkomen met de vertaalde sectienummering als deze verandert. Inhoudsopgaven moeten opnieuw worden gegenereerd om de vertaalde koptekst weer te geven. Indexgegevens moeten opnieuw worden vertaald en de paginanummers moeten worden bijgewerkt. Deze structurele elementen vereisen postvertaalwerk dat bij korte documenten zelden nodig is.
Probeer PDF vertalen
Geen installatie nodig. Werkt rechtstreeks in uw browser.
Een terminologiewoordenlijst samenstellen voordat u begint
Haal elke unieke technische term, productnaam en domeinspecifieke zin uit het brondocument voordat u iets vertaalt. Definieer voor elke term de goedgekeurde vertaling. Deel deze woordenlijst met elke vertaler of vertaaltool die aan het document zal werken. De verklarende woordenlijst is de enige bron van waarheid die inconsistentie voorkomt. Een term die 50 keer op 200 pagina's voorkomt, wordt alle 50 keer op dezelfde manier vertaald omdat de woordenlijst dit afdwingt.
Het bouwen van de woordenlijst duurt een paar uur voor een lang document en betaalt zich terug in de consistentie op elke vertaalde pagina. Voor documenten die in toekomstige versies zullen worden bijgewerkt en opnieuw vertaald, dient u de woordenlijst als een levend document te bewaren. Voeg nieuwe termen toe zoals ze verschijnen in updates. Verwijder termen die zijn verwijderd. De woordenlijst wordt een institutioneel bezit dat elke volgende vertaling van gerelateerde documenten verbetert.
Het document splitsen voor parallelle vertaling
Splits de PDF in secties die onafhankelijk en parallel kunnen worden vertaald. Hoofdstukgrenzen zijn natuurlijke splitsingspunten. Een handleiding van 200 pagina's met 15 hoofdstukken wordt 15 vertaaleenheden. Meerdere vertalers of vertaaltools kunnen tegelijkertijd aan verschillende hoofdstukken werken, waardoor de totale vertaaltijd van weken naar dagen wordt teruggebracht. De woordenlijst zorgt ervoor dat de onafhankelijk vertaalde hoofdstukken consistente terminologie gebruiken wanneer ze opnieuw worden samengesteld.
Nummer elke sectie duidelijk en houd bij welke secties in uitvoering zijn, voltooid en geverifieerd. Een eenvoudige spreadsheet met sectienummer, paginabereik, gebruikte vertaler of tool, status en verificatiedatum houdt de parallelle workflow georganiseerd. Wanneer alle secties voltooid en geverifieerd zijn, voegt u ze weer samen in één vertaalde PDF. Bij de samenvoegstap moeten de oorspronkelijke paginavolgorde en sectienummering behouden blijven.
| Documentelement | Vertaaluitdaging | Oplossing |
|---|---|---|
| Technische terminologie | Inconsistente vertaling tussen hoofdstukken | Woordenlijst afgedwongen door alle vertalers |
| Kruisverwijzingen | Sectienummers kunnen in de vertaling veranderen | Update kruisverwijzingen nadat de vertaling is voltooid |
| Figuren met ingesloten tekst | Tekst in afbeeldingen die niet door standaardtools wordt geëxtraheerd | Extraheer figuurtekst afzonderlijk, overlay-vertalingen |
| Inhoudsopgave | Paginanummers verschuiven in de vertaalde versie | Regenereer TOC nadat alle secties zijn geassembleerd |
| Indexvermeldingen | Termen en paginanummers veranderen beide | Index opnieuw opbouwen op basis van vertaalde inhoud |
Omgaan met cijfers, tabellen en ingesloten tekst
Standaard PDF-tekstextractie legt hoofdtekst, kopteksten en tabelcelinhoud vast. Tekst ingebed in figuren, labels op diagrammen en toelichtingen op illustraties worden vaak gemist omdat deze bestaan als vectorafbeeldingen of rasterafbeeldingen, en niet als selecteerbare teksttekens. Voor documenten waarin figuurtekst een kritische betekenis heeft, extraheert u de figuren als afbeeldingen, vertaalt u de zichtbare tekst en legt u de vertalingen als tekstvakken over de figuurafbeeldingen in het vertaalde document.
Deze stap voor het vertalen van cijfers is het meest arbeidsintensieve deel van het vertalen van een lang technisch document en wordt het vaakst overgeslagen. Een vertaalde handleiding waarbij de hoofdtekst in het Frans is, maar elk diagramlabel in het Engels blijft, is slechts gedeeltelijk vertaald. Budgettijd voor het vertalen van cijfers evenredig aan de mate waarin het document afhankelijk is van diagrammen. Een technisch handboek dat via tekeningen communiceert, heeft meer vertaaltijd nodig dan een beleidsdocument dat via tekst communiceert.
Vertaalgeheugen gebruiken voor consistentie en efficiëntie
Vertaalgeheugen (TM) is een database waarin eerder vertaalde zinsparen worden opgeslagen. Wanneer het TM een zin tegenkomt die lijkt op een zin die hij eerder heeft gezien, suggereert hij de vorige vertaling. Voor lange documenten met repetitieve inhoud, standaardzinnen, terugkerende waarschuwingen en herhaalde sectie-introducties kan TM 30-50% van het document automatisch vertalen met resultaten van menselijke kwaliteit, omdat die zinnen al eerder in hetzelfde document zijn vertaald.
TM-tools zoals SDL Trados, memoQ en OmegaT kunnen worden geïntegreerd met zowel menselijke vertaalworkflows als automatische vertaalsystemen. Voor een lang documentvertaalproject stelt u het TM aan het begin in en eist u dat alle vertalers het gebruiken. Het TM groeit naarmate het project vordert, en latere secties profiteren van de vertalingen die in eerdere secties zijn vastgelegd. Het consistentievoordeel is net zo waardevol als het efficiëntievoordeel. TM zorgt ervoor dat een standaardzin vertaald op pagina 12 identiek wordt verwoord op pagina 187.
Het vertaalde document opnieuw samenstellen en verifiëren
Nadat alle secties zijn vertaald en samengevoegd, leest u het volledige vertaalde document van begin tot eind. Deze verificatiepas spoort inconsistenties in de terminologie op die de woordenlijst had moeten voorkomen, maar soms niet deed, opmaakproblemen die door verschillende vertalers met verschillende tools zijn geïntroduceerd, en structurele problemen zoals gebroken kruisverwijzingen of verkeerd genummerde secties.
Laat de eindbeoordeling uitvoeren door een moedertaalspreker van de doeltaal die ook bekend is met het onderwerp van het document. Een algemeen vertaler kan grammaticaal correcte teksten produceren. Een materiedeskundige kan verifiëren dat de vertaalde tekst de juiste betekenis heeft. Het verschil tussen grammaticaal correct en technisch correct is de kloof tussen een bruikbare vertaling en een vertaling die dure misverstanden veroorzaakt.
De vertaling behouden voor toekomstige documentupdates
Wanneer het brondocument is bijgewerkt, mag u niet het hele document opnieuw vertalen. Identificeer welke secties zijn gewijzigd en vertaal alleen die. De ongewijzigde secties zijn overgenomen uit de vorige vertaling. Deze stapsgewijze aanpak vermindert de kosten en tijd van elke volgende vertaalcyclus. De woordenlijst blijft fungeren als terminologieautoriteit voor alle documentversies.
Archiveer het vertaalde document samen met het vertaalgeheugen en de woordenlijst. Wanneer de volgende versie arriveert, stelt het vertaalgeheugen vertalingen voor voor zinnen die lijken op eerder vertaalde zinnen. De vertaler of tool vertaalt alleen echt nieuwe inhoud. Bij meerdere versies wordt het vertaalgeheugen waardevoller omdat een steeds groter percentage van het document overeenkomt met eerder vertaalde inhoud. De eerste vertaling van een lang document is duur. Elke volgende update is goedkoper omdat het vertaalgeheugen het werk voortzet.
Probeer PDF vertalen
Geen installatie nodig. Werkt rechtstreeks in uw browser.
