Others

Kunt u de originele tekstlaag behouden bij het vertalen van een PDF?

Bij het vertalen van een PDF wordt doorgaans de originele tekst vervangen door de vertaalde versie. De brontaaltekst is verdwenen uit de uitvoer. Voor sommige gebruikssituaties is het waardevol om de originele tekst als verborgen laag naast de vertaling te behouden. Een tweetalige lezer kan de vertaling vergelijken met het origineel. Een toekomstige vertaler kan zien wat de brontekst was zonder het originele document te lokaliseren. En een zoekmachine kan beide talen indexeren, waardoor het document in beide talen vindbaar wordt. De vraag is of Translate PDF-tools de originele tekstlaag tijdens de vertaling kunnen behouden, en onder welke voorwaarden dit mogelijk is.

Belangrijkste punten

De meeste PDF-vertaalhulpmiddelen vervangen de originele tekst door de vertaalde versie. Om de originele tekst als een verborgen laag te behouden, is een tool nodig die tweetalige of parallelle uitvoer ondersteunt, waarbij de originele tekst wordt opgeslagen als een onzichtbare laag onder de vertaalde tekst. Deze functie is beschikbaar in sommige professionele vertaalhulpmiddelen, maar is niet standaard in PDF-vertalers van consumentenkwaliteit. Een alternatieve aanpak is om een kopie van de PDF te vertalen en het origineel als afzonderlijk referentiedocument te bewaren.

Can You Keep the Original Text Layer When Translating a PDF

Hoe PDF-tekstlagen werken tijdens vertaling

Bij de tekstextractiestap ligt de meeste complexiteit. Het vertaalhulpmiddel moet niet alleen de zichtbare tekst extraheren, maar ook de exacte positie, lettertype-eigenschappen en codering voor elk teken registreren. Bij het terugplaatsen van de vertaalde tekst heeft de tool de positiegegevens van de originele tekst nodig om de nieuwe tekst correct uit te lijnen. Een tool die de originele tekst als een verborgen laag bewaart, moet twee volledige sets tekstgegevens opslaan en hun gelaagdheid beheren. Dit verdubbelt grofweg de werklast voor tekstverwerking, en daarom bieden veel tools deze functie niet. De technische mogelijkheden bestaan in de PDF-specificatie. De beperking zit in de implementatie van het hulpmiddel, niet in het formaat.

Een PDF slaat tekst op als tekencodes in inhoudsstromen. Wanneer een vertaalprogramma de PDF verwerkt, extraheert het deze tekencodes, wijst deze toe aan leesbare tekst, stuurt de tekst naar een vertaalprogramma en plaatst de vertaalde tekst terug in het document. De standaardworkflow vervangt de originele tekencodes door de vertaalde codes. De originele tekst is uit het bestand verdwenen. Er is geen ongedaan maken. Om de originele tekst te behouden, moet het vertaalhulpmiddel een tweede tekstlaag maken die de brontaal bevat, deze markeren als verborgen of niet-afdrukbaar en de vertaalde tekst in de zichtbare laag plaatsen. Dit is technisch mogelijk, maar vereist dat de vertaaltool gedurende het hele proces dubbele tekstlagen beheert.

De PDF-specificatie ondersteunt optionele inhoudsgroepen, gewoonlijk PDF-lagen genoemd, die onafhankelijk kunnen worden weergegeven of verborgen. Een vertaalhulpmiddel kan de originele tekst in de ene laag plaatsen en de vertaalde tekst in een andere laag, waarbij de originele laag standaard op verborgen is ingesteld. Lezers die de originele tekst willen zien, kunnen de zichtbaarheid van de laag in hun PDF-viewer wijzigen. Deze aanpak bewaart beide talen in één enkel bestand en geeft de lezer controle over welke taal zichtbaar is. De technische mogelijkheden bestaan in het PDF-formaat. De vraag is of een bepaald vertaalhulpmiddel dit implementeert.

WukongPDF

Probeer PDF vertalen

Geen installatie nodig. Werkt rechtstreeks in uw browser.

Nu beginnen →

Vertaalhulpmiddelen die het behoud van originele tekst ondersteunen

Professionele vertaalplatforms die door lokalisatiebureaus worden gebruikt, ondersteunen vaak tweetalige PDF-uitvoer. Deze tools zijn ontworpen voor workflows waarbij een revisor de vertaling moet vergelijken met de brontekst. De uitvoer-PDF bevat beide taallagen en de revisor kan tussen deze lagen schakelen of ze naast elkaar bekijken in een gespecialiseerde revisie-interface. Deze tools zijn doorgaans gebaseerd op abonnementen en zijn ontworpen voor commercieel vertaalwerk met grote volumes in plaats van incidentele documentvertalingen.

Voor consumenten en kleinzakelijke gebruikers zijn de mogelijkheden beperkter. Sommige online PDF-vertaaldiensten bieden een zij-aan-zij uitvoerformaat waarbij de originele en vertaalde tekst in afwisselende alinea's of in een lay-out met twee kolommen verschijnen. Hierdoor blijven beide talen zichtbaar in plaats van dat er één als laag wordt verborgen. Het document is langer, maar beide talen zijn toegankelijk zonder wisselen van laag. De vertaaltool van WukongPDF ondersteunt een zij-aan-zij uitvoermodus waarbij de originele en vertaalde alinea's naast elkaar worden geplaatst, waardoor beide talen in één leesbaar document behouden blijven.

Alternatief: Bewaar de originele PDF als referentie

Voor teams die tweetalige versies van documenten gedurende meerdere revisiecycli moeten onderhouden, werkt een documentbeheeraanpak beter dan een aanpak met één bestand. Bewaar de originele en vertaalde PDF's in een versiebeheerde opslagplaats met een naamgevingsconventie die ze aan elkaar koppelt. Wanneer het originele document wordt bijgewerkt, maakt de naamgevingsconventie duidelijk welke vertaling moet worden bijgewerkt om overeen te komen. Deze workflow is betrouwbaarder dan één tweetalige PDF voor documenten die in de loop van de tijd veranderen.

Wanneer de vertaaltool geen uitvoer in twee talen ondersteunt, is de eenvoudigste workflow het vertalen van een kopie van de PDF en het bewaren van het origineel als afzonderlijk referentiebestand. Geef de bestanden een consistente naam, zodat de relatie ertussen duidelijk is. Een naamgevingsconventie zoals report-2025-en.pdf voor de Engelse vertaling en report-2025-fr-original.pdf voor het Franse origineel maakt de relatie duidelijk voor iedereen die door de map bladert. Bewaar beide bestanden op dezelfde locatie en verwijs naar de originele bestandsnaam in de metagegevens van het vertaalde document of in een notitie op het voorblad.

Voor archiveringsdoeleinden is het origineel-plus-vertaling-paar vaak de meest betrouwbare benadering. Elk bestand is een standaard-PDF die elke lezer kan openen. Er is geen afhankelijkheid van instellingen voor de zichtbaarheid van lagen of gespecialiseerde weergavetools. Het tweetal bestanden documenteert zowel de brontekst als de vertaling in een formaat dat tientallen jaren toegankelijk zal blijven. Deze aanpak is misschien niet zo elegant als een enkele tweetalige pdf, maar is op de lange termijn wel betrouwbaarder.

Controleren of de originele tekstlaag intact is

Voer een tekstextractietest uit op de tweetalige PDF. Haal alle tekst uit het document en zoek naar een onderscheidend woord of zin uit de originele taal. Als het in de geëxtraheerde tekst verschijnt, is de originele laag aanwezig en correct gecodeerd. Als de geëxtraheerde tekst alleen de vertaalde taal bevat, ontbreekt de originele laag of is deze niet gecodeerd als extraheerbare tekst. Met deze test worden coderingsfouten opgespoord die bij visuele inspectie van het lagenpaneel over het hoofd zouden worden gezien.

Als uw vertaalprogramma beweert de originele tekst als een verborgen laag te behouden, verifieer dit dan voordat u erop vertrouwt. Open de vertaalde PDF in een viewer die het schakelen tussen lagen ondersteunt, zoals Adobe Acrobat Pro. Zoek naar een lagenpaneel in het navigatiedeelvenster. Als het gereedschap de originele tekstlaag correct heeft gemaakt, wordt deze weergegeven als een benoemde laag met een zichtbaarheidsschakelaar. Schakel de laag in en uit om te bevestigen dat de originele tekst verschijnt en verdwijnt zoals verwacht. Voer een tekstzoekopdracht uit naar een woord waarvan u weet dat het in het origineel voorkomt, maar in de vertaling is gewijzigd. Als de zoekopdracht het oorspronkelijke woord vindt, is de laag aanwezig en doorzoekbaar.

Controleer ook de bestandsgrootte van de tweetalige PDF ten opzichte van de grootte van een standaard vertaalde versie. Een PDF met dubbele tekstlagen zal ongeveer 10 tot 30 procent groter zijn dan een versie in één taal, afhankelijk van de hoeveelheid tekst. Een tweetalige PDF die even groot is als een standaardvertaling bevat waarschijnlijk niet de originele tekstlaag, ongeacht wat de documentatie van het hulpprogramma beweert. Het verschil in bestandsgrootte is een snelle en betrouwbare controle.

Veelgestelde vragen

Zal de verborgen originele tekstlaag de bestandsgrootte aanzienlijk vergroten? De toename is evenredig met de hoeveelheid tekst, doorgaans 15 tot 30 procent voor documenten met veel tekst. Voor documenten met veel afbeeldingen waarbij de tekst een klein deel van de totale bestandsgrootte uitmaakt, is de toename verwaarloosbaar. De tweelaagsbenadering voegt een tweede kopie toe van de tekstgegevens en de metagegevens van het laagbeheer, maar er worden geen afbeeldingen, lettertypen of paginastructuur gedupliceerd. Voor archiefgebruik is de gematigde toename van de bestandsgrootte een redelijke afweging voor tweetalige toegankelijkheid.

Heeft het behoud van de originele tekstlaag invloed op de doorzoekbaarheid van de PDF?

Ja, positief. Als beide taallagen aanwezig zijn, is de PDF in beide talen doorzoekbaar. Een gebruiker die naar een term in de oorspronkelijke taal zoekt, vindt deze in de verborgen laag, en een gebruiker die in de vertaalde taal zoekt, vindt deze in de zichtbare laag. Deze dubbele doorzoekbaarheid is een van de belangrijkste voordelen van het behoud van de originele tekst.

Kan ik de originele tekst uit een tweetalige PDF extraheren om het brondocument te herstellen?

Als de originele tekstlaag aanwezig is en correct gecodeerd is, wordt door het extraheren ervan de brontekst met hoge betrouwbaarheid hersteld. De extractiekwaliteit hangt af van hoe de vertaaltool de originele tekst heeft opgeslagen. Tools die het opslaan als een volledige, onbeschadigde tekststroom produceren extraheerbare uitvoer. Tools die het opslaan als gefragmenteerde tekstobjecten kunnen extraheerbare uitvoer opleveren met afgebroken zinnen die handmatig moeten worden opgeschoond.

Is een tweetalige PDF groter dan twee afzonderlijke bestanden?

Meestal nee. Een tweetalige PDF met beide taallagen is doorgaans kleiner dan de gecombineerde grootte van twee afzonderlijke PDF's in één taal, omdat de afbeeldingen, lettertypen en paginastructuur tussen de lagen worden gedeeld. De tekstlaag voegt slechts een kleine hoeveelheid gegevens toe. Voor omgevingen met beperkte opslag is de tweetalige PDF efficiënter dan het onderhouden van twee afzonderlijke bestanden.

WukongPDF

Probeer PDF vertalen

Geen installatie nodig. Werkt rechtstreeks in uw browser.

Nu beginnen →