Tips & Tricks

Een foto van een afgedrukte pagina omzetten in bewerkbare, doorzoekbare tekst met behulp van OCR

Je maakt met je telefoon een foto van een afgedrukt document. Misschien is het een pagina uit een boek in de bibliotheek, een uitreikblad van een vergadering, een betalingsbewijs dat je nodig hebt voor een onkostendeclaratie of een bord dat je hebt gezien met belangrijke informatie. De foto is duidelijk genoeg om te lezen, maar het is maar een plaatje. Je kunt er niet op woorden zoeken. U kunt er geen tekst uit kopiëren en plakken. Je kunt het niet bewerken. Het is een foto van tekst, niet de tekst zelf.

Optische tekenherkenning kan die foto omzetten in bewerkbare, doorzoekbare tekst, en de tools om dit te doen zijn beschikbaar op uw telefoon en in uw browser. Bij dit proces wordt een foto van een afgedrukte pagina gemaakt en ontstaat er een document waarin u elk woord kunt zoeken, selecteren, kopiëren en bewerken alsof u het zelf hebt getypt.

How to Turn a Photo of a Printed Page Into Editable, Searchable Text Using OCR

De best mogelijke foto voor OCR verkrijgen

De nauwkeurigheid van de OCR is sterk afhankelijk van de kwaliteit van het invoerbeeld. Een goed belichte, scherp gefocuste foto van een platte pagina kan worden OCR met een nauwkeurigheid van 95% tot 99%. Een slecht belichte, wazige, scheve foto van een gebogen pagina kan OCR hebben met een nauwkeurigheid van 70%, wat betekent dat ongeveer één op de drie of vier woorden een fout bevat. De tijd die u besteedt aan het maken van een goede foto, wordt vele malen terugverdiend door minder correctie-inspanningen.

Plaats het document op een vlak, goed verlicht oppervlak. Natuurlijk daglicht is ideaal omdat het diffuus en schaduwvrij is. Kantoorverlichting boven het hoofd werkt als u zich zo positioneert dat uw schaduw niet op de pagina valt. Houd de telefoon direct boven de pagina, evenwijdig eraan en niet onder een hoek. Gebruik beide handen of laat uw ellebogen op een oppervlak rusten om de telefoon stabiel te houden. Vul het kader met de pagina en laat een kleine marge rond de randen vrij. Tik op het scherm om op de tekst te focussen. Als uw telefoon een documentscanmodus heeft, gebruik deze dan. Op de iPhone bevat de Notes-app een functie Documenten scannen die automatisch de paginaranden detecteert, het perspectief corrigeert en het contrast verbetert. Op Android doet de scanfunctie van Google Drive hetzelfde.

Als de pagina uit een ingebonden boek komt en niet plat kan liggen, drukt u zachtjes op de rug om de curve te verkleinen en accepteert u dat de OCR-nauwkeurigheid lager zal zijn nabij de rugmarge waar de pagina van de camera af buigt. Voor kritische tekst nabij de rug maakt u een tweede foto die specifiek op dat gebied is gericht, met de telefoon dichter bij de pagina om de resolutie van de gebogen tekst te maximaliseren.

WukongPDF

Probeer PDF-OCR

Geen installatie nodig. Werkt rechtstreeks in uw browser.

Nu beginnen →

OCR uitvoeren op een foto met behulp van de ingebouwde tools van uw telefoon

iPhones bevatten Live Text, een ingebouwde OCR-functie die rechtstreeks werkt in de Camera-app, Foto's-app en Safari. Richt de camera op tekst en er verschijnt een Live Text-pictogram in de hoek van de zoeker. Tik erop en de telefoon herkent de tekst in realtime. U kunt het onmiddellijk selecteren, kopiëren en plakken. Voor een foto die al in uw bibliotheek staat, opent u deze in de Foto's-app en zoekt u naar het Live Text-pictogram. Tik erop om alle herkende tekst te markeren. U kunt geselecteerde delen of alles kopiëren. Live Text werkt volledig op het apparaat en er is geen internetverbinding vereist.

Android-telefoons hebben Google Lens ingebouwd in Google Foto's en de Google-app. Open de foto in Google Foto's en tik op het Lens-pictogram. Google Lens identificeert tekst in de afbeelding en laat u deze selecteren, kopiëren, vertalen of doorzoeken. Net als Apple's Live Text werkt Google Lens offline voor tekstherkenning op recente apparaten. Voor beide platforms is de ingebouwde OCR ontworpen voor korte passages, een paar zinnen of een alinea, niet voor documenten met meerdere pagina's. Het extraheert de tekst, maar produceert geen opgemaakt document.

Een foto converteren naar een doorzoekbare PDF met behulp van OCR PDF Tools

Voor een foto die een echt document moet worden, een PDF met een doorzoekbare tekstlaag, verzorgen browsergebaseerde OCR-tools de volledige pijplijn. WukongPDF accepteert foto-uploads in JPEG, PNG, HEIC en andere veelgebruikte formaten. Upload de foto. De tool verwerkt deze, herkent de tekst en voert een PDF uit met de originele foto als de zichtbare pagina en de herkende tekst als een onzichtbare doorzoekbare laag daarachter. De uitvoer ziet er precies zo uit als de foto, maar u kunt nu op woorden zoeken, tekst selecteren en kopiëren, en het bestand gedraagt zich als elke andere PDF.

Als je meerdere foto's van opeenvolgende pagina's hebt, upload ze dan samen. De tool verwerkt ze allemaal en u kunt ze combineren tot één doorzoekbare PDF van meerdere pagina's. Dit is de workflow voor het digitaliseren van een kort document met uw telefoon: fotografeer elke pagina, upload de batch, voer OCR uit en download één doorzoekbare pdf van het hele document. Het proces duurt enkele minuten voor een document van 10 pagina's en levert een resultaat op dat functioneel gelijkwaardig is aan een gescande PDF van een flatbedscanner.

OCR-uitvoer van foto's opschonen

Foto's gemaakt met een telefoon, zelfs goede, produceren een lagere OCR-nauwkeurigheid dan flatbedscans met 300 DPI. Een telefoonfoto van een afgedrukte pagina wordt doorgaans met een nauwkeurigheid van 90% tot 95% OCR uitgevoerd, wat betekent dat ongeveer één op de twintig woorden een fout bevat. De fouten clusteren zich op voorspelbare plaatsen: nabij de randen van de pagina waar de cameralens vervorming introduceert, in kleine lettertypen onder de 10 punten, en in gebieden met schaduwen of ongelijkmatige verlichting.

Nadat u een Gescande PDF van een foto hebt geconverteerd, opent u de PDF en zoekt u naar veelvoorkomende OCR-fouten. Zoek naar "cl" wat vaak wordt herkend als "d," "rn" die vaak wordt herkend als "m" en "1" die vaak wordt herkend als "l." Lees de tekst door en corrigeer eventuele fouten die u tegenkomt. De tijd die nodig is voor het opruimen is afhankelijk van de lengte van het document en de fotokwaliteit. Het proeflezen van een document van één pagina duurt 5 tot 10 minuten. Een document van 20 pagina's duurt een uur of langer. De opruimstap is wat een slordig OCR-resultaat onderscheidt van een gepolijst, professioneel document.

Wanneer een foto een scanner verslaat

Een telefoonfoto is geen vervanging voor een flatbedscanner als kwaliteit de hoogste prioriteit heeft. Maar een telefoonfoto is oneindig veel beter dan een scanner die niet bij je is als je hem nodig hebt. De beste camera is degene die je hebt. Voor het vastleggen van tekst uit bibliotheekboeken, hand-outs van conferenties, whiteboard-aantekeningen, ontvangstbewijzen, borden, menu's en al het gedrukte materiaal dat u buiten uw bureau tegenkomt, verandert een telefoonfoto gevolgd door OCR een vluchtige visuele ontmoeting in permanente, doorzoekbare, bewerkbare tekst. De Afbeelding naar PDF-pijplijn van WukongPDF verbindt een telefoonfoto in minder dan een minuut met een voltooide PDF, waardoor de kloof wordt gedicht tussen het zien van tekst in de wereld en het beschikbaar hebben ervan als een document dat u kunt gebruiken.

Eén beperking die de moeite waard is om te begrijpen: telefoonfoto's van tekstdocumenten produceren doorgaans bestandsgroottes die groter zijn dan vergelijkbare flatbedscans, omdat telefooncamera's kleurinformatie vastleggen, zelfs voor zwart-witdocumenten. Een telefoonfoto van een enkele tekstpagina kan als JPEG 3 tot 5 MB groot zijn, terwijl een flatbedscan van dezelfde pagina in zwart-witmodus 200 KB kan zijn. Als u veel pagina's met uw telefoon digitaliseert, converteer dan de foto's naar grijswaarden voordat u OCR uitvoert. Dit verkleint de bestandsgrootte met 60% tot 80% en verbetert vaak de OCR-nauwkeurigheid omdat de grijswaardenconversie kleurruis en schaduwen elimineert die de herkenningsengine in verwarring brengen. De meeste fotobewerkingsapps, inclusief de ingebouwde Foto's-app op zowel iPhone als Android, bevatten een grijswaarden- of monofilter waarmee dit met één tik per foto wordt bereikt.

WukongPDF

Probeer PDF-OCR

Geen installatie nodig. Werkt rechtstreeks in uw browser.

Nu beginnen →