Vous prenez une photo d'un document imprimé avec votre téléphone. Il peut s'agir d'une page d'un livre à la bibliothèque, d'un document d'une réunion, d'un reçu dont vous avez besoin pour une note de frais ou d'un panneau que vous avez vu avec des informations importantes. La photo est suffisamment claire pour être lue, mais ce n'est qu'une image. Vous ne pouvez pas y rechercher de mots. Vous ne pouvez pas copier et coller du texte à partir de celui-ci. Vous ne pouvez pas le modifier. C'est une photographie du texte, pas du texte lui-même.
La reconnaissance optique de caractères peut convertir cette photo en texte modifiable et consultable, et les outils pour le faire sont disponibles sur votre téléphone et dans votre navigateur. Le processus prend une photo d'une page imprimée et produit un document dans lequel vous pouvez rechercher, sélectionner, copier et modifier chaque mot comme si vous l'aviez tapé vous-même.

Obtenir la meilleure photo possible pour l'OCR
La précision de l'OCR dépend fortement de la qualité de l'image d'entrée. Une photo bien éclairée et bien mise au point d'une page plate sera OCR avec une précision de 95 % à 99 %. Une photo mal éclairée, floue et inclinée d'une page incurvée peut avoir une OCR avec une précision de 70 %, ce qui signifie qu'environ un mot sur trois ou quatre contient une erreur. Le temps passé à obtenir une bonne photo est restitué plusieurs fois avec un effort de correction réduit.
Placez le document sur une surface plane et bien éclairée. La lumière naturelle du jour est idéale car elle est diffuse et sans ombre. L'éclairage du bureau fonctionne si vous vous positionnez de manière à ce que votre ombre ne tombe pas sur la page. Tenez le téléphone directement au-dessus de la page, parallèlement à celle-ci, et non en biais. Utilisez les deux mains ou posez vos coudes sur une surface pour maintenir le téléphone stable. Remplissez le cadre avec la page en laissant une petite marge sur les bords. Appuyez sur l'écran pour vous concentrer sur le texte. Si votre téléphone dispose d'un mode de numérisation de documents, utilisez-le. Sur iPhone, l'application Notes comprend une fonction Numériser des documents qui détecte automatiquement les bords de la page, corrige la perspective et améliore le contraste. Sur Android, la fonction d'analyse de Google Drive fait de même.
Si la page provient d'un livre relié et ne peut pas reposer à plat, appuyez doucement sur le dos pour réduire la courbe et acceptez que la précision de l'OCR soit inférieure près de la gouttière, là où la page s'éloigne de l'appareil photo. Pour le texte critique près du dos, prenez une deuxième photo en vous concentrant spécifiquement sur cette zone, avec le téléphone plus proche de la page pour maximiser la résolution du texte incurvé.
Essayez l'OCR PDF
Aucune installation nécessaire. Fonctionne directement dans votre navigateur.
Exécuter l'OCR sur une photo à l'aide des outils intégrés de votre téléphone
Les iPhones incluent Live Text, une fonctionnalité OCR intégrée qui fonctionne directement dans l'application Appareil photo, l'application Photos et Safari. Pointez l'appareil photo sur le texte et une icône Live Text apparaît dans le coin du viseur. Appuyez dessus et le téléphone reconnaît le texte en temps réel. Vous pouvez le sélectionner, le copier et le coller immédiatement. Pour une photo déjà dans votre bibliothèque, ouvrez-la dans l'application Photos et recherchez l'icône Live Text. Appuyez dessus pour mettre en surbrillance tout le texte reconnu. Vous pouvez copier des parties sélectionnées ou la totalité. Live Text fonctionne entièrement sur l'appareil sans connexion Internet requise.
Les téléphones Android intègrent Google Lens à Google Photos et à l'application Google. Ouvrez la photo dans Google Photos et appuyez sur l'icône Objectif. Google Lens identifie le texte dans l'image et vous permet de le sélectionner, de le copier, de le traduire ou de le rechercher. Comme Live Text d'Apple, Google Lens fonctionne hors ligne pour la reconnaissance de texte sur les appareils récents. Pour les deux plateformes, l'OCR intégré est conçu pour des passages courts, quelques phrases ou un paragraphe, et non pour des documents de plusieurs pages. Il extrait le texte mais ne produit pas de document formaté.
Conversion d'une photo en PDF consultable à l'aide des outils OCR PDF
Pour une photo qui doit devenir un document approprié, un PDF avec une couche de texte consultable, les outils OCR basés sur un navigateur gèrent l'ensemble du pipeline. WukongPDF accepte les téléchargements de photos aux formats JPEG, PNG, HEIC et autres formats courants. Téléchargez la photo. The tool processes it, recognizes the text, and outputs a PDF with the original photo as the visible page and the recognized text as an invisible searchable layer behind it. Le résultat ressemble exactement à la photo, mais vous pouvez désormais rechercher des mots, sélectionner et copier du texte, et le fichier se comporte comme n'importe quel autre PDF.
Si vous avez plusieurs photos de pages consécutives, téléchargez-les ensemble. L'outil traite chacun d'eux et vous pouvez les combiner en un seul PDF consultable de plusieurs pages. Il s'agit du flux de travail permettant de numériser un court document avec votre téléphone : photographiez chaque page, téléchargez le lot, exécutez l'OCR et téléchargez un seul PDF consultable de l'intégralité du document. Le processus prend quelques minutes pour un document de 10 pages et produit un résultat fonctionnellement équivalent à un PDF numérisé à partir d'un scanner à plat.
Nettoyage de la sortie OCR des photos
Les photos prises avec un téléphone, même les plus bonnes, produisent une précision OCR inférieure à celle des numérisations à plat à 300 DPI. Une photo téléphonique d'une page imprimée est généralement OCR avec une précision de 90 à 95 %, ce qui signifie qu'environ un mot sur 20 comportera une erreur. Les erreurs se regroupent à des endroits prévisibles : près des bords de la page où l'objectif de la caméra introduit une distorsion, dans les petites polices inférieures à 10 points et dans les zones d'ombres ou d'éclairage inégal.
Après avoir converti un PDF numérisé à partir d'une photo, ouvrez le PDF et recherchez les erreurs OCR courantes. Recherchez "cl" qui est souvent reconnu comme "d", "rn" qui est souvent reconnu comme "m", et "1" qui est souvent reconnu comme "l." Lisez le texte et corrigez les erreurs que vous trouvez. Le temps nécessaire au nettoyage dépend de la longueur du document et de la qualité de la photo. La relecture d’un document d’une seule page prend 5 à 10 minutes. Un document de 20 pages prend une heure ou plus. L’étape de nettoyage est ce qui sépare un résultat OCR bâclé d’un document soigné et professionnel.
Quand une photo bat un scanner
Une photo de téléphone ne remplace pas un scanner à plat lorsque la qualité est la priorité absolue. Mais une photo de téléphone est infiniment meilleure qu’un scanner qui n’est pas avec vous lorsque vous en avez besoin. Le meilleur appareil photo est celui que vous possédez. Pour capturer du texte à partir de livres de bibliothèque, de documents de conférence, de notes sur un tableau blanc, de reçus, de panneaux, de menus et de tout document imprimé que vous rencontrez loin de votre bureau, une photo de téléphone suivie d'une OCR transforme une rencontre visuelle éphémère en un texte permanent, consultable et modifiable. Le pipeline Image vers PDF de WukongPDF connecte une photo de téléphone à un PDF fini en moins d'une minute, comblant ainsi l'écart entre la visualisation de texte dans le monde et sa disponibilité sous forme de document que vous pouvez utiliser.
Une limitation mérite d'être comprise : les photos prises par téléphone à partir de documents texte produisent généralement des fichiers de taille plus grande que les numérisations à plat équivalentes, car les caméras des téléphones capturent les informations de couleur, même pour les documents en noir et blanc. Une photo de téléphone d'une seule page de texte peut faire 3 à 5 Mo au format JPEG, tandis qu'une numérisation à plat de la même page en mode noir et blanc peut faire 200 Ko. Si vous numérisez de nombreuses pages avec votre téléphone, convertissez les photos en niveaux de gris avant d'exécuter l'OCR. Cela réduit la taille du fichier de 60 à 80 % et améliore souvent la précision de l'OCR, car la conversion des niveaux de gris élimine le bruit de couleur et les ombres qui perturbent le moteur de reconnaissance. La plupart des applications de retouche photo, y compris l'application Photos intégrée sur iPhone et Android, incluent un filtre en niveaux de gris ou mono qui permet d'y parvenir en un seul clic par photo.
Essayez l'OCR PDF
Aucune installation nécessaire. Fonctionne directement dans votre navigateur.
