Tips & Tricks

Cómo convertir una fotografía de una página impresa en texto editable y con capacidad de búsqueda mediante OCR

Tomas una foto de un documento impreso con tu teléfono. Tal vez sea una página de un libro de la biblioteca, un folleto de una reunión, un recibo que necesita para un informe de gastos o un cartel que vio con información importante. La foto es lo suficientemente clara como para leerla, pero es sólo una imagen. No puedes buscar palabras en él. No puedes copiar y pegar texto de él. No puedes editarlo. Es una fotografía de texto, no el texto en sí.

El reconocimiento óptico de caracteres puede convertir esa foto en texto editable y con capacidad de búsqueda, y las herramientas para hacerlo están disponibles en su teléfono y en su navegador. El proceso toma una fotografía de una página impresa y produce un documento donde puedes buscar, seleccionar, copiar y editar cada palabra como si la hubieras escrito tú mismo.

How to Turn a Photo of a Printed Page Into Editable, Searchable Text Using OCR

Obtener la mejor foto posible para OCR

La precisión del OCR depende en gran medida de la calidad de la imagen de entrada. Una fotografía bien iluminada y bien enfocada de una página plana se realizará con OCR con una precisión del 95% al 99%. Una fotografía mal iluminada, borrosa y torcida de una página curva puede ser procesada con un OCR con una precisión del 70%, lo que significa que aproximadamente una de cada tres o cuatro palabras contiene un error. El tiempo invertido en obtener una buena fotografía se devuelve muchas veces con un esfuerzo de corrección reducido.

Coloque el documento sobre una superficie plana y bien iluminada. La luz natural es ideal porque es difusa y sin sombras. La iluminación superior de la oficina funciona si te posicionas de manera que tu sombra no caiga sobre la página. Sostenga el teléfono directamente encima de la página, paralelo a ella, no en ángulo. Utilice ambas manos o apoye los codos sobre una superficie para mantener el teléfono estable. Rellena el marco con la página, dejando un pequeño margen alrededor de los bordes. Toque la pantalla para centrarse en el texto. Si su teléfono tiene un modo de escaneo de documentos, úselo. En iPhone, la aplicación Notas incluye una función Escanear documentos que detecta automáticamente los bordes de la página, corrige la perspectiva y mejora el contraste. En Android, la función de escaneo de Google Drive hace lo mismo.

Si la página es de un libro encuadernado y no puede quedar plana, presione suavemente el lomo para reducir la curva y acepte que la precisión del OCR será menor cerca del canal donde la página se aleja de la cámara. Para texto crítico cerca del lomo, tome una segunda fotografía enfocándose específicamente en esa área, con el teléfono más cerca de la página para maximizar la resolución del texto curvo.

WukongPDF

Pruebe el OCR de PDF

No se necesita instalación. Funciona directamente en su navegador.

Empezar ahora →

Ejecutar OCR en una foto usando las herramientas integradas de su teléfono

Los iPhone incluyen Live Text, una función OCR incorporada que funciona directamente en la aplicación Cámara, la aplicación Fotos y Safari. Apunte la cámara al texto y aparecerá un ícono de Live Text en la esquina del visor. Tóquelo y el teléfono reconocerá el texto en tiempo real. Puede seleccionarlo, copiarlo y pegarlo inmediatamente. Para una foto que ya está en tu biblioteca, ábrela en la aplicación Fotos y busca el ícono de Live Text. Tóquelo para resaltar todo el texto reconocido. Puede copiar partes seleccionadas o la totalidad. Live Text funciona completamente en el dispositivo sin necesidad de conexión a Internet.

Los teléfonos Android tienen Google Lens integrado en Google Photos y la aplicación de Google. Abra la foto en Google Photos y toque el ícono de Lente. Google Lens identifica el texto de la imagen y te permite seleccionarlo, copiarlo, traducirlo o buscarlo. Al igual que Live Text de Apple, Google Lens funciona sin conexión para el reconocimiento de texto en dispositivos recientes. Para ambas plataformas, el OCR integrado está diseñado para pasajes cortos, unas pocas oraciones o un párrafo, no para documentos de varias páginas. Extrae el texto pero no produce un documento formateado.

Convertir una foto a un PDF con capacidad de búsqueda utilizando las herramientas OCR PDF

Para una fotografía que necesita convertirse en un documento adecuado, un PDF con una capa de texto con capacidad de búsqueda, las herramientas de OCR basadas en navegador manejan todo el proceso. WukongPDF acepta la carga de fotografías en JPEG, PNG, HEIC y otros formatos comunes. Sube la foto. La herramienta lo procesa, reconoce el texto y genera un PDF con la foto original como la página visible y el texto reconocido como una capa invisible detrás de ella. El resultado es exactamente igual a la foto, pero ahora puedes buscar palabras, seleccionar y copiar texto, y el archivo se comporta como cualquier otro PDF.

Si tiene varias fotos de páginas consecutivas, cárguelas juntas. La herramienta procesa cada uno de ellos y usted puede combinarlos en un único PDF con capacidad de búsqueda de varias páginas. Este es el flujo de trabajo para digitalizar un documento breve con su teléfono: fotografíe cada página, cargue el lote, ejecute OCR y descargue un único PDF con capacidad de búsqueda de todo el documento. El proceso tarda unos minutos para un documento de 10 páginas y produce un resultado funcionalmente equivalente a un PDF escaneado desde un escáner de superficie plana.

Limpiar la salida OCR de las fotos

Las fotos tomadas con un teléfono, incluso las buenas, producen una precisión de OCR menor que los escaneos planos a 300 DPI. Una foto tomada con un teléfono de una página impresa normalmente se OCR con una precisión del 90% al 95%, lo que significa que aproximadamente una palabra de cada 20 tendrá un error. Los errores se agrupan en lugares predecibles: cerca de los bordes de la página donde la lente de la cámara introduce distorsión, en fuentes pequeñas de menos de 10 puntos y en áreas con sombras o iluminación desigual.

Después de convertir un PDF escaneado a partir de una foto, abra el PDF y busque errores comunes de OCR. Busque "cl" que a menudo se reconoce como "d" "rn" que a menudo se reconoce como "m", y "1" que a menudo se reconoce como "l". Lea el texto y corrija los errores que encuentre. El tiempo necesario para la limpieza depende de la longitud del documento y de la calidad de la fotografía. La revisión de un documento de una sola página tarda entre 5 y 10 minutos. Un documento de 20 páginas lleva una hora o más. El paso de limpieza es lo que separa un resultado de OCR descuidado de un documento profesional y pulido.

Cuando una foto supera al escáner

Una fotografía de teléfono no reemplaza a un escáner de superficie plana cuando la calidad es la máxima prioridad. Pero una foto de teléfono es infinitamente mejor que un escáner que no está contigo cuando lo necesitas. La mejor cámara es la que tienes. Para capturar texto de libros de la biblioteca, folletos de conferencias, notas de pizarra, recibos, letreros, menús y cualquier material impreso que encuentre fuera de su escritorio, una foto del teléfono seguida de OCR convierte un encuentro visual fugaz en texto permanente, editable y con capacidad de búsqueda. El canal Image to PDF de WukongPDF conecta una foto de teléfono a un PDF terminado en menos de un minuto, cerrando la brecha entre ver texto en el mundo y tenerlo disponible como un documento que puede usar.

Una limitación que vale la pena comprender: las fotografías tomadas con teléfono de documentos de texto generalmente producen tamaños de archivo más grandes que los escaneos de superficie plana equivalentes porque las cámaras de los teléfonos capturan información en color incluso para documentos en blanco y negro. Una foto de teléfono de una sola página de texto puede tener entre 3 y 5 MB como JPEG, mientras que un escaneo plano de la misma página en modo blanco y negro puede tener 200 KB. Si está digitalizando muchas páginas con su teléfono, convierta las fotos a escala de grises antes de ejecutar OCR. Esto reduce el tamaño del archivo entre un 60% y un 80% y, a menudo, mejora la precisión del OCR porque la conversión en escala de grises elimina el ruido de color y las sombras que confunden al motor de reconocimiento. La mayoría de las aplicaciones de edición de fotografías, incluida la aplicación Fotos incorporada tanto en iPhone como en Android, incluyen un filtro monocromático o en escala de grises que logra esto con un toque por foto.

WukongPDF

Pruebe el OCR de PDF

No se necesita instalación. Funciona directamente en su navegador.

Empezar ahora →