Extraer texto de una imagen (OCR)
Reconoce el texto de una foto, una captura de pantalla o un PDF escaneado y cópialo o descárgalo en .txt. Funciona en inglés e italiano. Todo ocurre en tu navegador.
JPG, PNG, WEBP o PDF escaneado
Qué es el OCR
El OCR (reconocimiento óptico de caracteres) convierte el texto «dibujado» dentro de una imagen en texto real y editable que puedes copiar. Es perfecto para documentos escaneados, fotos de páginas, capturas de pantalla, carteles o etiquetas.
Consejos para un buen resultado
Usa imágenes nítidas y bien iluminadas, con el texto recto y buen contraste entre la escritura y el fondo. Elige el idioma correcto para acertar más. La primera vez se descarga el modelo de reconocimiento (solo una vez), después se queda en memoria. Si la foto del documento está torcida, antes conviene pasar por Endereza un documento.
Qué hace fallar un reconocimiento
Cuatro cosas, por orden de gravedad. La resolución: por debajo de cierto tamaño las letras no tienen bastantes píxeles para distinguirse, y la regla práctica es que el texto debe medir al menos veinte píxeles de alto. La inclinación: unos pocos grados de torcido bajan mucho el acierto, porque el programa busca líneas horizontales.
Luego el contraste, es decir cuánto se separa el texto del fondo: una fotocopia desvaída o una foto con la sombra de la mano encima dan resultados pésimos. Y por último la tipografía: las fuentes decorativas, la cursiva y la escritura a mano son otro problema, que las herramientas tradicionales ni siquiera abordan.
Cómo fotografiar un documento para que funcione
Con luz difusa, nunca con flash y nunca con una lámpara de lado: las sombras y los reflejos son la causa número uno de los reconocimientos erróneos. El teléfono hay que mantenerlo paralelo a la hoja, no inclinado, porque la perspectiva estrecha las líneas lejanas y las vuelve ilegibles.
Si la hoja está sobre una mesa, conviene apoyarla en una superficie de otro color y llenar el encuadre solo con el documento: lo que hay alrededor no sirve y confunde. Y si la foto ya está hecha torcida, antes de reconocer el texto hay que enderezarla: es el paso que por sí solo cambia más resultados.
Qué comprobar en el texto que sale
Los errores de lectura son siempre los mismos, y se encuentran deprisa si se sabe dónde mirar: 0 y O, 1 y l e I, 5 y S, 8 y B, rn leído como m. Son errores que una relectura distraída no capta, porque el texto sigue siendo plausible.
Donde de verdad importan es en los números: un IBAN, un número de identificación, un importe, una fecha. Ahí un carácter equivocado no se ve y produce un daño, así que cada secuencia numérica hay que compararla a mano con la imagen. El texto corrido, en cambio, se puede corregir leyendo.
Los límites, dichos con claridad
La escritura a mano no la reconocen las herramientas clásicas, ni tampoco esta: hace falta un modelo entrenado a propósito, y hasta esos se equivocan mucho más que con el texto impreso. Las tablas pierden la estructura: las celdas se convierten en líneas de texto en fila, y reconstruir las columnas es un trabajo aparte.
Y la maquetación no sobrevive: las columnas de un periódico, las notas al pie y los recuadros salen mezclados en el orden en que el programa los encuentra. Lo que se obtiene es el contenido, no el documento.
Herramientas cercanas
Si la foto está torcida, primero hace falta Enderezar un documento fotografiado. Para un PDF que ya lleva el texto dentro está Extraer el texto de un PDF, y para buscar dentro de muchos PDF Buscar una palabra en muchos PDF. Sobre el texto obtenido trabajan Contador de palabras y Reparar los caracteres raros.