Qué es convertir una imagen a texto
Convertir una imagen a texto se conoce como OCR, siglas en inglés de reconocimiento óptico de caracteres. Un programa analiza las formas de una imagen, decide cuáles son letras y las convierte en texto que puedes seleccionar, editar, buscar y copiar.
Sirve siempre que un texto está atrapado en una imagen: la captura de un mensaje de error, la foto de un cartel, una carta escaneada, una diapositiva de una presentación, una cita en una imagen que te enviaron. En lugar de copiarlo a mano, dejas que el programa lo lea.
Cómo usar el convertidor
- Elige el Idioma de la imagen. En esta página, Español está seleccionado por defecto. También están disponibles inglés, francés, alemán, italiano, portugués, japonés, coreano, chino (simplificado y tradicional), neerlandés e hindi.
- Dale una imagen a la herramienta de una de estas tres formas:
- Arrastra un archivo de imagen al cuadro que dice Suelta una imagen aquí o elige un archivo.
- Pulsa Elegir imagen y selecciona uno o varios archivos.
- Copia una captura de pantalla y pulsa Ctrl+V (Cmd+V en Mac) en cualquier parte de la página, o pulsa Pegar imagen.
- Mira la barra de progreso. El primer escaneo tarda más porque hay que descargar el motor de lectura y los datos del idioma. Después, cada imagen tarda unos segundos.
- Lee el resultado en Texto extraído. Puedes editarlo ahí mismo.
- Pulsa Copiar, o Descargar para guardarlo como texto-de-imagen.txt.
Si eliges varias imágenes a la vez, se leen en orden y el texto de cada una se añade debajo del anterior, separado por una línea en blanco. Los contadores bajo el texto muestran el número de Palabras y Caracteres, y la Confianza media del lote.
Qué funciona bien y qué no
| Imagen | Qué esperar |
|---|---|
| Captura de una página web, una app o un documento | Muy bien. El texto limpio, nítido y con mucho contraste es el más fácil de leer. |
| Foto de una página impresa, tomada de frente y con buena luz | Bien. Revisa los números y la puntuación. |
| Carta o formulario escaneado | Bien para texto mecanografiado. Las casillas y líneas de los formularios pueden añadir caracteres sueltos. |
| Foto tomada en ángulo, con sombras o desenfocada | Regular. Recorta la imagen o repite la foto si puedes. |
| Texto sobre una foto recargada o un estampado | Mal. El fondo confunde al motor. |
| Letra manuscrita | Mal, salvo letras de imprenta muy claras. |
| Texto muy pequeño, como una página entera en una captura pequeña | Mal. Amplía la página y haz una captura más cercana. |
Cómo funciona
La página usa Tesseract, un conocido motor de OCR de código abierto que se desarrolló primero en Hewlett-Packard y después se liberó al público. Aquí funciona mediante Tesseract.js, una versión del motor hecha para navegadores web.
Cuando empiezas el primer escaneo, tu navegador descarga tres cosas desde cdn.jsdelivr.net: un pequeño script auxiliar, el motor en sí y un archivo de datos para el idioma que elegiste. Son solo archivos del programa y del idioma. Tu navegador los guarda en caché, así que los escaneos siguientes empiezan mucho más rápido. Si eliges otro idioma, se descarga el archivo de datos de ese idioma.
Después, el motor encuentra las líneas de texto de tu imagen, las divide en palabras y letras y compara sus formas con lo que aprendió de sus datos de entrenamiento. Todo esto ocurre en tu dispositivo, sea un portátil o un móvil. La imagen se lee desde la memoria de tu dispositivo y nunca se sube, lo que hace que la herramienta sea segura para capturas con información privada.
Consejos para obtener mejores resultados
- Recorta hasta el texto. Quita bordes, fotos e iconos alrededor del texto antes de arrastrar la imagen.
- Cuanto más grande, mejor. Las letras grandes y nítidas se leen mucho mejor que las diminutas. Amplía la página antes de hacer la captura.
- Elige el idioma correcto. Las letras con tilde, la ñ, la ü y los signos ¿ y ¡ se leen con mucha más precisión cuando está seleccionado Español, que es la opción por defecto en esta página. Si eliges Inglés con un texto en español, es fácil que la ñ o las tildes salgan mal. Y si la imagen está en inglés, cambia a Inglés.
- Endereza las fotos. Sostén la cámara justo encima de la página, llena el encuadre con el texto y evita las sombras.
- Limpia después. El texto de una foto suele tener saltos de línea en medio de las frases. Pégalo en la herramienta para quitar saltos de línea para unir las líneas, y usa la de convertir a texto plano para arreglar comillas y espacios raros.
- Revisa el texto. Los errores de OCR parecen palabras reales, por ejemplo “rn” leído como “m” o “0” leído como “O”. Lee dos veces los números, los nombres y las direcciones de correo.
La mayoría de los navegadores no pueden leer las fotos del móvil guardadas en formato HEIC. Guarda o comparte la foto como JPG primero.
Otras formas de sacar texto de una imagen
Google Docs. Sube la imagen a Google Drive, haz clic derecho sobre ella y elige Abrir con y después Documentos de Google. El texto aparece debajo de la imagen en un documento nuevo. Esto sube la imagen a Google.
Microsoft OneNote y Word. En OneNote para Windows, pega la imagen, haz clic derecho sobre ella y usa la opción para copiar el texto de la imagen. Word puede abrir un PDF y convertirlo en un documento editable, algo que funciona mejor con escaneos limpios.
Tu móvil. Las versiones recientes de iOS y Android permiten seleccionar texto directamente en fotos y capturas. Mantén pulsado el texto en la app Fotos o Galería.
Código. Tesseract se puede instalar en Windows, macOS y Linux y ejecutar desde la línea de comandos con tesseract image.png output, que guarda el texto en output.txt. Para texto en español, añade -l spa. Los programas en Python suelen usarlo a través del paquete pytesseract.