Saltar al contenido
Case Converter Online
es

Convertir imagen a texto (OCR)

Copia el texto de una captura de pantalla, una foto o una página escaneada. Arrastra, pega o elige una imagen y el texto aparece listo para editar y copiar. Lee español, inglés y otros nueve idiomas, entre ellos japonés, coreano y chino.

Tu imagen

Palabras
0
Caracteres
0
Confianza
-

Tu imagen se lee en tu dispositivo y nunca se sube. El primer escaneo descarga el motor de lectura y los datos del idioma (unos pocos MB).

Qué es convertir una imagen a texto

Convertir una imagen a texto se conoce como OCR, siglas en inglés de reconocimiento óptico de caracteres. Un programa analiza las formas de una imagen, decide cuáles son letras y las convierte en texto que puedes seleccionar, editar, buscar y copiar.

Sirve siempre que un texto está atrapado en una imagen: la captura de un mensaje de error, la foto de un cartel, una carta escaneada, una diapositiva de una presentación, una cita en una imagen que te enviaron. En lugar de copiarlo a mano, dejas que el programa lo lea.

Cómo usar el convertidor

  1. Elige el Idioma de la imagen. En esta página, Español está seleccionado por defecto. También están disponibles inglés, francés, alemán, italiano, portugués, japonés, coreano, chino (simplificado y tradicional), neerlandés e hindi.
  2. Dale una imagen a la herramienta de una de estas tres formas:
    • Arrastra un archivo de imagen al cuadro que dice Suelta una imagen aquí o elige un archivo.
    • Pulsa Elegir imagen y selecciona uno o varios archivos.
    • Copia una captura de pantalla y pulsa Ctrl+V (Cmd+V en Mac) en cualquier parte de la página, o pulsa Pegar imagen.
  3. Mira la barra de progreso. El primer escaneo tarda más porque hay que descargar el motor de lectura y los datos del idioma. Después, cada imagen tarda unos segundos.
  4. Lee el resultado en Texto extraído. Puedes editarlo ahí mismo.
  5. Pulsa Copiar, o Descargar para guardarlo como texto-de-imagen.txt.

Si eliges varias imágenes a la vez, se leen en orden y el texto de cada una se añade debajo del anterior, separado por una línea en blanco. Los contadores bajo el texto muestran el número de Palabras y Caracteres, y la Confianza media del lote.

Qué funciona bien y qué no

Imagen Qué esperar
Captura de una página web, una app o un documento Muy bien. El texto limpio, nítido y con mucho contraste es el más fácil de leer.
Foto de una página impresa, tomada de frente y con buena luz Bien. Revisa los números y la puntuación.
Carta o formulario escaneado Bien para texto mecanografiado. Las casillas y líneas de los formularios pueden añadir caracteres sueltos.
Foto tomada en ángulo, con sombras o desenfocada Regular. Recorta la imagen o repite la foto si puedes.
Texto sobre una foto recargada o un estampado Mal. El fondo confunde al motor.
Letra manuscrita Mal, salvo letras de imprenta muy claras.
Texto muy pequeño, como una página entera en una captura pequeña Mal. Amplía la página y haz una captura más cercana.

Cómo funciona

La página usa Tesseract, un conocido motor de OCR de código abierto que se desarrolló primero en Hewlett-Packard y después se liberó al público. Aquí funciona mediante Tesseract.js, una versión del motor hecha para navegadores web.

Cuando empiezas el primer escaneo, tu navegador descarga tres cosas desde cdn.jsdelivr.net: un pequeño script auxiliar, el motor en sí y un archivo de datos para el idioma que elegiste. Son solo archivos del programa y del idioma. Tu navegador los guarda en caché, así que los escaneos siguientes empiezan mucho más rápido. Si eliges otro idioma, se descarga el archivo de datos de ese idioma.

Después, el motor encuentra las líneas de texto de tu imagen, las divide en palabras y letras y compara sus formas con lo que aprendió de sus datos de entrenamiento. Todo esto ocurre en tu dispositivo, sea un portátil o un móvil. La imagen se lee desde la memoria de tu dispositivo y nunca se sube, lo que hace que la herramienta sea segura para capturas con información privada.

Consejos para obtener mejores resultados

  • Recorta hasta el texto. Quita bordes, fotos e iconos alrededor del texto antes de arrastrar la imagen.
  • Cuanto más grande, mejor. Las letras grandes y nítidas se leen mucho mejor que las diminutas. Amplía la página antes de hacer la captura.
  • Elige el idioma correcto. Las letras con tilde, la ñ, la ü y los signos ¿ y ¡ se leen con mucha más precisión cuando está seleccionado Español, que es la opción por defecto en esta página. Si eliges Inglés con un texto en español, es fácil que la ñ o las tildes salgan mal. Y si la imagen está en inglés, cambia a Inglés.
  • Endereza las fotos. Sostén la cámara justo encima de la página, llena el encuadre con el texto y evita las sombras.
  • Limpia después. El texto de una foto suele tener saltos de línea en medio de las frases. Pégalo en la herramienta para quitar saltos de línea para unir las líneas, y usa la de convertir a texto plano para arreglar comillas y espacios raros.
  • Revisa el texto. Los errores de OCR parecen palabras reales, por ejemplo “rn” leído como “m” o “0” leído como “O”. Lee dos veces los números, los nombres y las direcciones de correo.

La mayoría de los navegadores no pueden leer las fotos del móvil guardadas en formato HEIC. Guarda o comparte la foto como JPG primero.

Otras formas de sacar texto de una imagen

Google Docs. Sube la imagen a Google Drive, haz clic derecho sobre ella y elige Abrir con y después Documentos de Google. El texto aparece debajo de la imagen en un documento nuevo. Esto sube la imagen a Google.

Microsoft OneNote y Word. En OneNote para Windows, pega la imagen, haz clic derecho sobre ella y usa la opción para copiar el texto de la imagen. Word puede abrir un PDF y convertirlo en un documento editable, algo que funciona mejor con escaneos limpios.

Tu móvil. Las versiones recientes de iOS y Android permiten seleccionar texto directamente en fotos y capturas. Mantén pulsado el texto en la app Fotos o Galería.

Código. Tesseract se puede instalar en Windows, macOS y Linux y ejecutar desde la línea de comandos con tesseract image.png output, que guarda el texto en output.txt. Para texto en español, añade -l spa. Los programas en Python suelen usarlo a través del paquete pytesseract.

Convertir imagen a texto: preguntas y respuestas

¿Cómo convierto una imagen a texto?

Arrastra la imagen al cuadro, pulsa Elegir imagen o copia una captura de pantalla y pulsa Ctrl+V en esta página. Antes, comprueba el idioma del texto: en esta página viene elegido Español, así que solo tienes que cambiarlo si la imagen está en otro idioma. El texto extraído aparece a la derecha, donde puedes corregirlo y pulsar Copiar.

¿Mi imagen se sube a un servidor?

No. El texto se lee en tu propio dispositivo. La primera vez que usas la herramienta, tu navegador descarga el motor de lectura y los datos del idioma desde cdn.jsdelivr.net, un servidor público de archivos. La imagen en sí nunca se envía a ninguna parte.

¿Puede leer letra manuscrita?

Solo letra manuscrita muy clara, tipo imprenta, y no de forma fiable. El motor está entrenado con texto impreso y mecanografiado. La letra cursiva ligada suele salir como una mezcla de letras correctas e incorrectas.

¿Puedo convertir un PDF a texto aquí?

No directamente. La herramienta lee archivos de imagen: PNG, JPG, WebP, BMP y GIF. Haz una captura de la página del PDF, o expórtala como imagen, y arrástrala aquí. Si el PDF se creó a partir de un documento de texto, normalmente puedes seleccionar y copiar el texto sin OCR.

¿Qué significa el número de Confianza?

Es la estimación del propio motor sobre lo seguro que está del texto, de 0 a 100 por ciento, promediada entre todas las imágenes del lote. Un número bajo es señal de que debes revisar el resultado con cuidado. Un número alto no garantiza que no haya errores.

Más herramientas de texto

Ver todas las herramientas