O que é converter imagem em texto
A conversão de imagem em texto é conhecida como OCR, sigla em inglês para reconhecimento óptico de caracteres. O computador olha as formas de uma imagem, descobre quais delas são letras e as transforma em texto que você pode selecionar, editar, pesquisar e copiar.
Ela é útil sempre que um texto está preso em uma imagem: o print de uma mensagem de erro, a foto de uma placa, uma carta digitalizada, um slide de apresentação, uma frase em uma imagem que alguém mandou. Em vez de digitar tudo, você deixa o computador ler.
Como usar o conversor
- Confira o Idioma da imagem. Nesta página, o português vem selecionado por padrão, então letras como ç, ã, õ e ê são reconhecidas corretamente. Há 12 idiomas ao todo: inglês, espanhol, francês, alemão, italiano, português, japonês, coreano, chinês (simplificado), chinês (tradicional), holandês e hindi. Se a imagem estiver em outra língua, escolha a certa.
- Entregue uma imagem à ferramenta de uma destas três maneiras:
- Arraste um arquivo de imagem para a caixa que diz Solte uma imagem aqui ou escolha um arquivo.
- Clique em Escolher imagem e selecione um ou mais arquivos.
- Copie um print e pressione Ctrl+V (Cmd+V no Mac) em qualquer lugar da página, ou clique em Colar imagem.
- Acompanhe a barra de progresso. A primeira leitura demora mais porque o programa de leitura e os dados do idioma precisam ser baixados. Depois disso, cada imagem leva alguns segundos.
- Leia o resultado em Texto extraído. Você pode editá-lo ali mesmo.
- Clique em Copiar, ou em Baixar para salvar como texto-da-imagem.txt.
Se você escolher várias imagens de uma vez, elas são lidas em ordem e o texto de cada uma é acrescentado abaixo do anterior, separado por uma linha em branco. As contagens abaixo do texto mostram o número de Palavras e Caracteres, além da Confiança média do lote.
O que funciona bem e o que não funciona
| Imagem | O que esperar |
|---|---|
| Print de uma página web, aplicativo ou documento | Muito bom. Texto limpo, nítido e com alto contraste é o mais fácil de ler. |
| Foto de uma página impressa, tirada de frente e com boa luz | Bom. Confira números e pontuação. |
| Carta ou formulário digitalizado | Bom para texto digitado. Caixas e linhas de formulários podem acrescentar caracteres soltos. |
| Foto tirada de lado, na sombra ou fora de foco | Variável. Recorte e tire a foto de novo, se puder. |
| Texto sobre uma foto cheia de detalhes ou uma estampa | Ruim. O fundo confunde o programa. |
| Letra de mão | Ruim, a não ser em letra de forma muito caprichada. |
| Texto muito pequeno, como uma página inteira em um print pequeno | Ruim. Dê zoom e tire um print mais de perto. |
Como funciona
A página usa o Tesseract, um programa de OCR de código aberto bastante conhecido, desenvolvido originalmente na Hewlett-Packard e depois liberado ao público. Aqui ele roda por meio do Tesseract.js, uma versão do programa feita para navegadores.
Quando você inicia a primeira leitura, o navegador baixa três coisas de cdn.jsdelivr.net: um pequeno script auxiliar, o programa em si e um arquivo de dados do idioma escolhido. São apenas arquivos de programa e de idioma. O navegador os guarda no cache, então as próximas leituras começam muito mais rápido. Escolher outro idioma baixa o arquivo de dados desse idioma.
Em seguida, o programa encontra as linhas de texto da imagem, divide tudo em palavras e letras e compara as formas com o que aprendeu nos dados de treinamento. Tudo isso acontece no seu computador ou celular. A imagem é lida da memória do aparelho e nunca é enviada, o que torna a ferramenta segura para prints com informações pessoais.
Dicas para resultados melhores
- Recorte até o texto. Tire bordas, fotos e ícones em volta do texto antes de soltar a imagem.
- Quanto maior, melhor. Letras grandes e nítidas são lidas muito melhor que letras pequenas. Dê zoom na página antes de tirar o print.
- Escolha o idioma certo. Letras acentuadas como é, ã, ç e ü são lidas com muito mais precisão quando o idioma correspondente está selecionado. Com o inglês selecionado, um texto em português costuma perder acentos e cedilhas. Para japonês, coreano e chinês, o idioma certo é indispensável, porque essas escritas usam conjuntos de caracteres próprios.
- Endireite as fotos. Segure a câmera bem acima da página, enquadre só o texto e evite sombras.
- Faça uma limpeza depois. O texto de uma foto muitas vezes tem quebras de linha no meio das frases. Cole na ferramenta de remover quebras de linha para juntar as linhas e use o conversor de texto simples para corrigir aspas e espaços estranhos.
- Revise. Os erros de OCR parecem palavras de verdade, como “rn” lido como “m” ou “0” lido como “O”. Leia duas vezes números, nomes e endereços de e-mail.
As fotos de celular salvas no formato HEIC não podem ser lidas pela maioria dos navegadores. Salve ou compartilhe a foto como JPG antes.
Outras formas de tirar o texto de uma imagem
Google Docs. Envie a imagem para o Google Drive, clique nela com o botão direito e escolha Abrir com, depois Documentos Google. O texto aparece abaixo da imagem em um novo documento. Esse método envia a imagem para o Google.
Microsoft OneNote e Word. No OneNote para Windows, cole a imagem, clique com o botão direito e escolha a opção de copiar o texto da imagem. O Word consegue abrir um PDF e convertê-lo em documento editável, o que funciona melhor com digitalizações limpas.
Seu celular. As versões recentes do iOS e do Android deixam você selecionar o texto direto em fotos e prints. Mantenha o dedo pressionado sobre o texto no aplicativo de Fotos ou Galeria.
Código. O Tesseract pode ser instalado no Windows, no macOS e no Linux e executado pela linha de comando com tesseract image.png output, que salva o texto em output.txt. Para português, acrescente -l por. Programas em Python costumam usá-lo pelo pacote pytesseract.