Pular para o conteúdo
Case Converter Online
pt

Converter imagem em texto

Copie o texto de um print, de uma foto ou de uma página digitalizada. Arraste, cole ou escolha uma imagem e o texto aparece pronto para editar e copiar.

Sua imagem

Palavras
0
Caracteres
0
Confiança
-

Sua imagem é lida no seu aparelho e nunca é enviada. A primeira leitura baixa o programa de leitura e os dados do idioma (alguns MB).

O que é converter imagem em texto

A conversão de imagem em texto é conhecida como OCR, sigla em inglês para reconhecimento óptico de caracteres. O computador olha as formas de uma imagem, descobre quais delas são letras e as transforma em texto que você pode selecionar, editar, pesquisar e copiar.

Ela é útil sempre que um texto está preso em uma imagem: o print de uma mensagem de erro, a foto de uma placa, uma carta digitalizada, um slide de apresentação, uma frase em uma imagem que alguém mandou. Em vez de digitar tudo, você deixa o computador ler.

Como usar o conversor

  1. Confira o Idioma da imagem. Nesta página, o português vem selecionado por padrão, então letras como ç, ã, õ e ê são reconhecidas corretamente. Há 12 idiomas ao todo: inglês, espanhol, francês, alemão, italiano, português, japonês, coreano, chinês (simplificado), chinês (tradicional), holandês e hindi. Se a imagem estiver em outra língua, escolha a certa.
  2. Entregue uma imagem à ferramenta de uma destas três maneiras:
    • Arraste um arquivo de imagem para a caixa que diz Solte uma imagem aqui ou escolha um arquivo.
    • Clique em Escolher imagem e selecione um ou mais arquivos.
    • Copie um print e pressione Ctrl+V (Cmd+V no Mac) em qualquer lugar da página, ou clique em Colar imagem.
  3. Acompanhe a barra de progresso. A primeira leitura demora mais porque o programa de leitura e os dados do idioma precisam ser baixados. Depois disso, cada imagem leva alguns segundos.
  4. Leia o resultado em Texto extraído. Você pode editá-lo ali mesmo.
  5. Clique em Copiar, ou em Baixar para salvar como texto-da-imagem.txt.

Se você escolher várias imagens de uma vez, elas são lidas em ordem e o texto de cada uma é acrescentado abaixo do anterior, separado por uma linha em branco. As contagens abaixo do texto mostram o número de Palavras e Caracteres, além da Confiança média do lote.

O que funciona bem e o que não funciona

Imagem O que esperar
Print de uma página web, aplicativo ou documento Muito bom. Texto limpo, nítido e com alto contraste é o mais fácil de ler.
Foto de uma página impressa, tirada de frente e com boa luz Bom. Confira números e pontuação.
Carta ou formulário digitalizado Bom para texto digitado. Caixas e linhas de formulários podem acrescentar caracteres soltos.
Foto tirada de lado, na sombra ou fora de foco Variável. Recorte e tire a foto de novo, se puder.
Texto sobre uma foto cheia de detalhes ou uma estampa Ruim. O fundo confunde o programa.
Letra de mão Ruim, a não ser em letra de forma muito caprichada.
Texto muito pequeno, como uma página inteira em um print pequeno Ruim. Dê zoom e tire um print mais de perto.

Como funciona

A página usa o Tesseract, um programa de OCR de código aberto bastante conhecido, desenvolvido originalmente na Hewlett-Packard e depois liberado ao público. Aqui ele roda por meio do Tesseract.js, uma versão do programa feita para navegadores.

Quando você inicia a primeira leitura, o navegador baixa três coisas de cdn.jsdelivr.net: um pequeno script auxiliar, o programa em si e um arquivo de dados do idioma escolhido. São apenas arquivos de programa e de idioma. O navegador os guarda no cache, então as próximas leituras começam muito mais rápido. Escolher outro idioma baixa o arquivo de dados desse idioma.

Em seguida, o programa encontra as linhas de texto da imagem, divide tudo em palavras e letras e compara as formas com o que aprendeu nos dados de treinamento. Tudo isso acontece no seu computador ou celular. A imagem é lida da memória do aparelho e nunca é enviada, o que torna a ferramenta segura para prints com informações pessoais.

Dicas para resultados melhores

  • Recorte até o texto. Tire bordas, fotos e ícones em volta do texto antes de soltar a imagem.
  • Quanto maior, melhor. Letras grandes e nítidas são lidas muito melhor que letras pequenas. Dê zoom na página antes de tirar o print.
  • Escolha o idioma certo. Letras acentuadas como é, ã, ç e ü são lidas com muito mais precisão quando o idioma correspondente está selecionado. Com o inglês selecionado, um texto em português costuma perder acentos e cedilhas. Para japonês, coreano e chinês, o idioma certo é indispensável, porque essas escritas usam conjuntos de caracteres próprios.
  • Endireite as fotos. Segure a câmera bem acima da página, enquadre só o texto e evite sombras.
  • Faça uma limpeza depois. O texto de uma foto muitas vezes tem quebras de linha no meio das frases. Cole na ferramenta de remover quebras de linha para juntar as linhas e use o conversor de texto simples para corrigir aspas e espaços estranhos.
  • Revise. Os erros de OCR parecem palavras de verdade, como “rn” lido como “m” ou “0” lido como “O”. Leia duas vezes números, nomes e endereços de e-mail.

As fotos de celular salvas no formato HEIC não podem ser lidas pela maioria dos navegadores. Salve ou compartilhe a foto como JPG antes.

Outras formas de tirar o texto de uma imagem

Google Docs. Envie a imagem para o Google Drive, clique nela com o botão direito e escolha Abrir com, depois Documentos Google. O texto aparece abaixo da imagem em um novo documento. Esse método envia a imagem para o Google.

Microsoft OneNote e Word. No OneNote para Windows, cole a imagem, clique com o botão direito e escolha a opção de copiar o texto da imagem. O Word consegue abrir um PDF e convertê-lo em documento editável, o que funciona melhor com digitalizações limpas.

Seu celular. As versões recentes do iOS e do Android deixam você selecionar o texto direto em fotos e prints. Mantenha o dedo pressionado sobre o texto no aplicativo de Fotos ou Galeria.

Código. O Tesseract pode ser instalado no Windows, no macOS e no Linux e executado pela linha de comando com tesseract image.png output, que salva o texto em output.txt. Para português, acrescente -l por. Programas em Python costumam usá-lo pelo pacote pytesseract.

Imagem em texto: perguntas e respostas

Como converter uma imagem em texto?

Arraste a imagem para a caixa, clique em Escolher imagem ou copie um print e pressione Ctrl+V nesta página. O idioma já vem como Português nesta página. Se o texto estiver em outra língua, escolha o idioma certo antes. O texto extraído aparece à direita, onde você pode corrigi-lo e clicar em Copiar.

Minha imagem é enviada para algum servidor?

Não. O texto é lido no seu próprio aparelho. Na primeira vez que você usa a ferramenta, o navegador baixa o programa de leitura e os dados do idioma de cdn.jsdelivr.net, um serviço público de arquivos. A imagem em si nunca é enviada para lugar nenhum.

Ele consegue ler letra de mão?

Só letra de forma bem caprichada, e mesmo assim sem muita confiabilidade. O programa foi treinado com texto impresso e digitado. Letra cursiva costuma sair como uma mistura de letras certas e erradas.

Posso converter um PDF em texto aqui?

Não diretamente. A ferramenta lê arquivos de imagem: PNG, JPG, WebP, BMP e GIF. Tire um print da página do PDF, ou exporte a página como imagem, e solte aqui. Se o PDF foi gerado a partir de um documento de texto, normalmente dá para selecionar e copiar o texto sem OCR.

O que significa o número de Confiança?

É a própria estimativa do programa sobre o quanto ele tem certeza do texto, de 0 a 100 por cento, em média para todas as imagens do lote. Um número baixo é sinal para revisar o resultado com atenção. Um número alto não garante que não haja erros.

Mais ferramentas de texto

Ver todas as ferramentas