Imagem para texto (OCR)

Extraia o texto de uma foto ou captura de tela.

Funciona no navegador. Seus arquivos nunca saem do seu dispositivo.

Como extrair texto de uma imagem

  1. Solte uma foto ou captura de tela aqui.
  2. Espere alguns segundos enquanto o texto é lido.
  3. Copie ou baixe o resultado.

O que o OCR lê bem

OrigemResultado
Captura de tela limpa de texto digitadoExcelente, geralmente 95% de confiança ou mais
Digitalização de documento impressoMuito bom
Foto de uma placa ou página, de frenteBom
Foto em ângulo, tremida ou com pouca luzRuim, muitos erros
Letra manuscritaPouco confiável, funciona melhor em letra de forma bem caprichada

Como funciona o nível de confiança

O mecanismo de OCR retorna uma porcentagem de confiança para toda a extração, sua própria estimativa de quão certo ele está do texto que encontrou. Acima de cerca de 90, o resultado costuma ser preciso. Abaixo de 70, compare a saída com a imagem original antes de confiar nela, principalmente para nomes, números e datas que um pequeno erro de leitura mudaria.

Como conseguir um resultado melhor

  • Corte qualquer coisa que não seja texto antes de enviar, como um fundo carregado ou uma foto, já que o OCR tenta ler padrões em tudo.
  • Endireite uma foto tirada em ângulo primeiro com a ferramenta Girar imagem do TabbyKit. Texto inclinado atrapalha a detecção de linhas.
  • Uma resolução maior ajuda até certo ponto. Uma foto tremida em alta resolução ainda lê pior do que uma foto nítida em resolução menor.
  • Uma iluminação boa e uniforme, sem reflexo, vence uma foto mais clara mas com luz irregular.
  • Uma digitalização plana e de frente de uma página quase sempre supera uma foto da mesma página tirada à mão, mesmo com uma boa câmera.

Como funciona esse mecanismo de OCR

Esta ferramenta roda o Tesseract, um mecanismo de OCR de código aberto desenvolvido originalmente na HP e hoje mantido pelo Google, totalmente dentro do seu navegador como WebAssembly. O modelo de reconhecimento de texto em inglês é baixado uma vez, e toda foto depois disso é lida no seu dispositivo, sem servidor envolvido.

Perguntas frequentes sobre Imagem para texto

Quais idiomas essa ferramenta suporta?

No momento, esta ferramenta lê texto em inglês. Os melhores resultados são em texto impresso ou digitado e bem legível.

Ela consegue ler letra manuscrita?

Às vezes consegue ler uma letra manuscrita bem caprichada, mas o OCR foi feito para texto impresso e tem dificuldade com letra cursiva ou manuscrita bagunçada.

O que significa o nível de confiança?

É a própria estimativa do mecanismo de OCR sobre o quanto ele tem certeza do texto, de 0 a 100. Acima de cerca de 90 o resultado costuma ser preciso; abaixo de 70, confira com a imagem original.

Por que uma captura de tela lê melhor do que uma foto?

Capturas de tela e digitalizações têm iluminação uniforme e bordas nítidas. Uma foto tirada em ângulo, com sombras ou desfoque, dá menos informação para o OCR trabalhar.

Minha imagem é enviada para um servidor?

Não. O mecanismo de OCR é baixado uma vez para o seu navegador, e toda foto depois disso é lida no seu próprio dispositivo.

Por que ele falhou ao ler minha imagem?

Isso é raro, e só acontece se o próprio arquivo de imagem não puder ser decodificado. Tente outra foto ou uma captura de tela direta, em vez de uma foto de uma tela.

Posso copiar só parte do texto extraído?

Sim. O resultado aparece em uma caixa de texto editável, então você pode selecionar, copiar ou editar qualquer parte antes de baixar.

Funciona em um PDF?

Não diretamente. Tire uma captura de tela da página do PDF ou exporte-a como imagem primeiro, depois solte essa imagem aqui.

Posso usar isso no celular?

Sim. Tudo roda no navegador, incluindo Safari e Chrome no celular, embora uma foto muito grande possa levar alguns segundos a mais em um aparelho mais antigo.

Ferramentas relacionadas