0 1 0 1 0 1 0 1 0 1 0 1 0 1 0 1 0 1 0 1 0 1 0 1 0
OCR: imagem e PDF para texto
Extraia o texto de uma imagem, captura de tela ou PDF. Nos PDFs combina o texto do próprio documento —incluindo assinaturas e campos— com o reconhecimento óptico (OCR) das imagens. Todo o processo ocorre no seu navegador, sem enviar o arquivo a nenhum servidor.

Arraste uma imagem ou um PDF, ou clique para selecionar

PDF, PNG, JPEG, WebP, GIF, BMP

Escolha um ou mais idiomas presentes na imagem

Como funciona

O OCR (reconhecimento óptico de caracteres) converte o texto que aparece dentro de uma imagem ou PDF —uma foto, uma captura de tela ou um documento digitalizado— em texto editável que você pode copiar, pesquisar ou colar em qualquer lugar.

Você pode escolher um ou mais idiomas para melhorar a precisão: ao indicar o idioma correto, o mecanismo interpreta melhor os acentos, os caracteres especiais e as palavras completas. Na primeira vez que você usa um idioma, o modelo é baixado e depois fica salvo para as próximas vezes.

Todo o reconhecimento ocorre no seu navegador com WebAssembly: o arquivo não é enviado a nenhum servidor. O resultado inclui uma estimativa de confiança para você saber quão confiável foi a leitura.

Casos de uso

  • Copiar o texto de uma captura de tela quando você não consegue selecioná-lo.
  • Digitalizar um documento, fatura ou recibo escaneado para editá-lo.
  • Extrair um trecho de código ou uma mensagem de erro de uma foto.
  • Recuperar texto de uma imagem para traduzir ou pesquisar.
  • Extrair o texto de um PDF, seja digital ou digitalizado, para reutilizá-lo.

Perguntas frequentes

A minha imagem é enviada para algum servidor?

Não. O reconhecimento é executado inteiramente no seu navegador; a imagem nunca sai do seu dispositivo. Somente os modelos de idioma que você escolher são baixados, uma única vez.

Por que devo escolher o idioma do texto?

Cada idioma tem o seu próprio modelo treinado. Selecionar o idioma correto melhora consideravelmente a precisão, sobretudo com acentos e caracteres próprios. Se uma imagem mistura idiomas, você pode selecionar vários ao mesmo tempo.

Como obtenho melhores resultados?

Use imagens nítidas e bem iluminadas, com bom contraste entre o texto e o fundo. Texto horizontal e sem distorção funciona melhor do que fotos em ângulo, borradas ou com letra manuscrita.

Que formatos posso usar?

Você pode usar imagens nos formatos habituais (PNG, JPEG, WebP, GIF e BMP) e também arquivos PDF. Para documentos, uma captura ou digitalização em boa resolução dá melhores resultados.

Como os PDFs são processados?

São percorridos página por página combinando todo o texto disponível: o texto do próprio PDF —incluindo campos de formulário e assinaturas digitais— é extraído de forma direta e exata, e o texto dentro das imagens também é reconhecido com OCR. PDFs "digitais" são lidos na hora; os digitalizados ou com muitas imagens podem demorar mais.