OCR de imagens — extraia texto de fotos e capturas

Extraia texto de fotos e capturas de tela com um motor OCR WASM que roda inteiramente no seu navegador — sem uploads, com modelos em inglês, espanhol, português e indonésio.

Sua imagem é processada inteiramente no seu navegador com Tesseract.js — nunca é enviada. Apenas o arquivo de modelo de idioma público é baixado de uma CDN no primeiro uso.

Extraia texto de uma imagem

Solte uma imagem aqui ou clique para procurar — PNG, JPG ou WebP · processado localmente

O primeiro uso baixa o modelo de idioma (alguns MB); depois fica em cache.
Pré-visualização da imagem
Texto reconhecido

Como funciona

O reconhecimento é feito pelo Tesseract, um motor OCR open-source compilado para WebAssembly. A imagem, o texto extraído e todos os buffers intermediários ficam na sua aba do navegador — não há endpoint de upload, nem conta, nem requisição que leve seus pixels.

Um motor WASM, totalmente no navegador
O Tesseract.js executa o mesmo motor C++ usado por apps nativos, compilado para WebAssembly e rodando em um worker em segundo plano, então a página continua responsiva enquanto o texto é reconhecido. Todo o pipeline — análise de layout, segmentação de palavras, classificação de caracteres LSTM — acontece no seu dispositivo.
O primeiro uso baixa o modelo de idioma
Cada idioma precisa do seu arquivo traineddata (aprox. 2–15 MB; inglês cerca de 10 MB). Ele é baixado uma vez de uma CDN pública e o navegador o mantém em cache, então visitas seguintes e o uso offline na mesma sessão funcionam da mesma forma. Trocar de idioma dispara um download equivalente.
Capturas versus fotos
Capturas são o caso fácil: glifos nítidos sobre fundo plano, precisão quase perfeita. Fotos exigem mais — iluminação uniforme, página plana e paralela à câmera, texto preenchendo o quadro. Fontes pequenas abaixo de ~10 px, páginas curvas, sombras e borrão de movimento degradam o resultado, então recorte bem a região desejada.
Não para letra de mão
Os modelos são treinados com tipo impresso. Cursiva, letra pessoal e tipografia estilizada são lidas de forma não confiável — para esses casos, fluxos com texto impresso ou transcrição manual continuam sendo as opções honestas.

Perguntas frequentes

Ele lê letra de mão?

Não. O Tesseract é treinado com tipografia impressa — livros, documentos, capturas de tela e placas. Letra cursiva e caligrafia descuidada são lidas mal ou não são lidas. Texto impresso em tamanho razoável é onde ele se destaca.

Ele lê PDF?

Esta página aceita apenas arquivos de imagem — PNG, JPG e WebP. Para um PDF, use a ferramenta irmã, o Extrator de Texto de PDF, que lê a camada de texto embutida de um documento página por página, sem nenhum OCR.

De onde vem o modelo de idioma e ele funciona offline depois?

No primeiro uso, o navegador baixa um pequeno modelo treinado (alguns MB) do idioma selecionado da CDN do Tesseract, junto com o motor WASM. O navegador guarda esses arquivos em cache, então visitas seguintes — e até uma aba offline após um carregamento — reconhecem texto sem baixar nada.

Quão preciso é e como consigo os melhores resultados?

Capturas de tela ficam quase perfeitas: texto nítido sobre fundo plano. Fotos dependem da qualidade da captura — iluminação uniforme, página plana e reta, texto preenchendo o quadro. Texto borrado, inclinado ou muito pequeno causa a maioria dos erros, então recorte bem a região desejada.

Minha imagem é enviada para um servidor?

Não. O OCR roda 100% no seu navegador com WebAssembly — a imagem em si nunca é enviada. O único tráfego de rede é o arquivo de modelo público e pré-compilado que todos os visitantes baixam uma vez da mesma URL da CDN.

Precisa de texto de um PDF em vez de uma imagem? A ferramenta irmã Extrator de Texto de PDF lê a camada de texto embutida do documento página por página — sem OCR.