Passe OCR centenas de imagens em uma única passagem: recibos, digitalizações, capturas de tela, arquivos. Cada imagem produz seu próprio .txt, e o ZIP também carrega uma JSON combinada com cada linha, sua posição e sua confiança, pronta para ser consumida pelo roteiro.
Como funciona
- Coloque uma imagem ou PDF. A detecção de texto é executada imediatamente.
- Escolha seu pacote de idiomas (baixado uma vez, 8–17 MB) e pressione Ler texto.
- Copie as falas, ou baixe .txt / .json. PDFs são lidos de capa a capa.
Perguntas frequentes
- Quantos arquivos um lote pode pegar?
- Até 500 arquivos ou 2 GB de entrada por execução, descartados como arquivos soltos ou um único ZIP. Os itens são processados um de cada vez no seu dispositivo, nada é enviado, e a faixa de progresso mostra um tempo estimado de chegada por item. Trabalhos maiores: dividir em duas quedas.
- O que eu ganho de volta?
- Um ZIP: cada arquivo processado, nomeado exatamente como o download de arquivo único, além de _report.txt e _report.json listando cada entrada e o que aconteceu com ela, incluindo qualquer que falhou e por quê. Um lote cancelado ainda baixa os itens finalizados até então, com o relatório dizendo isso.
- Meu arquivo é enviado?
- Não. Os modelos e todo o processamento rodam dentro do seu navegador, no seu próprio dispositivo. Você pode verificar isso por conta própria: abra a DevTools do seu navegador, observe a aba Rede e processe um arquivo: não há uploads. Após a primeira visita, a maioria das ferramentas também funciona totalmente offline.
- Quais linguagens são suportadas?
- 106 línguas em latim, cirílico, árabe, devanagari, CJK, grego, tailandês, tâmil e telugu. O bengali é a única grande lacuna, já que ainda não existe um modelo v5 para ele, e quem escolheu isso diz em vez de adivinhar.
- Quão preciso é isso?
- Em texto limpo de documentos, a taxa de erro de caracteres medida é inferior a 2%, e cada linha carrega uma pontuação de confiança, então você pode ver quais verificar. A caligrafia e fotos de baixa resolução vão parecer piores.
- Ele lê PDFs escaneados?
- Sim. PDFs digitais são lidos a partir de sua própria camada de texto, com caracteres exatos em posições exatas. Páginas escaneadas passam por detecção e reconhecimento, e documentos mistos usam ambos.