OCR grega

● 100% no seu navegador: nada é enviado

Loading…

Leia o grego a partir de uma foto, escaneamento ou captura de tela: vogais acentuadas, a diaerese e sigma final (ς) em contraste com sigma medial (σ) — uma distinção que um modelo treinado em texto latino perde. O inglês na mesma página é lido pelo mesmo pacote, o que importa para documentos científicos e matemáticos.

Como funciona

  1. Coloque uma imagem ou PDF. A detecção de texto é executada imediatamente.
  2. Escolha seu pacote de idiomas (baixado uma vez, 8–17 MB) e pressione Ler texto.
  3. Copie as falas, ou baixe .txt / .json. PDFs são lidos de capa a capa.

Perguntas frequentes

Está escrito em grego politônico (antigo)?
O grupo é treinado com grego moderno, então texto monótono é o que ele faz bem. Respirações politônicas e o subscrito iota estão fora desse treinamento — espere que as letras voltem e que os diacríticos sejam pouco confiáveis.
Meu arquivo é enviado?
Não. Os modelos e todo o processamento rodam dentro do seu navegador, no seu próprio dispositivo. Você pode verificar isso por conta própria: abra a DevTools do seu navegador, observe a aba Rede e processe um arquivo: não há uploads. Após a primeira visita, a maioria das ferramentas também funciona totalmente offline.
Quais linguagens são suportadas?
106 línguas em latim, cirílico, árabe, devanagari, CJK, grego, tailandês, tâmil e telugu. O bengali é a única grande lacuna, já que ainda não existe um modelo v5 para ele, e quem escolheu isso diz em vez de adivinhar.
Quão preciso é isso?
Em texto limpo de documentos, a taxa de erro de caracteres medida é inferior a 2%, e cada linha carrega uma pontuação de confiança, então você pode ver quais verificar. A caligrafia e fotos de baixa resolução vão parecer piores.
Ele lê PDFs escaneados?
Sim. PDFs digitais são lidos a partir de sua própria camada de texto, com caracteres exatos em posições exatas. Páginas escaneadas passam por detecção e reconhecimento, e documentos mistos usam ambos.

Ferramentas relacionadas