Lee griego a partir de una foto, escaneo o captura de pantalla: vocales acentuadas, la diaeresi y sigma final (ς) en contraste con la sigma medial (σ) — una distinción que un modelo entrenado con texto latino pierde. El inglés en la misma página es leído por el mismo grupo, lo cual es importante para documentos científicos y matemáticos.
Cómo funciona
- Deja una imagen o PDF. La detección de texto se ejecuta inmediatamente.
- Elige tu paquete de idiomas (descargado una vez, 8–17 MB) y pulsa Leer texto.
- Copia las líneas o descarga .txt / .json. Los PDFs se leen de principio a fin.
Preguntas frecuentes
- ¿Dice griego politónico (antiguo)?
- El pack está entrenado en griego moderno, así que se le da bien el texto monótono. Las respiraciones politónicas y el iota subíndice están fuera de ese entrenamiento — espera que las letras vuelvan y que los diacríticos sean poco fiables.
- ¿Mi archivo se sube?
- No. Los modelos y todo el procesamiento se ejecutan dentro de tu navegador en tu propio dispositivo. Puedes comprobarlo tú mismo: abre la DevTools de tu navegador, mira la pestaña de Red y procesa un archivo: no hay subidas. Después de la primera visita, la mayoría de las herramientas también funcionan completamente offline.
- ¿Qué lenguajes están soportados?
- 106 idiomas en latín, cirílico, árabe, devanagari, CJK, griego, tailandés, tamil y telugu. El bengalí es la única gran diferencia, ya que aún no existe un modelo v5 para él, y el seleccionador lo dice en lugar de adivinar.
- ¿Qué tan precisa es?
- En texto limpio de documentos, la tasa de error de caracteres medida es inferior al 2%, y cada línea lleva una puntuación de confianza para que puedas ver cuáles debes comprobar. La caligrafía y las fotos de baja resolución se leen peor.
- ¿Lee PDFs escaneados?
- Sí. Los PDFs digitales se leen desde su propia capa de texto, con caracteres exactos en posiciones exactas. Las páginas escaneadas pasan por detección y reconocimiento, y los documentos mixtos usan ambos.