Revisa OCR cientos de imágenes en una sola pasada: recibos, escaneos, capturas de pantalla, archivos. Cada imagen produce su propia .txt, y el ZIP también lleva una JSON combinada con cada línea, su posición y su confianza, lista para que un guion la consuma.
Cómo funciona
- Deja una imagen o PDF. La detección de texto se ejecuta inmediatamente.
- Elige tu paquete de idiomas (descargado una vez, 8–17 MB) y pulsa Leer texto.
- Copia las líneas o descarga .txt / .json. Los PDFs se leen de principio a fin.
Preguntas frecuentes
- ¿Cuántos archivos puede llevar un lote?
- Hasta 500 archivos o 2 GB de entrada por ejecución, que se descartaban como archivos sueltos o un solo ZIP. Los objetos se procesan uno a uno en tu dispositivo, no se sube nada y la franja de progreso muestra una fecha estimada estimada por artículo. Trabajos más grandes: divididos en dos drops.
- ¿Qué me corresponde?
- Una ZIP: cada archivo procesado, con el nombre exacto de la descarga de un solo archivo, además de _report.txt y _report.json listando cada entrada y qué le ocurrió, incluyendo cualquiera que falló y por qué. Un lote cancelado sigue descargando los artículos terminados hasta ahora, y el informe lo indica.
- ¿Mi archivo se sube?
- No. Los modelos y todo el procesamiento se ejecutan dentro de tu navegador en tu propio dispositivo. Puedes comprobarlo tú mismo: abre la DevTools de tu navegador, mira la pestaña de Red y procesa un archivo: no hay subidas. Después de la primera visita, la mayoría de las herramientas también funcionan completamente offline.
- ¿Qué lenguajes están soportados?
- 106 idiomas en latín, cirílico, árabe, devanagari, CJK, griego, tailandés, tamil y telugu. El bengalí es la única gran diferencia, ya que aún no existe un modelo v5 para él, y el seleccionador lo dice en lugar de adivinar.
- ¿Qué tan precisa es?
- En texto limpio de documentos, la tasa de error de caracteres medida es inferior al 2%, y cada línea lleva una puntuación de confianza para que puedas ver cuáles debes comprobar. La caligrafía y las fotos de baja resolución se leen peor.
- ¿Lee PDFs escaneados?
- Sí. Los PDFs digitales se leen desde su propia capa de texto, con caracteres exactos en posiciones exactas. Las páginas escaneadas pasan por detección y reconocimiento, y los documentos mixtos usan ambos.