Führe OCR hunderte Bilder in einem Durchgang durch: Quittungen, Scans, Screenshots, Archive. Jedes Bild erzeugt sein eigenes .txt, und das ZIP trägt außerdem eine kombinierte JSON mit jeder Zeile, seiner Position und seiner Zuversicht, bereit für ein Skript zum Konsumieren.
So funktioniert es
- Ein Bild oder PDF. Die Texterkennung läuft sofort.
- Wählen Sie Ihr Sprachpaket (einmal heruntergeladen, 8–17 MB) und drücken Sie auf Text lesen.
- Kopieren Sie die Zeilen oder laden Sie .txt / .json herunter. PDFs werden von Anfang bis Ende gelesen.
Häufige Fragen
- Wie viele Dateien kann ein Batch aufnehmen?
- Bis zu 500 Dateien oder 2 GB Eingabe pro Durchlauf, die als lose Dateien oder als einzelne ZIP entfernt werden. Die Artikel werden einzeln auf deinem Gerät verarbeitet, nichts wird hochgeladen, und der Fortschrittsstreifen zeigt eine ETA-Rate pro Item an. Größere Aufgaben: in zwei Drops aufgeteilt.
- Was bekomme ich zurück?
- Eine ZIP: jede verarbeitete Datei, genau so benannt wie der Einzeldatei-Download, dazu _report.txt und _report.json jede Eingabe und was damit passiert ist, einschließlich aller fehlgeschlagenen Dateien und warum. Eine stornierte Charge lädt die bisher fertigen Artikel trotzdem herunter, was im Bericht so steht.
- Wird meine Datei hochgeladen?
- Nein. Die Modelle und die gesamte Verarbeitung laufen in deinem Browser auf deinem eigenen Gerät. Du kannst das selbst überprüfen: Öffne die DevTools deines Browsers, schau dir den Netzwerk-Tab an und bearbeite eine Datei: Es gibt keine Uploads. Nach dem ersten Besuch funktionieren die meisten Tools auch vollständig offline.
- Welche Sprachen werden unterstützt?
- 106 Sprachen in lateinischen, kyrillischen, arabischen, Devanagari, CJK, griechischen, thailändischen, tamilischen und teluguischen Schriften. Bengali ist die einzige große Lücke, da es dafür noch kein v5-Modell gibt und der Picker das sagt, anstatt zu raten.
- Wie genau ist das?
- Bei sauberem Dokumenttext liegt die gemessene Fehlerquote unter 2 %, und jede Zeile trägt einen Konfidenzwert, sodass man sehen kann, welche man überprüfen sollte. Handschrift und Fotos in niedriger Auflösung werden schlechter wirken.
- Liest es gescannte PDFs?
- Ja. Digitale PDFs werden von einer eigenen Textschicht aus gelesen, mit exakten Zeichen an exakten Stellen. Gescannte Seiten werden erkannt und erkannt, und gemischte Dokumente verwenden beides.