Lesen Sie kyrillische Schrift aus einem Bild: bulgarisch, mazedonisch, serbisch, kasachisch, mongolisch und etwa 30 weitere, wobei Englisch auf derselben Seite vom gleichen Modell gelesen wird. Wenn dein Dokument russisch, ukrainisch oder belarussisch ist, verwende stattdessen das ostslawische Paket – es ist speziell auf diese drei zugeschnitten und genauer als dieses allgemeine.
So funktioniert es
- Ein Bild oder PDF. Die Texterkennung läuft sofort.
- Wählen Sie Ihr Sprachpaket (einmal heruntergeladen, 8–17 MB) und drücken Sie auf Text lesen.
- Kopieren Sie die Zeilen oder laden Sie .txt / .json herunter. PDFs werden von Anfang bis Ende gelesen.
Häufige Fragen
- Kyrillisch oder ostslawisch – was möchte ich?
- Ostslawisch für Russisch, Ukrainisch und Belarussisch; diesmal für alles andere, was in kyrillisch geschrieben ist. Beide sind etwa 8 MB groß, beide lesen auch Englisch, und man kann im Picker die Pakete wechseln, ohne die Seite neu laden zu müssen.
- Wird meine Datei hochgeladen?
- Nein. Die Modelle und die gesamte Verarbeitung laufen in deinem Browser auf deinem eigenen Gerät. Du kannst das selbst überprüfen: Öffne die DevTools deines Browsers, schau dir den Netzwerk-Tab an und bearbeite eine Datei: Es gibt keine Uploads. Nach dem ersten Besuch funktionieren die meisten Tools auch vollständig offline.
- Welche Sprachen werden unterstützt?
- 106 Sprachen in lateinischen, kyrillischen, arabischen, Devanagari, CJK, griechischen, thailändischen, tamilischen und teluguischen Schriften. Bengali ist die einzige große Lücke, da es dafür noch kein v5-Modell gibt und der Picker das sagt, anstatt zu raten.
- Wie genau ist das?
- Bei sauberem Dokumenttext liegt die gemessene Fehlerquote unter 2 %, und jede Zeile trägt einen Konfidenzwert, sodass man sehen kann, welche man überprüfen sollte. Handschrift und Fotos in niedriger Auflösung werden schlechter wirken.
- Liest es gescannte PDFs?
- Ja. Digitale PDFs werden von einer eigenen Textschicht aus gelesen, mit exakten Zeichen an exakten Stellen. Gescannte Seiten werden erkannt und erkannt, und gemischte Dokumente verwenden beides.