キリル文字 OCR

● 100%ブラウザで:何もアップロードされていません

Loading…

画像からキリル文字を読み取ると、ブルガリア語、マケドニア語、セルビア語、カザフ語、モンゴル語、そして約30文字が同じページに英語で読み上げられ、同じモデルが読みます。もしあなたの文書がロシア語、ウクライナ語、ベラルーシ語であれば、代わりに東スラブ語のパックを使いましょう。これはこれら3つに特化して訓練されており、この一般的なものよりも正確です。

使い方

  1. 画像や PDFを投稿してください。テキスト検出は即座に作動します。
  2. 言語パック(ダウンロード1回、8〜17MB)を選んで「テキストを読む」ボタンを押します。
  3. セリフをコピーするか、.txt/.jsonをダウンロードしてください。PDFは最初から最後まで読み進めます。

よくある質問

キリル文字か東スラヴ文字か — どちらがいいのか?
ロシア語、ウクライナ語、ベラルーシ語は東スラブ語、これはキリル文字で書かれたすべてのものに対して。どちらも約8MBで、英語も読み取れますし、ページを読み込まずにピッカーでパックを切り替えられます。
私のファイルはアップロードされますか?
いいえ。モデルやすべての処理は、自分のデバイス上のブラウザ内で動作します。ご自身で確認できます:ブラウザの DevToolsを開き、ネットワークタブを見てファイルを処理すると、アップロードはありません。初回訪問後はほとんどのツールも完全にオフラインで動作します。
どの言語が対応していますか?
ラテン文字、キリル文字、アラビア文字、デーヴァナーガリー文字、 CJK文字、ギリシャ文字、タイ文字、タミル文字、テルグ文字で106言語が書かれています。ベンガル語が唯一の大きなギャップで、まだv5モデルが存在せず、選ぶ人が推測ではなくそう言っています。
その精度はどのくらいですか?
クリーンな文書テキストでは、測定された文字誤り率は2%未満で、各行に信頼度スコアが付いているので、どの行をチェックすべきかがわかります。手書きや低解像度の写真は読みにくいです。
スキャンされたPDFは読み取れますか?
はい。デジタルPDFは独自のテキストレイヤーから読み上げられ、正確な文字が正確な位置に記載されています。スキャンされたページは検出と認識を経て、混合文書は両方を使用します。

関連ツール