画像を、選択も検索もできるテキストに変換します。検出が一行ずつ文字の場所を見つけ、選んだ言語パックで読み取り、各行に信頼度スコアが付くので確認すべき箇所がひと目でわかります。画像がブラウザの外に出ることはありません。
使い方
- 画像か PDF をドロップすると、すぐに文字の検出が始まります。
- 言語パックを選び(初回のみ 8〜17 MB のダウンロード)、「文字を読み取る」を押します。
- 読み取った行をコピーするか、.txt / .json でダウンロード。PDF は最初から最後まで読み取ります。
よくある質問
- ファイルはアップロードされますか?
- いいえ。モデルもすべての処理も、あなたのブラウザの中、あなたの端末上で動作します。ご自分で確かめられます。ブラウザのデベロッパーツールを開いて「ネットワーク」タブを見ながらファイルを処理してください。アップロードは一切発生しません。初回アクセス以降は、ほとんどのツールが完全にオフラインでも動作します。
- 対応している言語は?
- ラテン文字、キリル文字、アラビア文字、デーヴァナーガリー、中日韓、ギリシャ文字、タイ文字、タミル文字、テルグ文字にわたる 106 言語です。ベンガル語だけは大きな空白で、対応する v5 モデルがまだ存在しません。言語選択画面でも推測でごまかさず、その旨をはっきり示しています。
- 精度はどのくらいですか?
- きれいな書類の文字であれば、実測の文字誤り率は 2% 未満です。各行に信頼度スコアが付くので、確認すべき行がわかります。手書きや解像度の低い写真では精度が落ちます。
- スキャンした PDF も読めますか?
- 読めます。デジタル作成の PDF は元々のテキストレイヤーから読み取るので、文字も位置も正確です。スキャンされたページは検出と認識の処理を通し、両方が混在する書類では両方の方法を使い分けます。