Sitedeki en küçük ve en hızlı paket 7.8 MB ile sadece İngilizce eğitimi almıştır. Sayfanın İngilizce olduğunu zaten biliyorsanız ve en kısa indirme ile en hızlı yayını istiyorsanız seçin; Belge başka bir Avrupa diline geçebilirse Latince paketi seçin ve herhangi bir CJK taşıyacaksa Çin paketini seçin.
Nasıl çalışır
- Bir resim veya PDF bırakın. Metin algılama hemen çalışıyor.
- Dil paketinizi seçin (bir kez indirildi, 8–17 MB) ve Metni O'ru tuşuna basın.
- Satırları kopyalayın veya .txt / .json indirin. PDF'ler baştan sona okunabilir.
Sık sorulan sorular
- Neden bunu varsayılan yerine seçiyorsun?
- İndirme boyutu ve hızı. Varsayılan olarak Çince, Japonca ve İngilizce birlikte okunur ve 16 MB maliyetindedir; bu 7.8 MB ve arama için daha küçük bir karakter seti var, bu yüzden satır başına daha hızlı. Sadece İngilizce belgelerde doğruluk farkı işlem yaptığınız şey değildir.
- Dosyam yükleniyor mu?
- Hayır. Modeller ve tüm işleme cihazınızda tarayıcınız içinde çalışıyor. Bunu kendiniz doğrulayabilirsiniz: tarayıcınızın DevTools açın, Ağ sekmesini izleyin ve dosyayı işleyin: yükleme yok. İlk ziyaretten sonra çoğu araç tamamen çevrimdışı çalışıyor.
- Hangi diller destekleniyor?
- Latince, Kiril, Arapça, Devanagari, CJK, Yunanca, Tayca, Tamil ve Telugu alfabelerinde 106 dil. Bengalce büyük bir boşluk, çünkü henüz bunun için bir v5 modeli yok ve seçici bunu tahmin etmek yerine söylüyor.
- Ne kadar doğru?
- Temiz belge metininde ölçülen karakter hata oranı %2'nin altındadır ve her satır bir güven puanı taşır, böylece hangilerini kontrol edeceğinizi görebiliyorsunuz. El yazısı ve düşük çözünürlüklü fotoğraflar daha kötü okunur.
- Taranmış PDF'leri okuyor mu?
- Evet. Dijital PDF'ler, kendi metin katmanlarından okunur ve karakterler tam konumlarda yer alır. Taranan sayfalar tespit ve tanıma sürecinden geçerken, karışık belgeler her ikisini de kullanır.