Hangul'u ekran görüntüsü, fotoğraf veya tarama üzerinden okuyun. Korece, harfleri bir satırda yazmak yerine kare hece bloklarına oluşturur, böylece tanıyıcı 24 harf yerine bloklara eğitilir — ve çıktı sıradan Unicode Korece'dir. Aynı sayfadaki İngilizce aynı 13 MB'lık paket tarafından okunuyor.
Nasıl çalışır
- Bir resim veya PDF bırakın. Metin algılama hemen çalışıyor.
- Dil paketinizi seçin (bir kez indirildi, 8–17 MB) ve Metni O'ru tuşuna basın.
- Satırları kopyalayın veya .txt / .json indirin. PDF'ler baştan sona okunabilir.
Sık sorulan sorular
- Hangul kadar Hanja mı okuyordu?
- Karma Hanja bu paketin eğitilmiş olduğu şey değil. Önemli Çince karakterleri içeren bir belge, Çin paketi tarafından daha iyi sunulur; CJK ve İngilizce birlikte okunur — dil seçicisini açın ve tekrar çalıştırın.
- Dosyam yükleniyor mu?
- Hayır. Modeller ve tüm işleme cihazınızda tarayıcınız içinde çalışıyor. Bunu kendiniz doğrulayabilirsiniz: tarayıcınızın DevTools açın, Ağ sekmesini izleyin ve dosyayı işleyin: yükleme yok. İlk ziyaretten sonra çoğu araç tamamen çevrimdışı çalışıyor.
- Hangi diller destekleniyor?
- Latince, Kiril, Arapça, Devanagari, CJK, Yunanca, Tayca, Tamil ve Telugu alfabelerinde 106 dil. Bengalce büyük bir boşluk, çünkü henüz bunun için bir v5 modeli yok ve seçici bunu tahmin etmek yerine söylüyor.
- Ne kadar doğru?
- Temiz belge metininde ölçülen karakter hata oranı %2'nin altındadır ve her satır bir güven puanı taşır, böylece hangilerini kontrol edeceğinizi görebiliyorsunuz. El yazısı ve düşük çözünürlüklü fotoğraflar daha kötü okunur.
- Taranmış PDF'leri okuyor mu?
- Evet. Dijital PDF'ler, kendi metin katmanlarından okunur ve karakterler tam konumlarda yer alır. Taranan sayfalar tespit ve tanıma sürecinden geçerken, karışık belgeler her ikisini de kullanır.