İspanyol OCR

● %100 tarayıcınızda: hiçbir şey yüklenmiyor

Loading…

İspanyolcayı bir fotoğraftan, taramadan veya ekran görüntüsünden okuyun; vurgulu ünlülerle, ñ ve ters ¿ ¡ normal karakterler olarak işlenir, düşürülerek değil. 8 MB'lik bir model, Fransızca, Almanca, Portekizce, İtalyanca, Flemenkçe, Lehçe, Türkçe, Vietnamca ve daha fazlası olan 47 Latin alfabesini kapsamaktadır, yani aralarında geçiş yapan bir belge yine de tek geçiş süresi olur.

Nasıl çalışır

  1. Bir resim veya PDF bırakın. Metin algılama hemen çalışıyor.
  2. Dil paketinizi seçin (bir kez indirildi, 8–17 MB) ve Metni O'ru tuşuna basın.
  3. Satırları kopyalayın veya .txt / .json indirin. PDF'ler baştan sona okunabilir.

Sık sorulan sorular

Bu model Fransız mı yoksa Alman mı OCR?
Evet. PaddleOCR, her SCRIPT için bir tanıyıcı eğitir, dil başına değil ve 47 Latin alfabesi dili bu 8 MB paketi paylaşır. Bu yüzden 47 neredeyse aynı sayfa yerine bir sayfa var — zaten doğru sayfadasınız.
Dosyam yükleniyor mu?
Hayır. Modeller ve tüm işleme cihazınızda tarayıcınız içinde çalışıyor. Bunu kendiniz doğrulayabilirsiniz: tarayıcınızın DevTools açın, Ağ sekmesini izleyin ve dosyayı işleyin: yükleme yok. İlk ziyaretten sonra çoğu araç tamamen çevrimdışı çalışıyor.
Hangi diller destekleniyor?
Latince, Kiril, Arapça, Devanagari, CJK, Yunanca, Tayca, Tamil ve Telugu alfabelerinde 106 dil. Bengalce büyük bir boşluk, çünkü henüz bunun için bir v5 modeli yok ve seçici bunu tahmin etmek yerine söylüyor.
Ne kadar doğru?
Temiz belge metininde ölçülen karakter hata oranı %2'nin altındadır ve her satır bir güven puanı taşır, böylece hangilerini kontrol edeceğinizi görebiliyorsunuz. El yazısı ve düşük çözünürlüklü fotoğraflar daha kötü okunur.
Taranmış PDF'leri okuyor mu?
Evet. Dijital PDF'ler, kendi metin katmanlarından okunur ve karakterler tam konumlarda yer alır. Taranan sayfalar tespit ve tanıma sürecinden geçerken, karışık belgeler her ikisini de kullanır.

İlgili araçlar