Baca bahasa Rusia dari foto, scan, atau screenshot dengan pengenal yang khusus dilatih pada bahasa Slavia Timur — Rusia, Ukraina, dan Belarus — yang membuatnya lebih akurat untuk ketiga bahasa tersebut dibandingkan paket Sirilik umum yang mencakup sekitar 30 bahasa. Bahasa Inggris pada halaman yang sama dibaca oleh model yang sama.
Cara kerjanya
- Tinggalkan gambar atau PDF. Deteksi teks langsung jalan.
- Pilih paket bahasa Anda (diunduh sekali, 8–17 MB) dan tekan Baca teks.
- Salin barisnya, atau unduh .txt / .json. PDF dibaca dari awal hingga akhir.
Pertanyaan umum
- Apakah tertulis dalam bahasa Ukraina dan Belarus juga?
- Ya. Paket ini dilatih pada ketiga bahasa Slavia Timur secara bersamaan, jadi mencampur dokumen adalah satu kali proses. Untuk bahasa Bulgaria, Serbia, Makedonia, atau Kazakh, beralih ke kelompok Sirilik umum.
- Apakah file saya diunggah?
- Tidak. Model dan semua pemrosesan berjalan di browser Anda di perangkat Anda sendiri. Anda dapat memverifikasi sendiri: buka DevTools browser Anda, perhatikan tab Jaringan, dan proses file: tidak ada unggahan. Setelah kunjungan pertama, sebagian besar alat juga berfungsi sepenuhnya offline.
- Bahasa apa saja yang didukung?
- 106 bahasa dalam aksara Latin, Sirilik, Arab, Devanagari, CJK, Yunani, Thailand, Tamil, dan Telugu. Bengali adalah satu-satunya kekurangan utama, karena belum ada model v5 untuk itu, dan pemilih mengatakan demikian daripada menebak.
- Seberapa akurat itu?
- Pada teks dokumen yang bersih, tingkat kesalahan karakter yang diukur di bawah 2%, dan setiap baris memiliki skor kepercayaan sehingga Anda bisa melihat mana yang harus diperiksa. Tulisan tangan dan foto beresolusi rendah akan terdengar lebih buruk.
- Apakah bisa membaca PDF hasil scan?
- Ya. PDF digital dibaca dari lapisan teks tersendiri, dengan karakter yang tepat pada posisi yang tepat. Halaman yang dipindai melewati deteksi dan pengenalan, dan dokumen campuran menggunakan keduanya.