Baca aksara Sirilik dari sebuah gambar: Bulgaria, Makedonia, Serbia, Kazakh, Mongolia, dan sekitar 30 lainnya, dengan bahasa Inggris di halaman yang sama dibaca oleh model yang sama. Jika dokumen Anda berbahasa Rusia, Ukraina, atau Belarus, gunakan paket Slavia Timur sebagai gantinya — paket ini dilatih khusus pada ketiga hal tersebut dan lebih akurat dibandingkan yang umum ini.
Cara kerjanya
- Tinggalkan gambar atau PDF. Deteksi teks langsung jalan.
- Pilih paket bahasa Anda (diunduh sekali, 8–17 MB) dan tekan Baca teks.
- Salin barisnya, atau unduh .txt / .json. PDF dibaca dari awal hingga akhir.
Pertanyaan umum
- Sirilik atau Slavia Timur — mana yang saya inginkan?
- Slavia Timur untuk bahasa Rusia, Ukraina, dan Belarus; yang ini untuk semua yang ditulis dalam Sirilik. Keduanya sekitar 8 MB, keduanya juga bisa membaca bahasa Inggris, dan Anda bisa mengganti paket di picker tanpa memuat ulang halaman.
- Apakah file saya diunggah?
- Tidak. Model dan semua pemrosesan berjalan di browser Anda di perangkat Anda sendiri. Anda dapat memverifikasi sendiri: buka DevTools browser Anda, perhatikan tab Jaringan, dan proses file: tidak ada unggahan. Setelah kunjungan pertama, sebagian besar alat juga berfungsi sepenuhnya offline.
- Bahasa apa saja yang didukung?
- 106 bahasa dalam aksara Latin, Sirilik, Arab, Devanagari, CJK, Yunani, Thailand, Tamil, dan Telugu. Bengali adalah satu-satunya kekurangan utama, karena belum ada model v5 untuk itu, dan pemilih mengatakan demikian daripada menebak.
- Seberapa akurat itu?
- Pada teks dokumen yang bersih, tingkat kesalahan karakter yang diukur di bawah 2%, dan setiap baris memiliki skor kepercayaan sehingga Anda bisa melihat mana yang harus diperiksa. Tulisan tangan dan foto beresolusi rendah akan terdengar lebih buruk.
- Apakah bisa membaca PDF hasil scan?
- Ya. PDF digital dibaca dari lapisan teks tersendiri, dengan karakter yang tepat pada posisi yang tepat. Halaman yang dipindai melewati deteksi dan pengenalan, dan dokumen campuran menggunakan keduanya.