Paket terkecil dan tercepat di lokasi dengan 7,8 MB, dilatih hanya dengan bahasa Inggris. Pilih saat Anda sudah tahu halaman tersebut berbahasa Inggris dan ingin unduhan tercepat serta proses tercepat; pilih paket Latin jika dokumen mungkin masuk ke bahasa Eropa lain, dan paket Cina jika ada CJK.
Cara kerjanya
- Tinggalkan gambar atau PDF. Deteksi teks langsung jalan.
- Pilih paket bahasa Anda (diunduh sekali, 8–17 MB) dan tekan Baca teks.
- Salin barisnya, atau unduh .txt / .json. PDF dibaca dari awal hingga akhir.
Pertanyaan umum
- Mengapa memilih ini daripada default?
- Ukuran dan kecepatan unduhan. Versi default terbaca bahasa Mandarin, Jepang, dan Inggris bersamaan dan harganya 16 MB; yang ini berukuran 7,8 MB dan memiliki set karakter yang lebih kecil untuk pencarian, jadi per baris lebih cepat. Pada dokumen hanya berbahasa Inggris, perbedaan akurasi bukanlah apa yang Anda perdagangkan.
- Apakah file saya diunggah?
- Tidak. Model dan semua pemrosesan berjalan di browser Anda di perangkat Anda sendiri. Anda dapat memverifikasi sendiri: buka DevTools browser Anda, perhatikan tab Jaringan, dan proses file: tidak ada unggahan. Setelah kunjungan pertama, sebagian besar alat juga berfungsi sepenuhnya offline.
- Bahasa apa saja yang didukung?
- 106 bahasa dalam aksara Latin, Sirilik, Arab, Devanagari, CJK, Yunani, Thailand, Tamil, dan Telugu. Bengali adalah satu-satunya kekurangan utama, karena belum ada model v5 untuk itu, dan pemilih mengatakan demikian daripada menebak.
- Seberapa akurat itu?
- Pada teks dokumen yang bersih, tingkat kesalahan karakter yang diukur di bawah 2%, dan setiap baris memiliki skor kepercayaan sehingga Anda bisa melihat mana yang harus diperiksa. Tulisan tangan dan foto beresolusi rendah akan terdengar lebih buruk.
- Apakah bisa membaca PDF hasil scan?
- Ya. PDF digital dibaca dari lapisan teks tersendiri, dengan karakter yang tepat pada posisi yang tepat. Halaman yang dipindai melewati deteksi dan pengenalan, dan dokumen campuran menggunakan keduanya.