Ảnh sang văn bản

● 100% trong trình duyệt: không có gì được tải lên

Loading…

Biến ảnh thành văn bản có thể bôi đen và tìm kiếm. Bước dò tìm xác định từng dòng, bước nhận dạng đọc chúng bằng gói ngôn ngữ bạn chọn, và mỗi dòng đều kèm điểm tin cậy để bạn biết chỗ nào cần soát lại. Ảnh không bao giờ rời khỏi trình duyệt của bạn.

Cách hoạt động

  1. Thả một ảnh hoặc tệp PDF. Việc dò tìm chữ chạy ngay lập tức.
  2. Chọn gói ngôn ngữ (chỉ tải một lần, 8–17 MB) rồi nhấn Đọc văn bản.
  3. Sao chép các dòng, hoặc tải về .txt / .json. Tệp PDF được đọc từ đầu đến cuối.

Câu hỏi thường gặp

Tệp của tôi có bị tải lên máy chủ không?
Không. Các mô hình và toàn bộ quá trình xử lý đều chạy bên trong trình duyệt, trên chính thiết bị của bạn. Bạn có thể tự kiểm chứng: mở công cụ dành cho nhà phát triển, theo dõi tab Network rồi xử lý một tệp — sẽ không có lượt tải lên nào. Sau lần truy cập đầu tiên, hầu hết công cụ còn chạy được hoàn toàn ngoại tuyến.
Hỗ trợ những ngôn ngữ nào?
106 ngôn ngữ thuộc các hệ chữ Latinh, Kirin, Ả Rập, Devanagari, Trung–Nhật–Hàn, Hy Lạp, Thái, Tamil và Telugu. Tiếng Bengal là khoảng trống lớn duy nhất, vì chưa có mô hình phiên bản 5 cho nó, và phần chọn ngôn ngữ nói thẳng điều đó thay vì đoán bừa.
Độ chính xác thế nào?
Với chữ tài liệu rõ nét, tỉ lệ lỗi ký tự đo được dưới 2%, và mỗi dòng đều có điểm tin cậy để bạn biết dòng nào cần kiểm tra. Chữ viết tay và ảnh độ phân giải thấp sẽ đọc kém hơn.
Có đọc được PDF bản quét không?
Có. Tệp PDF dạng số được đọc từ chính lớp văn bản của nó, ký tự và vị trí đều chính xác. Trang quét sẽ đi qua bước dò tìm và nhận dạng, còn tài liệu pha trộn thì dùng cả hai cách.

Công cụ liên quan