Hy Lạp OCR

● 100% trên trình duyệt của bạn: không có gì được tải lên

Loading…

Đọc tiếng Hy Lạp từ ảnh, quét hoặc chụp màn hình: nguyên âm có trọng âm, diaeresis và sigma cuối (ς) khác với sigma giữa (σ) — một sự khác biệt mà một mô hình được huấn luyện trên văn bản Latin sẽ mất. Tiếng Anh trên cùng một trang được đọc bởi cùng một bộ bài, điều này rất quan trọng đối với các tài liệu khoa học và toán học.

Cách hoạt động

  1. Thả một hình ảnh hoặc PDF. Phát hiện văn bản chạy ngay lập tức.
  2. Chọn gói ngôn ngữ của bạn (tải về một lần, 8–17 MB) và nhấn Đọc văn bản.
  3. Sao chép các dòng hoặc tải .txt / .json. Các file PDF được đọc từ đầu đến cuối.

Câu hỏi thường gặp

Nó có đọc là tiếng Hy Lạp cổ đại đa âm không?
Bộ truyện được huấn luyện bằng tiếng Hy Lạp hiện đại, nên văn bản đơn điệu là điểm mạnh của nó. Thở đa âm và chỉ số iota nằm ngoài quá trình huấn luyện đó — hãy chuẩn bị tinh thần các chữ cái sẽ quay lại và dấu phụ không đáng tin cậy.
Tệp của tôi có được tải lên không?
Không. Các mô hình và toàn bộ quá trình xử lý đều chạy ngay trong trình duyệt của bạn trên thiết bị của bạn. Bạn có thể tự kiểm tra: mở DevTools trình duyệt, theo dõi tab Mạng và xử lý một tệp: không có tệp tải lên. Sau lần truy cập đầu tiên, hầu hết các công cụ cũng hoạt động hoàn toàn ngoại tuyến.
Những ngôn ngữ nào được hỗ trợ?
106 ngôn ngữ với các chữ Latin, Cyrillic, Ả Rập, Devanagari, CJK, Hy Lạp, Thái, Tamil và Telugu. Tiếng Bengal là khoảng trống lớn duy nhất, vì chưa có mẫu v5 nào cho nó, và người chọn cũng nói vậy thay vì đoán mò.
Độ chính xác của nó đến mức nào?
Trên văn bản sạch trong tài liệu, tỷ lệ lỗi ký tự đo được dưới 2%, và mỗi dòng đều có điểm độ tin cậy để bạn có thể xem cần kiểm tra điểm nào. Chữ viết tay và ảnh độ phân giải thấp sẽ đọc kém hơn.
Nó có đọc được các file PDF đã quét không?
Đúng vậy. PDF kỹ thuật số được đọc từ một lớp văn bản riêng, với ký tự chính xác ở vị trí chính xác. Các trang quét sẽ trải qua phát hiện và nhận dạng, và các tài liệu hỗn hợp sử dụng cả hai.

Công cụ liên quan