타밀 OCR

● 100% 브라우저에서: 아무것도 업로드되지 않았습니다

Loading…

이미지에서 타밀 문자를 읽어보세요. 타밀어는 모음을 자음 주변에 붙은 기호로 표기하는데, 이는 앞뒤, 위, 또는 양쪽에 동시에 붙어 있기 때문에, 인식자는 군을 왼쪽에서 오른쪽이 아니라 하나의 단위로 읽어야 합니다. 같은 페이지의 영어는 동일한 7.9MB 팩으로 읽히며, 한 번 다운로드하면 오프라인에서 작동합니다.

사용 방법

  1. 이미지를 올리거나 한 장 PDF주세요. 문자 감지가 즉시 실행됩니다.
  2. 언어 팩(한 번 다운로드, 8–17MB)을 선택하고 텍스트 읽기를 누르세요.
  3. 대사를 복사하거나 .txt / .json를 다운로드하세요. PDF는 처음부터 끝까지 읽습니다.

자주 묻는 질문

어떤 타밀어 자료가 가장 잘 읽히나요?
인쇄된 텍스트 — 책, 표지판, 양식, 스크린샷 — 이 훈련된 대상이자 가장 강점이 있는 부분입니다. 손글씨 타밀어는 그 훈련의 일부가 아닙니다. 모든 줄은 신뢰도 점수를 포함하므로, 약한 판독은 조용히 보이지 않고 보이게 됩니다.
제 파일이 업로드되나요?
아니. 모델과 모든 처리 과정은 사용자의 브라우저 내에서 자신의 기기에서 실행됩니다. 직접 확인해 보세요: 브라우저 DevTools를 열고 네트워크 탭을 확인한 후 파일을 처리하면 업로드가 없습니다. 첫 방문 후에는 대부분의 도구도 완전히 오프라인으로 작동합니다.
어떤 언어가 지원되나요?
라틴어, 키릴 문자, 아랍어, 데바나가리어, CJK어, 그리스어, 태국어, 타밀어, 텔루구 문자 등 106개 언어가 포함되어 있습니다. 벵골어가 유일한 큰 공백인데, 아직 v5 모델이 없고, 피커가 추측하기보다는 그렇게 말합니다.
정확도는 어느 정도인가요?
깨끗한 문서 텍스트에서는 측정된 문자 오류율이 2% 미만이며, 각 줄마다 신뢰도 점수가 있어 어떤 항목을 확인해야 하는지 알 수 있습니다. 필체나 저해상도 사진은 더 잘 읽히지 않습니다.
스캔된 PDF를 읽나요?
네. 디지털 PDF는 자체 텍스트 레이어에서 읽히며, 정확한 위치에 정확한 문자가 있습니다. 스캔된 페이지는 감지와 인식을 거치며, 혼합 문서는 두 가지 모두를 사용합니다.

관련 도구