배치 이미지에서 텍스트로 변환

● 100% 브라우저에서: 아무것도 업로드되지 않았습니다

Loading…

수백 장의 이미지를 한 번에 OCR 돌리세요: 영수증, 스캔본, 스크린샷, 아카이브. 각 이미지는 고유한 .txt을 만들어내며, ZIP 또한 각 대사, 위치, 자신감에 하나의 결합된 JSON 을 담고 있어 대본이 소비할 준비가 되어 있다.

사용 방법

  1. 이미지를 올리거나 한 장 PDF주세요. 문자 감지가 즉시 실행됩니다.
  2. 언어 팩(한 번 다운로드, 8–17MB)을 선택하고 텍스트 읽기를 누르세요.
  3. 대사를 복사하거나 .txt / .json를 다운로드하세요. PDF는 처음부터 끝까지 읽습니다.

자주 묻는 질문

한 배치에 몇 개의 파일을 처리할 수 있나요?
최대 500개의 파일 또는 2GB의 입력이 실행에 해당하며, 느슨한 파일이나 단일 ZIP로 삭제됩니다. 아이템은 기기에서 하나씩 처리되고, 아무것도 업로드되지 않으며, 진행 스트립에는 아이템별 예상 완료 시간이 표시됩니다. 더 큰 작업: 두 개의 드롭으로 나누세요.
내가 얻는 건 뭐야?
한 ZIP: 처리된 모든 파일 이름이 단일 파일 다운로드와 똑같이 명명되고, 각 입력과 그 입력에 무슨 일이 있었는지, 실패한 입력과 그 이유까지 나열한 _report.txt과 _report.json. 취소된 배치도 지금까지 완료된 아이템을 다운로드하며, 보고서에도 그렇게 나와 있습니다.
제 파일이 업로드되나요?
아니. 모델과 모든 처리 과정은 사용자의 브라우저 내에서 자신의 기기에서 실행됩니다. 직접 확인해 보세요: 브라우저 DevTools를 열고 네트워크 탭을 확인한 후 파일을 처리하면 업로드가 없습니다. 첫 방문 후에는 대부분의 도구도 완전히 오프라인으로 작동합니다.
어떤 언어가 지원되나요?
라틴어, 키릴 문자, 아랍어, 데바나가리어, CJK어, 그리스어, 태국어, 타밀어, 텔루구 문자 등 106개 언어가 포함되어 있습니다. 벵골어가 유일한 큰 공백인데, 아직 v5 모델이 없고, 피커가 추측하기보다는 그렇게 말합니다.
정확도는 어느 정도인가요?
깨끗한 문서 텍스트에서는 측정된 문자 오류율이 2% 미만이며, 각 줄마다 신뢰도 점수가 있어 어떤 항목을 확인해야 하는지 알 수 있습니다. 필체나 저해상도 사진은 더 잘 읽히지 않습니다.
스캔된 PDF를 읽나요?
네. 디지털 PDF는 자체 텍스트 레이어에서 읽히며, 정확한 위치에 정확한 문자가 있습니다. 스캔된 페이지는 감지와 인식을 거치며, 혼합 문서는 두 가지 모두를 사용합니다.

관련 도구