Koreański OCR

● 100% w przeglądarce: nic nie jest przesyłane

Loading…

Odczytaj hangul z zrzutu ekranu, zdjęcia lub skanu. Koreański komponuje litery w kwadratowe bloki sylabowe zamiast pisać je w linii, więc rozpoznawacz jest trenowany na blokach, a nie na 24 literach — a wyjście to zwykły koreański w Unicode. Angielski na tej samej stronie jest czytany przez ten sam pakiet 13 MB.

Jak to działa

  1. Wrzuć zdjęcie lub PDF. Wykrywanie tekstu uruchamia się natychmiast.
  2. Wybierz swój pakiet językowy (pobrany raz, 8–17 MB) i naciśnij Czytaj tekst.
  3. Skopiuj kwestie lub pobierz .txt / .json. PDF-y czyta się od deski do deski.

Najczęstsze pytania

Czy czyta się na Hanja równie dobrze jak na hangulu?
Mieszana Hanja to nie jest to, do czego ten pakiet jest szkolony. Dokument z dużą ilością chińskich znaków lepiej sprawdza się w chińskim pakiecie, który czyta CJK i angielski razem — włącz wybór języka i uruchom go ponownie.
Czy mój plik jest przesyłany?
Nie. Modele i całe przetwarzanie działają w Twojej przeglądarce na twoim urządzeniu. Możesz to sprawdzić sam: otwórz DevTools przeglądarki, obejrzyj zakładkę Sieć i przetworz plik: nie ma żadnych przesłań. Po pierwszej wizycie większość narzędzi działa całkowicie offline.
Które języki są obsługiwane?
106 języków w alfabecie łaciny, cyrylicy, arabskim, dewanagari, CJK, greckim, tajskim, tamilskim i telugu. Bengalski to jedyna główna luka, bo nie istnieje jeszcze model v5 dla niej, a wybierający mówi to zamiast zgadywać.
Jak bardzo jest dokładny?
W czystym tekście dokumentu wskaźnik błędów znaków wynosi poniżej 2%, a każda linijka ma ocenę pewności, więc możesz zobaczyć, które należy sprawdzić. Pismo ręczne i zdjęcia w niskiej rozdzielczości będą wyglądać gorzej.
Czy czyta zeskanowane PDF-y?
Tak. Cyfrowe pliki PDF są odczytywane z własnej warstwy tekstowej, z dokładnymi znakami na dokładnych pozycjach. Zeskanowane strony przechodzą przez wykrywanie i rozpoznawanie, a dokumenty mieszane korzystają z obu tych metod.

Powiązane narzędzia