OCR telugu

● 100% w przeglądarce: nic nie jest przesyłane

Loading…

Przeczytaj pismo telugu z obrazu. Telugu oznacza klastry spółgłosek, zapisując pod pierwszą formę indeksu drugiej, więc glify układają się pionowo w linii — co jest tym, co ten pakiet jest wytrenowany do czytania i co ogólny model robi błędnie. Angielski na tej samej stronie jest czytany przez ten sam pakiet 7,9 MB.

Jak to działa

  1. Wrzuć zdjęcie lub PDF. Wykrywanie tekstu uruchamia się natychmiast.
  2. Wybierz swój pakiet językowy (pobrany raz, 8–17 MB) i naciśnij Czytaj tekst.
  3. Skopiuj kwestie lub pobierz .txt / .json. PDF-y czyta się od deski do deski.

Najczęstsze pytania

Czy obsługuje ułożone skupiska spółgłosek?
Tak — to właśnie układanie się jest konkretnym powodem, dla którego telugu potrzebuje własnego rozpoznawacza, zamiast dzielić go z innym indyjskim pismem. Wyjście to Unicode Telugu, więc wkleja się do dowolnego edytora, który ma tę czcionkę.
Czy mój plik jest przesyłany?
Nie. Modele i całe przetwarzanie działają w Twojej przeglądarce na twoim urządzeniu. Możesz to sprawdzić sam: otwórz DevTools przeglądarki, obejrzyj zakładkę Sieć i przetworz plik: nie ma żadnych przesłań. Po pierwszej wizycie większość narzędzi działa całkowicie offline.
Które języki są obsługiwane?
106 języków w alfabecie łaciny, cyrylicy, arabskim, dewanagari, CJK, greckim, tajskim, tamilskim i telugu. Bengalski to jedyna główna luka, bo nie istnieje jeszcze model v5 dla niej, a wybierający mówi to zamiast zgadywać.
Jak bardzo jest dokładny?
W czystym tekście dokumentu wskaźnik błędów znaków wynosi poniżej 2%, a każda linijka ma ocenę pewności, więc możesz zobaczyć, które należy sprawdzić. Pismo ręczne i zdjęcia w niskiej rozdzielczości będą wyglądać gorzej.
Czy czyta zeskanowane PDF-y?
Tak. Cyfrowe pliki PDF są odczytywane z własnej warstwy tekstowej, z dokładnymi znakami na dokładnych pozycjach. Zeskanowane strony przechodzą przez wykrywanie i rozpoznawanie, a dokumenty mieszane korzystają z obu tych metod.

Powiązane narzędzia