OCR arabski

● 100% w przeglądarce: nic nie jest przesyłane

Loading…

Czytaj pismo arabskie z obrazu, z zachowaną kolejnością czytania od prawej do lewej w wydruku, a nie odwróconą. Litery arabskie zmieniają kształt w zależności od pozycji w słowie, co sprawia, że pismo jest trudne dla OCR i do czego ten pakiet jest przygotowany. Ten sam model to perski, urdu, ujgurski, pasztoński, kurdyjski, sindhijski i beludżski.

Jak to działa

  1. Wrzuć zdjęcie lub PDF. Wykrywanie tekstu uruchamia się natychmiast.
  2. Wybierz swój pakiet językowy (pobrany raz, 8–17 MB) i naciśnij Czytaj tekst.
  3. Skopiuj kwestie lub pobierz .txt / .json. PDF-y czyta się od deski do deski.

Najczęstsze pytania

Czy tekst jest od prawej do lewej na wyjściu?
Yes. Reading order comes from the language pack rather than from guessing at the characters, so Latin words inside an Arabic line are left alone instead of being flipped. The searchable-PDF export writes the same order.
Czy mój plik jest przesyłany?
Nie. Modele i całe przetwarzanie działają w Twojej przeglądarce na twoim urządzeniu. Możesz to sprawdzić sam: otwórz DevTools przeglądarki, obejrzyj zakładkę Sieć i przetworz plik: nie ma żadnych przesłań. Po pierwszej wizycie większość narzędzi działa całkowicie offline.
Które języki są obsługiwane?
106 języków w alfabecie łaciny, cyrylicy, arabskim, dewanagari, CJK, greckim, tajskim, tamilskim i telugu. Bengalski to jedyna główna luka, bo nie istnieje jeszcze model v5 dla niej, a wybierający mówi to zamiast zgadywać.
Jak bardzo jest dokładny?
W czystym tekście dokumentu wskaźnik błędów znaków wynosi poniżej 2%, a każda linijka ma ocenę pewności, więc możesz zobaczyć, które należy sprawdzić. Pismo ręczne i zdjęcia w niskiej rozdzielczości będą wyglądać gorzej.
Czy czyta zeskanowane PDF-y?
Tak. Cyfrowe pliki PDF są odczytywane z własnej warstwy tekstowej, z dokładnymi znakami na dokładnych pozycjach. Zeskanowane strony przechodzą przez wykrywanie i rozpoznawanie, a dokumenty mieszane korzystają z obu tych metod.

Powiązane narzędzia