Przetwarzanie obrazu wsadowego na tekst

● 100% w przeglądarce: nic nie jest przesyłane

Loading…

Przejrzyj OCR setki obrazów za jednym przejściem: paragony, skany, zrzuty ekranu, archiwa. Każdy obraz generuje własny .txt, a ZIP niesie także jeden połączony JSON z każdą linijką, jej pozycją i pewnością siebie, gotową do pochłonięcia przez scenariusz.

Jak to działa

  1. Wrzuć zdjęcie lub PDF. Wykrywanie tekstu uruchamia się natychmiast.
  2. Wybierz swój pakiet językowy (pobrany raz, 8–17 MB) i naciśnij Czytaj tekst.
  3. Skopiuj kwestie lub pobierz .txt / .json. PDF-y czyta się od deski do deski.

Najczęstsze pytania

Ile plików może przyjąć jedna partia?
Do 500 plików, czyli 2 GB wejścia na jeden ruch, porzucanych jako luźne pliki lub pojedyncza ZIP. Przedmioty są przetwarzane pojedynczo na urządzeniu, nic nie jest przesyłane, a pasek postępu pokazuje przewidywany czas na każdy przedmiot. Większe zlecenia: podzielone na dwie zrzuty.
Co dostanę z powrotem?
Jeden ZIP: każdy przetworzony plik, nazwany dokładnie tak, jak pojedynczy plik pobierany, plus _report.txt i _report.json z listą każdego wejścia i tego, co się z nim stało, włącznie z tym, co się nie udało i dlaczego. Anulowana partia nadal pobiera dotychczas ukończone przedmioty, co raport potwierdza.
Czy mój plik jest przesyłany?
Nie. Modele i całe przetwarzanie działają w Twojej przeglądarce na twoim urządzeniu. Możesz to sprawdzić sam: otwórz DevTools przeglądarki, obejrzyj zakładkę Sieć i przetworz plik: nie ma żadnych przesłań. Po pierwszej wizycie większość narzędzi działa całkowicie offline.
Które języki są obsługiwane?
106 języków w alfabecie łaciny, cyrylicy, arabskim, dewanagari, CJK, greckim, tajskim, tamilskim i telugu. Bengalski to jedyna główna luka, bo nie istnieje jeszcze model v5 dla niej, a wybierający mówi to zamiast zgadywać.
Jak bardzo jest dokładny?
W czystym tekście dokumentu wskaźnik błędów znaków wynosi poniżej 2%, a każda linijka ma ocenę pewności, więc możesz zobaczyć, które należy sprawdzić. Pismo ręczne i zdjęcia w niskiej rozdzielczości będą wyglądać gorzej.
Czy czyta zeskanowane PDF-y?
Tak. Cyfrowe pliki PDF są odczytywane z własnej warstwy tekstowej, z dokładnymi znakami na dokładnych pozycjach. Zeskanowane strony przechodzą przez wykrywanie i rozpoznawanie, a dokumenty mieszane korzystają z obu tych metod.

Powiązane narzędzia