Zamień obraz w tekst, który da się zaznaczyć i przeszukać. Wykrywanie znajduje każdy wiersz, rozpoznawanie odczytuje je wybranym pakietem językowym, a każdy wiersz ma współczynnik pewności, dzięki czemu widzisz, co warto sprawdzić. Obraz nigdy nie opuszcza Twojej przeglądarki.
Jak to działa
- Upuść obraz lub PDF. Wykrywanie tekstu rusza natychmiast.
- Wybierz pakiet językowy (pobierany raz, 8–17 MB) i naciśnij Odczytaj tekst.
- Skopiuj wiersze albo pobierz .txt / .json. PDF-y są odczytywane od pierwszej do ostatniej strony.
Najczęstsze pytania
- Czy mój plik jest gdzieś wysyłany?
- Nie. Modele i całe przetwarzanie działają wewnątrz Twojej przeglądarki, na Twoim własnym urządzeniu. Możesz to sprawdzić samodzielnie: otwórz narzędzia deweloperskie przeglądarki, obserwuj zakładkę Sieć i przetwórz plik — nie zobaczysz żadnej wysyłki. Po pierwszej wizycie większość narzędzi działa nawet całkowicie offline.
- Jakie języki są obsługiwane?
- 106 języków w alfabecie łacińskim, cyrylicy, piśmie arabskim, dewanagari, CJK, greckim, tajskim, tamilskim i telugu. Bengalski to jedyna poważna luka, bo nie istnieje jeszcze dla niego model w wersji 5 — i lista języków mówi o tym wprost, zamiast zgadywać.
- Jak dokładny jest odczyt?
- Na czystym tekście dokumentowym zmierzony współczynnik błędów na znak wynosi poniżej 2%, a każdy wiersz ma współczynnik pewności, więc widać, które warto sprawdzić. Pismo odręczne i zdjęcia w niskiej rozdzielczości odczytują się gorzej.
- Czy odczytuje zeskanowane PDF-y?
- Tak. Cyfrowe PDF-y są odczytywane z własnej warstwy tekstowej, ze znakami dokładnie tam, gdzie są. Zeskanowane strony przechodzą przez wykrywanie i rozpoznawanie, a dokumenty mieszane korzystają z obu ścieżek.