Превратите изображение в текст, который можно выделять и искать. Детекция находит каждую строку, распознавание читает их выбранным языковым пакетом, а у каждой строки есть оценка уверенности — сразу видно, что стоит перепроверить. Изображение никогда не покидает ваш браузер.
Как это работает
- Перетащите изображение или PDF. Поиск текста начинается сразу.
- Выберите языковой пакет (скачивается один раз, 8–17 МБ) и нажмите «Распознать текст».
- Скопируйте строки или скачайте .txt / .json. PDF читаются от первой страницы до последней.
Частые вопросы
- Мой файл куда-нибудь загружается?
- Нет. Модели и вся обработка выполняются внутри вашего браузера, на вашем собственном устройстве. Вы можете убедиться в этом сами: откройте инструменты разработчика, перейдите на вкладку «Сеть» и обработайте файл — никаких загрузок не будет. После первого визита большинство инструментов работает даже без интернета.
- Какие языки поддерживаются?
- 106 языков на латинице, кириллице, арабском письме, деванагари, китайско-японско-корейских иероглифах, греческом, тайском, тамильском и телугу. Единственный крупный пробел — бенгальский: для него пока нет модели пятой версии, и выбор языков честно об этом говорит, а не пытается угадать.
- Насколько это точно?
- На чистом документном тексте измеренная доля ошибок на символ ниже 2%, и у каждой строки есть оценка уверенности, чтобы понимать, что проверить. Рукописный текст и снимки низкого разрешения распознаются хуже.
- Читает ли он отсканированные PDF?
- Да. Цифровые PDF читаются из собственного текстового слоя — точные символы в точных позициях. Отсканированные страницы проходят детекцию и распознавание, а в смешанных документах используются оба пути.