Изображение в текст

● 100% в вашем браузере: ничего не загружается

Loading…

Превратите изображение в текст, который можно выделять и искать. Детекция находит каждую строку, распознавание читает их выбранным языковым пакетом, а у каждой строки есть оценка уверенности — сразу видно, что стоит перепроверить. Изображение никогда не покидает ваш браузер.

Как это работает

  1. Перетащите изображение или PDF. Поиск текста начинается сразу.
  2. Выберите языковой пакет (скачивается один раз, 8–17 МБ) и нажмите «Распознать текст».
  3. Скопируйте строки или скачайте .txt / .json. PDF читаются от первой страницы до последней.

Частые вопросы

Мой файл куда-нибудь загружается?
Нет. Модели и вся обработка выполняются внутри вашего браузера, на вашем собственном устройстве. Вы можете убедиться в этом сами: откройте инструменты разработчика, перейдите на вкладку «Сеть» и обработайте файл — никаких загрузок не будет. После первого визита большинство инструментов работает даже без интернета.
Какие языки поддерживаются?
106 языков на латинице, кириллице, арабском письме, деванагари, китайско-японско-корейских иероглифах, греческом, тайском, тамильском и телугу. Единственный крупный пробел — бенгальский: для него пока нет модели пятой версии, и выбор языков честно об этом говорит, а не пытается угадать.
Насколько это точно?
На чистом документном тексте измеренная доля ошибок на символ ниже 2%, и у каждой строки есть оценка уверенности, чтобы понимать, что проверить. Рукописный текст и снимки низкого разрешения распознаются хуже.
Читает ли он отсканированные PDF?
Да. Цифровые PDF читаются из собственного текстового слоя — точные символы в точных позициях. Отсканированные страницы проходят детекцию и распознавание, а в смешанных документах используются оба пути.

Похожие инструменты