Где работает хорошо
- Скриншоты приложений, диалогов, сообщений об ошибках и терминалов
- Печатные документы, отсканированные ровно
- Слайды и схемы с настоящим текстом
- Таблицы, хотя структура при этом не сохранится
Где не работает
Рукописный текст, декоративные шрифты, надписи поверх насыщенной фотографии, низкий контраст и всё, снятое под углом. Это ограничения самого подхода, а не конкретного инструмента: движок здесь тот же, что используют почти все браузерные OCR.
Сначала выберите язык
Именно языковая модель превращает формы в символы, поэтому кириллическая страница, прочитанная как английская, выдаёт правдоподобную бессмыслицу, а не ошибку. Для документа, где смешаны латиница и кириллица, берите совмещённый вариант — он медленнее и заметно точнее любого из двух по отдельности.
Обязательно перечитывайте
OCR не знает, когда ошибается: он возвращает лучшую догадку с приложенной оценкой уверенности. Распознанный текст здесь можно править прямо на месте именно поэтому — чинить его, пока изображение перед глазами, проще, чем после вставки куда-то ещё.
Вопросы
Моё изображение куда-то загружается?+
Нет. Распознавание работает на WebAssembly в этой вкладке. Единственный сетевой запрос — за движком и языковой моделью, которые скачиваются один раз и кешируются. Об этом стоит сказать прямо, а не утверждать, будто всё локально.
Насколько точно?+
Хорошо на чистых скриншотах и печатном тексте, плохо на рукописном, низком контрасте и снимках под углом. Результат всегда перечитывайте: OCR путает похожие символы, и классические подмены — 0 вместо O, 1 вместо l, rn вместо m — как раз переживают беглый взгляд.
Какие языки поддерживаются?+
Английский, русский и кыргызский, а также английский с русским вместе для смешанных документов. Неверно выбранный язык — самая частая причина бессмыслицы на выходе: кириллическая страница, прочитанная как английская, даёт уверенную абракадабру.
Как улучшить результат?+
Дайте больше пикселей и больше контраста. Скриншот в родном разрешении лучше фотографии экрана; ровный скан лучше снимка телефоном под углом. Помогает и обрезка до самого текстового блока перед распознаванием — анализу вёрстки останется меньше поводов ошибиться.