Изображение в текст: распознать текст с фото
Получите редактируемый текст из фотографий, скриншотов и сканов, не загружая их в интернет.
Форматы и ограничения
Форматы и ограничения
- Поддерживаемые форматы
- JPEG, PNG, WebP, TIFF, BMP, GIF и AVIF
- Результат
- TXT
| На компьютере | На телефоне или планшете | |
|---|---|---|
| Макс. размер файла | 200 МБ | 50 МБ |
| Макс. общий размер | 200 МБ | 50 МБ |
| Макс. файлов за раз | 20 | 20 |
| Макс. число страниц | 50 | 10 |
| Макс. размер изображения | 30 Мп | 16 Мп |
Лимиты на устройстве зависят от его памяти. Файлы побольше тоже могут сработать — инструмент заранее предупредит.
Как это работает
- 01 Выберите или перетащите одно или несколько изображений (JPG, PNG, WebP, TIFF, BMP).
- 02 Укажите язык текста.
- 03 Нажмите «Распознать текст».
- 04 Скопируйте текст или скачайте его файлом TXT.
Об инструменте
Нужны слова с фотографии документа, скриншота или отсканированной страницы? Добавьте одно или несколько изображений — Hushdesk прочитает их с помощью Tesseract OCR прямо в браузере. Распознанный русский и английский текст появится в поле, откуда его можно скопировать, а ещё его можно скачать обычным файлом TXT. Для каждого изображения считается уверенность распознавания, а трудночитаемые картинки перечисляются отдельно — вы знаете, что перепроверить. Распознавание на устройстве пока в статусе бета: на компьютере это несколько секунд на изображение, на телефоне дольше. Лучший результат дают резкие, хорошо освещённые и ровные снимки.
-
Несколько изображений сразу
До 20 изображений за раз. Многостраничный TIFF читается постранично, и текст собирается по порядку.
-
Видимая оценка точности
Средняя уверенность показывается вместе с результатом, а слабые изображения перечислены отдельно.
-
Подходит для фото с телефона
Поворот снимка из EXIF учитывается до распознавания, а мелкие точки убираются автоматически.
Что означает уверенность распознавания?
Tesseract оценивает каждое прочитанное слово от 0 до 100. Мы показываем среднее значение по изображению; ниже 75 в тексте обычно есть ошибки, которые стоит проверить глазами.
Вопросы и ответы
Из каких форматов изображений можно извлечь текст?
JPG, PNG, WebP, TIFF (в том числе многостраничный), BMP, GIF и AVIF. Для PDF-файлов используйте распознавание текста в PDF.
Как сфотографировать документ, чтобы текст распознался?
Снимайте страницу ровно сверху при хорошем свете, чтобы текст занимал весь кадр, без теней и бликов. Буквы высотой меньше примерно 10 пикселей распознаются плохо.
Распознаётся ли рукописный текст на картинке?
Надёжно — нет. Движок обучен на печатном тексте: аккуратные печатные буквы иногда читаются, скоропись — нет.
Есть ли ограничение на размер изображения?
Очень большие фото перед распознаванием уменьшаются под память устройства: 30 мегапикселей на компьютере, 16 на телефоне. Для страницы документа этого более чем достаточно.
Сохраняется ли форматирование распознанного текста?
Результат — простой текст. Переносы строк и абзацы сохраняются, а шрифты, жирный, таблицы и колонки — нет.