Перетворити скан на PDF з пошуком за текстом
Кожна сторінка лишається такою, як була, а текст на ній бачать пошук, копіювання та екранні диктори.
Франція · Планове очищення: через 60 хв після створення завдання · Безкоштовно
Формати й обмеження
Формати й обмеження
- Підтримувані формати
- Результат
| На комп’ютері | На телефоні або планшеті | У хмарі | |
|---|---|---|---|
| Макс. розмір файлу | 200 МБ | 50 МБ | 100 МБ |
| Макс. кількість сторінок | 50 | 10 | 200 |
| Макс. розмір зображення | 30 Мп | 16 Мп | Без обмежень |
Планове очищення: через 60 хв після створення завдання · Зазвичай близько 20 с
Ліміти на пристрої залежать від його пам’яті. Більші файли теж можуть спрацювати; інструмент попередить про це заздалегідь.
Як це працює
- 01 Перетягніть PDF, у якому має працювати пошук.
- 02 Виберіть мову тексту.
- 03 Натисніть «Розпізнати текст» і зачекайте, поки буде оброблено кожну сторінку.
- 04 Завантажте файл і спробуйте знайти через Ctrl+F слово зі скану.
Про інструмент
PDF прямо зі сканера чи з мобільного застосунку зберігає кожну сторінку як фото, тому ні файловий менеджер, ні пошук у пошті, ні архів документів не бачать у ньому жодного слова. Перетворення на PDF з пошуком за текстом це виправляє. Hushdesk розпізнає російський та англійський текст і записує його у файл прихованим шаром, вирівняним за словами на сторінці. Українські документи поки обробляються ненадійно: і, ї, є, ґ та апостроф можуть вийти з помилками, тож перевірте пошук на кількох словах. Зовні нічого не змінюється, зображення не перекодовуються, і розмір лишається близьким до оригіналу. Сторінки, де пошук уже працює, виявляються й пропускаються. Перетворення відбувається на вашому пристрої (бета), а для великих архівів є хмарний режим.
-
Видно в пошуку на комп’ютері
Пошук Windows, Spotlight і більшість систем документообігу індексують прихований текст, тож старі скани нарешті потрапляють у результати пошуку.
-
Ті ж сторінки, схожий розмір
Вихідні зображення зберігаються байт у байт; текстовий шар додає лише кілька кілобайтів на сторінку.
-
Не чіпає вже готове
Сторінки, створені в цифровому вигляді, і сторінки, розпізнані раніше, виявляються й лишаються без змін, тож текст ніколи не дублюється.
Запитання й відповіді
Що таке PDF з пошуком за текстом?
Це PDF, у якому кожна відсканована сторінка має невидимий шар розпізнаного тексту. Ви й далі бачите оригінальний скан, а програми можуть знаходити, виділяти й копіювати слова.
Чи буде PDF з пошуком більшим за оригінал?
У режимі пристрою лише трохи: зображення не змінюються, а текстовий шар додає кілька кілобайтів на сторінку. У хмарному режимі вирівнювання перекошених сторінок перемальовує їх, і файл стає в кілька разів більшим.
Чи можна додати пошук у PDF, де сканами є лише частина сторінок?
Так. Сторінки, які вже містять текст, визначаються як такі й пропускаються; через OCR проходять тільки сторінки-зображення.
Чи зберігаються розриви рядків, коли я копіюю з PDF з пошуком?
Здебільшого так. Копіювання йде за розпізнаними рядками. Таблиці й сторінки з кількома колонками після вставлення, можливо, доведеться підправити, бо прихований шар не має структури таблиці.
PDF з пошуком за текстом і PDF/A — це одне й те саме?
Ні. PDF/A — стандарт для довготривалого архівного зберігання. Цей інструмент додає текстовий шар, але не перетворює файл на PDF/A.