Zamień zeskanowany PDF w przeszukiwalny PDF
Każda strona wygląda jak dotąd, a do tego dostaje tekst dla wyszukiwania, kopiowania i czytników ekranu.
Francja · Planowane czyszczenie: 60 min po utworzeniu zadania · Bezpłatnie
Formaty i limity
Formaty i limity
- Obsługiwane formaty
- Wynik
| Na komputerze | Na telefonie lub tablecie | W chmurze | |
|---|---|---|---|
| Maks. rozmiar pliku | 200 MB | 50 MB | 100 MB |
| Maks. liczba stron | 50 | 10 | 200 |
| Maks. rozmiar obrazu | 30 Mpx | 16 Mpx | Bez limitu |
Planowane czyszczenie: 60 min po utworzeniu zadania · Zwykle ok. 20 s
Limity na urządzeniu zależą od jego pamięci. Większe pliki też mogą zadziałać – narzędzie najpierw Cię ostrzeże.
Jak to działa
- 01 Upuść PDF, który ma stać się przeszukiwalny.
- 02 Wybierz język tekstu.
- 03 Kliknij „Rozpoznaj tekst” i poczekaj, aż każda strona zostanie przetworzona.
- 04 Pobierz plik i wypróbuj Ctrl+F na słowie ze skanu.
O tym narzędziu
PDF prosto ze skanera lub aplikacji w telefonie przechowuje każdą stronę jak zdjęcie, więc menedżer plików, wyszukiwarka poczty ani archiwum dokumentów nie widzą w nim ani jednego słowa. Zamiana na przeszukiwalny PDF to naprawia. Hushdesk rozpoznaje tekst rosyjski i angielski i zapisuje go w pliku jako ukrytą warstwę dopasowaną do słów na stronie. Nic widocznego się nie zmienia, a obrazy nie są ponownie kodowane, więc rozmiar pozostaje zbliżony do oryginału. Strony, które już da się przeszukiwać, są wykrywane i pomijane. Konwersja działa na Twoim urządzeniu (beta), a przy dużych archiwach do dyspozycji jest tryb w chmurze.
-
Widoczny dla wyszukiwania systemowego
Wyszukiwanie Windows, Spotlight i większość systemów obiegu dokumentów indeksują ukryty tekst, więc stare skany wreszcie pojawiają się w wynikach.
-
Te same strony, podobny rozmiar
Oryginalne obrazy zostają zachowane bajt w bajt; warstwa tekstowa dodaje tylko kilka kilobajtów na stronę.
-
Pomija to, co już gotowe
Strony utworzone cyfrowo i strony, które wcześniej przeszły OCR, są wykrywane i zostawiane w spokoju, więc tekst nigdy się nie dubluje.
Pytania i odpowiedzi
Co to jest przeszukiwalny PDF?
PDF, w którym każda zeskanowana strona ma niewidoczną warstwę rozpoznanego tekstu. Nadal widzisz oryginalny skan, ale programy mogą znajdować, zaznaczać i kopiować słowa.
Czy przeszukiwalny PDF będzie większy od oryginału?
W trybie na urządzeniu tylko nieznacznie: obrazy pozostają nietknięte, a warstwa tekstowa dodaje kilka kilobajtów na stronę. W trybie w chmurze prostowanie przekrzywionych stron rysuje je od nowa, przez co plik staje się kilka razy większy.
Czy da się przeszukiwać PDF mieszany, w którym tylko część stron to skany?
Tak. Strony, które już zawierają tekst, są rozpoznawane jako takie i pomijane; przez OCR przechodzą tylko strony będące samym obrazem.
Czy przy kopiowaniu z przeszukiwalnego PDF zostają podziały wierszy?
W większości tak. Kopiowanie podąża za rozpoznanymi wierszami. Tabele i strony wielokolumnowe mogą wymagać uporządkowania po wklejeniu, bo ukryta warstwa nie ma struktury tabeli.
Czy przeszukiwalny PDF to to samo co PDF/A?
Nie. PDF/A to standard długoterminowej archiwizacji. To narzędzie dodaje warstwę tekstową, ale nie konwertuje pliku do PDF/A.