Gescande PDF omzetten naar doorzoekbare PDF
Elke pagina blijft zoals hij eruitziet, met tekst erbij die zoeken, kopiëren en schermlezers kunnen gebruiken.
Upload alleen met toestemming · Gratis te gebruiken · Nooit gebruikt voor AI-training
Frankrijk · Geplande opschoning: 60 min na aanmaken taak · Gratis te gebruiken
Formaten en limieten
Formaten en limieten
- Ondersteunde formaten
- Resultaat
| Op een computer | Op een telefoon of tablet | In de cloud | |
|---|---|---|---|
| Max. bestandsgrootte | 200 MB | 50 MB | 100 MB |
| Max. aantal pagina’s | 50 | 10 | 200 |
| Max. afbeeldingsgrootte | 30 MP | 16 MP | Geen limiet |
Geplande opschoning: 60 min na aanmaken taak · Meestal ongeveer 20 s
De limieten op je apparaat hangen af van het geheugen. Grotere bestanden kunnen ook werken; de tool waarschuwt je eerst.
Zo werkt het
- 01 Sleep de PDF die je doorzoekbaar wilt maken hierheen.
- 02 Kies de taal van de tekst.
- 03 Klik op ‘Tekst herkennen’ en wacht terwijl elke pagina wordt verwerkt.
- 04 Download het bestand en zoek met Ctrl+F naar een woord uit de scan.
Over deze tool
Een PDF die rechtstreeks uit een scanner of een telefoonapp komt, slaat elke pagina op als foto. Je bestandsbeheer, de zoekfunctie van je mail en je documentarchief zien er dus geen enkel woord in. Omzetten naar een doorzoekbare PDF lost dat op. Hushdesk herkent de Russische en Engelse tekst en schrijft die als verborgen laag in het bestand, precies uitgelijnd met de woorden op de pagina. Er verandert niets zichtbaars en de afbeeldingen worden niet opnieuw gecodeerd, dus de grootte blijft dicht bij het origineel. Pagina’s die al doorzoekbaar zijn, worden herkend en overgeslagen. De omzetting draait op je apparaat (bèta), en voor grote archieven is er een cloudmodus.
-
Gevonden door je computer
Windows Search, Spotlight en de meeste documentsystemen indexeren de verborgen tekst, dus oude scans duiken eindelijk op in zoekresultaten.
-
Zelfde pagina’s, vergelijkbare grootte
De oorspronkelijke afbeeldingen blijven byte voor byte behouden; de tekstlaag voegt maar een paar kilobyte per pagina toe.
-
Slaat over wat al klaar is
Digitaal gemaakte pagina’s en pagina’s die eerder al OCR kregen, worden herkend en met rust gelaten, zodat tekst nooit dubbel komt.
Vragen en antwoorden
Wat is een doorzoekbare PDF?
Een PDF waarin elke gescande pagina een onzichtbare laag met herkende tekst heeft. Je ziet nog steeds de originele scan, maar software kan de woorden vinden, selecteren en kopiëren.
Wordt de doorzoekbare PDF groter dan het origineel?
In de apparaatmodus maar een klein beetje: de afbeeldingen blijven onaangeroerd en de tekstlaag voegt een paar kilobyte per pagina toe. In de cloudmodus worden scheve pagina’s rechtgezet en dus opnieuw getekend, waardoor het bestand een aantal keer zo groot wordt.
Kan ik een gemengde PDF doorzoekbaar maken als maar een deel van de pagina’s scans zijn?
Ja. Pagina’s die al tekst bevatten, worden als zodanig herkend en overgeslagen; alleen de pagina’s die uit een afbeelding bestaan, gaan door de OCR.
Blijven regeleinden behouden als ik uit een doorzoekbare PDF kopieer?
Grotendeels. Kopiëren volgt de herkende regels. Tabellen en pagina’s met meerdere kolommen moet je na het plakken soms opschonen, omdat de verborgen laag geen tabelstructuur heeft.
Is een doorzoekbare PDF hetzelfde als PDF/A?
Nee. PDF/A is een standaard voor archivering op lange termijn. Deze tool voegt een tekstlaag toe, maar zet het bestand niet om naar PDF/A.