Gescanntes PDF in durchsuchbares PDF umwandeln
Jede Seite bleibt, wie sie aussieht, und erhält Text, den Suche, Kopieren und Screenreader nutzen können.
Frankreich · Geplante Bereinigung: 60 Min. nach Auftragserstellung · Kostenlos
Formate und Limits
Formate und Limits
- Unterstützte Formate
- Ergebnis
| Am Computer | Auf Smartphone oder Tablet | In der Cloud | |
|---|---|---|---|
| Max. Dateigröße | 200 MB | 50 MB | 100 MB |
| Max. Seitenzahl | 50 | 10 | 200 |
| Max. Bildgröße | 30 MP | 16 MP | Kein Limit |
Geplante Bereinigung: 60 Min. nach Auftragserstellung · Meist etwa 20 Sek.
Die Limits auf Ihrem Gerät hängen von seinem Arbeitsspeicher ab. Größere Dateien können trotzdem funktionieren; das Werkzeug warnt Sie vorher.
So funktioniert’s
- 01 Ziehen Sie das PDF hierher, das durchsuchbar werden soll.
- 02 Wählen Sie die Sprache des Textes.
- 03 Klicken Sie auf „Text erkennen“ und warten Sie, während jede Seite verarbeitet wird.
- 04 Laden Sie die Datei herunter und probieren Sie Strg+F mit einem Wort aus dem Scan.
Über dieses Werkzeug
Ein PDF direkt aus dem Scanner oder einer Handy-App speichert jede Seite als Foto. Dateimanager, E-Mail-Suche und Dokumentenarchiv finden darin deshalb kein einziges Wort. Die Umwandlung in ein durchsuchbares PDF ändert das. Hushdesk erkennt den russischen und englischen Text und schreibt ihn als versteckte Ebene in die Datei, passgenau über den Wörtern auf der Seite. Sichtbar ändert sich nichts, und die Bilder werden nicht neu kodiert, daher bleibt die Größe nah am Original. Seiten, die bereits durchsuchbar sind, werden erkannt und übersprungen. Die Umwandlung läuft auf Ihrem Gerät (Beta), und für große Archive gibt es einen Cloud-Modus.
-
Von der Desktopsuche gefunden
Die Windows-Suche, Spotlight und die meisten Dokumentensysteme indexieren den versteckten Text, sodass alte Scans endlich in den Suchergebnissen auftauchen.
-
Gleiche Seiten, ähnliche Größe
Die Originalbilder bleiben Byte für Byte erhalten; die Textebene fügt pro Seite nur wenige Kilobyte hinzu.
-
Überspringt, was schon erledigt ist
Digital erzeugte Seiten und Seiten mit früherer OCR werden entdeckt und in Ruhe gelassen, damit Text nie doppelt vorkommt.
Fragen und Antworten
Was ist ein durchsuchbares PDF?
Ein PDF, bei dem jede gescannte Seite eine unsichtbare Ebene mit erkanntem Text trägt. Sie sehen weiterhin den Originalscan, aber Programme können die Wörter finden, markieren und kopieren.
Wird das durchsuchbare PDF größer als das Original?
Im Gerätemodus nur geringfügig: Die Bilder bleiben unberührt, und die Textebene fügt wenige Kilobyte pro Seite hinzu. Im Cloud-Modus werden schiefe Seiten beim Geraderichten neu gezeichnet, was die Datei um ein Mehrfaches vergrößert.
Kann ich ein gemischtes PDF durchsuchbar machen, in dem nur einige Seiten Scans sind?
Ja. Seiten, die bereits Text enthalten, werden als solche erkannt und übersprungen; nur die reinen Bildseiten durchlaufen die OCR.
Bleiben Zeilenumbrüche erhalten, wenn ich aus einem durchsuchbaren PDF kopiere?
Größtenteils. Beim Kopieren folgen die Zeilen der Erkennung. Tabellen und mehrspaltige Seiten brauchen nach dem Einfügen eventuell etwas Nacharbeit, weil die versteckte Ebene keine Tabellenstruktur kennt.
Ist ein durchsuchbares PDF dasselbe wie PDF/A?
Nein. PDF/A ist ein Standard für die Langzeitarchivierung. Dieses Werkzeug fügt eine Textebene hinzu, wandelt die Datei aber nicht in PDF/A um.