Convertir un PDF scanné en PDF interrogeable
Chaque page garde son aspect et reçoit un texte utilisable par la recherche, le copier-coller et les lecteurs d’écran.
France · Nettoyage prévu : 60 min après création de la tâche · Gratuit
Formats et limites
Formats et limites
- Formats acceptés
- Résultat
| Sur ordinateur | Sur téléphone ou tablette | Dans le cloud | |
|---|---|---|---|
| Taille max. par fichier | 200 Mo | 50 Mo | 100 Mo |
| Nombre de pages max. | 50 | 10 | 200 |
| Taille d’image max. | 30 Mpx | 16 Mpx | Sans limite |
Nettoyage prévu : 60 min après création de la tâche · Généralement environ 20 s
Sur votre appareil, les limites dépendent de sa mémoire. Des fichiers plus gros peuvent aussi passer ; l’outil vous prévient d’abord.
Comment ça marche
- 01 Déposez le PDF à rendre interrogeable.
- 02 Choisissez la langue du texte.
- 03 Cliquez sur Reconnaître le texte et patientez pendant le traitement de chaque page.
- 04 Téléchargez le fichier et essayez Ctrl+F sur un mot du scan.
À propos de cet outil
Un PDF sorti d’un scanner ou d’une appli de numérisation stocke chaque page comme une photo : votre gestionnaire de fichiers, la recherche de votre messagerie et votre archive documentaire n’y voient pas un seul mot. Le convertir en PDF interrogeable règle ce problème. Hushdesk reconnaît le texte russe et anglais et l’écrit dans le fichier sous forme de couche cachée, alignée sur les mots de la page. Rien ne change à l’œil et les images ne sont pas réencodées : la taille reste proche de l’original. Les pages déjà interrogeables sont détectées et sautées. La conversion tourne sur votre appareil (bêta), et un mode cloud existe pour les grosses archives.
-
Trouvé par la recherche de l’ordinateur
Windows Search, Spotlight et la plupart des systèmes documentaires indexent le texte caché : vos vieux scans apparaissent enfin dans les résultats de recherche.
-
Mêmes pages, taille voisine
Les images d’origine sont conservées octet pour octet ; la couche de texte n’ajoute que quelques kilo-octets par page.
-
Ce qui est fait n’est pas refait
Les pages nées numériques et celles déjà passées par l’OCR sont détectées et laissées de côté : le texte n’est jamais doublé.
Questions fréquentes
Qu’est-ce qu’un PDF interrogeable ?
Un PDF dont chaque page scannée porte une couche invisible de texte reconnu. Vous voyez toujours le scan d’origine, mais les logiciels peuvent trouver, sélectionner et copier les mots.
Le PDF interrogeable sera-t-il plus lourd que l’original ?
En mode appareil, à peine : les images ne sont pas touchées et la couche de texte ajoute quelques kilo-octets par page. En mode cloud, le redressement des pages inclinées les redessine et rend le fichier plusieurs fois plus lourd.
Puis-je rendre interrogeable un PDF mixte dont seules certaines pages sont scannées ?
Oui. Les pages qui contiennent déjà du texte sont reconnues comme telles et sautées ; seules les pages faites uniquement d’images passent par l’OCR.
Les retours à la ligne sont-ils conservés quand je copie depuis un PDF interrogeable ?
En grande partie. La copie suit les lignes reconnues. Les tableaux et les pages en colonnes peuvent demander un peu de remise en ordre après le collage, car la couche cachée n’a pas de structure de tableau.
Un PDF interrogeable est-il la même chose qu’un PDF/A ?
Non. Le PDF/A est une norme d’archivage à long terme. Cet outil ajoute une couche de texte mais ne convertit pas le fichier en PDF/A.