OCR PDF
Une page scannée est une image : l'ordinateur voit de l'encre, pas des mots, et Ctrl+F ne trouve rien. Cet outil applique la reconnaissance optique de caractères (OCR) : il lit les caractères présents dans l'image et ajoute par-dessus une couche de texte invisible, sans toucher à l'aspect du scan. Utile pour des factures archivées, un contrat signé sur papier ou des pages de livre photographiées. Anglais, français, espagnol, portugais et arabe sont reconnus. Les documents scannés sont limités à 10 pages, chaque page devant être analysée image par image.
Cliquez ou déposez votre fichier ici
.pdf
Comment ça marche
1
Importez
Déposez votre PDF scanné
2
Reconnaître
Les caractères sont lus
3
Télécharger
Obtenez un PDF cherchable
Fonctionnalités
Aucun changement visuel
— le scan d'origine est conservé pixel pour pixel.Recherche et copie
— Ctrl+F fonctionne, et le texte se sélectionne comme dans n'importe quel PDF.Documents mixtes
— les pages contenant déjà du texte sont laissées intactes.Cinq langues
— Anglais, français, espagnol, portugais et arabe.Cas d'usage courants
Des factures papier archivées en scans, à retrouver par fournisseur ou par montant.
Un contrat signé sur papier puis scanné, dans lequel il faut retrouver une clause précise.
Des pages de livre ou d'article photographiées pour étudier, afin de citer un passage sans le retaper.
D'anciens dossiers administratifs numérisés en masse et impossibles à parcourir.
Documents pris en charge
Any PDF whose pages are images: scanner output, photocopier output, or photos of paper turned into a PDF. Printed text gives excellent results. Handwriting is not reliably recognised. Scanned documents are limited to 10 pages per file; a PDF that already contains text can go up to 50.
Conseils pour la meilleure conversion
Numérisez à 300 ppp — en dessous de 200 ppp, les caractères se brouillent et les erreurs se multiplient.
Gardez les pages droites : une feuille scannée de travers perd en précision.
Préférez du noir sur blanc uni plutôt que des fonds colorés ou texturés.
Réglez la langue du site sur celle de votre document avant l'envoi.
Vos fichiers sont traités en toute sécurité
Votre fichier est traité en toute sécurité sur nos serveurs, puis automatiquement supprimé juste après le traitement. Il n'est jamais partagé ni conservé.
Questions fréquentes
Comment savoir si mon PDF a besoin d'OCR ?
Ouvrez-le et essayez de sélectionner une ligne à la souris, ou faites Ctrl+F et cherchez un mot visible à l'écran. Si rien ne se sélectionne et que la recherche ne trouve rien, la page est une image : l'OCR est nécessaire.
Le document gardera-t-il le même aspect ?
Oui. Le scan d'origine reste intact et le texte reconnu est ajouté en couche invisible par-dessus. Rien ne change visuellement : vous gagnez seulement la recherche, la sélection et la copie.
Quelles langues sont reconnues ?
L'anglais, le français, l'espagnol, le portugais et l'arabe. Réglez la langue du site sur celle de votre document avant l'envoi : la précision de la reconnaissance en dépend fortement.
Pourquoi certains mots sont-ils erronés ?
La qualité dépend du scan. Pages floues, faible résolution, feuilles de travers, écriture manuscrite ou polices inhabituelles réduisent la précision. Un scan net à 300 ppp donne de loin les meilleurs résultats ; une photo prise de biais dans une lumière faible, les pires.
Que deviennent les pages contenant déjà du texte ?
Elles sont laissées telles quelles. Un document peut mêler pages scannées et pages normales : seules les pages-images sont traitées, rien de déjà correct n'est réécrit.
Pourquoi la limite est-elle de 10 pages pour un scan ?
Chaque page d'un scan est reconstruite en image avant d'être lue, ce qui prend environ huit secondes. Dix pages maintiennent l'attente sous une minute et demie et évitent qu'un seul gros document ralentisse le service pour tout le monde. Pour un scan plus long, découpez-le d'abord avec notre outil Diviser PDF.