OCR PDF
Une page scannée est une image : l'ordinateur voit de l'encre, pas des mots, et Ctrl+F ne trouve rien. Cet outil applique la reconnaissance optique de caractères (OCR) : il lit les caractères présents dans l'image et ajoute par-dessus une couche de texte invisible, sans toucher à l'aspect du scan. Utile pour des factures archivées, un contrat signé sur papier ou des pages de livre photographiées. Anglais, français, espagnol, portugais et arabe sont reconnus. Documents jusqu'à 50 pages.
Cliquez ou déposez votre fichier ici
.pdf
Comment ça marche
1
Importez
Déposez votre PDF scanné
2
Reconnaître
Les caractères sont lus
3
Télécharger
Obtenez un PDF cherchable
Fonctionnalités
Aucun changement visuel
— le scan d'origine est conservé pixel pour pixel.Recherche et copie
— Ctrl+F fonctionne, et le texte se sélectionne comme dans n'importe quel PDF.Documents mixtes
— les pages contenant déjà du texte sont laissées intactes.Cinq langues
— Anglais, français, espagnol, portugais et arabe.Cas d'usage courants
Des factures papier archivées en scans, à retrouver par fournisseur ou par montant.
Un contrat signé sur papier puis scanné, dans lequel il faut retrouver une clause précise.
Des pages de livre ou d'article photographiées pour étudier, afin de citer un passage sans le retaper.
D'anciens dossiers administratifs numérisés en masse et impossibles à parcourir.
Documents pris en charge
Tout PDF dont les pages sont des images : sortie de scanner, de photocopieur, ou photos de papier converties en PDF. Le texte imprimé donne d'excellents résultats. L'écriture manuscrite n'est pas reconnue de façon fiable. Les documents sont limités à 50 pages par fichier.
Conseils pour la meilleure conversion
Numérisez à 300 ppp — en dessous de 200 ppp, les caractères se brouillent et les erreurs se multiplient.
Gardez les pages droites : une feuille scannée de travers perd en précision.
Préférez du noir sur blanc uni plutôt que des fonds colorés ou texturés.
Réglez la langue du site sur celle de votre document avant l'envoi.
Vos fichiers sont traités en toute sécurité
Votre fichier est traité en toute sécurité sur nos serveurs, puis automatiquement supprimé juste après le traitement. Il n'est jamais partagé ni conservé.
Questions fréquentes
Comment savoir si mon PDF a besoin d'OCR ?
Ouvrez-le et essayez de sélectionner une ligne à la souris, ou faites Ctrl+F et cherchez un mot visible à l'écran. Si rien ne se sélectionne et que la recherche ne trouve rien, la page est une image : l'OCR est nécessaire.
Le document gardera-t-il le même aspect ?
Oui. Le scan d'origine reste intact et le texte reconnu est ajouté en couche invisible par-dessus. Rien ne change visuellement : vous gagnez seulement la recherche, la sélection et la copie.
Quelles langues sont reconnues ?
L'anglais, le français, l'espagnol, le portugais et l'arabe. Réglez la langue du site sur celle de votre document avant l'envoi : la précision de la reconnaissance en dépend fortement.
Pourquoi certains mots sont-ils erronés ?
La qualité dépend du scan. Pages floues, faible résolution, feuilles de travers, écriture manuscrite ou polices inhabituelles réduisent la précision. Un scan net à 300 ppp donne de loin les meilleurs résultats ; une photo prise de biais dans une lumière faible, les pires.
Que deviennent les pages contenant déjà du texte ?
Elles sont laissées telles quelles. Un document peut mêler pages scannées et pages normales : seules les pages-images sont traitées, rien de déjà correct n'est réécrit.
Pourquoi la limite est-elle de 50 pages ?
Chaque page d'un scan doit être lue comme une image, ce qui prend un instant. Cinquante pages gardent l'attente raisonnable et évitent qu'un seul gros document ralentisse le service pour tout le monde. Pour un scan plus long, découpez-le d'abord avec notre outil Diviser PDF.