OCR PDF : extraire le texte d’un PDF scanné
Reconnaissance optique de caractères sur un PDF scanné, page par page, sans quitter votre navigateur.
OCR PDF est un outil gratuit qui s’exécute entièrement dans votre navigateur, sans aucun envoi vers un serveur. Extraire le texte d’un PDF scanné par reconnaissance optique de caractères.
À quoi ça sert
Récupérer le texte d’un document scanné ou photographié pour le copier, le modifier ou le rechercher, alors qu’un PDF issu d’un scanner ne contient souvent que des images de pages.
Ce que cet outil ne fait pas
Cet outil ne prend pas en charge les PDF protégés par un mot de passe et ne reconnaît qu’une seule langue à la fois par passage. La mise en page d’origine (colonnes, tableaux) n’est pas reconstituée : seul le texte brut est extrait.
Questions fréquentes
Pourquoi un fichier de langue se télécharge-t-il au premier lancement ?
Le modèle de reconnaissance de caractères (plusieurs mégaoctets par langue) est hébergé sur ce site et chargé une seule fois par votre navigateur, qui le garde ensuite en cache. Aucune donnée de votre document n’est envoyée où que ce soit : seul ce modèle est téléchargé, dans le sens site vers navigateur.
Le résultat est-il fiable à 100 % ?
Non : la reconnaissance de caractères dépend de la qualité du scan. Un document net et bien contrasté donne un bien meilleur résultat qu’une photo floue ou inclinée.
Mes fichiers sont-ils envoyés sur un serveur ?
Non : le traitement a lieu entièrement dans votre navigateur, sur votre appareil. Aucun fichier n’est transmis à un serveur, à aucun moment.
Outils similaires
Convertir un PDF en images
Transformer chaque page d’un PDF en image JPEG ou PNG.
Comparer deux PDF
Repérer les différences de texte entre deux versions d’un document.
Compteur de mots et de caractères
Mots, caractères, phrases et temps de lecture, calculés en direct.
Convertir des images en PDF
Assembler plusieurs images JPEG ou PNG en un seul PDF.