OCR PDF : extraire le texte d’un PDF scanné

Reconnaissance optique de caractères sur un PDF scanné, page par page, sans quitter votre navigateur.

Déposer un PDF scanné ici ou cliquer pour le choisir.

OCR PDF est un outil gratuit qui s’exécute entièrement dans votre navigateur, sans aucun envoi vers un serveur. Extraire le texte d’un PDF scanné par reconnaissance optique de caractères.

À quoi ça sert

Récupérer le texte d’un document scanné ou photographié pour le copier, le modifier ou le rechercher, alors qu’un PDF issu d’un scanner ne contient souvent que des images de pages.

Ce que cet outil ne fait pas

Cet outil ne prend pas en charge les PDF protégés par un mot de passe et ne reconnaît qu’une seule langue à la fois par passage. La mise en page d’origine (colonnes, tableaux) n’est pas reconstituée : seul le texte brut est extrait.

Questions fréquentes

Pourquoi un fichier de langue se télécharge-t-il au premier lancement ?

Le modèle de reconnaissance de caractères (plusieurs mégaoctets par langue) est hébergé sur ce site et chargé une seule fois par votre navigateur, qui le garde ensuite en cache. Aucune donnée de votre document n’est envoyée où que ce soit : seul ce modèle est téléchargé, dans le sens site vers navigateur.

Le résultat est-il fiable à 100 % ?

Non : la reconnaissance de caractères dépend de la qualité du scan. Un document net et bien contrasté donne un bien meilleur résultat qu’une photo floue ou inclinée.

Mes fichiers sont-ils envoyés sur un serveur ?

Non : le traitement a lieu entièrement dans votre navigateur, sur votre appareil. Aucun fichier n’est transmis à un serveur, à aucun moment.