OCR gratuit dans le navigateur
Faites l’OCR d’un PDF numérisé en ligne gratuitement
Extrayez un vrai texte exploitable d’un PDF numérisé ou composé d’images. Lancez l’OCR avec l’outil ci-dessous, puis téléchargez le texte reconnu.
OCR dans le navigateur
Ouvrez un PDF numérisé ou composé d’images et reconnaissez le texte de chaque page. Le moteur d’OCR se télécharge et tourne entièrement dans votre navigateur : la première utilisation peut prendre un moment, et l’OCR est plus lent que les autres outils du site.
Vos fichiers sont traités en toute sécurité
✔ Le traitement se fait dans votre navigateur
✔ Votre fichier n’est jamais envoyé sur un serveur
✔ Vos fichiers ne sont ni stockés ni enregistrés nulle part
✔ Aucun compte ni inscription
Pourquoi l’utiliser
Pourquoi utiliser l’OCR
Documents numérisés
Récupérez un vrai texte exploitable dans un PDF fait de pages numérisées ou de photos.
Vieux papiers
Transformez des archives composées uniquement d’images en texte que vous pouvez rechercher, copier et modifier.
PDF sans couche de texte
Récupérez le contenu de PDF dans lesquels Compresser, Diviser et les autres outils basés sur le texte ne trouvent aucun texte extractible.
Comment ça marche
Trois étapes simples
1. Choisissez votre PDF numérisé
Choisissez le PDF numérisé ou composé d’images que vous voulez lire.
2. Lancez l’OCR
Chaque page est rendue puis analysée par un moteur d’OCR qui tourne dans le navigateur.
3. Téléchargez le texte
Enregistrez le texte reconnu au format .txt ou .docx.
Limites, en toute franchise
Un vrai OCR, avec ses limites
Il s’agit d’une vraie reconnaissance de texte, pas d’un raccourci — c’est donc plus lent et plus lourd que les autres outils du site. Le texte reconnu est fourni dans un fichier .txt ou .docx ; l’outil ne reconstruit pas un PDF consultable avec une couche de texte invisible bien positionnée. La qualité dépend de la netteté de la numérisation, et seul le texte en anglais est reconnu pour le moment.
Guides associés
Nos guides sont en anglais pour le moment.
FAQ
Questions sur l’OCR PDF
Pourquoi l’OCR est-il plus lent que vos autres outils ?
L’OCR fait tourner un vrai moteur de reconnaissance de texte (Tesseract), entièrement dans votre navigateur. Ce moteur pèse plusieurs mégaoctets à télécharger lors de la première utilisation, et reconnaître du texte demande bien plus de calcul que les opérations sur fichiers d’outils comme Compresser ou Fusionner.
Obtient-on un PDF consultable ou seulement du texte ?
Cet outil extrait le texte reconnu dans un fichier .txt ou .docx. Il ne réinsère pas dans le PDF une couche de texte invisible et bien positionnée.
Quelles langues sont prises en charge ?
Pour le moment, cet outil reconnaît uniquement le texte en anglais.
Mon fichier est-il envoyé sur un serveur ?
Non. L’OCR tourne entièrement dans votre navigateur grâce à un moteur de reconnaissance de texte en WebAssembly. Votre PDF n’est jamais envoyé sur un serveur et rien n’est conservé.