Logo PDFAreUsPDFAreUs

OCR gratuit dans le navigateur

Faites l’OCR d’un PDF numérisé en ligne gratuitement

Extrayez un vrai texte exploitable d’un PDF numérisé ou composé d’images. Lancez l’OCR avec l’outil ci-dessous, puis téléchargez le texte reconnu.

OCR dans le navigateur

Ouvrez un PDF numérisé ou composé d’images et reconnaissez le texte de chaque page. Le moteur d’OCR se télécharge et tourne entièrement dans votre navigateur : la première utilisation peut prendre un moment, et l’OCR est plus lent que les autres outils du site.

Vos fichiers sont traités en toute sécurité

✔ Le traitement se fait dans votre navigateur

✔ Votre fichier n’est jamais envoyé sur un serveur

✔ Vos fichiers ne sont ni stockés ni enregistrés nulle part

✔ Aucun compte ni inscription

En savoir plus sur notre gestion de la sécurité →

Pourquoi l’utiliser

Pourquoi utiliser l’OCR

Documents numérisés

Récupérez un vrai texte exploitable dans un PDF fait de pages numérisées ou de photos.

Vieux papiers

Transformez des archives composées uniquement d’images en texte que vous pouvez rechercher, copier et modifier.

PDF sans couche de texte

Récupérez le contenu de PDF dans lesquels Compresser, Diviser et les autres outils basés sur le texte ne trouvent aucun texte extractible.

Comment ça marche

Trois étapes simples

1. Choisissez votre PDF numérisé

Choisissez le PDF numérisé ou composé d’images que vous voulez lire.

2. Lancez l’OCR

Chaque page est rendue puis analysée par un moteur d’OCR qui tourne dans le navigateur.

3. Téléchargez le texte

Enregistrez le texte reconnu au format .txt ou .docx.

Limites, en toute franchise

Un vrai OCR, avec ses limites

Il s’agit d’une vraie reconnaissance de texte, pas d’un raccourci — c’est donc plus lent et plus lourd que les autres outils du site. Le texte reconnu est fourni dans un fichier .txt ou .docx ; l’outil ne reconstruit pas un PDF consultable avec une couche de texte invisible bien positionnée. La qualité dépend de la netteté de la numérisation, et seul le texte en anglais est reconnu pour le moment.

FAQ

Questions sur l’OCR PDF

Pourquoi l’OCR est-il plus lent que vos autres outils ?

L’OCR fait tourner un vrai moteur de reconnaissance de texte (Tesseract), entièrement dans votre navigateur. Ce moteur pèse plusieurs mégaoctets à télécharger lors de la première utilisation, et reconnaître du texte demande bien plus de calcul que les opérations sur fichiers d’outils comme Compresser ou Fusionner.

Obtient-on un PDF consultable ou seulement du texte ?

Cet outil extrait le texte reconnu dans un fichier .txt ou .docx. Il ne réinsère pas dans le PDF une couche de texte invisible et bien positionnée.

Quelles langues sont prises en charge ?

Pour le moment, cet outil reconnaît uniquement le texte en anglais.

Mon fichier est-il envoyé sur un serveur ?

Non. L’OCR tourne entièrement dans votre navigateur grâce à un moteur de reconnaissance de texte en WebAssembly. Votre PDF n’est jamais envoyé sur un serveur et rien n’est conservé.

Nos guides sont en anglais pour le moment.

Voir tous les guides PDF →