OCR PDF
Transformez un PDF scanné en PDF consultable et sélectionnable. L’OCR s’exécute localement dans votre navigateur : le fichier ne quitte jamais votre appareil.
Rien n’est téléversé
Le moteur d’OCR PDF tourne en WebAssembly dans votre navigateur. Votre scan n’est jamais envoyé à un serveur.
Voyez ce qui a été lu
Chaque mot reconnu est surligné sur la page, pour vérifier le résultat avant de télécharger.
11 langues
Alphabets latin et cyrillique et écritures CJC sont pris en charge, dont le chinois, le japonais, le coréen et le russe.
Gratuit, sans inscription
Pas de compte, pas de filigrane, pas de limite de pages. La seule vraie limite est la mémoire de votre appareil.
En bref : L’OCR PDF lit le texte d’une page scannée et le réinscrit dans le PDF sous forme de couche de texte invisible. La page reste identique, mais vous pouvez enfin la chercher, la sélectionner et la copier. Cet outil fait tout le travail dans votre navigateur.
Pourquoi les PDF scannés bloquent votre travail
Un client vous renvoie un contrat. Vous cherchez une clause. Vous faites Ctrl+F, tapez le mot, et le PDF affirme qu’il n’y a aucun résultat — alors que le mot est là, sous vos yeux.
C’est le moment où la plupart des gens se mettent à chercher un OCR PDF. Le document n’est pas cassé : il n’a tout simplement jamais contenu de texte.
Un scan est une image, pas un document
Quand un scanner ou l’appareil photo d’un téléphone capture une page, il enregistre des pixels. Les lettres que vous voyez sont des formes, pas des caractères. Pour le lecteur PDF, la page entière est une seule image plate.
Ce que vous perdez sans reconnaissance de texte
Pas de recherche. Pas de copier-coller. Pas de sélection pour citer. Les lecteurs d’écran n’annoncent rien. Votre gestion documentaire indexe un fichier vide. Toutes ces fonctions supposent que la page contienne de vrais caractères.
Là où ça fait le plus mal
Contrats signés, factures papier, reçus, dossiers médicaux, articles universitaires, vieilles archives. Ce sont précisément les documents que vous aurez le plus besoin de chercher plus tard, et précisément ceux qui arrivent scannés.
Qu’est-ce que l’OCR PDF ?
L’OCR PDF consiste à lire le texte présent sur l’image d’une page scannée et à le réenregistrer dans le PDF sous forme de couche de texte réelle mais invisible — la page reste identique, mais vous pouvez désormais chercher, sélectionner et copier les mots qui s’y trouvent.
OCR signifie reconnaissance optique de caractères. Le moteur observe les formes de la page, les compare aux lettres d’une langue et restitue des caractères ainsi que la position exacte de chaque mot.
Comment fonctionne la couche de texte invisible
Les mots reconnus sont redessinés sur la page dans le mode de rendu de texte 3 du PDF, qui signifie « dessine ce texte mais ne l’affiche pas ». Chaque mot se place exactement au-dessus de son image dans le scan.
C’est pourquoi un fichier correctement traité par OCR paraît inchangé tout en se surlignant correctement lors d’une recherche. Vous sélectionnez la couche invisible, pas l’image.
PDF consultable ou extraction de texte brut
Quand vous voulez un PDF consultable
Vous devez conserver l’apparence d’origine : signatures, tampons, en-tête, mise en page. Tout ce qui doit rester présentable ou juridiquement reconnaissable doit rester un PDF.
Quand le texte brut suffit
Vous allez coller dans un e-mail, un tableur ou une note. Dans ce cas, laissez le PDF de côté et prenez l’export en texte brut. Cet outil vous donne les deux en une seule passe.
Ce que l’OCR ne peut pas corriger
L’OCR lit ce qui est là. Elle ne récupère pas un texte que le scan a effacé, et elle ne relit pas à votre place. Une photo de travers et peu définie donnera des résultats de travers et de mauvaise qualité.
Comment faire l’OCR d’un PDF en 3 étapes
Tout se passe sur votre propre machine. Aucune file d’attente, aucun téléversement, aucune salle d’attente.
- 1
Ouvrez votre PDF scanné
Glissez le fichier sur le cadre ci-dessus, ou choisissez-le depuis votre appareil. Il se charge directement dans l’onglet du navigateur : il n’y a aucune étape de téléversement.
- 2
Choisissez la langue du document
Choisissez la langue imprimée sur la page, pas celle de votre interface. Le moteur télécharge ce pack de langue une fois et le garde en cache.
- 3
Lancez l’OCR et téléchargez
Suivez le traitement page par page, vérifiez les mots surlignés, puis prenez le PDF consultable ou le texte brut. Les deux sont générés localement.
Astuce — Le choix de la langue compte plus qu’on ne le croit. Passer de l’anglais sur une page allemande massacrera chaque tréma. Si le résultat ressemble à du charabia, la langue en est presque toujours la cause.
Remarque — La première passe dans une nouvelle langue télécharge un pack de moins de 3 Mo. Ensuite, c’est instantané et cela fonctionne hors ligne.
Voyez ce que l’OCR a vraiment lu
La plupart des outils d’OCR PDF vous remettent un fichier en vous souhaitant bonne chance. Vous ne découvrez si ça a marché qu’après l’avoir téléchargé, ouvert et cherché vous-même.
C’est un mauvais marché, car la qualité des scans varie énormément et l’OCR PDF échoue en silence. Un outil qui rend discrètement 60 % de précision ressemble exactement à un outil qui en rend 99 %.
La couche de texte, rendue visible
Activez « Afficher la couche de texte » et chaque mot reconnu apparaît encadré directement sur la page. Ce que vous voyez est exactement ce qui a été écrit dans le PDF.
Repérer un mauvais scan avant de télécharger
Les mots dont le moteur n’est pas sûr sont marqués en rouge. Survolez n’importe quel cadre pour voir ce qu’il a lu et avec quel degré de confiance.
Quelques cadres rouges éparpillés, c’est normal. Une page majoritairement rouge signale un problème : le plus souvent une mauvaise langue, ou un scan à refaire en meilleure résolution.
Ce que vous pouvez faire avec un PDF consultable
Dès que la couche de texte existe, le document se comporte comme un vrai document partout où vous l’utilisez.
Chercher dans le document
Ctrl+F fonctionne dans n’importe quel lecteur PDF, sur n’importe quel appareil. Retrouver une clause dans un contrat scanné de 60 pages cesse d’être un défilement manuel.
Copier et citer sans retaper
Sélectionnez un paragraphe et collez-le dans un e-mail ou un rapport. Aucune retranscription, aucune coquille introduite en chemin.
Rendre les scans accessibles
Les lecteurs d’écran ne peuvent lire qu’une couche de texte. Lancer une OCR est souvent la plus grande amélioration d’accessibilité possible pour un fonds de scans.
Alimenter d’autres outils en texte propre
Les index de recherche, les applis de notes, les traducteurs et les tableurs ont besoin de caractères, pas de pixels. L’export en texte brut s’y insère directement.
Votre scan ne quitte pas cet onglet
Les documents scannés sont souvent les fichiers les plus sensibles que l’on possède : accords signés, passeports, papiers fiscaux, courriers médicaux. Les envoyer sur un serveur inconnu juste pour les rendre consultables est un drôle de marché.
Cet outil charge le moteur d’OCR PDF dans votre navigateur en WebAssembly et l’y exécute. Les packs de langue viennent de notre serveur, mais votre document ne va nulle part. Vous pouvez couper le réseau une fois la page chargée : le travail ira jusqu’au bout.
OCR PDF dans le navigateur ou outils d’OCR avec téléversement
Le traitement local est le bon réglage par défaut pour des documents privés, mais il n’est pas sans contreparties. Voici la comparaison honnête.
| Critère | Cet outil (dans le navigateur) | Outils d’OCR avec téléversement |
|---|---|---|
| Où va votre fichier | Il ne quitte jamais votre appareil | Il est envoyé sur un serveur distant |
| Fonctionne hors ligne | Oui, après le premier chargement | Non |
| Limite de taille | Fixée par la mémoire de votre appareil | Fixée par la formule du service |
| Compte requis | Non | Souvent, pour les gros fichiers |
| Vitesse sur de très gros PDF | Plus lente — elle utilise votre processeur | Plus rapide — elle utilise leurs serveurs |
| Précision sur les scans difficiles | Bonne sur de l’imprimé propre | Souvent meilleure — moteurs commerciaux |
Les deux dernières lignes sont réelles. Un service commercial au moteur affiné battra un moteur libre sur un fax froissé de 1998, et une ferme de serveurs ira toujours plus vite qu’un ordinateur portable sur un fichier de 500 pages. Si votre document n’est pas sensible et que la précision sur un mauvais scan compte plus que la confidentialité, utilisez plutôt l’un d’eux.
Comment obtenir la meilleure précision d’OCR
La qualité de l’OCR PDF se joue surtout avant d’appuyer sur le bouton. Ces quatre points expliquent l’essentiel de l’écart.
- 1
Scannez à 300 ppp ou plus
C’est le facteur le plus déterminant. À 150 ppp, les contours des caractères commencent à se confondre ; à 72 ppp, la plupart des moteurs devinent. 300 ppp est la cible standard pour la reconnaissance de texte.
- 2
Redressez et nettoyez la page d’abord
Une page inclinée de seulement deux degrés fait baisser la précision de façon mesurable. Activez le redressement pour les scans de travers, et le nettoyage du fond pour les scans gris ou piqués.
- 3
Une seule langue par passe
Mélanger les packs de langue dilue la précision. Si un document est majoritairement en anglais avec quelques noms français, traitez-le en anglais.
- 4
Vérifiez la couche de texte, puis relancez
Regardez les mots surlignés avant de télécharger. Si une page est pleine de cadres rouges, changez de langue ou de réglages de scan et relancez : cela ne coûte rien.
Suite complète d'outils PDF
Découvrez notre collection complète d'outils PDF conçus pour répondre à tous vos besoins documentaires
PNG en PDF
Regrouper des images PNG dans un PDF prêt à imprimer
JPG en PDF
Convertir des images JPG au format PDF
Fusionner PDF
Combiner plusieurs fichiers PDF en un seul
Compresser PDF
Réduire efficacement la taille des PDF
PDF en PNG
Convertir des pages PDF en images PNG
PDF en JPG
Convertir des pages PDF en images JPG
PDF en texte
Extraire le contenu texte de fichiers PDF
Diviser PDF
Diviser un PDF en pages distinctes
Modifier PDF
Modifier et annoter des documents PDF
Organiser PDF
Organiser et réorganiser les pages d'un PDF
Pivoter un PDF
Pivoter les pages d'un PDF et enregistrer définitivement
Numéros de page
Ajouter des numéros de page à un PDF avec aperçu en direct
Filigrane PDF
Ajouter un filigrane texte à un PDF avec aperçu en direct
HEIC en JPG
Convertir des photos HEIC d'iPhone en JPG
Supprimer des pages PDF
Retirez les pages inutiles et téléchargez un PDF propre
Extraire des pages PDF
Enregistrez les pages choisies en un nouveau PDF ou en fichiers séparés
Signer un PDF
Dessinez, tapez ou importez une signature et placez-la sur n'importe quelle page
Redimensionner un PDF
Changez la taille de page en A4, Letter ou en dimensions personnalisées
Rogner un PDF
Coupez les marges, sélectionnez par glisser ou rognez les blancs automatiquement
Aplatir le PDF
Rendez les formulaires en lecture seule — gardez le texte consultable ou verrouillez en image
Métadonnées PDF
Affichez, modifiez ou supprimez l'auteur, le titre, les dates et autres métadonnées
PDF en niveaux de gris
Convertissez en niveaux de gris ou en noir et blanc pour économiser l'encre couleur
Extraire les images d'un PDF
Extrayez les photos intégrées d'un PDF et enregistrez-les en PNG ou JPG
WebP en PDF
Convertissez des images WebP en PDF, fusionnez-en plusieurs en un seul fichier
Protéger un PDF
Ajoutez un mot de passe d'ouverture à votre PDF, entièrement dans votre navigateur
Déverrouiller un PDF
Retirez un mot de passe connu ou des restrictions d'un PDF, dans votre navigateur
HEIC en PDF
Convertir des photos HEIC d'iPhone en PDF
AVIF en PDF
Convertir des images AVIF en PDF
TIFF en PDF
Convertir des images et scans TIFF en PDF
BMP en PDF
Convertir des images BMP en PDF
OCR PDF
Rendez un PDF scanné consultable, entièrement dans votre navigateur
Caviarder un PDF
Supprimez définitivement le texte sensible d’un PDF, dans votre navigateur
Compresser une image
Réduisez JPEG, PNG et WebP par lot, entièrement dans votre navigateur
Redimensionner une image
Changez les dimensions par lot, avec préréglages, dans votre navigateur
Questions fréquentes
Tout ce que l’on demande avant de lancer une OCR PDF sur un scan.
Comment faire l’OCR d’un PDF gratuitement ?
Ouvrez le fichier ci-dessus, choisissez la langue du document et cliquez sur « Lancer l’OCR ». Tout se passe dans cet onglet et ne coûte rien. Vous récupérez un PDF consultable et un fichier texte, sans compte et sans limite de pages.
Cet outil d’OCR PDF est-il vraiment gratuit ? Quelle est la limite ?
Il est gratuit, sans plafond de pages et sans filigrane. Nous n’imposons pas de quota parce que le coût n’est pas de notre côté : c’est votre appareil qui travaille. La limite réelle est la mémoire ; sur un téléphone ancien, un très gros scan peut l’épuiser, et il vaut alors mieux traiter par plages de pages.
Mes fichiers sont-ils envoyés sur un serveur ?
Non. Votre PDF ne quitte jamais le navigateur. Le moteur d’OCR est du WebAssembly exécuté en local. Les seules choses téléchargées depuis chez nous sont le moteur et le pack de langue. Vous pouvez le vérifier en coupant le réseau une fois la page chargée : l’OCR continue de fonctionner.
Quelle est la précision de l’OCR PDF ?
Très bonne sur du texte imprimé propre, plus faible sur l’écriture manuscrite et les mauvais scans. Un scan à 300 ppp de texte imprimé ordinaire est en général reconnu au-delà de quatre-vingt-dix pour cent. L’écriture à la main, le papier de fax passé, les tableaux denses et les photos peu définies dégradent vite le résultat. Utilisez la vue de la couche de texte pour juger votre propre document plutôt que de vous fier à une moyenne.
Puis-je convertir un PDF scanné en Word avec l’OCR ?
Pas directement — cet outil produit un PDF consultable et du texte brut, pas un .docx. Dans la plupart des cas, l’export en texte brut est justement ce dont vous avez besoin et se colle directement dans un document. Si vous ne voulez que le texte seul, notre outil PDF vers texte couvre ce cas.
Quelles langues l’OCR PDF prend-elle en charge ?
Onze, couvrant les écritures latine, cyrillique et CJC. Anglais, chinois simplifié et traditionnel, espagnol, portugais, allemand, français, italien, japonais, coréen et russe. Les écritures non latines reçoivent une couche de texte complète : les scans en chinois et en russe sont réellement consultables, et pas seulement en partie.
Pourquoi la première passe est-elle plus lente que la seconde ?
La première télécharge le moteur d’OCR et le pack de langue. Ensuite, les deux sont en cache dans votre navigateur : les passes suivantes démarrent immédiatement et fonctionnent sans connexion. Passer à une nouvelle langue télécharge ce pack une fois.
Que faire après avoir passé un PDF à l’OCR ?
En général, le compresser ou en extraire le texte. La couche de texte n’ajoute que quelques kilo-octets par page, mais le scan qui se trouve dessous est souvent lourd. Compresser ensuite conserve la recherche tout en réduisant la taille du fichier.
Outils associés
Ce que vous pourriez vouloir faire d’autre avec le même document.
- PDF en texte — extrayez le texte d’un PDF qui possède déjà une couche de texte.
- Compresser un PDF — allégez le scan après l’OCR sans perdre la couche de texte.
- PDF en PNG — exportez les pages en images si vous voulez les retoucher avant de rescanner.
- PDF en niveaux de gris — retirez la couleur d’un scan bruité, ce qui aide souvent la reconnaissance.
- Fusionner des PDF — réunissez plusieurs pages scannées en un document avant de lancer l’OCR.
- Caviarder un PDF — supprimez le texte sensible une fois le scan devenu consultable.
Rendez vos scans consultables
Lancez l’OCR sur un PDF directement dans votre navigateur. Sans téléversement, sans compte, sans limite de pages.
Ouvrir l’outil d’OCR PDF