Rendre un PDF scanné consultable avec l'OCR
Transformez un PDF scanné, uniquement composé d'images, en un document consultable et copiable grâce à l'OCR — en quelques clics, dans votre langue. Gratuit à l'usage, sans compte.
Réponse courte : ouvrez l'outil OCR, importez votre scan, choisissez la langue du document et téléchargez un PDF dans lequel vous pouvez rechercher et copier. Les pages contenant déjà du texte sont ignorées automatiquement.
Un PDF scanné n'est en réalité qu'une image de la page : vous ne pouvez pas sélectionner le texte ni rien trouver avec Ctrl+F. L'OCR corrige cela en reconnaissant les caractères et en ajoutant une couche de texte consultable derrière l'image.
Vérifiez d'abord si l'OCR est vraiment nécessaire
Ouvrez le PDF et essayez de sélectionner une ligne de texte à la souris :
| Ce qui se passe | Ce qu'il faut faire |
|---|---|
| Des mots individuels se surlignent | Rien — le texte est déjà réel et consultable |
| Toute la page se sélectionne d'un bloc | Lancez l'OCR |
| Rien ne se sélectionne | Lancez l'OCR |
Appliquer l'OCR à un PDF qui contient déjà du texte n'est pas nuisible, mais ne change rien non plus.
Comment appliquer l'OCR à un PDF
- Importez votre PDF scanné dans l'outil OCR. Les fichiers jusqu'à 50 Mo sont pris en charge.
- Choisissez la langue du document pour une meilleure précision, ou l'option automatique en cas de doute.
- Téléchargez le PDF consultable. Vous pouvez désormais utiliser Ctrl+F, sélectionner le texte et le copier.
Pourquoi le choix de la langue compte
Les moteurs OCR utilisent des modèles propres à chaque langue. Choisir la bonne langue :
- améliore la précision sur les caractères accentués (é, è, ê, à, ç, ù),
- réduit les mots mal lus, car le dictionnaire corrige les résultats improbables,
- et est plus rapide que d'exécuter toutes les langues à la fois.
Si un document mélange plusieurs langues, l'option automatique exécute toutes les langues installées ensemble. C'est plus lent et un peu moins précis que de nommer une langue : réservez-le aux cas où c'est nécessaire.
Ce que l'OCR fait — et ne fait pas
- ✅ Rend les PDF scannés/photographiés consultables et copiables.
- ✅ Conserve l'apparence exacte de la page.
- ✅ Ignore les pages qui contiennent déjà du vrai texte.
- ❌ Ne convertit pas le PDF en fichier Word modifiable — utilisez pour cela l'outil PDF vers Word.
- ❌ Ne lit pas l'écriture manuscrite de façon fiable.
De bons scans donnent de meilleurs résultats
La plupart des erreurs d'OCR se jouent avant même son exécution, par la qualité de l'image :
- Scannez à 300 DPI. En dessous d'environ 200 DPI, les formes de lettres voisines deviennent difficiles à distinguer.
- Gardez les pages droites. L'inclinaison est corrigée automatiquement, mais partir droit donne des résultats plus propres.
- Évitez les ombres. C'est le problème habituel des photos prises au téléphone : une ombre sur la page brouille la limite entre l'encre et le papier.
- Préférez la sortie d'un scanner aux photos quand vous avez le choix.
Plus l'image est propre, moins l'OCR fait d'erreurs. Si un résultat est mauvais, rescanner à une résolution supérieure aide presque toujours plus que relancer l'OCR.
Après l'OCR
Une fois la couche de texte créée, le document se comporte comme n'importe quel PDF texte. Étapes suivantes courantes :
- Convertissez-le en Word si vous devez modifier le contenu sous forme de paragraphes.
- Extrayez ses tableaux vers Excel si le scan contient des données à exploiter.
- Compressez-le — les scans sont volumineux, et la couche de texte ajoute encore un peu.
Ce que ça coûte
L'outil OCR est gratuit à l'usage, sans compte et sans limite quotidienne : importez autant de documents que vous voulez et voyez le résultat avant de décider quoi que ce soit. Le téléchargement du fichier terminé nécessite un abonnement, résiliable à tout moment.