La reconnaissance optique de caractères, ou OCR, lit les lettres d'une image et les transforme en texte. Plus besoin de recopier un courrier ligne par ligne : il suffit d'une photo.

À quoi ça sert au quotidien ?

  • Reprendre le texte d'un courrier pour y répondre ou le citer.
  • Copier un numéro de contrat, un IBAN ou une adresse depuis un document papier.
  • Rendre un PDF scanné recherchable : on peut ensuite y chercher un mot ou copier un passage.
  • Récupérer le texte d'une capture d'écran ou d'une diapositive.

Réussir sa photo

  • Posez le document à plat, bien éclairé, sans ombre de la main ni du téléphone.
  • Photographiez bien en face, pour que les lignes restent droites.
  • Assurez-vous que le texte est net et assez grand dans l'image : approchez-vous plutôt que de zoomer.
  • Une page par photo donne de meilleurs résultats qu'une double page.

Les limites à connaître

L'OCR excelle sur le texte imprimé. L'écriture manuscrite, les tableaux très serrés ou les polices fantaisie donnent des résultats moins fiables. Relisez toujours le texte obtenu, surtout les chiffres : un 5 peut devenir un S, un 0 un O.

Dans votre navigateur, sans envoi

L'outil Extraire le texte d'une image utilise le moteur libre Tesseract, directement dans votre navigateur : vos images ne sont pas envoyées. Il lit les photos, les captures et les PDF scannés, en français, et fournit le texte modifiable, un fichier .txt et un PDF avec texte sélectionnable. Pour vérifier le résultat, passez-le au correcteur d'orthographe.