OCRReconnaissance optique de caractères
Réponse directe
Une technologie qui détecte et convertit le texte présent dans une image ou un document numérisé en caractères exploitables par un logiciel.
Explication détaillée
L’OCR localise des caractères imprimés ou manuscrits dans une image, puis les transforme en texte numérique que l’on peut rechercher, copier ou analyser. Certains systèmes conservent aussi la position des mots et la structure du document. Reconnaître les caractères ne signifie toutefois pas comprendre le sens ni identifier correctement chaque champ.
Exemple
Une application photographie une facture et transforme son contenu en texte afin de permettre la recherche du nom du fournisseur ou du montant.
Analogie
C’est comme demander à un copiste de retaper le contenu d’une photo pour le rendre modifiable et consultable.
Erreurs fréquentes
« OCR signifie résumé automatique. » L’OCR extrait le texte ; une autre étape peut ensuite le résumer ou l’interpréter.
« Le résultat est toujours exact. » La qualité de l’image, la mise en page, la langue et l’écriture influencent les erreurs.
« Un PDF contient forcément du texte sélectionnable. » Un PDF scanné peut n’être qu’une suite d’images nécessitant un OCR.
Termes liés
Sources
- Google Cloud — OCR, Optical Character Recognition — Google Cloud · consulté le 2026-07-24
- Google Cloud Vision — Detect and extract text from images — Google Cloud · consulté le 2026-07-24
Dernière mise à jour : 24/07/2026 · Rédaction : Alban Speckaert
