Aller au contenu
Notitia

OCRReconnaissance optique de caractères

Réponse directe

Une technologie qui détecte et convertit le texte présent dans une image ou un document numérisé en caractères exploitables par un logiciel.

Explication détaillée

L’OCR localise des caractères imprimés ou manuscrits dans une image, puis les transforme en texte numérique que l’on peut rechercher, copier ou analyser. Certains systèmes conservent aussi la position des mots et la structure du document. Reconnaître les caractères ne signifie toutefois pas comprendre le sens ni identifier correctement chaque champ.

Exemple

Une application photographie une facture et transforme son contenu en texte afin de permettre la recherche du nom du fournisseur ou du montant.

Analogie

C’est comme demander à un copiste de retaper le contenu d’une photo pour le rendre modifiable et consultable.

Erreurs fréquentes

« OCR signifie résumé automatique. » L’OCR extrait le texte ; une autre étape peut ensuite le résumer ou l’interpréter. « Le résultat est toujours exact. » La qualité de l’image, la mise en page, la langue et l’écriture influencent les erreurs. « Un PDF contient forcément du texte sélectionnable. » Un PDF scanné peut n’être qu’une suite d’images nécessitant un OCR.

Termes liés

Sources

Dernière mise à jour : 24/07/2026 · Rédaction : Alban Speckaert