Read in English →

GLOSSAIRE

ICR (reconnaissance intelligente de caractères)

Par Sygnet Research. Rédigé par Sygnet, sourcé, vérifié avant publication.

La reconnaissance intelligente de caractères (ICR) est une technologie qui lit le texte manuscrit et cursif dans les documents ou formulaires numérisés, le convertissant en données lisibles par machine. Contrairement à l'OCR de base, qui a été conçue pour les caractères imprimés et uniformes, l'ICR apprend et s'adapte aux variations des styles d'écriture individuels. Elle est généralement utilisée au sein d'un pipeline de traitement de documents plus large pour gérer les champs que la reconnaissance de texte brut ne peut pas traiter.

Comment ça marche

Les systèmes ICR s'appuient sur des modèles d'apprentissage automatique entraînés sur de grands ensembles d'échantillons d'écriture manuscrite, couvrant différents styles d'écriture, pressions de stylo, formes de lettres et liaisons entre les caractères. Plutôt que de faire correspondre un caractère à un modèle fixe (comme le faisaient les anciens moteurs OCR), l'ICR prédit la lettre ou le mot le plus probable en fonction des motifs qu'elle a déjà vus, de manière similaire au fonctionnement du texte prédictif sur un clavier de téléphone.

Le processus se déroule généralement par étapes. Tout d'abord, l'image du document est segmentée en lignes, mots et caractères ou traits individuels. Ensuite, un modèle de reconnaissance attribue un score à chaque segment par rapport aux lettres probables, utilisant souvent le contexte (le mot environnant ou le type de champ) pour résoudre l'ambiguïté: est-ce un "1" ou un "l" minuscule ? De nombreux systèmes de production appliquent également une vérification de dictionnaire ou de règles métier par la suite, comparant la sortie aux valeurs attendues telles que les codes postaux, les dates ou les numéros de compte pour détecter et corriger les erreurs.

L'ICR moderne chevauche de plus en plus les modèles vision-langage, qui lisent l'écriture manuscrite et le texte imprimé en une seule passe plutôt que de nécessiter des modules distincts spécifiques à l'écriture manuscrite. Ce changement modifie la façon dont les fournisseurs conçoivent les systèmes d'IA de documents, un point abordé plus en détail dans notre comparaison OCR vs VLM. Les anciens produits ICR, en revanche, étaient des outils étroits boulonnés aux moteurs OCR pour gérer spécifiquement les champs manuscrits.

Pourquoi c'est important pour le traitement des documents

L'écriture manuscrite est inévitable dans les flux de travail papier à volume élevé: formulaires signés, notes médicales, remarques d'experts en sinistres, amendements manuscrits sur les contrats. Sans ICR, ces champs nécessitent une saisie manuelle des données, ce qui ralentit le traitement et introduit des erreurs de transcription. Un pipeline de documents qui ne gère que le texte imprimé classera mal ou rejettera tout ce qui contient des sections manuscrites, créant un goulot d'étranglement exactement là où l'automatisation est la plus nécessaire.

La précision de l'écriture manuscrite est généralement plus faible et plus variable que celle du texte imprimé, de sorte que les sorties ICR méritent des règles de validation plus strictes et, dans de nombreux cas, un examen humain pour les champs à faible confiance. Cela est directement important dans des flux de travail tels que le traitement des réclamations d'assurance, où les notes manuscrites de l'expert ou les formulaires de réclamation signés sont courants, ou dans l'intégration KYC, où les signatures et les formulaires d'identité manuscrits apparaissent toujours. Choisir de créer des modèles ICR personnalisés en interne ou d'utiliser le moteur pré-entraîné d'un fournisseur est l'une des questions pratiques abordées dans notre guide construire ou acheter.

Termes associés

FAQ

L'ICR est-il identique à l'OCR ?

Non. L'OCR reconnaît le texte imprimé, généré par machine, avec des formes de caractères assez cohérentes. L'ICR est une extension spécialisée conçue pour gérer le texte manuscrit et cursif, où les formes des lettres varient d'une personne à l'autre et même au sein de l'écriture d'une même personne. De nombreux outils de traitement de documents combinent les deux, utilisant l'OCR pour les champs dactylographiés et l'ICR pour les champs manuscrits.

Quelle est la précision de l'ICR par rapport à l'OCR ?

La précision de l'ICR est généralement inférieure à celle de l'OCR car l'écriture manuscrite est intrinsèquement plus variable et plus difficile à standardiser que l'imprimé. Les résultats dépendent fortement de la lisibilité de l'écriture, de la qualité des données d'entraînement et de l'utilisation par le système du contexte ou des vérifications de dictionnaire pour corriger les erreurs probables. Pour les champs critiques, l'association de l'ICR à un examen humain est une pratique courante.

ÉTAPE SUIVANTE

Voyez le résultat sur vos propres documents

Un email quand nous publions quelque chose qui vaut votre temps.