Read in English →

GLOSSAIRE

Extraction clé-valeur

Par Sygnet Research. Rédigé par Sygnet, sourcé, vérifié avant publication.

L'extraction de paires clé-valeur est le processus qui consiste à extraire des points de données spécifiques et étiquetés d'un document et à les apparier sous forme de paires champ-valeur, par exemple "Numéro de facture : 4471" ou "Titulaire de la police : Jane Doe". Au lieu de renvoyer un mur de texte brut, le système identifie quelle partie du texte répond à quelle question et renvoie des données structurées prêtes pour une base de données ou un flux de travail. C'est l'une des sorties les plus courantes que les entreprises souhaitent réellement d'un pipeline IDP.

Comment ça marche

Un système d'extraction de paires clé-valeur doit d'abord localiser le texte sur une page, généralement via l'OCR ou un modèle vision-langage qui lit le document directement. Il doit ensuite déterminer quels mots sont des étiquettes ("Total dû", "Date de naissance", "Numéro de réclamation") et quels mots sont les valeurs correspondantes situées à côté, au-dessus ou en dessous d'eux.

Les anciens systèmes reposaient sur des modèles fixes : une zone sur la page 2 était toujours la date de la facture, de sorte que le logiciel lisait simplement ces coordonnées. Cela ne fonctionnait plus dès qu'un fournisseur modifiait sa mise en page. Les approches modernes utilisent des modèles d'apprentissage automatique entraînés à reconnaître les relations étiquette-valeur quelle que soit la position, de sorte qu'un champ "Date d'échéance" est trouvé qu'il se trouve en haut à gauche sur une facture ou en bas à droite sur une autre. Les modèles vision-langage vont plus loin en raisonnant sur la mise en page visuelle et le texte ensemble, ce qui aide avec les tableaux, les cases à cocher et les formulaires à plusieurs colonnes où l'étiquette et la valeur ne sont pas simplement adjacentes.

La sortie est généralement un enregistrement structuré : un ensemble de clés (définies par un schéma que vous spécifiez) mappées aux valeurs trouvées dans le document, souvent avec un score de confiance attaché à chaque paire. Les paires à faible confiance sont acheminées vers un réviseur humain plutôt que d'être directement intégrées à un système en aval. Ce routage basé sur la confiance est ce qui permet de maintenir les taux d'erreur à un niveau gérable en production.

Pourquoi c'est important pour le traitement de documents

L'extraction de paires clé-valeur est l'étape qui transforme un PDF numérisé en quelque chose qu'un système commercial peut réellement utiliser. Une équipe de comptabilité fournisseurs n'a pas besoin du texte intégral d'une facture, elle a besoin du nom du fournisseur, du montant et de la date d'échéance intégrés dans l'ERP. Un expert en sinistres a besoin du numéro de police et de la date de l'incident, pas d'une transcription du formulaire entier.

Réussir cela détermine si un projet IDP fait gagner du temps ou ne fait que déplacer le travail manuel en aval. Une mauvaise extraction de paires clé-valeur produit des paires mal assorties (la bonne valeur attachée au mauvais champ) qui sont pires que l'absence d'automatisation, car les erreurs sont acceptées et se propagent silencieusement. C'est pourquoi la notation de confiance au niveau des champs et un chemin d'escalade clair pour les exceptions sont plus importants que les affirmations de précision brute. Les types de documents avec des mises en page variables, comme les factures de centaines de fournisseurs différents ou les formulaires d'assurance de plusieurs assureurs, sont les endroits où la qualité de l'extraction est la plus difficilement testée.

Termes associés

FAQ

Quelle est la différence entre l'extraction de paires clé-valeur et l'OCR ?

L'OCR convertit une image de texte en caractères lisibles par machine, mais elle n'a aucune idée de ce que signifie ce texte. L'extraction de paires clé-valeur fonctionne en complément de la sortie OCR (ou d'un VLM) et ajoute la couche de compréhension : décider quel texte est une étiquette, quelle est sa valeur, et les apparier en un champ structuré qu'un système peut consommer.

L'extraction de paires clé-valeur fonctionne-t-elle sur des documents qu'elle n'a jamais vus auparavant ?

Les systèmes basés sur des modèles ont du mal avec les nouvelles mises en page. L'apprentissage automatique moderne et l'extraction basée sur le VLM se généralisent mieux car ils apprennent la relation entre les étiquettes et les valeurs plutôt que des coordonnées fixes, de sorte qu'une facture de nouveau fournisseur ou un formulaire inconnu fonctionne souvent sans réapprentissage, bien que la précision bénéficie toujours d'un certain réglage sur des échantillons réels.

ÉTAPE SUIVANTE

Voyez le résultat sur vos propres documents

Un email quand nous publions quelque chose qui vaut votre temps.