WORKFLOWS & ROI

Tester l'IA pour factures: précision et pièges à éviter

Par Sygnet Research, vérifié avant publication

Un reçu papier d'AirAsia Japan pour de l'onigiri et de la soupe miso est présenté à côté des aliments sur une tablette d'avion.
Photo: Comyu · CC BY-SA 3.0 (Wikimedia Commons)

À retenir

  • Un outil d'IA qui annonce « 98 % de précision » ne dit rien d'utile tant que vous ne savez pas sur quels champs, sur quel type de factures et avec quelle méthode de mesure ce chiffre a été obtenu.
  • La bonne méthode de vérification tient en une phrase : constituez un lot de 150 à 300 factures réelles, saisissez-les à la main une fois, et comparez champ par champ avec la sortie de l'outil.
  • Les benchmarks de l'IOFM situent le taux d'erreur des services comptabilité fournisseurs automatisés autour de 0,8 %, contre environ 2 % en manuel : viser le zéro erreur coûte plus cher que les erreurs elles-mêmes.
  • À partir du 1er septembre 2026, toutes les entreprises assujetties à la TVA doivent pouvoir recevoir des factures électroniques, ce qui change la nature du contrôle mais ne le supprime pas.

Pourquoi faut-il tester un outil d'IA sur ses propres factures avant de l'adopter ?

Parce que les chiffres de précision affichés par les éditeurs sont mesurés sur leurs jeux de données, pas sur les vôtres. Un outil excellent sur des factures Orange ou EDF peut s'effondrer sur un bon de livraison scanné de travers par un artisan, ou sur une facture d'avoirs avec trois taux de TVA.

Prenez un cabinet comptable de 40 personnes qui reçoit 300 factures fournisseurs par mois pour ses clients. Le traitement manuel d'une facture coûte, selon les études convergentes, entre 12,80 € et 20 €, avec une moyenne autour de 15 € pour une PME française. Sur 3 600 factures par an, l'enjeu est de l'ordre de 54 000 €. Mais une erreur non détectée coûte aussi : le même calcul estime le coût de correction d'une facture mal imputée autour de 150 €, entre retraitement, nouvelle validation et relance fournisseur.

Autrement dit, 2 % d'erreurs silencieuses sur 3 600 factures effacent une bonne partie du gain. C'est exactement pour ça que la phase de test n'est pas une formalité commerciale.

Un taux de précision sans protocole de mesure n'est pas une donnée, c'est un argument marketing.

Comment construire un jeu de test représentatif ?

Prenez 150 à 300 factures réelles, tirées de vos trois derniers mois, et forcez-vous à y inclure vos cas pénibles. Un échantillon trop propre vous donnera un faux sentiment de sécurité.

La composition concrète pour le cabinet de 40 personnes :

  • 60 % de factures « normales » (PDF natif, un seul taux de TVA, fournisseur récurrent) ;
  • 20 % de scans de mauvaise qualité, photos prises au téléphone, documents inclinés ;
  • 10 % de factures multi-pages avec tableaux de lignes, ce qui est le point de rupture le plus fréquent (voir le guide Sygnet sur l'évaluation de l'extraction de tableaux) ;
  • 10 % de cas tordus : avoirs, factures en devise étrangère, autoliquidation de TVA, acomptes, factures sans bon de commande.

Ensuite, créez la vérité terrain : une personne saisit à la main les 8 à 12 champs qui comptent vraiment pour vous (numéro de facture, SIRET du fournisseur, date, échéance, total HT, TVA par taux, total TTC, IBAN, référence commande). Comptez 3 à 4 heures de travail pour 200 factures. C'est le seul investissement sérieux du protocole, et il est réutilisable pour tester un deuxième fournisseur.

Quels indicateurs regarder (et lesquels ignorer) ?

Le seul indicateur qui vous intéresse est le taux de factures exploitables sans retouche humaine, pas la précision moyenne par caractère. Une facture dont 11 champs sur 12 sont bons doit quand même être rouverte par un humain : elle compte pour un échec.

Mesurez trois choses :

  1. Exactitude par champ : pour chaque champ, le pourcentage de valeurs identiques à votre saisie manuelle. Vous verrez vite que la date d'échéance et la ventilation de TVA sont les points faibles.
  2. Taux de documents parfaits (straight-through processing) : factures où tous les champs critiques sont corrects. C'est votre vrai gain de temps.
  3. Erreurs silencieuses : les cas où l'outil se trompe tout en se déclarant confiant. Ce sont les seules erreurs dangereuses, puisqu'elles passent le contrôle.

Le reste est du bruit. Un outil annonçant 99 % de précision caractère par caractère peut très bien produire 20 % de factures à rouvrir. Pour creuser l'arbitrage entre exactitude et coût réel, Sygnet a documenté le raisonnement en coût par réponse correcte plutôt qu'en pourcentage brut.

Comment utiliser les scores de confiance sans se tromper ?

Un score de confiance sert à trier, pas à rassurer. Son seul usage légitime : décider automatiquement quelles factures partent en validation humaine et lesquelles passent directement en comptabilité.

La méthode est simple. Sur votre jeu de test, tracez pour chaque palier de confiance le taux d'erreur réel observé. Si à 0,95 vous constatez 0,5 % d'erreurs et à 0,85 vous en constatez 6 %, votre seuil de passage automatique se situe entre les deux, selon votre tolérance. Ce calibrage est propre à chaque entreprise : un seuil valable pour des notes de frais à 40 € n'a aucun sens pour des factures de sous-traitance à 80 000 €.

Règle de bon sens : indexez le seuil sur le montant. Toute facture au-dessus d'un seuil (par exemple 5 000 €) passe en revue humaine quelle que soit la confiance affichée. Et tout changement d'IBAN fournisseur passe en revue humaine, point. C'est la porte d'entrée principale de la fraude au virement, et aucun outil d'extraction ne vous protège contre un faux RIB parfaitement lisible.

Ce que vous mesurezCe que ça vous ditPiège classique
Précision par caractèreQualité de lecture bruteFlatteuse, sans lien avec le travail évité
Exactitude par champOù l'outil décrocheMasque les factures à plusieurs erreurs
Taux de factures parfaitesGain de temps réelChute vite sur les lignes de détail
Erreurs silencieusesRisque financierIgnorée par la plupart des démos
Coût par facture correctement traitéeRentabilitéOublie le coût de la revue humaine

Quels contrôles automatiques mettre en place en production ?

Les contrôles arithmétiques et métier attrapent la majorité des erreurs d'extraction, sans IA et sans relecture humaine. Ils sont faciles à écrire et doivent tourner sur 100 % des factures.

La liste minimale, pour notre cabinet de 40 personnes :

  • total HT + TVA = total TTC (tolérance 1 centime d'arrondi) ;
  • somme des lignes = total HT ;
  • taux de TVA appartenant à la liste des taux français en vigueur (20 %, 10 %, 5,5 %, 2,1 %) ;
  • SIRET valide (clé de Luhn) et cohérent avec la base fournisseurs ;
  • détection de doublon sur le triplet fournisseur + numéro de facture + montant, le meilleur rempart contre le double paiement ;
  • date d'échéance postérieure à la date de facture.

Une facture qui échoue à l'un de ces contrôles part en file d'attente humaine, peu importe le score de confiance. Et gardez une traçabilité complète : qui a validé quoi, quand, avec quelle valeur d'origine. Vous en aurez besoin en cas de contrôle fiscal, et les factures doivent de toute façon être conservées 10 ans au titre du Code de commerce, règle rappelée dans les guides de conformité e-invoicing.

Est-ce que la facturation électronique rend ces vérifications inutiles ?

Non, elle en déplace seulement une partie. À compter du 1er septembre 2026, toutes les entreprises assujetties à la TVA en France devront être en mesure de recevoir des factures électroniques structurées, sans seuil de chiffre d'affaires, l'obligation d'émission s'appliquant d'abord aux grandes entreprises et ETI (entreprises de taille intermédiaire), puis au 1er septembre 2027 aux PME, TPE et micro-entreprises.

Une facture au format structuré (Factur-X, UBL, CII) n'a plus besoin d'être « lue » : les données arrivent en clair. Mais trois réalités subsistent. D'abord, pendant des mois vous continuerez de recevoir des PDF et des scans de fournisseurs étrangers ou en retard de mise en conformité. Ensuite, les pièces jointes au cycle achats (bons de livraison, devis, contrats) ne sont pas couvertes par la réforme. Enfin, données structurées ne veut pas dire données justes : un fournisseur peut très bien émettre un IBAN erroné dans un flux parfaitement conforme.

Côté sanctions, le défaut d'émission sous forme électronique est sanctionné par une amende de 15 € par facture, plafonnée à 15 000 € par année civile, et le défaut d'e-reporting par 250 € par transmission manquante. Sygnet publie un point détaillé sur la facturation électronique française et sur les pénalités applicables.

La réforme garantit le format des factures que vous recevez, jamais leur exactitude.

Combien de temps faut-il pour valider un outil sérieusement ?

Quatre à six semaines, dont deux de fonctionnement en parallèle. Le piège est de basculer en production après une démo de 20 factures choisies par l'éditeur.

Le déroulé qui marche :

  • Semaine 1 : constitution du jeu de test et saisie manuelle de la vérité terrain.
  • Semaine 2 : passage du lot dans l'outil, calcul des trois indicateurs, calibrage des seuils.
  • Semaines 3 à 5 : double saisie en production. L'outil traite tout, les humains traitent tout, vous comparez chaque jour. C'est coûteux, mais c'est le seul moment où vous découvrez les cas que votre échantillon avait oubliés.
  • Semaine 6 : décision, avec un chiffre en main : coût par facture correctement traitée, revue humaine incluse.

Un repère utile : les équipes comptabilité fournisseurs les plus performantes dépensent 2,78 $ par facture traitée contre 12,88 $ pour les organisations moyennes. Si votre coût complet après automatisation ne descend pas nettement sous votre coût manuel actuel, le problème n'est pas l'IA, c'est le paramétrage de la revue humaine.

FAQ

Quel taux de précision exiger d'un outil d'extraction de factures ?

Exigez un taux de factures exploitables sans retouche de 85 % minimum sur vos propres documents, et un taux d'erreur résiduel inférieur à 1 % sur les champs financiers. Les benchmarks sectoriels situent l'automatisation autour de 0,8 % d'erreurs contre environ 2 % en manuel. N'acceptez aucun chiffre qui ne soit pas mesuré sur votre jeu de test.

Faut-il encore faire valider les factures par un humain ?

Oui, mais de façon ciblée. Trois catégories doivent rester systématiquement en revue : les factures au-dessus d'un seuil de montant défini par vous, celles qui échouent à un contrôle arithmétique, et tout changement de coordonnées bancaires fournisseur. Le reste peut passer en automatique si vos seuils de confiance ont été calibrés sur des données réelles.

Faut-il développer son propre outil ou acheter une solution ?

Pour un volume inférieur à environ 1 000 factures par mois, l'achat est presque toujours plus rentable : le coût caché d'un développement interne réside dans la maintenance des cas tordus et dans la mise à jour des formats réglementaires. L'analyse comparative des deux approches est détaillée dans le dossier Sygnet sur l'arbitrage build vs buy.

Un email quand nous publions quelque chose qui vaut votre temps.