Document AI : extraction de champs personnalisés depuis n'importe quel document (FR)
Bulletins de salaire, preuves de fonds, déclarations fiscales, actes de constitution, relevés bancaires. Les documents les plus importants pour l'intégration sont ceux sans modèle fixe.

Les documents d'identité sont simples. Il en existe environ 14 000 dans le monde, ils ont des mises en page fixes, et un bon moteur OCR les lit sans aucune instruction. Les documents qui retardent réellement une intégration sont les autres : une constancia de situación fiscal mexicaine, un RIF vénézuélien, une escritura de constitución espagnole, un relevé bancaire indien, une fiche de paie britannique, une lettre de source de richesse rédigée par le comptable de quelqu'un. Il n'y en a pas deux qui se ressemblent, et aucun modèle ne les couvre.
La réponse habituelle est un humain. Quelqu'un ouvre le PDF, lit le numéro, le tape dans un formulaire et passe à autre chose – quelques centaines de fois par semaine. Document AI est la réponse qui n'est pas humaine.
Points clés à retenir
- Vous configurez jusqu'à trois documents par flux de travail, et pour chacun d'eux, vous définissez les champs exacts que vous souhaitez extraire — nom, type (
texte,nombre,date), une instruction d'extraction et si le champ est obligatoire. - Un modèle vision-langage lit chaque document par rapport à un schéma construit à partir de vos définitions de champs et renvoie des valeurs typées — des nombres comme des nombres, des dates au format
AAAA-MM-JJ. - Des analyses forensiques PDF et EXIF sont effectuées sur chaque téléchargement pour détecter les manipulations.
- Les champs extraits peuvent être contre-référencés avec d'autres étapes — le nom du titulaire du compte sur un relevé bancaire par rapport au nom sur l'identité vérifiée, par exemple — et avec des règles personnalisées que vous rédigez.
- 0,20 $ par document. Il existe également une API autonome si vous détenez déjà le fichier et ne souhaitez aucune interface utilisateur hébergée.
Ce que fait Document AI
Vous décrivez un document une seule fois. Vous lui donnez un titre et une description à l'écran, qui sont automatiquement traduits dans toutes les langues de vérification, et vous listez les points de données à lire. Chaque champ reçoit une clé, un nom humain, une instruction indiquant au modèle ce qu'il doit rechercher, un type et un indicateur obligatoire.
L'utilisateur télécharge un PDF ou une image. Didit le rend, exécute l'extraction par rapport à votre schéma, applique les analyses forensiques, puis applique vos règles. Le résultat est un statut par document qui s'intègre au statut de la fonctionnalité, avec Refusé l'emportant sur En révision l'emportant sur Approuvé.
Pourquoi c'est important
Trois choses se produisent lors de l'intégration qu'un OCR à modèle fixe ne peut pas résoudre.
Le document n'a pas de modèle. Une preuve de fonds est ce que la banque du client a choisi d'imprimer. Une lettre de source de richesse est une prose. La seule chose qui se généralise est un modèle qui lit pour le sens plutôt que pour la position.
Les données doivent concorder avec le reste de la session. Extraire « J. Dupont » d'une fiche de paie a très peu de valeur en soi. L'extraire et le comparer au nom complet figurant sur le document d'identité vérifié est un contrôle. Document AI effectue la comparaison et vous permet de décider ce qui se passe en cas d'échec.
Le document peut être modifié. Une fiche de paie avec un numéro différent collé sur l'original est la plus ancienne astuce en matière de prêt. Des vérifications forensiques de la structure PDF et de l'EXIF de l'image sont effectuées sur chaque téléchargement et peuvent refuser, réviser ou approuver selon l'action que vous configurez.
Détails techniques
Si le fichier est déjà sur votre serveur, une seule requête fait tout :
curl -X POST https://verification.didit.me/v3/document-ai/ \
-H "x-api-key: $DIDIT_API_KEY" \
-F "document=@payslip.pdf" \
-F 'fields=[{"key":"account_holder","name":"Account holder","instruction":"Full name of the employee","type":"text","required":true,"is_full_name":true},{"key":"net_pay","name":"Net pay","instruction":"Net amount paid this period","type":"number","required":true},{"key":"pay_date","name":"Pay date","instruction":"Date of payment","type":"date","required":true}]'
Vous obtenez les champs extraits, le résultat de la correspondance de nom et un statut de manière synchrone. Pas de flux hébergé, pas de session.
Dans un flux de travail, la même configuration se trouve sur la fonctionnalité DOCUMENT_AI, et l'utilisateur télécharge via le flux hébergé ou le SDK. DOCUMENT_AI apparaît ensuite dans le tableau features[] de la décision, et vous récupérez le résultat de GET /v3/session/{sessionId}/decision/ ou vous vous abonnez à session.status.updated.
Les règles que vous pouvez définir
| Règle | Se déclenche quand | Action |
|---|---|---|
document_ai_unreadable_document_action | Le fichier ne peut pas être lu | DECLINE · REVIEW · NO_ACTION |
document_ai_missing_required_fields_action | Un champ obligatoire est absent | DECLINE · REVIEW · NO_ACTION |
document_ai_document_tampering_action | L'analyse forensique détecte une manipulation | DECLINE · REVIEW · NO_ACTION |
document_ai_name_mismatch_action | Le champ de nom est inférieur au seuil | DECLINE · REVIEW · NO_ACTION |
document_ai_unsupported_file_action | Le type de fichier n'est pas accepté | DECLINE · REVIEW · NO_ACTION |
document_ai_max_attempts_exceeded_action | L'utilisateur a épuisé les tentatives | DECLINE · REVIEW · NO_ACTION |
Plus document_ai_name_match_score_threshold de 0 à 100 et document_ai_max_retry_attempts de 2 à 5.
Référencement croisé d'autres étapes
Les status_rules[] personnalisées référencent un champ extrait comme document_ai. et peuvent le comparer à la sortie d'une autre étape en utilisant value_type: "field". Ainsi, document_ai.account_holder equals kyc.full_name est une règle que vous écrivez, pas une fonctionnalité que vous attendez.
Dans un flux de travail pour une personne, un champ marqué is_full_name est automatiquement comparé à l'identité vérifiée. Dans un flux de travail pour une entreprise, il est comparé au nom de l'entreprise correspondant au registre.
Cas d'utilisation
Prêt et BNPL. Fiches de paie et relevés bancaires, avec le salaire net extrait sous forme de nombre sur lequel vos règles de souscription peuvent agir, et détection de falsification sur chaque téléchargement.
Crypto et intégration de grande valeur. Preuves de fonds et lettres de source de richesse, vérifiées par recoupement avec l'identité vérifiée.
Intégration d'entreprises en Amérique latine. Constancia de situación fiscal, RIF, contrato social, certificado de existencia. Des documents dont le format est défini par une autorité fiscale et change sans préavis, lus par instruction plutôt que par modèle.
Services professionnels réglementés. Lettres d'engagement et actes de fiducie, où le nom sur le document doit correspondre à la personne qui a signé la session.
Comment intégrer Didit
- Ouvrez le constructeur de flux de travail et ajoutez la fonctionnalité Document AI.
- Définissez vos documents et leurs champs. Partez d'un modèle ou construisez à partir de zéro.
- Définissez les règles de base et le seuil de correspondance de nom.
- Ajoutez toutes les règles de statut personnalisées qui se recoupent avec d'autres étapes.
- Créez des sessions avec
POST /v3/session/et lisez la décision, ou appelez directementPOST /v3/document-ai/si vous détenez déjà le fichier.
Foire aux questions
Combien de documents puis-je configurer ?
Jusqu'à trois par flux de travail, chacun avec sa propre liste de champs, titre et description.
Quels types de fichiers fonctionnent ?
PDF et images. Tout autre type déclenche document_ai_unsupported_file_action.
Gère-t-il les documents dans d'autres langues ?
Oui. Les titres et descriptions que vous rédigez sont automatiquement traduits dans toutes les langues de vérification, et l'extraction est basée sur des instructions plutôt que liée à une langue spécifique.
Quel est le coût ?
0,20 $ par document, que ce soit via le flux de travail ou l'API autonome. Les 500 premiers par mois sont gratuits, comme pour toutes les fonctionnalités de Didit.
Puis-je l'utiliser sans vérification d'identité ?
Oui. POST /v3/document-ai/ est un appel serveur-à-serveur autonome. Aucune session, aucune interface utilisateur hébergée, aucune étape d'identité requise.
Prêt à commencer ?
Lisez la documentation de Document AI, la référence de l'API autonome, consultez les tarifs, et commencez gratuitement.
Articles associés
- Document AI : extraction de champs personnalisés depuis n'importe quel document (FR)
- La deuxième tranche AML/CTF est en vigueur en Australie : ce que la diligence raisonnable client exige désormais (FR-1)
- La règle européenne sur les deepfakes est en vigueur et vise l'outil, pas la fraude
- L'IA au cœur de la vérification d'identité dans les jeux de hasard
- La règle d'identité des stablecoins : émission et rachat, mais pas au-delà
- L'Égypte prend en charge le coût de l'actualisation KYC pour ses expatriés