Ves al contingut principal
Didit recapta 7,5M $ per construir la infraestructura per a identitat i frau
Didit
Torna al blog
Blog · 7 de setembre del 2026

Document AI: extracció de camps personalitzats de qualsevol document (CA)

Nòmines, justificants de fons, declaracions d'impostos, escriptures de constitució, extractes bancaris. Els documents més importants en l'onboarding no tenen una plantilla fixa.

Per DiditActualitzat el
document-ai-custom-document-data-extraction.png

Els documents d'identitat són fàcils. N'hi ha aproximadament 14.000 al món, tenen dissenys fixos i un bon motor OCR els llegeix sense que se li digui res. Els documents que realment dificulten un onboarding són els altres: una constancia de situación fiscal mexicana, un RIF veneçolà, una escritura de constitución espanyola, un extracte bancari indi, una nòmina del Regne Unit, una carta d'origen de fons escrita per l'assessor fiscal d'algú. No n'hi ha dos d'iguals, i cap plantilla els cobreix.

La resposta habitual és un humà. Algú obre el PDF, llegeix el número, l'escriu en un formulari i continua, unes quantes vegades a la setmana. Document AI és la resposta que no és un humà.

Aspectes clau

  • Podeu configurar fins a tres documents per flux de treball, i per a cadascun definiu els camps exactes que voleu extreure: nom, tipus (text, number, date), una instrucció d'extracció i si és obligatori.
  • Un model de visió-llenguatge llegeix cada document segons un esquema construït a partir de les vostres definicions de camp i retorna valors tipificats — nombres com a nombres, dates com a YYYY-MM-DD.
  • S'executen anàlisis forenses de PDF i EXIF en cada càrrega per detectar manipulacions.
  • Els camps extrets es poden contrastar amb altres passos — el nom del titular del compte en un extracte bancari amb el nom de la identificació verificada, per exemple — i amb regles personalitzades que escriviu.
  • 0,20 $ per document. També hi ha una API autònoma si ja teniu el fitxer i no voleu cap interfície d'usuari allotjada.

Què fa Document AI

Descriviu un document una vegada. Li doneu un títol i una descripció en pantalla, que es tradueixen automàticament a tots els idiomes de verificació, i enumereu els punts de dades a llegir. Cada camp té una clau, un nom humà, una instrucció que indica al model què ha de buscar, un tipus i una bandera de camp obligatori.

L'usuari puja un PDF o una imatge. Didit el renderitza, executa l'extracció segons el vostre esquema, aplica anàlisis forenses i, a continuació, aplica les vostres regles. El resultat és un estat per document que es resumeix en l'estat de la funció, amb Declined superant In Review superant Approved.

Per què és important

Tres coses fallen en l'onboarding que un OCR de plantilla fixa no pot solucionar.

El document no té plantilla. Un justificant de fons és el que el banc del client va decidir imprimir. Una carta d'origen de fons és prosa. L'única cosa que es generalitza és un model que llegeix per significat en lloc de per posició.

Les dades han de coincidir amb la resta de la sessió. Extreure "J. Smith" d'una nòmina val molt poc per si sol. Extreure-ho i comparar-ho amb el nom complet del document d'identitat verificat és un control. Document AI fa la comparació i us permet decidir què passa quan falla.

El document podria estar editat. Una nòmina amb un número diferent enganxat sobre l'original és el truc més antic en els préstecs. Les comprovacions forenses de l'estructura del PDF i de l'EXIF de la imatge s'executen en cada càrrega i poden rebutjar, revisar o aprovar segons l'acció que configureu.

Detalls tècnics

Si el fitxer ja és al vostre servidor, una sola sol·licitud ho fa tot:

curl -X POST https://verification.didit.me/v3/document-ai/ \
  -H "x-api-key: $DIDIT_API_KEY" \
  -F "document=@payslip.pdf" \
  -F 'fields=[{"key":"account_holder","name":"Account holder","instruction":"Full name of the employee","type":"text","required":true,"is_full_name":true},{"key":"net_pay","name":"Net pay","instruction":"Net amount paid this period","type":"number","required":true},{"key":"pay_date","name":"Pay date","instruction":"Date of payment","type":"date","required":true}]'

Obteniu els camps extrets, el resultat de la coincidència de noms i un estat de manera síncrona. Sense flux allotjat, sense sessió.

Dins d'un flux de treball, la mateixa configuració es troba a la funció DOCUMENT_AI, i l'usuari puja a través del flux allotjat o de l'SDK. DOCUMENT_AI apareix aleshores a la matriu features[] de la decisió, i obteniu el resultat de GET /v3/session/{sessionId}/decision/ o us subscriviu a session.status.updated.

Les regles que podeu establir

ReglaS'activa quanAcció
document_ai_unreadable_document_actionNo es pot llegir el fitxerDECLINE · REVIEW · NO_ACTION
document_ai_missing_required_fields_actionFalta un camp obligatoriDECLINE · REVIEW · NO_ACTION
document_ai_document_tampering_actionLes anàlisis forenses detecten manipulacióDECLINE · REVIEW · NO_ACTION
document_ai_name_mismatch_actionEl camp del nom té una puntuació inferior al llindarDECLINE · REVIEW · NO_ACTION
document_ai_unsupported_file_actionEl tipus de fitxer no és acceptatDECLINE · REVIEW · NO_ACTION
document_ai_max_attempts_exceeded_actionL'usuari esgota els reintentsDECLINE · REVIEW · NO_ACTION

A més, document_ai_name_match_score_threshold de 0 a 100 i document_ai_max_retry_attempts de 2 a 5.

Contrastació amb altres passos

Les status_rules[] personalitzades fan referència a un camp extret com a document_ai. i el poden comparar amb la sortida d'un altre pas utilitzant value_type: "field". Així, document_ai.account_holder equals kyc.full_name és una regla que escriviu, no una funció que espereu.

En un flux de treball de persona, un camp marcat com a is_full_name es compara automàticament amb la identitat verificada. En un flux de treball empresarial, es compara amb el nom de l'empresa coincident amb el registre.

Casos d'ús

Préstecs i BNPL. Nòmines i extractes bancaris, amb el sou net extret com a un número sobre el qual les vostres regles de subscripció poden actuar, i detecció de manipulacions en cada càrrega.

Onboarding de criptomonedes i d'alt valor. Justificants de fons i cartes d'origen de fons, contrastats amb la identitat verificada.

Onboarding empresarial a Llatinoamèrica. Constancia de situación fiscal, RIF, contrato social, certificado de existencia. Documents el format dels quals és establert per una autoritat fiscal i canvia sense previ avís, llegits per instrucció en lloc de per plantilla.

Serveis professionals regulats. Cartes de compromís i escriptures de fideïcomís, on el nom del document ha de coincidir amb la persona que va signar la sessió.

Com integrar-se amb Didit

  1. Obriu el constructor de fluxos de treball i afegiu la funció Document AI.
  2. Definiu els vostres documents i els seus camps. Comenceu amb una plantilla o construïu-los des de zero.
  3. Estableix les regles bàsiques i el llindar de coincidència de noms.
  4. Afegiu qualsevol regla d'estat personalitzada que contrasti amb altres passos.
  5. Creeu sessions amb POST /v3/session/ i llegiu la decisió, o truqueu directament a POST /v3/document-ai/ si ja teniu el fitxer.

Preguntes freqüents

Quants documents puc configurar?

Fins a tres per flux de treball, cadascun amb la seva pròpia llista de camps, títol i descripció.

Quins tipus de fitxers funcionen?

PDF i imatges. Qualsevol altra cosa activa document_ai_unsupported_file_action.

Gestiona documents en altres idiomes?

Sí. Els títols i les descripcions que escriviu es tradueixen automàticament a tots els idiomes de verificació, i l'extracció es basa en instruccions en lloc d'estar limitada per l'idioma.

Quant costa?

0,20 $ per document, ja sigui a través del flux de treball o de l'API autònoma. Els primers 500 al mes són gratuïts, com amb totes les funcions de Didit.

Puc utilitzar-ho sense cap verificació d'identitat?

Sí. POST /v3/document-ai/ és una trucada de servidor a servidor autònoma. Sense sessió, sense interfície d'usuari allotjada, sense pas d'identitat requerit.

Preparat per començar?

Llegiu la documentació de Document AI, la referència de l'API autònoma, consulteu els preus i comenceu de franc.

Infraestructura per a identitat i frau.

Una API per a KYC, KYB, monitorització de transaccions i anàlisi de carteres. Integra-la en 5 minuts.

Demana a una IA que resumeixi aquesta pàgina
API de Document AI — Extracció de dades de documents