Documentos con IA: extracción de campos personalizados de cualquier archivo (ES)
Nóminas, pruebas de fondos, declaraciones fiscales, escrituras de constitución, estados de cuenta bancarios. Los documentos más importantes para la incorporación no tienen una plantilla fija.

Los documentos de identidad son fáciles. Hay aproximadamente 14.000 de ellos en el mundo, tienen diseños fijos y un buen motor OCR los lee sin necesidad de instrucciones. Los documentos que realmente retrasan una incorporación son los otros: una constancia de situación fiscal mexicana, un RIF venezolano, una escritura de constitución española, un estado de cuenta bancario indio, una nómina del Reino Unido, una carta de origen de fondos escrita por el contador de alguien. No hay dos iguales y ninguna plantilla los cubre.
La respuesta habitual es un humano. Alguien abre el PDF, lee el número, lo escribe en un formulario y continúa, cientos de veces a la semana. La IA de Documentos es la respuesta que no es un humano.
Puntos clave
- Puede configurar hasta tres documentos por flujo de trabajo, y para cada uno define los campos exactos que desea extraer: nombre, tipo (
texto,número,fecha), una instrucción de extracción y si es obligatorio. - Un modelo de lenguaje-visión lee cada documento según un esquema creado a partir de sus definiciones de campo y devuelve valores tipificados: números como números, fechas como
AAAA-MM-DD. - Se realizan análisis forenses de PDF y EXIF en cada carga para detectar manipulaciones.
- Los campos extraídos se pueden cotejar con otros pasos —el nombre del titular de la cuenta en un estado de cuenta bancario con el nombre de la identificación verificada, por ejemplo— y con reglas personalizadas que usted escriba.
- $0.20 por documento. También hay una API independiente si ya tiene el archivo y no quiere ninguna interfaz de usuario alojada.
Qué hace la IA de Documentos
Usted describe un documento una vez. Le da un título y una descripción en pantalla, que se traducen automáticamente a todos los idiomas de verificación, y enumera los puntos de datos a leer. Cada campo obtiene una clave, un nombre legible, una instrucción que le dice al modelo qué buscar, un tipo y una bandera de obligatoriedad.
El usuario carga un PDF o una imagen. Didit lo renderiza, ejecuta la extracción contra su esquema, aplica la forense y luego aplica sus reglas. El resultado es un estado por documento que se acumula en el estado de la característica, con Rechazado superando a En Revisión superando a Aprobado.
Por qué es importante
Tres cosas fallan en la incorporación que un OCR de plantilla fija no puede solucionar.
El documento no tiene plantilla. Una prueba de fondos es lo que el banco del cliente decidió imprimir. Una carta de origen de fondos es prosa. Lo único que se generaliza es un modelo que lee por significado en lugar de por posición.
Los datos deben coincidir con el resto de la sesión. Extraer "J. Smith" de una nómina tiene muy poco valor por sí solo. Extraerlo y compararlo con el nombre completo en el documento de identidad verificado es un control. La IA de Documentos hace la comparación y le permite decidir qué sucede cuando falla.
El documento podría ser editado. Una nómina con un número diferente pegado sobre el original es el truco más antiguo en los préstamos. Las comprobaciones forenses en la estructura del PDF y el EXIF de la imagen se ejecutan en cada carga y pueden rechazar, revisar o aprobar según la acción que configure.
Detalles técnicos
Si el archivo ya está en su servidor, una solicitud hace todo el proceso:
curl -X POST https://verification.didit.me/v3/document-ai/ \
-H "x-api-key: $DIDIT_API_KEY" \
-F "document=@payslip.pdf" \
-F 'fields=[{"key":"account_holder","name":"Account holder","instruction":"Full name of the employee","type":"text","required":true,"is_full_name":true},{"key":"net_pay","name":"Net pay","instruction":"Net amount paid this period","type":"number","required":true},{"key":"pay_date","name":"Pay date","instruction":"Date of payment","type":"date","required":true}]'
Obtiene los campos extraídos, el resultado de la coincidencia de nombres y un estado de forma sincrónica. Sin flujo alojado, sin sesión.
Dentro de un flujo de trabajo, la misma configuración reside en la función DOCUMENT_AI, y el usuario carga a través del flujo alojado o el SDK. DOCUMENT_AI aparece entonces en la matriz features[] de la decisión, y usted obtiene el resultado de GET /v3/session/{sessionId}/decision/ o se suscribe a session.status.updated.
Las reglas que puede establecer
| Regla | Se activa cuando | Acción |
|---|---|---|
document_ai_unreadable_document_action | El archivo no se puede leer | DECLINE · REVIEW · NO_ACTION |
document_ai_missing_required_fields_action | Falta un campo obligatorio | DECLINE · REVIEW · NO_ACTION |
document_ai_document_tampering_action | La forense detecta manipulación | DECLINE · REVIEW · NO_ACTION |
document_ai_name_mismatch_action | El campo de nombre tiene una puntuación inferior al umbral | DECLINE · REVIEW · NO_ACTION |
document_ai_unsupported_file_action | El tipo de archivo no es aceptado | DECLINE · REVIEW · NO_ACTION |
document_ai_max_attempts_exceeded_action | El usuario agota los reintentos | DECLINE · REVIEW · NO_ACTION |
Además, document_ai_name_match_score_threshold de 0 a 100 y document_ai_max_retry_attempts de 2 a 5.
Cotejo de otros pasos
Las status_rules[] personalizadas hacen referencia a un campo extraído como document_ai. y pueden compararlo con la salida de otro paso usando value_type: "field". Así, document_ai.account_holder equals kyc.full_name es una regla que usted escribe, no una característica que espera.
En un flujo de trabajo de persona, un campo marcado is_full_name se compara automáticamente con la identidad verificada. En un flujo de trabajo de empresa, se compara con el nombre de la empresa registrado.
Casos de uso
Préstamos y BNPL. Nóminas y estados de cuenta bancarios, con el salario neto extraído como un número sobre el que sus reglas de suscripción pueden actuar, y detección de manipulaciones en cada carga.
Cripto y alta incorporación de valor. Pruebas de fondos y cartas de origen de riqueza, cotejadas con la identidad verificada.
Incorporación de empresas en América Latina. Constancia de situación fiscal, RIF, contrato social, certificado de existencia. Documentos cuyo formato es establecido por una autoridad fiscal y cambia sin previo aviso, leídos por instrucción en lugar de por plantilla.
Servicios profesionales regulados. Cartas de compromiso y escrituras de fideicomiso, donde el nombre en el documento debe coincidir con la persona que firmó la sesión.
Cómo integrar con Didit
- Abra el constructor de flujos de trabajo y añada la función de IA de Documentos.
- Defina sus documentos y sus campos. Empiece con una plantilla o construya desde cero.
- Establezca las reglas básicas y el umbral de coincidencia de nombres.
- Añada cualquier regla de estado personalizada que coteje otros pasos.
- Cree sesiones con
POST /v3/session/y lea la decisión, o llame directamente aPOST /v3/document-ai/si ya tiene el archivo.
Preguntas frecuentes
¿Cuántos documentos puedo configurar?
Hasta tres por flujo de trabajo, cada uno con su propia lista de campos, título y descripción.
¿Qué tipos de archivo funcionan?
PDF e imágenes. Cualquier otra cosa activa document_ai_unsupported_file_action.
¿Maneja documentos en otros idiomas?
Sí. Los títulos y descripciones que escriba se traducen automáticamente a todos los idiomas de verificación, y la extracción se basa en instrucciones en lugar de estar limitada por el idioma.
¿Cuál es el costo?
$0.20 por documento, ya sea a través del flujo de trabajo o de la API independiente. Los primeros 500 por mes son gratuitos, como con cada función de Didit.
¿Puedo usarlo sin ninguna verificación de identidad?
Sí. POST /v3/document-ai/ es una llamada de servidor a servidor independiente. Sin sesión, sin interfaz de usuario alojada, sin necesidad de un paso de identidad.
¿Listo para empezar?
Lea la documentación de IA de Documentos, la referencia de la API independiente, consulte los precios y empiece gratis.
Artículos relacionados
- Documentos con IA: extracción de campos personalizados de cualquier archivo (ES)
- La Segunda Fase AML/CTF en Australia: Diligencia Debida del Cliente Requerida (ES-1)
- La norma europea de deepfakes entra en vigor, impactando la herramienta, no el fraude
- La IA en el juego: un desafío en dos frentes para la verificación de identidad
- La regla de identidad de las stablecoins cubre emisión y canje, no lo que sigue
- Egipto asume el costo de una actualización KYC en lugar de pasárselo al cliente