Skip to main content

Integración SDK directa

Usa los SDK de AAP y AIP para añadir verificación de alineamiento y comprobación de integridad directamente al código de tu aplicación. Esto te da control total sobre cuándo se generan las trazas, cómo se ejecutan las comprobaciones de integridad y qué sucede ante las violaciones. Para las funciones de gobernanza (aplicación de políticas, reclasificación de violaciones, recuperación de confianza), usa la API Policy y la API Reclassification junto con los SDK.

Instalación

1

Definir una tarjeta de alineamiento

Una tarjeta de alineamiento declara la identidad de tu agente, sus valores, sus límites de autonomía y sus compromisos de auditoría. Cada traza y comprobación de integridad se verifica frente a esta tarjeta.
La tarjeta de alineamiento es el fundamento de ambos protocolos. Defínela una vez y úsala para la verificación AAP, la comprobación de integridad AIP y las comprobaciones de coherencia de valores.
2

Generar AP-Traces a partir de las acciones del agente

Cada decisión importante que tome tu agente debe producir una AP-Trace. La traza registra la acción tomada, las alternativas consideradas, el razonamiento aplicado y si se evaluó una escalada.
La verificación comprueba action.name contra bounded_actions, no action.type. Ambos campos tienen propósitos distintos: type es una categoría semántica; name es el identificador de operación específico que se compara con la lista bounded_actions de la tarjeta.
3

Verificar las trazas frente a la tarjeta

La verificación comprueba si el comportamiento del agente (registrado en la traza) es coherente con su alineamiento declarado (la tarjeta). Devuelve comprobaciones estructurales, una puntuación de similitud y cualquier violación o advertencia.
El similarity_score (de 0.0 a 1.0) mide cuán semánticamente similar es el comportamiento de la traza al alineamiento declarado. Una traza puede pasar todas las comprobaciones estructurales y aun así recibir una advertencia low_behavioral_similarity si la puntuación cae por debajo de 0.50. Consulta la calibración para saber cómo se derivaron los umbrales.
4

Añadir puntos de control de integridad

La comprobación de integridad AIP analiza los bloques de pensamiento del LLM por turno para detectar inyección de prompt, deriva de valores y manipulación. Cada comprobación produce un veredicto: clear, review_needed o boundary_violation.
AIP usa por defecto el modo fail-open. Si el LLM de análisis es inaccesible, las comprobaciones de integridad pasarán silenciosamente. Para los despliegues en producción que manejan operaciones sensibles, define failure_policy: { mode: "fail_closed" } en tu configuración AIP.

Correspondencia veredicto → acción

5

Comprobar la coherencia de valores

Antes de que tu agente colabore con otro agente, verifica que sus valores sean compatibles. La comprobación de coherencia compara los valores declarados y detecta conflictos.

Rastreo automático con decoradores (Python)

El SDK de Python de AAP proporciona decoradores para la generación automática de trazas:

Detección de deriva

Monitorea tu agente para detectar deriva de comportamiento a lo largo del tiempo:

Próximos pasos

  • Descripción general de CLPI — Capa de gobernanza: aplicación de políticas, recuperación de confianza, anclaje on-chain
  • API Policy — Gestión programática de políticas para integraciones SDK
  • API Reclassification — Reclasificación de violaciones y recuperación de la puntuación de confianza
  • Especificación AAP — Detalles completos del protocolo para implementadores
  • Especificación AIP — Detalles del protocolo de integridad
  • Limitaciones — Qué puede y qué no puede garantizar AAP
  • Modelo de seguridad — Modelo de amenaza y superficies de ataque
  • Integración A2A — Añadir AAP a los flujos de trabajo de agentes A2A
  • Migración MCP — Añadir rastreo de alineamiento a las herramientas MCP