Intégration SDK directe
Utilisez les SDK AAP et AIP pour ajouter la vérification d’alignement et la vérification d’intégrité directement à votre code applicatif. Cela vous donne un contrôle total sur le moment où les traces sont générées, la manière dont les vérifications d’intégrité s’exécutent et ce qui se passe en cas de violations. Pour les fonctionnalités de gouvernance (application des politiques, reclassification des violations, récupération de la confiance), utilisez l’API Policy et l’API Reclassification en complément des SDK.Ces démarrages rapides sont disponibles en espagnol (Español) et en français (Français) — six pages par langue ont été traduites.
Installation
--legacy-peer-deps est nécessaire sur npm 7+ tant que @mnemom/agent-integrity-protocol 1.3.0 déclare encore une dépendance peer optionnelle sur le package alignment-protocol 1.x ; les deux SDK fonctionnent ensemble en 2.0.0 / 1.3.0.1
Définir une carte d'alignement
Une carte d’alignement déclare l’identité, les valeurs, les limites d’autonomie et les engagements d’audit de votre agent. Chaque trace et vérification d’intégrité est vérifiée par rapport à cette carte.
Les noms de champs ont changé dans la forme de carte unifiée (AAP 2.0.0).
aap_version est maintenant card_version (ancré à une date) ; autonomy_envelope/AutonomyEnvelope est maintenant autonomy/Autonomy ; audit_commitment/AuditCommitment est maintenant audit/Audit ; autonomy_mode et integrity_mode sont de nouveaux champs de premier niveau ; principal.identifier est requis dès que principal.type n’est pas unspecified ; et audit.queryable: true nécessite audit.query_endpoint. Consultez la migration depuis l’ancienne forme de carte 0.5.0 pour le mapping complet.2
Générer des AP-Traces à partir des actions de l'agent
Chaque décision significative prise par votre agent devrait produire une AP-Trace. La trace enregistre l’action effectuée, les alternatives envisagées, le raisonnement appliqué, et si l’escalade a été évaluée.
3
Vérifier les traces par rapport à la carte
La vérification contrôle si le comportement de l’agent (enregistré dans la trace) est cohérent avec son alignement déclaré (la carte). Elle retourne des vérifications structurelles, un score de similarité, et toute violation ou avertissement.
Le
similarity_score (0,0 à 1,0) mesure à quel point le comportement de la trace est sémantiquement similaire à l’alignement déclaré. Une trace peut passer toutes les vérifications structurelles mais recevoir tout de même un avertissement low_behavioral_similarity si le score descend sous 0,50. Consultez la calibration pour savoir comment les seuils ont été dérivés.4
Ajouter des points de contrôle d'intégrité
La vérification d’intégrité AIP analyse les blocs de réflexion du LLM à chaque tour pour détecter l’injection de prompt, la dérive de valeurs et la manipulation. Chaque vérification produit un verdict :
clear, review_needed, ou boundary_violation.Un client se charge de l’extraction, de l’appel LLM et de la comptabilité des points de contrôle/fenêtres pour vous — passez-lui le corps de réponse brut du fournisseur, pas une chaîne de réflexion pré-extraite. Le card ici est la forme de carte minimale propre à AIP (card_id, values, autonomy_envelope) — un petit sous-ensemble de champs, gardé séparé de l’AlignmentCard AAP complète que vous avez construite à l’étape 1, puisque @mnemom/agent-alignment-protocol n’est qu’une dépendance peer optionnelle pour AIP.Mapping verdict vers action
5
Vérifier la cohérence des valeurs
Avant que votre agent ne collabore avec un autre agent, vérifiez que leurs valeurs sont compatibles. La vérification de cohérence compare les valeurs déclarées et détecte les conflits.
Traçage automatique avec décorateurs (Python)
Le SDK Python AAP fournit des décorateurs pour la génération automatique de traces :Détection de dérive
Surveillez votre agent pour détecter une dérive comportementale au fil du temps :Prochaines étapes
- Vue d’ensemble CLPI — Couche de gouvernance : application des politiques, récupération de la confiance, ancrage on-chain
- API Policy — Gestion programmatique des politiques pour les intégrations SDK
- API Reclassification — Reclassification des violations et récupération du score de confiance
- Spécification AAP — Détails complets du protocole pour les implémenteurs
- Spécification AIP — Détails du protocole d’intégrité
- Limitations — Ce qu’AAP peut et ne peut pas garantir
- Modèle de sécurité — Modèle de menace et surfaces d’attaque
- Intégration A2A — Ajouter AAP aux flux de travail d’agents A2A
- Migration MCP — Ajouter le traçage d’alignement aux outils MCP