Skip to main content

Intégration SDK directe

Utilisez les SDK AAP et AIP pour ajouter la vérification d’alignement et la vérification d’intégrité directement à votre code applicatif. Cela vous donne un contrôle total sur le moment où les traces sont générées, la manière dont les vérifications d’intégrité s’exécutent et ce qui se passe en cas de violations. Pour les fonctionnalités de gouvernance (application des politiques, reclassification des violations, récupération de la confiance), utilisez l’API Policy et l’API Reclassification en complément des SDK.
Ces démarrages rapides sont disponibles en espagnol (Español) et en français (Français) — six pages par langue ont été traduites.

Installation

--legacy-peer-deps est nécessaire sur npm 7+ tant que @mnemom/agent-integrity-protocol 1.3.0 déclare encore une dépendance peer optionnelle sur le package alignment-protocol 1.x ; les deux SDK fonctionnent ensemble en 2.0.0 / 1.3.0.
1

Définir une carte d'alignement

Une carte d’alignement déclare l’identité, les valeurs, les limites d’autonomie et les engagements d’audit de votre agent. Chaque trace et vérification d’intégrité est vérifiée par rapport à cette carte.
Les noms de champs ont changé dans la forme de carte unifiée (AAP 2.0.0). aap_version est maintenant card_version (ancré à une date) ; autonomy_envelope/AutonomyEnvelope est maintenant autonomy/Autonomy ; audit_commitment/AuditCommitment est maintenant audit/Audit ; autonomy_mode et integrity_mode sont de nouveaux champs de premier niveau ; principal.identifier est requis dès que principal.type n’est pas unspecified ; et audit.queryable: true nécessite audit.query_endpoint. Consultez la migration depuis l’ancienne forme de carte 0.5.0 pour le mapping complet.
La carte d’alignement est le fondement des deux protocoles. Définissez-la une fois et utilisez-la pour la vérification AAP, la vérification d’intégrité AIP et les vérifications de cohérence des valeurs.
2

Générer des AP-Traces à partir des actions de l'agent

Chaque décision significative prise par votre agent devrait produire une AP-Trace. La trace enregistre l’action effectuée, les alternatives envisagées, le raisonnement appliqué, et si l’escalade a été évaluée.
La vérification compare action.name à bounded_actions, pas action.type. Les deux champs servent des objectifs différents : type est une catégorie sémantique ; name est l’identifiant d’opération spécifique vérifié par rapport à la liste bounded_actions de la carte.
3

Vérifier les traces par rapport à la carte

La vérification contrôle si le comportement de l’agent (enregistré dans la trace) est cohérent avec son alignement déclaré (la carte). Elle retourne des vérifications structurelles, un score de similarité, et toute violation ou avertissement.
Le similarity_score (0,0 à 1,0) mesure à quel point le comportement de la trace est sémantiquement similaire à l’alignement déclaré. Une trace peut passer toutes les vérifications structurelles mais recevoir tout de même un avertissement low_behavioral_similarity si le score descend sous 0,50. Consultez la calibration pour savoir comment les seuils ont été dérivés.
4

Ajouter des points de contrôle d'intégrité

La vérification d’intégrité AIP analyse les blocs de réflexion du LLM à chaque tour pour détecter l’injection de prompt, la dérive de valeurs et la manipulation. Chaque vérification produit un verdict : clear, review_needed, ou boundary_violation.
AIP est en mode fail-open par défaut. Si le LLM d’analyse est injoignable, les vérifications d’intégrité passeront silencieusement. Pour les déploiements en production traitant des opérations sensibles, définissez failure_policy: { mode: "fail_closed" } dans votre configuration AIP.
Un client se charge de l’extraction, de l’appel LLM et de la comptabilité des points de contrôle/fenêtres pour vous — passez-lui le corps de réponse brut du fournisseur, pas une chaîne de réflexion pré-extraite. Le card ici est la forme de carte minimale propre à AIP (card_id, values, autonomy_envelope) — un petit sous-ensemble de champs, gardé séparé de l’AlignmentCard AAP complète que vous avez construite à l’étape 1, puisque @mnemom/agent-alignment-protocol n’est qu’une dépendance peer optionnelle pour AIP.
client.check() exécute le pipeline complet à chaque appel : extraire le bloc de réflexion pour le fournisseur détecté, appeler le LLM d’analyse, parser le verdict, mettre à jour la fenêtre glissante, et détecter la dérive. Il n’existe pas de fonction bas niveau séparée « parser simplement cette réponse d’analyse » dans l’API publique — check() est l’unique point d’entrée.

Mapping verdict vers action

5

Vérifier la cohérence des valeurs

Avant que votre agent ne collabore avec un autre agent, vérifiez que leurs valeurs sont compatibles. La vérification de cohérence compare les valeurs déclarées et détecte les conflits.

Traçage automatique avec décorateurs (Python)

Le SDK Python AAP fournit des décorateurs pour la génération automatique de traces :

Détection de dérive

Surveillez votre agent pour détecter une dérive comportementale au fil du temps :

Prochaines étapes