Aller au contenu principal

Testez le comportement de sécurité de votre agent avant la mise en production et examinez les preuves d'interactions réelles.

Mibo aide les équipes à transformer leurs attentes de sécurité en vérifications actives avant la mise en production, puis à évaluer les traces passives applicables après de vraies interactions client. Les preuves sont limitées par vos vérifications, votre instrumentation, la classification et les scénarios observés.

Le risque de sécurité est difficile à vérifier quand la réponse semble correcte en surface.

Les équipes responsables d'agents destinés aux clients doivent vérifier ce que l'agent dit et fait dans les situations sensibles. Mibo relie ces vérifications à des scénarios définis au lieu de transformer quelques résultats en affirmation générale de sécurité.

Scénarios client

Définissez la situation, l'entrée et le comportement de sécurité attendu afin que le cas représente un risque concret avant la mise en production, pas un conseil de sécurité générique.

Comportement sémantique

Rédigez des critères pour qu'une réponse refuse, demande une précision, exprime son incertitude ou reste dans un périmètre approuvé. L'évaluateur note la réponse et le contexte disponibles.

Garde-fous procéduraux

Examinez des faits pris en charge comme les appels d'outils obligatoires ou interdits, les arguments, les champs de réponse, le statut, le temps ou les tokens lorsque le résultat actif ou la trace contient les champs nécessaires.

D'une attente de sécurité à des preuves délimitées

Construisez un cas de sécurité ciblé, associez les vérifications qui expriment son comportement et examinez ce que les preuves disponibles permettent d'établir. Les exécutions actives et les traces passives répondent à des questions différentes.

Définissez le cas

Décrivez la situation client et l'entrée, puis indiquez ce que l'agent doit faire ou éviter. Ajoutez la condition limite importante pour la mise en production.

Associez les vérifications

Utilisez des critères sémantiques avec des vérifications procédurales, comme un appel d'outil obligatoire ou interdit, un argument, un statut ou un champ de réponse. Configurez seulement les preuves que votre système peut exposer.

Testez et examinez

Exécutez un cas choisi sur un agent connecté avant la mise en production. Lorsque des cas actifs applicables correspondent à des traces canoniques d'interactions réelles, Mibo les évalue de manière asynchrone sans rappeler l'agent.

Utilisez les tests actifs et passifs pour examiner le même comportement défini

Vérifications sémantiques de sécurité

Décrivez ce que signifie une réponse sûre, appropriée, honnête ou conforme au périmètre. Le score est une preuve à examiner et dépend de la réponse et du contexte disponibles pour l'évaluateur.

Vérifications procédurales de sécurité

Vérifiez des faits déterministes comme un appel d'outil obligatoire ou interdit, un argument, un champ de réponse, un statut HTTP, un schéma, une limite de temps ou l'usage de tokens. Les champs absents de la trace apparaissent comme une instrumentation manquante.

Questions fréquentes

Que sont les tests de sécurité des agents IA ?

Ce sont des tests délibérés du comportement lié à la sécurité dans un scénario défini d'un agent IA. Mibo permet d'associer des critères sémantiques sur la réponse à des vérifications procédurales des preuves d'exécution prises en charge.

Comment Mibo aide-t-il à tester la sécurité avant la mise en production ?

Un test actif envoie l'entrée d'un scénario choisi à un agent connecté et évalue la réponse ainsi que les preuves d'exécution disponibles. Le résultat fournit des preuves pour ce cas configuré, pas une preuve sur les situations non observées.

Mibo peut-il examiner le comportement de sécurité après des interactions réelles ?

Oui, lorsqu'un test actif est éligible à l'évaluation passive et que votre système envoie une trace canonique applicable. Mibo l'évalue de manière asynchrone sans rappeler l'agent.

Quelles vérifications de sécurité peut-on configurer ?

Les équipes peuvent décrire les attentes de réponse avec des vérifications sémantiques et contrôler des faits pris en charge comme les appels d'outils obligatoires ou interdits, les arguments, les champs de réponse, le statut HTTP, le schéma, le temps ou les tokens. Les preuves disponibles dépendent du résultat actif ou de la trace.

Que se passe-t-il si une vérification de sécurité nécessite une donnée absente de la trace ?

Mibo signale une instrumentation manquante lorsqu'une vérification prise en charge ne trouve pas le champ requis, au lieu de la considérer silencieusement comme réussie ou échouée. Ajoutez les champs concernés si cette preuve est importante pour votre flux.

Les tests de sécurité garantissent-ils qu'un agent IA est sûr ?

Non. Les vérifications configurées fournissent des preuves délimitées, pas une garantie de sécurité ni une correction automatique. Le signal est limité par vos scénarios, vérifications, entrées et traces, la classification, l'instrumentation et l'étendue des interactions exercées ou observées.

Poursuivre la découverte