Aller au contenu principal

Testez le comportement de votre agent IA avant sa mise en production.

Mibo offre aux équipes d’ingénierie une méthode reproductible pour exécuter des scénarios avant le lancement, examiner les preuves de chaque résultat et évaluer les traces réelles de production avec les mêmes tests.

Une réponse réussie ne prouve pas que le comportement est fiable.

Un agent peut renvoyer une réponse HTTP réussie tout en choisissant le mauvais outil, en inventant une action terminée ou en laissant une demande sans solution. Mibo transforme ces attentes en preuves vérifiables.

Mauvais routage

Vérifiez que la demande atteint le bon spécialiste et le bon workflow, et pas seulement que l’endpoint répond.

Utilisation des outils

Vérifiez les appels, les arguments et les autres faits observables dans la trace de l’agent.

Réponse incomplète

Évaluez si la réponse est claire, sûre et conforme au résultat attendu par votre client.

Une suite de tests pour tout le cycle de vie de l’agent

Définissez vos attentes une fois, puis utilisez-les pour vérifier les changements avant le lancement et analyser les interactions réelles ensuite.

Définissez le comportement

Décrivez le résultat attendu avec des vérifications sémantiques et procédurales.

Testez avant le lancement

Exécutez les scénarios choisis sur l’agent connecté et examinez la réponse avec ses preuves d’exécution.

Évaluez les traces réelles

Envoyez les traces via OpenTelemetry ou l’API Mibo pour une évaluation asynchrone après chaque interaction.

Chaque résultat conserve les preuves nécessaires à l’analyse

Vérifications sémantiques

Évaluez le sens, la sécurité, l’exhaustivité et l’alignement avec le résultat décrit sans imposer de chaîne fixe.

Vérifications procédurales

Inspectez les faits d’exécution tels que les appels d’outils, les arguments, les attributs, le statut HTTP et le schéma.

Questions fréquentes

Que teste Mibo dans un agent IA ?

Mibo évalue le comportement que vous décrivez, y compris la réponse et les preuves d’exécution observables comme le routage, les appels d’outils, les valeurs et le statut. Les vérifications basées sur des règles valident les faits, tandis que les vérifications alimentées par l’IA notent les réponses selon des critères en langage naturel.

Puis-je tester un agent avant et après son lancement ?

Oui. Les tests actifs envoient les scénarios choisis à un agent connecté. Après les interactions réelles, votre système peut envoyer des traces pour une évaluation passive avec les cas de test actifs applicables.

Les tests passifs placent-ils Mibo dans le chemin de la requête client ?

Non. Votre système traite l’interaction, puis envoie une trace à Mibo. Mibo évalue cette trace de manière asynchrone en arrière-plan.

Poursuivre la découverte