Vérifications actives de régression
Lancez des scénarios sélectionnés contre votre agent avant la mise en production et évaluez la réponse ainsi que les preuves d’exécution observables avec les tests que vous configurez.
Lancez délibérément des scénarios sélectionnés avant la mise en production, puis évaluez les traces de production disponibles après des interactions réelles avec les mêmes tests configurés. Mibo rend les preuves visibles sans prétendre à une couverture complète.
Un agent peut réussir un scénario sélectionné alors qu’une autre interaction réelle révèle un changement de routage, d’appel d’outil ou de réponse. Mibo relie les vérifications délibérées avant la mise en production aux preuves des traces après les interactions réelles, sans traiter un seul résultat comme une preuve de qualité.
Lancez des scénarios sélectionnés contre votre agent avant la mise en production et évaluez la réponse ainsi que les preuves d’exécution observables avec les tests que vous configurez.
Après une interaction réelle, envoyez à Mibo une trace canonique disponible. Les tests actifs applicables sont évalués de manière asynchrone sans que Mibo rappelle votre agent.
Interprétez les résultats selon les vérifications définies, l’instrumentation présente dans la trace, la classification de l’entrée et l’étendue des scénarios exercés ou observés.
Utilisez les tests actifs pour exercer délibérément des scénarios connus, puis évaluez les traces passives afin de voir comment ces mêmes vérifications se comportent face aux interactions réellement traitées par votre système.
01
Décrivez des scénarios et ajoutez des vérifications sémantiques ou procédurales pour la réponse, les appels d’outils, les arguments, le statut, le schéma, le temps ou toute autre preuve que la trace peut contenir.
02
Lancez des entrées sélectionnées contre l’agent avant de publier une modification. Examinez le résultat et ses preuves comme une vérification de régression ciblée, pas comme une garantie pour toutes les entrées possibles.
03
Envoyez les traces de production disponibles après les interactions. Mibo classe les scénarios applicables et évalue les tests configurés de manière asynchrone afin que l’équipe puisse étudier les différences dans le temps.
Les vérifications assistées par IA comparent une réponse aux critères que vous décrivez, comme l’exhaustivité, la fidélité aux sources, la sécurité ou l’alignement. Le score fournit une preuve à examiner et dépend de la réponse et du contexte disponibles pour l’évaluateur.
Les vérifications déterministes examinent des faits enregistrés tels que les appels de nœuds ou d’outils, les arguments, le statut HTTP, le schéma, l’utilisation des tokens et le temps de réponse. Les champs absents sont signalés comme une instrumentation manquante, pas comme une réussite ou un échec silencieux.
Mibo permet de lancer délibérément des tests actifs avant la mise en production et d’évaluer passivement les traces disponibles après des interactions réelles. Utiliser les mêmes tests configurés dans les deux modes aide à comparer des scénarios sélectionnés au comportement observé, tout en rendant visibles les limites de chaque signal.
Non. Votre système traite l’interaction réelle, puis envoie une trace canonique. Mibo évalue de manière asynchrone les tests actifs applicables sur cette trace et ne rappelle pas l’agent pendant l’évaluation passive.
Mibo utilise l’entrée disponible dans la trace pour classer les tests conditionnels liés aux scénarios pertinents. Les vérifications universelles peuvent s’appliquer à chaque trace, tandis qu’un test peut ne pas être disponible si la trace n’offre pas de correspondance exploitable ou ne contient pas les preuves nécessaires.
Non. Les résultats sont limités par les scénarios et vérifications que vous configurez, les interactions qui se produisent, le signal de classification, ainsi que l’instrumentation et les champs que vous envoyez. Mibo ne promet ni couverture complète, ni qualité garantie, ni correction automatique.
Mibo signale une instrumentation manquante pour les vérifications compatibles qui ne trouvent pas l’attribut requis dans la trace, au lieu de considérer silencieusement la vérification comme réussie ou échouée. Ajoutez les champs nécessaires si cette preuve est importante pour votre flux.
Les contenus des traces sont chiffrés au repos et l’accès dans le produit est limité au compte qui les possède. Envoyez des données synthétiques ou correctement gouvernées selon vos propres exigences de confidentialité.
Découvrez comment les traces réelles arrivent dans Mibo, comment les tests applicables sont évalués de manière asynchrone et comment l’instrumentation manquante est signalée.
Lire la documentation →Consultez les champs et attributs que Mibo peut utiliser pour l’évaluation sémantique et procédurale.
Lire la référence des traces →Comprenez les vérifications sémantiques et procédurales derrière les exécutions actives et les traces passives.
Découvrir l’évaluation →Étudiez les régressions de comportement dans les traces de production sans placer Mibo dans le parcours de la requête client.
Découvrir le monitoring →Définissez des scénarios et lancez des vérifications délibérées avant la mise en production avec les mêmes tests utilisés pour les preuves de production.
Découvrir les tests d’agents →Lancez la vérification de fiabilité en direct avec une demande client synthétique.
Lancer une vérification →Suivez une méthode pratique pour les tests actifs, les traces passives et les limites d’interprétation.
Lire le guide →