Traces de production
Envoyez une trace canonique avec l’interaction, la réponse et les détails d’exécution après une requête réelle via OpenTelemetry ou le parcours Votre API de Mibo.
Mibo évalue les traces de production avec les tests actifs que vous définissez, conserve des preuves asynchrones pour l’analyse et reste hors du parcours de la requête client.
Une requête peut aboutir tandis que l’agent l’achemine vers le mauvais spécialiste, appelle un outil avec des arguments dangereux ou fournit une réponse incomplète. Mibo transforme la trace de production en preuves à examiner au lieu de considérer la disponibilité comme une preuve de fiabilité.
Envoyez une trace canonique avec l’interaction, la réponse et les détails d’exécution après une requête réelle via OpenTelemetry ou le parcours Votre API de Mibo.
Mibo stocke la trace et planifie en arrière-plan les tests actifs applicables. L’évaluation passive n’envoie pas de nouvelle requête à votre système.
Examinez le comportement sémantique et les faits procéduraux tels que les appels d’outils, les arguments, le statut, le schéma, les tokens et le temps de réponse lorsque la trace contient les champs requis.
Séparez l’évaluation en production de l’interaction client tout en rendant visibles les preuves et leurs limites pour l’équipe responsable de l’agent.
01
Votre système traite la requête utilisateur, puis envoie à Mibo la trace canonique avec l’entrée, la sortie et les détails d’exécution disponibles pour l’évaluation.
02
Mibo stocke la trace et l’évalue de manière asynchrone avec les tests actifs applicables. La réponse d’ingestion n’attend pas la fin de l’évaluation.
03
Comparez les résultats dans le temps et ouvrez les preuves derrière un échec. Utilisez les constats pour prioriser un correctif ; Mibo ne corrige pas automatiquement l’agent.
Les vérifications sémantiques assistées par IA comparent la réponse aux critères que vous décrivez, comme la fidélité aux sources, l’exhaustivité, la sécurité ou l’alignement. Elles fournissent des preuves à examiner, pas une garantie de vérité ou de qualité globale.
Les vérifications déterministes examinent des faits enregistrés tels que les appels de nœuds ou d’outils, les arguments, les attributs, le statut HTTP, le schéma, l’utilisation des tokens et le temps de réponse. Les champs absents sont signalés comme une instrumentation manquante, pas comme une réussite ou un échec silencieux.
Un agent peut renvoyer une réponse HTTP réussie tout en choisissant le mauvais outil, en inventant un résultat ou en donnant une réponse incomplète. Mibo évalue le comportement configuré et les preuves de la trace, pas seulement la disponibilité de l’endpoint.
Votre système envoie une trace canonique après l’interaction. Mibo la stocke, identifie les tests actifs applicables et l’évalue de manière asynchrone en arrière-plan. L’évaluation passive ne rappelle pas votre agent.
Non. Votre système traite d’abord la requête client et envoie séparément la trace à Mibo. La réponse d’ingestion est indépendante de l’évaluation en arrière-plan.
Non. Mibo évalue les tests actifs et les champs de trace disponibles. Les cas limites non observés, des critères étroits, une classification indisponible et une instrumentation manquante peuvent limiter le signal, et Mibo ne corrige pas automatiquement l’agent.
Les contenus des traces sont chiffrés au repos et l’accès dans le produit est limité au compte qui les possède. Envoyez des données synthétiques ou correctement gouvernées selon vos propres exigences de confidentialité.
Consultez les parcours de trace pris en charge, le flux d’évaluation asynchrone, le comportement passif et les limites d’une instrumentation manquante.
Lire la documentation →Consultez les champs et attributs que Mibo peut utiliser pour l’évaluation sémantique et procédurale.
Lire la référence des traces →Comprenez les vérifications sémantiques et procédurales derrière les exécutions actives et les traces passives.
Découvrir l’évaluation →Définissez des scénarios, lancez des vérifications actives avant la mise en production et réutilisez-les pour les traces de production.
Découvrir les tests d’agents →Distinguez le trafic observé des scénarios inactifs et sans correspondance sans traiter la couverture comme une preuve de qualité.
Découvrir la couverture →Reliez les vérifications délibérées avant la mise en production à l’évaluation des traces disponibles après des interactions réelles.
Découvrir les tests de régression →Lancez la vérification de fiabilité en direct avec une demande client synthétique.
Lancer une vérification →Suivez une méthode pratique pour les tests actifs, les traces passives et les limites d’interprétation.
Lire le guide →