Aller au contenu principal

Testez votre agent IA avant et après sa mise en production.

Définissez ce que votre agent doit dire et faire, et ce qu’il ne doit jamais faire. Exécutez ces tests avant la mise en production, puis appliquez automatiquement la même suite aux interactions réelles.

Testez une réponse réelle · sans inscription.Lire la documentation

La trace d’un agent peut parvenir à Mibo via OTLP. Après évaluation, Mibo indique si le test a réussi ou échoué.

Une suite de tests. Avant et après la mise en production.

Mibo est conçu pour tester les agents IA : exécutez des scénarios planifiés à la demande, puis continuez à appliquer automatiquement les mêmes tests aux interactions réelles.

Testez délibérément avant la mise en production

Choisissez un scénario et exécutez-le sur votre véritable agent. Vérifiez la réponse, les outils, les valeurs, la latence, les jetons et les étapes d’exécution.

  • Contrôles sémantiques
  • Assertions procédurales
  • Scénarios reproductibles
  • Diagnostic étape par étape

Testez automatiquement les interactions réelles

Continuez à tester après le lancement sans rejouer le trafic. Mibo associe chaque exécution aux tests pertinents et conserve les preuves.

  • Classification des scénarios
  • Historique des interactions réelles
  • Couverture par scénario
  • Preuves de régression

Testez toute l’exécution

Inspectez les entrées, appels d’outils, sorties et étapes au lieu de juger uniquement le message final.

Exécutez les bons tests

Appliquez les contrôles universels à chaque exécution et les tests conditionnels seulement lorsque le scénario correspond.

Diagnostiquez avec des preuves

Consultez l’assertion en échec, le comportement attendu, la valeur observée et le contexte au même endroit.

Du premier test à la couverture continue.

Connectez un agent, décrivez le comportement attendu et lancez un test réel. La même suite peut continuer à tester les interactions terminées après le lancement.

Essayer un test en direct
  1. 01

    Connectez votre agent

    Utilisez n8n, Flowise ou un endpoint HTTP personnalisé. Commencez par la réponse et ajoutez des traces lorsque vous devez vérifier les outils et les étapes.

  2. 02

    Définissez le comportement attendu

    Créez des tests réutilisables pour ce que l’agent doit dire, faire et éviter. Combinez évaluation sémantique et assertions déterministes.

  3. 03

    Lancez un test réel

    Envoyez un scénario à votre agent et inspectez le résultat. Mibo montre quel contrôle a échoué, ce qui était attendu et les preuves nécessaires.

  4. 04

    Continuez à tester après le lancement

    Envoyez les exécutions terminées à Mibo. Il associe chaque interaction aux tests pertinents sans intervenir dans le chemin de la requête.

Commencez gratuitement. Évoluez avec votre suite.

Connectez un agent et lancez vos premiers tests gratuitement. Passez au niveau supérieur lorsque votre équipe a besoin de plus d’exécutions, d’agents et d’historique.

Gratuit

$0/mois
Gratuit pour toujours

Pour les développeurs individuels et les petits prototypes.

Comprend :

  • 100 exécutions / mois
  • 1 agent
  • Diagnostic des tests
  • Historique de 7 jours

Starter

$20/mois
Facturé annuellement (240 $)

Pour les équipes en croissance qui développent des agents en production.

Tout le plan Gratuit, plus :

  • 1000 exécutions / mois
  • 10 agents simultanés
  • Métriques sémantiques
  • Historique de 90 jours

Full

$50/mois
Facturé annuellement (600 $)

Pour les équipes qui ont besoin de la plateforme complète.

Tout le plan Starter, plus :

  • 3000 exécutions / mois
  • 100 agents
  • Historique de 365 jours
  • Support prioritaire