Zum Hauptinhalt springen

Testen Sie das Verhalten Ihres KI-Agenten, bevor er in Produktion geht.

Mibo bietet Engineering-Teams einen wiederholbaren Ansatz, um Szenarien vor dem Release auszuführen, die Nachweise hinter jedem Ergebnis zu prüfen und reale Produktions-Traces mit denselben Tests auszuwerten.

Eine erfolgreiche Antwort ist kein Beweis für zuverlässiges Verhalten.

Ein Agent kann eine erfolgreiche HTTP-Antwort liefern und trotzdem das falsche Tool wählen, eine abgeschlossene Aktion erfinden oder eine Kundenanfrage ungelöst lassen. Mibo macht aus diesen Erwartungen überprüfbare Nachweise.

Falsches Routing

Prüfen Sie, ob eine Anfrage den richtigen Spezialisten und Workflow erreicht – nicht nur, ob der Endpoint antwortet.

Tool-Verhalten

Überprüfen Sie Aufrufe, Argumente und andere beobachtbare Fakten im Trace des Agenten.

Unvollständige Antwort

Bewerten Sie, ob die Antwort klar, sicher und auf das gewünschte Kundenergebnis ausgerichtet ist.

Eine Testsuite für den gesamten Agenten-Lebenszyklus

Definieren Sie Erwartungen einmal und verwenden Sie sie anschließend vor dem Release und zur Prüfung realer Interaktionen.

Verhalten definieren

Beschreiben Sie das erwartete Ergebnis mit semantischen und prozeduralen Prüfungen.

Vor dem Release testen

Führen Sie ausgewählte Szenarien gegen den verbundenen Agenten aus und prüfen Sie Antwort und Ausführungsnachweise.

Reale Traces bewerten

Senden Sie Traces über OpenTelemetry oder die Mibo API zur asynchronen Bewertung nach jeder Interaktion.

Jedes Ergebnis enthält die nötigen Nachweise für Ihre Analyse

Semantische Prüfungen

Bewerten Sie Bedeutung, Sicherheit, Vollständigkeit und Übereinstimmung mit dem beschriebenen Ergebnis statt einer festen Zeichenfolge.

Prozedurale Prüfungen

Untersuchen Sie Ausführungsfakten wie Tool-Aufrufe, Argumente, Attribute, HTTP-Status und Schema.

Häufig gestellte Fragen

Was testet Mibo bei einem KI-Agenten?

Mibo bewertet das von Ihnen beschriebene Verhalten einschließlich der Antwort und beobachtbarer Ausführungsnachweise wie Routing, Tool-Aufrufe, Werte und Status. Regelbasierte Prüfungen verifizieren Fakten, während KI-gestützte Prüfungen Antworten anhand natürlichsprachlicher Kriterien bewerten.

Kann ich einen Agenten vor und nach dem Release testen?

Ja. Aktive Tests senden ausgewählte Szenarien an einen verbundenen Agenten. Nach realen Interaktionen kann Ihr System Traces zur passiven Bewertung anhand der passenden aktiven Testfälle senden.

Wird Mibo durch passive Tests Teil des Anfragepfads?

Nein. Ihr System verarbeitet die Interaktion und sendet danach einen Trace an Mibo. Mibo bewertet den Trace asynchron im Hintergrund.

Mehr entdecken