Kundennahe Szenarien
Definieren Sie Situation, Eingabe und erwartetes Sicherheitsverhalten, damit ein Testfall eine konkrete Release-Sorge statt allgemeiner Sicherheitstipps abbildet.
Mibo hilft Teams, Sicherheitserwartungen vor dem Release in aktive Prüfungen zu übersetzen und danach passende passive Traces aus realen Kundeninteraktionen auszuwerten. Die Nachweise sind durch konfigurierte Prüfungen, Instrumentierung, Klassifizierung und beobachtete Szenarien begrenzt.
Teams, die kundenorientierte Agenten verantworten, müssen prüfen, was der Agent in sicherheitsrelevanten Situationen sagt und tut. Mibo verknüpft diese Prüfungen mit definierten Szenarien, statt aus wenigen Ergebnissen eine allgemeine Sicherheitsaussage abzuleiten.
Definieren Sie Situation, Eingabe und erwartetes Sicherheitsverhalten, damit ein Testfall eine konkrete Release-Sorge statt allgemeiner Sicherheitstipps abbildet.
Formulieren Sie Kriterien dafür, dass eine Antwort ablehnt, nachfragt, Unsicherheit offenlegt oder im freigegebenen Umfang bleibt. Der Evaluator bewertet verfügbare Antwort und Kontext.
Prüfen Sie unterstützte Fakten wie erforderliche oder verbotene Tool-Aufrufe, Argumente, Antwortfelder, Status, Zeit oder Token-Nutzung, wenn Ergebnis oder Trace die nötigen Felder enthalten.
Erstellen Sie einen fokussierten Sicherheitsfall, kombinieren Sie passende Prüfungen und untersuchen Sie, was die verfügbaren Nachweise tragen. Aktive Läufe und passive Traces beantworten unterschiedliche Fragen.
01
Beschreiben Sie Kundensituation und Eingabe und legen Sie fest, was der Agent tun oder vermeiden soll. Ergänzen Sie die für das Release wichtige Randbedingung.
02
Verwenden Sie semantische Kriterien zusammen mit prozeduralen Prüfungen, etwa für einen erforderlichen oder verbotenen Tool-Aufruf, ein Argument, einen Status oder ein Antwortfeld. Konfigurieren Sie nur exponierbare Nachweise.
03
Führen Sie einen ausgewählten Fall vor dem Release gegen einen verbundenen Agenten aus. Treffen passende aktive Fälle auf kanonische Traces realer Interaktionen, evaluiert Mibo sie asynchron, ohne den Agenten erneut aufzurufen.
Beschreiben Sie, was eine sichere, angemessene, ehrliche oder umfangsgerechte Antwort bedeutet. Der Score ist ein Untersuchungsnachweis und hängt von verfügbarer Antwort und Kontext ab.
Prüfen Sie deterministische Fakten wie einen erforderlichen oder verbotenen Tool-Aufruf, ein Argument, ein Antwortfeld, einen HTTP-Status, ein Schema, ein Zeitlimit oder Token-Nutzung. Fehlende Trace-Felder erscheinen als fehlende Instrumentierung.
Damit ist die gezielte Prüfung sicherheitsrelevanten Verhaltens in einem definierten KI-Agenten-Szenario gemeint. Mibo verbindet semantische Kriterien zur Antwort mit prozeduralen Prüfungen unterstützter Ausführungsnachweise.
Ein aktiver Test sendet die Eingabe eines ausgewählten Szenarios an einen verbundenen Agenten und wertet Antwort sowie verfügbare Ausführungsnachweise aus. Das Ergebnis belegt den konfigurierten Fall, nicht unbeobachtete Situationen.
Ja, wenn ein aktiver Test für passive Evaluierung geeignet ist und Ihr System einen passenden kanonischen Trace sendet. Mibo evaluiert ihn asynchron, ohne den Agenten erneut aufzurufen.
Teams können Antworterwartungen semantisch beschreiben und unterstützte Fakten wie erforderliche oder verbotene Tool-Aufrufe, Argumente, Antwortfelder, HTTP-Status, Schema, Zeit oder Token-Nutzung prüfen. Die verfügbaren Nachweise hängen vom aktiven Ergebnis oder Trace ab.
Mibo meldet fehlende Instrumentierung, wenn eine unterstützte Prüfung das benötigte Trace-Feld nicht findet, statt sie stillschweigend als bestanden oder fehlgeschlagen zu behandeln. Ergänzen Sie relevante Felder, wenn dieser Nachweis für Ihren Ablauf wichtig ist.
Nein. Konfigurierte Prüfungen liefern begrenzte Nachweise, keine Sicherheitsgarantie und keine automatische Behebung. Das Signal wird durch Szenarien, Prüfungen, verfügbare Eingaben und Traces, Klassifizierung, Instrumentierung und die Breite beobachteter oder ausgeführter Interaktionen begrenzt.
Nutzen Sie die gepflegte Dokumentation, um Szenarien, Eingaben, Prüfungen und passives Verhalten zu definieren.
Dokumentation lesen →Erfahren Sie, welche semantischen und prozeduralen Prüfungen verfügbar sind und welche Trace-Nachweise sie nutzen können.
Prüfungsdokumentation lesen →Definieren Sie Szenarien, führen Sie aktive Prüfungen vor dem Release aus und verwenden Sie sie für passive Produktions-Traces wieder.
Agententests entdecken →Verstehen Sie, wie Mibo konfiguriertes Verhalten über den Antwortcode hinaus evaluiert.
Evaluierung entdecken →Untersuchen Sie Verhalten in Produktions-Traces und verfolgen Sie Regressionen nach realen Interaktionen.
Monitoring entdecken →Übersetzen Sie Sicherheitserwartungen in konkrete Szenarien mit semantischen und prozeduralen Prüfungen.
Testfälle entdecken →Führen Sie den Live-Zuverlässigkeitscheck mit einer synthetischen Kundenanfrage aus.
Live-Check starten →