Zum Hauptinhalt springen

Testen Sie das Sicherheitsverhalten Ihres Agenten vor dem Release und prüfen Sie Nachweise aus realen Interaktionen.

Mibo hilft Teams, Sicherheitserwartungen vor dem Release in aktive Prüfungen zu übersetzen und danach passende passive Traces aus realen Kundeninteraktionen auszuwerten. Die Nachweise sind durch konfigurierte Prüfungen, Instrumentierung, Klassifizierung und beobachtete Szenarien begrenzt.

Sicherheitsrisiken lassen sich schwer prüfen, wenn eine Antwort oberflächlich korrekt wirkt.

Teams, die kundenorientierte Agenten verantworten, müssen prüfen, was der Agent in sicherheitsrelevanten Situationen sagt und tut. Mibo verknüpft diese Prüfungen mit definierten Szenarien, statt aus wenigen Ergebnissen eine allgemeine Sicherheitsaussage abzuleiten.

Kundennahe Szenarien

Definieren Sie Situation, Eingabe und erwartetes Sicherheitsverhalten, damit ein Testfall eine konkrete Release-Sorge statt allgemeiner Sicherheitstipps abbildet.

Semantisches Verhalten

Formulieren Sie Kriterien dafür, dass eine Antwort ablehnt, nachfragt, Unsicherheit offenlegt oder im freigegebenen Umfang bleibt. Der Evaluator bewertet verfügbare Antwort und Kontext.

Prozedurale Leitplanken

Prüfen Sie unterstützte Fakten wie erforderliche oder verbotene Tool-Aufrufe, Argumente, Antwortfelder, Status, Zeit oder Token-Nutzung, wenn Ergebnis oder Trace die nötigen Felder enthalten.

Von einer Sicherheitserwartung zu begrenzten Nachweisen

Erstellen Sie einen fokussierten Sicherheitsfall, kombinieren Sie passende Prüfungen und untersuchen Sie, was die verfügbaren Nachweise tragen. Aktive Läufe und passive Traces beantworten unterschiedliche Fragen.

Fall definieren

Beschreiben Sie Kundensituation und Eingabe und legen Sie fest, was der Agent tun oder vermeiden soll. Ergänzen Sie die für das Release wichtige Randbedingung.

Prüfungen kombinieren

Verwenden Sie semantische Kriterien zusammen mit prozeduralen Prüfungen, etwa für einen erforderlichen oder verbotenen Tool-Aufruf, ein Argument, einen Status oder ein Antwortfeld. Konfigurieren Sie nur exponierbare Nachweise.

Testen und untersuchen

Führen Sie einen ausgewählten Fall vor dem Release gegen einen verbundenen Agenten aus. Treffen passende aktive Fälle auf kanonische Traces realer Interaktionen, evaluiert Mibo sie asynchron, ohne den Agenten erneut aufzurufen.

Aktive und passive Tests untersuchen dasselbe definierte Verhalten

Semantische Sicherheitsprüfungen

Beschreiben Sie, was eine sichere, angemessene, ehrliche oder umfangsgerechte Antwort bedeutet. Der Score ist ein Untersuchungsnachweis und hängt von verfügbarer Antwort und Kontext ab.

Prozedurale Sicherheitsprüfungen

Prüfen Sie deterministische Fakten wie einen erforderlichen oder verbotenen Tool-Aufruf, ein Argument, ein Antwortfeld, einen HTTP-Status, ein Schema, ein Zeitlimit oder Token-Nutzung. Fehlende Trace-Felder erscheinen als fehlende Instrumentierung.

Häufig gestellte Fragen

Was sind Sicherheitstests für KI-Agenten?

Damit ist die gezielte Prüfung sicherheitsrelevanten Verhaltens in einem definierten KI-Agenten-Szenario gemeint. Mibo verbindet semantische Kriterien zur Antwort mit prozeduralen Prüfungen unterstützter Ausführungsnachweise.

Wie unterstützt Mibo Sicherheitstests vor dem Release?

Ein aktiver Test sendet die Eingabe eines ausgewählten Szenarios an einen verbundenen Agenten und wertet Antwort sowie verfügbare Ausführungsnachweise aus. Das Ergebnis belegt den konfigurierten Fall, nicht unbeobachtete Situationen.

Kann Mibo Sicherheitsverhalten nach realen Interaktionen untersuchen?

Ja, wenn ein aktiver Test für passive Evaluierung geeignet ist und Ihr System einen passenden kanonischen Trace sendet. Mibo evaluiert ihn asynchron, ohne den Agenten erneut aufzurufen.

Welche Sicherheitsprüfungen können Teams konfigurieren?

Teams können Antworterwartungen semantisch beschreiben und unterstützte Fakten wie erforderliche oder verbotene Tool-Aufrufe, Argumente, Antwortfelder, HTTP-Status, Schema, Zeit oder Token-Nutzung prüfen. Die verfügbaren Nachweise hängen vom aktiven Ergebnis oder Trace ab.

Was passiert, wenn eine Sicherheitsprüfung Daten benötigt, die der Trace nicht enthält?

Mibo meldet fehlende Instrumentierung, wenn eine unterstützte Prüfung das benötigte Trace-Feld nicht findet, statt sie stillschweigend als bestanden oder fehlgeschlagen zu behandeln. Ergänzen Sie relevante Felder, wenn dieser Nachweis für Ihren Ablauf wichtig ist.

Garantieren Sicherheitstests, dass ein KI-Agent sicher ist?

Nein. Konfigurierte Prüfungen liefern begrenzte Nachweise, keine Sicherheitsgarantie und keine automatische Behebung. Das Signal wird durch Szenarien, Prüfungen, verfügbare Eingaben und Traces, Klassifizierung, Instrumentierung und die Breite beobachteter oder ausgeführter Interaktionen begrenzt.

Mehr entdecken