Konkrete Szenarien
Beschreiben Sie Situation, Eingabe und zu schützendes Verhalten, damit ein Testfall ein gezieltes Kundenszenario statt einer vagen Anweisung darstellt.
Mibo hilft Teams, ein reales Agentenszenario zu beschreiben, semantische und prozedurale Prüfungen hinzuzufügen, ausgewählte Fälle gezielt auszuführen und passende Traces auszuwerten, wenn Nachweise verfügbar sind.
Teams müssen eine reale Kundensituation in eine konkrete Eingabe, erwartetes Verhalten und prüfbare Nachweise übersetzen. Mibo hält diese Teile zusammen, ohne ein einzelnes Szenario als Aussage über jede Interaktion zu behandeln.
Beschreiben Sie Situation, Eingabe und zu schützendes Verhalten, damit ein Testfall ein gezieltes Kundenszenario statt einer vagen Anweisung darstellt.
Formulieren Sie Kriterien für Bedeutung, Sicherheit, Vollständigkeit oder Zielausrichtung in natürlicher Sprache. Der Evaluator bewertet Antwort und verfügbaren Kontext anhand Ihrer Beschreibung.
Prüfen Sie beobachtbare Fakten wie Knoten- oder Tool-Aufrufe, Argumente, Status, Schema, Zeit oder Token-Nutzung, wenn die aktive Antwort oder der Trace die nötigen Felder enthält.
Erstellen Sie einen fokussierten Fall, wählen Sie passende Prüfungen und nutzen Sie das Ergebnis, um den nächsten Untersuchungsschritt festzulegen. Aktive Läufe und passive Traces bleiben unterschiedliche Signale.
01
Beschreiben Sie die Kundensituation und die Eingabe, die sie auslösen soll. Ergänzen Sie das erwartete Ergebnis sowie wichtige Sicherheits- oder Randbedingungen.
02
Kombinieren Sie semantische Kriterien mit prozeduralen Prüfungen für Antwort und Ausführungsnachweise, die Ihr Agent liefern kann. Legen Sie Schwellenwerte und erwartete Werte gezielt fest.
03
Führen Sie den ausgewählten Fall gegen einen verbundenen Agenten aus und evaluieren Sie anschließend passende kanonische Traces realer Interaktionen asynchron, wenn Ihr System sie sendet.
Beschreiben Sie, was eine hilfreiche, sichere, vollständige oder fundierte Antwort bedeutet. Der Score ist ein Untersuchungsnachweis und hängt von der für den Evaluator verfügbaren Antwort und dem Kontext ab.
Prüfen Sie deterministische Fakten wie einen erforderlichen Tool-Aufruf, ein Argument, ein Antwortfeld, einen HTTP-Status, ein Schema, ein Zeitlimit oder Token-Nutzung. Fehlende Trace-Felder erscheinen als fehlende Instrumentierung.
Ein definierter Testfall besteht aus Szenario, Eingabe, erwartetem Verhalten und Prüfungen, die Mibo auswerten kann. Prüfungen können die Bedeutung der Antwort beschreiben oder beobachtbare Fakten wie Tool-Aufrufe, Argumente, Status, Schema, Zeit oder Tokens untersuchen.
Ein Testfall ist die konkrete Definition von Szenario und Prüfungen. Mibo evaluiert die konfigurierten Prüfungen in einem gezielten aktiven Lauf und kann passende aktive Testfälle wiederverwenden, wenn Ihr System Traces realer Interaktionen sendet.
Ja. Ein aktiver Test sendet die ausgewählte Eingabe an einen verbundenen Agenten und wertet Antwort und verfügbare Ausführungsnachweise aus. Das Ergebnis belegt dieses Szenario, nicht unbeobachtete Fälle.
Ja, wenn der Test aktiv und für passive Evaluierung geeignet ist und Ihr System nach der Interaktion einen kanonischen Trace sendet. Mibo klassifiziert passende Szenarien und evaluiert sie asynchron, ohne den Agenten erneut aufzurufen.
Mibo meldet fehlende Instrumentierung für unterstützte Prüfungen, die das erforderliche Trace-Feld nicht finden, statt die Prüfung stillschweigend als bestanden oder fehlgeschlagen zu behandeln. Ergänzen Sie relevante Felder, wenn dieser Nachweis für Ihren Ablauf wichtig ist.
Nein. Das Signal ist durch konfigurierte Szenarien und Prüfungen, verfügbare Eingaben und Traces, Klassifizierung, Instrumentierung und die Breite der ausgeführten oder beobachteten Interaktionen begrenzt. Mibo verspricht weder garantierte Qualität noch automatische Behebung.
Nutzen Sie die gepflegte Dokumentation, um Szenarien, Eingaben, Prüfungen und passives Verhalten zu definieren.
Dokumentation lesen →Erfahren Sie, welche semantischen und prozeduralen Prüfungen verfügbar sind und welche Trace-Nachweise sie verwenden können.
Prüfungsdokumentation lesen →Definieren Sie Szenarien, führen Sie aktive Prüfungen vor dem Release aus und verwenden Sie sie für die passive Evaluierung von Produktions-Traces wieder.
Agententests entdecken →Verstehen Sie, wie Mibo konfiguriertes Verhalten über den Antwortcode hinaus evaluiert.
Evaluierung entdecken →Sehen Sie, welche bedingten Szenarien realem Traffic entsprechen, ohne beobachtete Abdeckung mit Prüfungsergebnissen zu verwechseln.
Testabdeckung entdecken →Folgen Sie einem praktischen Ablauf für Szenarien, Prüfungen, aktive Läufe, passive Traces und Interpretationsgrenzen.
Leitfaden lesen →Führen Sie den Live-Zuverlässigkeitscheck mit einer synthetischen Kundenanfrage aus.
Live-Check starten →