Produktions-Traces
Senden Sie nach einer realen Anfrage einen kanonischen Trace mit Interaktion, Antwort und Ausführungsdetails über OpenTelemetry oder Mibos Pfad Ihre API.
Mibo evaluiert Produktions-Traces anhand der von Ihnen definierten aktiven Tests, speichert asynchrone Nachweise zur Untersuchung und bleibt außerhalb des Kundenanfragepfads.
Eine Anfrage kann erfolgreich abgeschlossen werden, während der Agent an den falschen Spezialisten weiterleitet, ein Tool mit unsicheren Argumenten aufruft oder eine unvollständige Antwort gibt. Mibo verwandelt den Produktions-Trace in untersuchbare Nachweise, statt Verfügbarkeit als Beleg für zuverlässiges Verhalten zu behandeln.
Senden Sie nach einer realen Anfrage einen kanonischen Trace mit Interaktion, Antwort und Ausführungsdetails über OpenTelemetry oder Mibos Pfad Ihre API.
Mibo speichert den Trace und plant die zutreffenden aktiven Tests im Hintergrund. Die passive Evaluierung sendet keine weitere Anfrage an Ihr System.
Prüfen Sie semantisches Verhalten und prozedurale Fakten wie Tool-Aufrufe, Argumente, Status, Schema, Tokens und Antwortzeit, sofern der Trace die erforderlichen Felder enthält.
Halten Sie die Produktionsevaluierung von der Kundeninteraktion getrennt und machen Sie Nachweise sowie deren Grenzen für das verantwortliche Team sichtbar.
01
Ihr System verarbeitet die Nutzeranfrage und sendet anschließend den kanonischen Trace mit Eingabe, Ausgabe und verfügbaren Ausführungsdetails zur Evaluierung an Mibo.
02
Mibo speichert den Trace und evaluiert ihn asynchron anhand der zutreffenden aktiven Tests. Die Ingestionsantwort wartet nicht auf den Abschluss der Evaluierung.
03
Vergleichen Sie Ergebnisse im Zeitverlauf und öffnen Sie die Nachweise hinter einem Fehler. Nutzen Sie die Erkenntnisse, um eine Korrektur zu priorisieren; Mibo behebt den Agenten nicht automatisch.
KI-gestützte semantische Prüfungen vergleichen die Antwort mit von Ihnen beschriebenen Kriterien wie Fundierung, Vollständigkeit, Sicherheit oder Zielausrichtung. Sie liefern Nachweise zur Untersuchung, keine Garantie für Wahrheit oder Gesamtqualität.
Deterministische Prüfungen untersuchen aufgezeichnete Fakten wie Knoten- oder Tool-Aufrufe, Argumente, Attribute, HTTP-Status, Schema, Token-Nutzung und Antwortzeit. Fehlende Felder werden als fehlende Instrumentierung gemeldet und nicht stillschweigend als bestanden oder fehlgeschlagen gewertet.
Ein Agent kann eine erfolgreiche HTTP-Antwort liefern und trotzdem das falsche Tool wählen, ein Ergebnis erfinden oder unvollständig antworten. Mibo evaluiert konfiguriertes Verhalten und Trace-Nachweise, nicht nur die Erreichbarkeit des Endpunkts.
Ihr System sendet nach der Interaktion einen kanonischen Trace. Mibo speichert ihn, ermittelt die zutreffenden aktiven Tests und evaluiert ihn asynchron im Hintergrund. Bei der passiven Evaluierung wird Ihr Agent nicht erneut aufgerufen.
Nein. Ihr System verarbeitet zuerst die Kundenanfrage und sendet den Trace separat an Mibo. Die Ingestionsantwort ist von der Evaluierung im Hintergrund getrennt.
Nein. Mibo evaluiert die aktiven Tests und verfügbaren Trace-Felder. Unbeobachtete Randfälle, enge Kriterien, nicht verfügbare Klassifizierung und fehlende Instrumentierung können das Signal begrenzen, und Mibo behebt den Agenten nicht automatisch.
Trace-Inhalte werden im Ruhezustand verschlüsselt, und der Produktzugriff ist auf das besitzende Konto beschränkt. Senden Sie synthetische oder angemessen verwaltete Daten entsprechend Ihren eigenen Datenschutzanforderungen.
Lesen Sie mehr über unterstützte Trace-Pfade, den asynchronen Evaluierungsablauf, passives Verhalten und die Grenzen fehlender Instrumentierung.
Dokumentation lesen →Erfahren Sie, welche Felder und Attribute Mibo für semantische und prozedurale Evaluierungen verwenden kann.
Trace-Referenz lesen →Verstehen Sie die semantischen und prozeduralen Prüfungen hinter aktiven Läufen und passiven Traces.
Evaluierung entdecken →Definieren Sie Szenarien, führen Sie aktive Prüfungen vor dem Release aus und verwenden Sie sie für Produktions-Traces wieder.
Agententests entdecken →Unterscheiden Sie beobachteten Szenario-Traffic von inaktiven und nicht zugeordneten Fällen, ohne Abdeckung als Qualitätsbeleg zu behandeln.
Testabdeckung entdecken →Verbinden Sie gezielte Prüfungen vor dem Release mit der Auswertung verfügbarer Produktions-Traces nach realen Interaktionen.
Regressionstests entdecken →Führen Sie den Live-Zuverlässigkeitscheck mit einer synthetischen Kundenanfrage aus.
Live-Check starten →Folgen Sie einem praktischen Ablauf für aktive Tests, passive Traces und Interpretationsgrenzen.
Leitfaden lesen →