Pular para o conteúdo principal

Teste o comportamento do seu agente de IA antes de colocá-lo em produção.

A Mibo oferece às equipes de engenharia uma forma repetível de executar cenários antes do lançamento, revisar as evidências de cada resultado e avaliar traces reais de produção com os mesmos testes.

Uma resposta bem-sucedida não comprova um comportamento confiável.

Um agente pode retornar uma resposta HTTP bem-sucedida e ainda assim escolher a ferramenta errada, inventar uma ação concluída ou deixar uma solicitação sem solução. A Mibo transforma essas expectativas em evidências que você pode revisar.

Rota errada

Verifique se a solicitação chega ao especialista e ao fluxo corretos, não apenas se o endpoint responde.

Uso de ferramentas

Valide chamadas, argumentos e outros fatos observáveis no trace do agente.

Resposta incompleta

Avalie se a resposta é clara, segura e alinhada ao resultado de que seu cliente precisa.

Uma suíte de testes para todo o ciclo do agente

Defina as expectativas uma vez e use-as para verificar mudanças antes do lançamento e analisar interações reais depois.

Defina o comportamento

Descreva o resultado esperado com verificações semânticas e procedurais.

Teste antes do lançamento

Execute cenários selecionados no agente conectado e revise a resposta junto às evidências de execução.

Avalie traces reais

Envie traces via OpenTelemetry ou pela API da Mibo para avaliação assíncrona após cada interação.

Cada resultado preserva as evidências necessárias para investigar

Verificações semânticas

Avalie significado, segurança, completude e alinhamento ao resultado descrito, sem exigir uma string fixa.

Verificações procedurais

Inspecione fatos da execução, como chamadas de ferramentas, argumentos, atributos, status HTTP e schema.

Perguntas frequentes

O que a Mibo testa em um agente de IA?

A Mibo avalia o comportamento que você descreve, incluindo a resposta e evidências observáveis da execução, como rotas, chamadas de ferramentas, valores e status. Verificações baseadas em regras validam fatos, enquanto verificações com IA pontuam respostas segundo critérios em linguagem natural.

Posso testar um agente antes e depois do lançamento?

Sim. Os testes ativos enviam cenários selecionados a um agente conectado. Após interações reais, seu sistema pode enviar traces para avaliação passiva com os casos de teste ativos aplicáveis.

Os testes passivos colocam a Mibo no caminho da solicitação do cliente?

Não. Seu sistema processa a interação e depois envia um trace à Mibo. A Mibo avalia o trace de forma assíncrona em segundo plano.

Continue explorando