Diagnóstico de produção

Seu agente está pronto para produção?

Responda seis dimensões que aparecem quando um agente deixa de ser demo: identidade, conhecimento, memória, ferramentas, isolamento e operação.

O resultado é um checklist, não uma certificação. Use como triagem antes de validar comportamento com usuários e transcripts.

Checklist interativo

Seis perguntas para separar demo de operação

Marque o estado atual de cada dimensão. As respostas ficam no hash da URL em formato compacto, sem nome, e-mail, empresa ou texto livre.

1. O agente tem identidade operacional clara?

Papel, tom, regras de recusa e fronteiras do que ele pode responder.

2. As respostas factuais vêm de conhecimento com fonte?

Brain/RAG, documentos próprios e citação verificável nas perguntas importantes.

3. A memória é separada por usuário final?

O agente lembra preferências e fatos do usuário correto, sem misturar pessoas.

4. As ferramentas REST foram testadas fora do happy path?

Cada chamada precisa ter segredo protegido, teste inline e erro claro quando a API recusa.

5. Tenant e usuário final estão resolvidos pelo servidor?

O modelo não deve decidir sozinho a qual cliente ou pessoa uma memória pertence.

6. A operação mede custo, falhas e transcripts?

Produção exige visibilidade de custo por execução, logs, histórico auditável e orçamento.

Prova pública

Use o diagnóstico junto com evidência auditável

592 transcripts
abertos no Catcher Bench

25/25
factuais com citação no Medic

1 caso embedded
um SaaS de gestão de clínicas

O Bench compara agentes reais em produção e mostra custo, qualidade, latência, turnos, tool calls e transcripts. A rodada com Brain ativo no Medic teve 25/25 factuais com citação nos oito modelos, mas não é prova causal isolada porque não houve controle Medic sem Brain.

Próximo passo

Transforme os gaps em um agente testável

Comece pelo Console ou leia a API para embutir runtime token, sessão e mensagem no seu produto.