Testando Agentes
A plataforma SipPulse AI oferece o Agent Playground — um ambiente de teste unificado onde você pode interagir com seus agentes via texto e voz na mesma interface. Valide seus agentes aqui antes de implantá-los em canais de produção como WhatsApp, SIP, Telegram ou widgets web.
Acessando o Agent Playground
- Navegue até Agentes e selecione um agente
- Clique no nome do agente ou em ⋮ → Abrir Playground
Agent Playground
O Agent Playground combina interação por texto e voz em uma única interface. Você pode alternar entre os modos durante uma conversa sem perder o contexto.
Layout da Interface
| Região | Localização | Função |
|---|---|---|
| Lista de Threads | Painel esquerdo | Histórico de conversas com paginação e filtros por trigger |
| Fluxo de Mensagens | Centro | Onde você interage com o Agente por texto ou voz |
| Barra de Controle | Parte superior | Gerencia a conversa (nova, atualizar, encerrar, reabrir, info) |
| Sidebar de Informações | Painel direito (alternar com ℹ️) | Métricas de contexto, custos, status, modelo e ferramentas |
Barra de Controle
| Ícone | Ação | Observações |
|---|---|---|
| ➕ | Nova conversa | Cria um thread em branco |
| 🔄 | Atualizar | Recarrega mensagens |
| ⏹ | Encerrar conversa | Marca como Fechada. Executa Pós-Análise se configurada |
| ▶️ | Reabrir conversa | Aparece apenas quando fechada |
| ℹ️ | Informações | Mostra/oculta a Sidebar de Informações |
Enviando Imagens
Você pode anexar imagens diretamente no chat do agente para testar capacidades de visão.
Como anexar:
- Clique no ícone de anexo na área de entrada do chat
- Ou arraste e solte um arquivo de imagem no chat
Requisitos:
- O modelo do agente deve suportar visão (ex: GPT-4o, Claude Sonnet)
- Formatos suportados: PNG, JPG, JPEG, GIF, WebP
A imagem é enviada junto com sua mensagem de texto. O modelo processa tanto o texto quanto o conteúdo visual para gerar a resposta.
INFO
Se o modelo selecionado não suporta visão, o botão de anexo não fica disponível.
Alternando entre Texto e Voz
O Playground suporta alternância de modo integrada:
- Modo texto: Digite mensagens normalmente no campo de entrada
- Modo voz: Clique no botão de microfone para iniciar uma sessão de voz
Você pode alternar entre os modos a qualquer momento — o contexto da conversa é preservado. Ao iniciar uma sessão de voz, a interface mostra um visualizador de microfone e exibe a transcrição da sua fala junto com as respostas do agente.
TIP
Chamadas de ferramentas (tool calls) feitas pelo agente são exibidas em tempo real durante sessões de voz, para que você veja exatamente quais ações o agente está tomando enquanto fala.
Modo Voz
Para usar o modo voz, seu agente deve ter um modelo TTS e voz configurados na aba Configurações de Voz.
| Elemento | Função |
|---|---|
| Botão de Microfone | Iniciar/encerrar sessão de voz |
| Visualizador de Microfone | Indicador visual quando o mic está ativo |
| Estado do Agente | Mostra Idle, Listening, Thinking ou Speaking |
| Transcrição | Sua fala e respostas do agente aparecem como texto no fluxo de mensagens |
Fluxo da sessão de voz:
- Clique no botão de microfone para conectar
- Fale normalmente — sua fala é transcrita automaticamente
- O agente responde com áudio e texto simultaneamente
- Tool calls aparecem em tempo real durante o processamento
- Clique no botão de microfone novamente para desconectar
INFO
O agente usa TTS streaming por sentença, o que significa que a reprodução de áudio começa antes da resposta completa ser gerada. Isso reduz a latência percebida.
Lista de Threads e Histórico
O painel esquerdo mostra seus threads de conversa com:
- Paginação para navegar em muitos threads
- Filtro por trigger para mostrar threads por origem (UI, API, WhatsApp, SIP, etc.)
- Badges de status indicando o estado do thread (Pendente, Ativo, Em execução, Fechado)
- Indicador de carregamento ao alternar entre threads
Você também pode acessar seu histórico completo de conversas na página History na barra lateral.
Sidebar de Informações
A Sidebar exibe as configurações do Agente no momento em que a conversa foi criada. Alterações posteriores não são aplicadas retroativamente.
| Campo | O que mostra |
|---|---|
| Acionado por | Canal de origem (UI, API, WhatsApp, SIP). Canais externos tornam o campo de entrada somente leitura. |
| Status | Estado atual do thread |
| Modelo | LLM utilizado nesta conversa |
| Contexto | Tokens usados / limite do modelo |
| Custo total | Custo de tokens de entrada + saída |
| Velocidade | Média de tokens/s na geração |
| Ferramentas | Tool calls disponíveis para esta conversa |
| Pós-Análise | Resultado estruturado, se configurado e conversa encerrada |
O bloco de uso de cada mensagem também mostra os tokens de entrada em cache quando o provedor reporta o dado.
Instruções Adicionais & Variáveis
Antes da primeira mensagem, você pode adicionar instruções adicionais que são concatenadas às Instruções do Sistema apenas para essa conversa.
Exemplos de uso:
- Passar contexto temporário: "Esta conversa é sobre o pedido #12345."
- Personalizar: "Você está falando com Mariana."
Se o agente possui variáveis nas instruções, preencha os valores antes de iniciar a conversa.
INFO
No modo voz, alterações nas configurações de sessão só têm efeito antes de conectar. Desconecte primeiro se precisar modificá-las.
Bloco Pensando
Enquanto o modelo raciocina, aparece uma linha Pensando com brilho animado. Ao terminar, a linha vira Pensou por N s e, quando o provedor reporta, mostra também a contagem de tokens. Clique para expandir e ler o texto do raciocínio. Quando o provedor não expõe nada, nenhum bloco é mostrado. Veja Raciocínio em LLMs para saber quais provedores devolvem o texto.
Trocar modelo e raciocínio na conversa
No compositor do Playground, o seletor de modelo e o seletor de nível de raciocínio valem só para a conversa aberta, ou para a nova conversa antes da primeira mensagem. Os níveis vêm do catálogo de cada modelo, e o nível do agente aparece marcado.
- Trocar o modelo reconcilia os parâmetros por intenção e descarta os que o novo modelo não declara.
- Salvar modelo, raciocínio e voz no agente grava modelo e raciocínio no agente. A confirmação lista o que muda e avisa que os canais já publicados passam a usar o novo modelo.
- Uma divisória na conversa marca o ponto em que o modelo mudou.
- O microfone fica desabilitado quando o modelo da conversa difere do modelo do agente, porque a sessão de voz continua rodando e sendo cobrada pelo modelo do agente.
Como as chamadas de ferramenta aparecem
A busca e o carregamento de ferramentas por trás dos panos aparecem como uma linha de texto discreta. As ferramentas do agente, como API, base de conhecimento, função manual e MCP, aparecem como um cartão com um selo de origem; nas de MCP, o selo mostra o nome do servidor e o host. As ferramentas nativas aparecem como um cartão neutro com um resumo de uma linha. O controle de chamada (end_dialog, transfer_call, send_dtmf, receive_dtmf) aparece como uma pílula de evento. A cor indica apenas o estado: em execução, concluída ou com erro.
Enviar e parar
Há um só botão de enviar e parar: Enter envia e Esc interrompe. Ao rolar para cima, o auto-scroll pausa e um botão de ir para o fim aparece.
Boas Práticas de Teste
Geral
- Teste antes de produção — cubra todos os cenários críticos e fluxos alternativos.
- Compare modelos — algumas tarefas funcionam melhor em modelos maiores; outras exigem menor latência.
- Monitore contexto e custo — revise se o Agente ultrapassa 75% do limite de tokens.
- Valide ferramentas — certifique-se de que cada tool call retorna o formato esperado.
- Documente aprendizados — registre falhas e ajustes para compor histórico de melhorias.
Testes de Texto
- Teste cenários de erro (respostas vazias, timeouts).
- Valide o comportamento com diferentes tipos de input.
- Use instruções adicionais para simular contextos específicos.
Testes de Voz
- Teste em ambiente silencioso para melhor reconhecimento.
- Valide a latência da resposta do agente.
- Teste diferentes sotaques e velocidades de fala.
- Confirme que a voz TTS selecionada é adequada para o caso de uso.
- Verifique o comportamento quando você interrompe o agente.
- Confirme que tool calls aparecem corretamente durante sessões de voz.
Pós-Análise
Ao encerrar uma conversa, o sistema executa automaticamente as análises estruturadas configuradas no Agente. O resultado aparece na Sidebar para consulta.
Para mais informações sobre análises estruturadas, consulte Análises Estruturadas.
Recursos Relacionados
- Configuração de Agentes — Referência completa de perfil, instruções, ferramentas e parâmetros.
- Análises Estruturadas — Como criar métricas automáticas para cada conversa.
- Implantação de Agentes — Conectar seu Agente a WhatsApp, HTTP API e mais.
- Monitoramento de Conversas — Acompanhar conversas em tempo real.
