Otimizações de Token
O SuperSquad inclui um conjunto de otimizações pré-configuradas para reduzir consumo de tokens e melhorar a performance do seu agente.
Otimizações disponíveis
Model Routing
Roteamento inteligente entre modelos. Usa modelos menores para tarefas simples e reserva modelos maiores para tarefas complexas, economizando tokens.
Session Init
Otimiza a inicialização de sessões para reduzir tokens no primeiro contato de cada conversa.
Heartbeat
Monitoramento contínuo do agente com batimentos periódicos para garantir disponibilidade sem consumo excessivo.
Rate Limits
Controle de consumo de tokens por período. Previne gastos inesperados com limites configuráveis.
Prompt Caching
Ativa o cache do system prompt e de contextos recorrentes. Pode reduzir significativamente o consumo de tokens em agentes com prompts longos.
Session Reset
Limpeza automática de sessões inativas após um período configurável. Libera recursos e reduz custos.
Como configurar
Todas as otimizações são configuráveis na criação do agente (Modo Avançado → Otimização) ou na página de configurações do agente.
Cada otimização pode ser ativada/desativada individualmente com um toggle.