Princípios fundamentais
Uma via de especialista só melhora a capacidade de processamento quando reduz a contenção pelos verdadeiros gargalos:- Bloqueios de sessão: apenas uma execução deve alterar uma determinada sessão por vez.
- Capacidade global do modelo: todas as execuções visíveis de chat ainda compartilham os limites do provedor.
- Capacidade das ferramentas: trabalhos no shell, navegador, rede e repositório podem ser mais lentos que a própria interação com o modelo.
- Orçamento de contexto: transcrições longas tornam cada interação futura mais lenta e menos focada.
- Ambiguidade de responsabilidade: agentes duplicados fazendo o mesmo trabalho desperdiçam capacidade.
Implantação recomendada
Fase 1: contratos das vias + trabalho pesado em segundo plano
Forneça a cada via um contrato escrito em seu espaço de trabalho e prompt do sistema:- Finalidade: o trabalho pelo qual esta via é responsável.
- Fora do escopo: trabalho que ela deve encaminhar em vez de tentar realizar.
- Orçamento do chat: respostas rápidas permanecem no chat; tarefas longas recebem uma confirmação breve e são executadas por um subagente ou tarefa em segundo plano.
- Regra de encaminhamento: quando outra via for responsável pelo trabalho, informe para onde ele deve ser enviado e forneça um resumo conciso para o encaminhamento.
- Regra de risco das ferramentas: prefira a menor superfície de ferramentas capaz de realizar o trabalho.
Fase 2: controles de prioridade e simultaneidade
Ajuste a capacidade da fila e do modelo de acordo com o valor de negócio de cada via:Fase 3: coordenador/controlador de tráfego
Adicione um padrão simples de coordenação quando várias vias estiverem ativas:- Acompanhe as tarefas e os responsáveis ativos de cada via.
- Detecte solicitações duplicadas entre grupos.
- Encaminhe resumos de transferência entre as vias.
- Apresente apenas bloqueios, resultados concluídos e decisões que a pessoa precisa tomar.