Principi fondamentali
Una corsia specialistica migliora la capacità di elaborazione solo quando riduce la contesa per i veri colli di bottiglia:- Blocchi di sessione: una sola esecuzione alla volta deve modificare una determinata sessione.
- Capacità globale del modello: tutte le esecuzioni di chat visibili continuano a condividere i limiti del provider.
- Capacità degli strumenti: le operazioni su shell, browser, rete e repository possono essere più lente del turno del modello stesso.
- Budget del contesto: trascrizioni lunghe rendono ogni turno futuro più lento e meno focalizzato.
- Ambiguità della responsabilità: agenti duplicati che svolgono lo stesso lavoro sprecano capacità.
Implementazione graduale consigliata
Fase 1: contratti delle corsie e lavoro pesante in background
Fornisci a ogni corsia un contratto scritto nel relativo spazio di lavoro e nel prompt di sistema:- Scopo: il lavoro di cui è responsabile questa corsia.
- Obiettivi esclusi: il lavoro che deve delegare anziché tentare di svolgere.
- Budget della chat: le risposte rapide rimangono nella chat; per le attività lunghe, invia una breve conferma, quindi eseguile in un sotto-agente o in un’attività in background.
- Regola di passaggio: quando il lavoro è di competenza di un’altra corsia, indica dove deve essere inoltrato e fornisci un riepilogo sintetico per il passaggio.
- Regola sui rischi degli strumenti: preferisci il set minimo di strumenti in grado di svolgere il lavoro.
Fase 2: controlli di priorità e concorrenza
Configura la capacità della coda e del modello in base al valore aziendale di ciascuna corsia:Fase 3: coordinatore / controllore del traffico
Aggiungi un semplice modello di coordinamento quando sono attive più corsie:- Tieni traccia delle attività e dei responsabili delle corsie attive.
- Rileva le richieste duplicate tra i gruppi.
- Instrada tra le corsie i riepiloghi per il passaggio.
- Mostra solo gli impedimenti, i risultati completati e le decisioni che deve prendere la persona.