Questa settimana ho «centrato un obiettivo»: ho bruciato la mia quota di 5 ore su Claude in pochi minuti — ahi. E badate bene, con Haiku. Non con Sonnet, non con Opus, non con Fable.
Motivo: uso massiccio di subagent durante un’attività di ricerca. Fiero di questo? No! Chi mi conosce, conosce anche la mia opinione sul consumo di token e il concetto di «potenza reattiva». Chi si occupa di elettrotecnica sa cosa intendo.
Lezioni apprese
- Gli agenti multi-purpose (come Claude Code) generano un overhead di token considerevole.
- Per compiti unici e non ripetibili può essere giustificato. Per compiti standardizzabili, nella maggior parte dei casi, si bruciano semplicemente token.
- Anche gli LLM locali possono tirarti fuori dai guai — con compiti chiari forniscono risultati sorprendentemente affidabili.
I subagent costano sempre qualcosa: l’overhead di token si giustifica per compiti di ricerca unici e non strutturati — per tutto ciò che si può standardizzare, è quasi sempre pura potenza reattiva. E a volte un LLM locale con un compito chiaro basta e avanza.