“Non metti il tuo architetto capo su ogni vite del cartongesso. Abbina il lavoratore al compito e il conto si sistema da solo.”
Instrada i membri del team su un modello più economico
Tieni il lead su Opus 4.7, perché deve ragionare su architettura e coordinamento. Sposta i membri del team, che fanno esecuzione mirata, su Sonnet 4.6. Stessa qualità su attività ben delimitate, una frazione della spesa.
# Lead runs on whatever model you're using (Opus 4.7 for complex work). # Teammates and subagents use this model instead: export CLAUDE_CODE_SUBAGENT_MODEL="claude-sonnet-4-6" # (the "sonnet" alias also resolves to Sonnet 4.6)
Effort e thinking
Altre due manopole influenzano quanto intensamente, e quanto costosamente, lavorano gli agenti. Imposta il livello di effort in modo esplicito, e sui modelli 4.6 puoi riportare il thinking adattivo a un budget fisso (non ha effetto su Opus 4.7).
export CLAUDE_CODE_EFFORT_LEVEL=high # or a level name / "auto" export CLAUDE_CODE_DISABLE_ADAPTIVE_THINKING=1 # no effect on Opus 4.7
Limitare la spesa: la versione onesta
La fonte raccomanda un flag `--max-budget-usd` per limitare il costo totale di una sessione. Quel flag non è nella documentazione di Claude Code, quindi non contarci. Le leve che esistono davvero: instrada i membri del team su un modello più economico (vedi sopra), imposta se serve un tetto di output/token per workspace sul lavoro più verboso, e affidati al tuo piano e al tuo tier di utilizzo API come limite duro. Poi tieni d'occhio la dashboard di utilizzo mentre un team lavora.
Una riga per ciascuno
- Tieni il lead su Opus 4.7; instrada i membri del team su Sonnet 4.6 tramite CLAUDE_CODE_SUBAGENT_MODEL (o l'alias 'sonnet').
- Imposta l'effort con CLAUDE_CODE_EFFORT_LEVEL (non l'inventato DEFAULT_EFFORT); l'override del thinking adattivo vale solo per i 4.6.
- Non esiste un flag --max-budget-usd documentato. Il vero controllo della spesa è il routing dei modelli, eventuali tetti di token e il tuo tier di utilizzo.
Dove andare ora