A colpo d'occhio
Anthropic offre Claude in tre taglie, e scegliere quella giusta è al tempo stesso la leva più semplice e la più grande sia sulla qualità sia sulla fattura. Opus è il modello più capace per il ragionamento più difficile, Sonnet il cavallo da tiro equilibrato che gestisce bene la maggior parte delle task di coding e di agente, e Haiku il modello rapido ed economico per il lavoro ad alto volume e sensibile alla latenza. Condividono le stesse capacità di base e, nel 2026, un contesto di 1M di token al prezzo standard; ciò che cambia è la profondità di ragionamento, la velocità e il costo per token. Questa pagina li confronta onestamente, così tu adatti il modello alla task, invece di pagare Opus per un lavoro che Haiku farebbe, o di inviare un problema davvero pesante a Haiku e restare frustrato. Accompagna il nostro articolo Choosing an AI Model. I prezzi sono prezzi di listino del 2026 e cambiano nel tempo.
Le opzioni
Fianco a fianco
| Dimensione | Claude Opus | Claude Sonnet | Claude Haiku |
|---|---|---|---|
| Livello | Il più capace | Equilibrato | Il più rapido ed economico |
| Ideale per | Ragionamento più duro, architettura, refactoring complessi | La maggior parte del coding e del lavoro di agente | Alto volume, task semplici, lavoro sensibile alla latenza |
| Capacità relativa | La più alta | Alta | Buona per la sua taglia |
| Velocità relativa | La più lenta | Rapida | La più rapida |
| Prezzo Input per milione (stato 2026) | Circa USD 5 | Circa USD 3 | Circa USD 1 |
| Prezzo Output per milione (stato 2026) | Circa USD 25 | Circa USD 15 | Circa USD 5 |
| Context window (2026) | 1M di token al prezzo standard | 1M di token al prezzo standard | Grande contesto |
Il verdetto
Fai di Sonnet il tuo default: gestisce la grande maggioranza del coding e del lavoro di agente a un forte rapporto qualità-costo, per questo Claude Code lo usa di default. Usa Opus per i problemi davvero pesanti, ragionamento complesso, refactoring intricati e architettura, dove la sua profondità aggiuntiva si ripaga centrando giusto al primo colpo. Scendi verso Haiku per lavoro ad alto volume, semplice o sensibile alla latenza come la classificazione, l'estrazione e i subagent in sola lettura, dove la velocità e il costo contano più del ragionamento di punta. Uno schema forte è mescolarli: un modello più forte guida, mentre Haiku fa il lavoro laterale stretto ed economico. Per ridurre ancora i costi, usa il Prompt Caching per il contesto ripetuto e l'elaborazione in batch per i job non urgenti. Nel dubbio, inizia su Sonnet e sali o scendi solo quando una task lo esige chiaramente.
