Vai al contenuto principale
Tutti gli articoli

Claude Opus 5.5: più bravo di Fable, e costa meno

La cache di Opus al prezzo di Sonnet: il modello di punta che costa meno del predecessore

AIBusiness

6 min di lettura

Claude Opus 5.5 è uscito oggi, 22 settembre, e ci sto lavorando dentro Claude Code da quando è comparso nel selettore dei modelli. Costa 4 dollari per milione di token in input e 20 in output, contro i 5 e 25 di Opus 5. Anthropic dice che lavora al livello di Claude Fable 5.1, che ne costa 10 e 50, e sui benchmark che ha pubblicato gli sta davanti. Il modello nuovo costa meno di quello che sostituisce e fa di più: non capitava da un pezzo.

Dalle prime ore mi porto a casa una cosa sola, ma netta: le risposte sono più precise. I numeri che Anthropic ha pubblicato vanno nella stessa direzione, e raccontano più di quanto dica il titolo del comunicato.

Il listino di Opus non si muoveva da novembre 2025

L'ultima volta che Opus ha cambiato prezzo è stata con la 4.5, quando è passato da 15 e 75 dollari a 5 e 25. Poi sono uscite la 4.6, la 4.7, la 4.8 e la 5, tutte allo stesso listino. Dieci mesi e quattro versioni senza toccare un centesimo.

Per 1M tokenOpus 5Opus 5.5Differenza
Input$5$4-20%
Output$25$20-20%
Cache write (5 min)$6.25$5-20%
Cache read$0.50$0.20-60%
Fast mode (in/out)$10 / $50$8 / $40-20%
Batch (in/out)$2.50 / $12.50$2 / $10-20%

Il taglio è un -20% uniforme su tutte le righe tranne una.

La cache di Opus ora costa quanto quella di Sonnet

La riga che non segue il -20% è il cache read. Finora un cache hit costava un decimo del prezzo di input, su tutti i modelli. Per Opus 5.5 il moltiplicatore scende a 0.05x: su un input da 4 dollari fa 0.20.

Messo accanto al resto del listino, il numero diventa strano:

  • Sonnet 5 ha lo stesso cache read, 0.20 dollari;
  • Fable 5.1 sta a 0.25, sopra Opus;
  • Haiku 4.5 sta a 0.10, la metà.

Quella colonna conta più di quanto sembri, perché in un agent è la voce che cresce con il numero di passi. System prompt, definizioni dei tool e cronologia vengono riletti a ogni tool call: una sessione da quaranta chiamate con un contesto medio di 150 mila token fa sei milioni di token letti dalla cache. Con Opus 5 erano 3 dollari, con Opus 5.5 sono 1.20. L'output resta la voce più pesante, ma è quella che cresce meno quando la sessione si allunga.

Il 40% che nel listino non c'è

Nella pagina di lancio c'è una frase che vale più della tabella: con le impostazioni di default, Opus 5.5 costa il 40% in meno di Opus 5 sui carichi tipici. Il listino da solo fa il 20%. Il resto deve venire da qualche parte.

Il conto a spanne è questo: 0.8 per 0.75 fa 0.6. Anche mettendo nel conto lo sconto sulla cache, resta un pezzo che si spiega solo con meno token per lo stesso task. E i clienti citati da Anthropic lo dicono in chiaro:

  • Optiver: stessa qualità di Opus 5 in circa metà dei turni, del tempo e dei token di output, con un costo più basso del 40-50%;
  • Kiro: più task risolti con il 40% di chiamate in meno e metà dei token;
  • GitHub: in VS Code, più task da terminale risolti in meno della metà dei passaggi.

C'è poi una riga tecnica che dice la stessa cosa da un altro lato: su diversi benchmark Opus 5.5 con l'effort di default batte Opus 5 con l'effort al massimo. E genera l'output più veloce di oltre il 30%.

La mia lettura, ed è una deduzione, non qualcosa che Anthropic spiega: non hanno solo ridotto il margine. Hanno un modello che arriva al risultato con meno passi, e meno token per risposta vuol dire meno calcolo per servirla. È quello che permette di abbassare il prezzo senza perderci. Spiegherebbe anche perché oggi, giorno di lancio, non l'ho trovato intasato: di solito i primi giorni di un modello nuovo sono i più lenti.

Sopra Fable sui benchmark, a meno della metà del prezzo

BenchmarkOpus 5.5Fable 5.1Opus 5
Terminal-Bench 4.066.4%55.8%52.3%
CursorBench 4.057.8%51.8%46.6%
GDPval-AA v2.1 (Elo)184617351708
OSWorld 2.081.8%80.7%74.0%

Il distacco più largo è su Terminal-Bench, più di dieci punti. Su OSWorld sono praticamente pari. Il test interno che mi ha colpito di più è un altro: tradurre HAProxy da C a Rust. Entrambi i modelli hanno passato quasi tutti i test di regressione, ma Opus 5.5 ha finito in 9 ore e mezza contro le 12 di Fable 5.1, e con un costo più basso del 51%.

Io benchmark non ne faccio: lo uso per lavorare, e le differenze le vedo lì. Trova il problema prima, e quando lo trova guarda anche cosa c'è intorno invece di fermarsi alla riga rotta. Si capisce meglio cosa sta facendo, perché scrive in modo più chiaro. Sono impressioni di poche ore, ma vanno nella stessa direzione della tabella.

Fable 5.1 resta a 10 e 50 dollari. Nell'annuncio della famiglia 5.5 Fable non compare, e finché non si muove anche lui, per il lavoro di tutti i giorni fatico a trovare un motivo per pagarlo il doppio e mezzo.

Sonnet 5.5 e Haiku 5.5: si sposta tutta la scala

Opus 5.5 è il primo modello della famiglia 5.5. Anthropic scrive che Sonnet 5.5 e Haiku 5.5 arriveranno nelle prossime settimane, con molti degli stessi miglioramenti su prestazioni, efficienza e sicurezza. Niente date, niente prezzi.

Il dato che mi interessa di più è Haiku. La 4.5 è di ottobre 2025, a 1 e 5 dollari: in quasi un anno Opus ha avuto quattro versioni e Haiku nessuna. Eppure è il modello che finisce nei nodi che girano più spesso in un sistema agentico, la classificazione, il routing, l'estrazione di campi. Sono gli stessi nodi di cui ho scritto in Stai pagando un LLM per fare un if: quelli a cui un modello serve davvero, ma piccolo. Se Haiku 5.5 fa lo stesso salto di efficienza di Opus, è lì che la bolletta cambia di più, perché è lì che le chiamate si contano a migliaia.

Sonnet 5 sta a 2 e 10 dollari da quando il prezzo di lancio è diventato definitivo, il primo settembre. Se Sonnet 5.5 terrà quel listino, Anthropic non l'ha ancora detto.

Dove rimettere mano ai conti

Il model ID è claude-opus-5-5. La prossima volta che scegli il modello per un progetto nuovo, o apri la dashboard della spesa API a fine mese, rifai la tabella con questi numeri. Se c'è qualcosa che avevi messo su Fable per sicurezza, è il primo nodo da riprovare su Opus 5.5.

Il budget dei nodi piccoli invece non lo fisserei adesso. Tra qualche settimana cambia anche quello.

Hai un progetto in mente?

Costruisco software per aziende e startup dal 2018. Se sul tuo prodotto serve una mano, scrivimi: nel peggiore dei casi ti porti a casa un'opinione gratis.

Parliamone

Da leggere dopo

Una linea netta attraversa due riquadri di codice spenti fino a una sfera luminosa, e dall'altro lato ne esce sfilacciata in quattro tratti tratteggiati che sbiadiscono
ArchitetturaAI

Stai pagando un LLM per fare un if

Determinismo dove la risposta è una sola, reasoning dove non lo è: l'architettura che nessuno disegna più

7 min di lettura

Una fila di fotogrammi spenti con la testina di lettura ferma su uno solo, acceso e con dentro il marchio HyperFrames
AIArchitettura

HyperFrames: il video della feature lo scrivi in HTML

Motion graphics scritte da un prompt: roba da studio di produzione, senza lo studio di produzione

7 min di lettura