Svennis AI
10 min di lettura

Passare da Claude Opus 5 a Opus 5.5: costi, modifiche e verifiche prima del cambio

Opus 5.5 è più economico e più veloce di Opus 5, ma non si sostituisce con un semplice scambio. Qui trova prezzi, modifiche incompatibili, un esempio di costo mensile e una checklist.

Due flussi di forme geometriche che confluiscono in un unico percorso più snello e ordinato

Passare da Claude Opus 5 a Opus 5.5 conviene, dopo una verifica controllata

Passare da Claude Opus 5 a Opus 5.5 conviene quasi sempre. Opus 5.5 costa il 20% in meno per token. Anthropic dichiara inoltre che sui carichi tipici costa il 40% in meno e genera output oltre il 30% più velocemente. Il cambio però non è un semplice scambio di nome del modello, perché quattro modifiche incompatibili possono rompere codice che oggi funziona.

Il cambio di modello, in un sistema aziendale in produzione, è la sostituzione del modello che risponde alle richieste di un'applicazione già in uso. Insieme al modello cambia tutto ciò che dipende dalle sue risposte: prompt, regole di instradamento, formati di uscita e costi. Un instradamento (routing) è la decisione automatica su dove mandare una richiesta, per esempio a quale coda di Zoho Desk assegnare un ticket. Se il nuovo modello risponde in modo leggermente diverso, l'instradamento può cambiare senza che nessuno se ne accorga.

Questa guida riguarda solo la migrazione e i costi. Per capire quando Opus 5.5 è il modello adatto a un processo, esiste già un post su quando conviene usare Claude Opus 5.5 in azienda. Qui trova i prezzi a confronto, le modifiche da controllare nel codice, un esempio di costo mensile e una checklist di migrazione.

Prezzi di Opus 5.5 e Opus 5: il 20% in meno per token, il 60% sulle letture di cache

Opus 5.5 costa 4 dollari per milione di token in ingresso e 20 dollari in uscita, contro i 5 e 25 dollari di Opus 5. Sono i prezzi pubblicati da Anthropic, tutti in USD. Un token è un frammento di testo che il modello elabora: in inglese vale circa 4 caratteri o 0,75 parole.

Voce (USD per milione di token)Opus 5Opus 5.5Differenza
Ingresso5,004,00-20%
Uscita25,0020,00-20%
Scrittura in cache, 5 minuti6,255,00-20%
Scrittura in cache, 1 ora10,008,00-20%
Lettura dalla cache0,500,20-60%
Batch, ingresso / uscita2,50 / 12,502,00 / 10,00-20%

Il prompt caching è la funzione che riusa parti di prompt già elaborate in chiamate precedenti e le fattura a una frazione del prezzo di ingresso. Anthropic scrive che le letture di cache costituiscono la maggior parte dei costi nel lavoro agentico e di programmazione. Per questi carichi, quindi, il 60% in meno pesa più del 20%.

La Batch API elabora grandi volumi di richieste in modo asincrono, con il 50% di sconto su ingresso e uscita per entrambi i modelli. Opus 5.5 ha anche una modalità veloce a latenza ridotta, in anteprima di ricerca e solo sulla Claude API. Costa 8 dollari per milione di token in ingresso e 40 in uscita.

Opus 5.5 costa 4 dollari in ingresso e 20 in uscita per milione di token, contro 5 e 25 di Opus 5: Uscita, Opus 5 25, Uscita, Opus 5.5 20, Ingresso, Opus 5 5, Ingresso, Opus 5.5 4 (USD per milione di token)
Fonte: platform.claude.com

Perché Anthropic calcola il 40% in meno: prezzo per token ed effort predefinito

Il 40% di risparmio annunciato da Anthropic va oltre il prezzo per token, che spiega soltanto il 20%. Nelle parole di Anthropic: «Our tests show that at default settings it will cost 40% less than Opus 5 on typical workloads». La parte restante dipende da quanti token il modello consuma per ogni attività.

L'effort è il parametro che regola la profondità del ragionamento, la latenza e il costo. Su Opus 5.5 il valore predefinito è medium, mentre su Opus 5 era high. Una richiesta che non specifica l'effort, quindi, su Opus 5.5 ragiona in modo meno approfondito di prima. Poiché l'effort regola anche il costo, questa impostazione predefinita è una delle leve del risparmio dichiarato.

Le conseguenze pratiche sono due:

  • il 40% vale alle impostazioni predefinite e sui carichi tipici, quindi il Suo carico può risparmiare di più o di meno;
  • se il Suo sistema ha bisogno della profondità di ragionamento che aveva su Opus 5, dovrà impostare un effort più alto e rinunciare a parte del risparmio.

Solo una prova sui Suoi casi reali dice quale dei due scenari vale per la Sua azienda. Il prezzo di listino è certo, il consumo di token per attività va misurato.

Opus 5.5 costa il 40% in meno da eseguire, e la lettura dalla cache scende da 0,50 a 0,20 dollari: Costo d'esercizio rispetto a Opus 5 40% in meno, Lettura dalla cache, Opus 5 0,50 USD per milione di token, Lettura dalla cache, Opus 5.5 0,20 USD per
Fonte: anthropic.com, platform.claude.com

Qualità e velocità di Opus 5.5 nelle misure pubblicate da Anthropic

Anthropic afferma che Opus 5.5 lavora al livello di Claude Fable 5.1 nella maggior parte dei compiti e genera output oltre il 30% più velocemente di Opus 5. Fable 5.1 costa 10 dollari in ingresso e 50 in uscita per milione di token. Il confronto riguarda quindi un modello di fascia di prezzo superiore.

La tabella dei benchmark di Anthropic confronta solo modelli Claude. Su GDPval-AA v2.1, con Opus 5.5 al massimo effort, Anthropic riporta 1846 Elo per Opus 5.5, 1735 per Fable 5.1 e 1708 per Opus 5. Sono misure di Anthropic, non indipendenti. Sono state inoltre ottenute al massimo effort, non all'effort predefinito.

Anthropic stessa invita alla prudenza. Scrive che a questi livelli di capacità i margini nei benchmark sono diventati una guida meno affidabile delle differenze reali. Riporta anche segnali che Opus 5.5 spesso sospetta di essere valutato, e questo rende più difficile prevederne il comportamento. Per un'azienda il messaggio è semplice: il benchmark indica la direzione, la verifica sui propri casi decide.

Le altre specifiche restano uguali. Entrambi i modelli hanno una finestra di contesto di 1 milione di token e un'uscita massima di 128.000 token. Il limite di conoscenza affidabile passa da maggio 2026 per Opus 5 a giugno 2026 per Opus 5.5.

Le quattro modifiche incompatibili di Opus 5.5 per il codice scritto su Opus 5

Anthropic elenca quattro modifiche incompatibili che colpiscono il codice già in esecuzione su Opus 5. Un errore 400 è la risposta con cui l'API rifiuta una richiesta non valida. La chiamata fallisce e il sistema non riceve alcuna risposta dal modello.

  1. Il thinking non si può disattivare. Il thinking adattivo è il ragionamento che il modello svolge prima di rispondere, e su Opus 5.5 è sempre attivo. Una richiesta con thinking: {"type": "disabled"} o con un budget manuale budget_tokens restituisce un errore 400. La profondità del ragionamento si regola solo con l'effort.
  2. L'uso forzato degli strumenti non è supportato. Il tool use è la capacità del modello di chiamare funzioni esterne, per esempio una ricerca nel CRM. Con tool_choice impostato a {"type": "any"} o {"type": "tool"}, Opus 5.5 restituisce un errore 400. Il modello deve poter decidere da sé quando chiamare lo strumento.
  3. I blocchi di thinking sono legati al modello e alla conversazione. Opus 5.5 legge i blocchi di thinking di Opus 5, ma non quelli dei modelli Fable o Mythos. Un blocco illeggibile viene scartato: la richiesta riesce e il blocco non viene fatturato. Per gli account creati dal 31 agosto 2026, l'API rifiuta con un errore 400 i blocchi di thinking ripresentati dopo una modifica al contesto precedente.
  4. La versione precedente dello strumento di computer use viene rifiutata. Sulla Claude API e su Google Cloud, Opus 5.5 non accetta computer_20251124. Su Amazon Bedrock quello strumento continua a funzionare come su Opus 5.

Le prime tre modifiche valgono anche su Claude Fable 5.1. Chi aveva disattivato il thinking su Opus 5, per esempio in una classificazione semplice, deve riscrivere quella chiamata prima di tutte le altre.

Due cambi di Opus 5.5 che non producono errori: effort medio e testo tra gli strumenti

Due differenze di Opus 5.5 non generano alcun errore, e per questo sono le più facili da non notare. La prima è l'effort predefinito: una richiesta che non lo specifica gira a medium invece che a high. Un agente che su Opus 5 ragionava a fondo senza impostazioni esplicite, su Opus 5.5 ragiona di meno. La qualità può quindi calare in modo graduale, senza segnali evidenti.

La seconda differenza riguarda il testo che il modello scrive tra una chiamata a uno strumento e l'altra. Su Opus 5.5 quel testo arriva in blocchi di thinking e non in blocchi di testo. Con l'impostazione di visualizzazione predefinita, il testo di quei blocchi è vuoto. Un assistente in Microsoft Teams che mostra agli utenti aggiornamenti come «sto cercando il ticket» resta muto. Il silenzio dura finché l'applicazione non imposta un valore di visualizzazione che restituisce il testo.

La documentazione di Opus 5.5 descrive anche il formato dei rifiuti, da gestire nel codice. Una richiesta rifiutata restituisce HTTP 200 con stop_reason: "refusal" e un oggetto stop_details che indica l'area di policy. Un codice che controlla solo lo stato HTTP tratterebbe il rifiuto come una risposta valida. Opus 5.5 esegue inoltre un classificatore di sicurezza per la biologia, oltre a quello per la cybersicurezza.

Su Opus 5.5 l'effort predefinito passa da high a medium e il testo tra gli strumenti va nel thinking. Opus 5 / Opus 5.5. Effort predefinito: high / medium; Testo tra le chiamate agli strumenti: In blocchi di testo / In blocchi di thinking, vuoti con

Opus 5 resta disponibile almeno fino al 24 luglio 2027: il tempo per testare

Il passaggio da Opus 5 a Opus 5.5 non richiede fretta. Opus 5, uscito il 24 luglio 2026, ha lo stato «Active (legacy)» e sarà ritirato non prima del 24 luglio 2027. Legacy significa che il modello non riceverà più aggiornamenti e in futuro potrà essere deprecato. Opus 5.5, uscito il 22 settembre 2026, è indicato da Anthropic come il modello Opus attuale.

Il ritiro di un modello non arriva senza preavviso. Per i modelli pubblici, Anthropic avvisa i clienti con implementazioni attive almeno 60 giorni prima. Dopo il ritiro, le richieste a quel modello falliscono. Queste date valgono per le piattaforme gestite da Anthropic: Claude API, Claude Platform on AWS e Microsoft Foundry. Amazon Bedrock e Google Cloud fissano calendari propri, quindi chi usa quelle piattaforme deve controllarne le date.

Il margine di tempo permette di migrare senza improvvisare. Si può provare Opus 5.5 su una copia del sistema e confrontarne i risultati con Opus 5 prima di spostare il traffico reale. Anthropic stessa, a chi non sa quale modello scegliere, consiglia di partire da Opus 5.5 per la maggior parte dei carichi.

Esempio pratico: lo stesso carico mensile prezzato su Opus 5 e su Opus 5.5

Prendiamo un assistente di service desk interno che classifica le richieste e le instrada verso le code di Zoho Desk. Ipotizziamo che in un mese consumi 30 milioni di token in ingresso fuori cache e 60 milioni di token letti dalla cache. Nella cache stanno le istruzioni e il catalogo delle code, uguali per ogni richiesta. In uscita produce 4 milioni di token. I volumi sono ipotetici, i prezzi sono quelli pubblicati da Anthropic.

Voce (USD al mese)Opus 5Opus 5.5
Ingresso, 30 milioni di token150,00120,00
Lettura dalla cache, 60 milioni di token30,0012,00
Uscita, 4 milioni di token100,0080,00
Totale280,00212,00

A parità di token, il conto mensile scende da 280 a 212 dollari, circa il 24% in meno. Il risparmio supera il 20% perché la lettura dalla cache costa il 60% in meno. Se Opus 5.5, all'effort predefinito medium, consuma meno token per la stessa richiesta, il risparmio aumenta ancora.

Per semplicità l'esempio esclude le scritture in cache, che per la durata di 5 minuti costano 5 dollari per milione su Opus 5.5 e 6,25 su Opus 5. Un calcolo affidabile parte dai consumi reali, non da stime. La pagina Usage della Claude Console permette di esportare quei consumi divisi per chiave API e per modello.

Come verificare prompt, instradamenti e risultati attesi prima del passaggio a Opus 5.5

Una verifica controllata è il confronto tra le risposte di Opus 5 e quelle di Opus 5.5 sugli stessi casi reali, con un risultato atteso fissato in anticipo. Il primo passo è l'inventario. Dalla pagina Usage della Claude Console si esporta un CSV con l'utilizzo diviso per chiave API e per modello. Da quel file si ricava quali applicazioni chiamano ancora claude-opus-5.

Il secondo passo è la scelta dei casi. Servono richieste reali già chiuse, con un esito che il team ha accettato: la coda corretta, il campo giusto compilato, la risposta approvata. Su ciascun caso si controllano tre aspetti:

  • prompt: il nuovo modello segue le istruzioni, senza parametri di thinking o di tool_choice che ora restituiscono errore;
  • instradamento: la richiesta finisce nella stessa coda o nello stesso flusso previsto dal risultato atteso;
  • formato e costo: l'uscita rispetta il formato letto dal sistema a valle, e il consumo di token per caso viene registrato.

In Svennis, prima di cambiare il modello di un sistema in produzione, facciamo girare sul nuovo modello un campione di ticket già chiusi e confrontiamo caso per caso instradamento e risposta con l'esito approvato dal team. Le differenze che vediamo più spesso non riguardano la qualità del testo, ma i casi di confine che stanno tra due code.

Checklist di migrazione da Claude Opus 5 a Opus 5.5

La checklist seguente riassume i passaggi della migrazione da Opus 5 a Opus 5.5 nell'ordine in cui conviene eseguirli. Ogni riga indica cosa fare e come capire che il passaggio è riuscito.

PassaggioCosa fareCome verificarlo
1. InventarioEsportare dalla Claude Console il CSV di utilizzo per chiave API e modelloElenco completo delle applicazioni che usano claude-opus-5
2. Identificativo del modelloSostituire claude-opus-5 con claude-opus-5-5; su Amazon Bedrock usare anthropic.claude-opus-5-5Le richieste di prova ricevono risposta
3. ThinkingRimuovere il thinking disattivato e i budget_tokens manualiNessun errore 400 invalid_request_error
4. StrumentiTogliere tool_choice di tipo "any" e "tool"; sostituire computer_20251124 su Claude API e Google CloudIl modello chiama gli strumenti attesi senza forzatura
5. EffortDecidere se tenere medium o impostare esplicitamente un valore più altoQualità pari a Opus 5 sui casi di prova
6. Streaming e rifiutiImpostare la visualizzazione del thinking se si mostrano aggiornamenti; gestire stop_reason: "refusal"Gli utenti vedono i progressi e i rifiuti non passano come risposte
7. Casi realiFar girare venti casi reali già chiusi su entrambi i modelliStesso instradamento e stesso esito atteso
8. Qualità e fatturaConfrontare qualità, consumo di token e costo mensileCosto per caso inferiore, a qualità pari o migliore

Venti casi reali sono un minimo pratico per un primo controllo, non una garanzia statistica. Se il sistema gestisce molte categorie diverse, conviene includerle tutte nel campione, compresi i casi rari.

Cosa significa il passaggio a Opus 5.5 per un'azienda italiana: dollari, AI Act e watermark

Per un'azienda italiana il primo effetto del passaggio a Opus 5.5 è sul budget. Anthropic pubblica tutti i prezzi in dollari, quindi il risparmio in euro dipende anche dal cambio. Conviene confrontare i due modelli in dollari e in token, e convertire in euro solo alla fine.

Il secondo effetto riguarda l'AI Act europeo. Dal 2 agosto l'Unione europea chiede ai fornitori di AI che servono il suo mercato di marcare i contenuti generati. Opus 5.5 include le misure di watermark che Anthropic applica per rispettare l'AI Act. Il watermark è uno schema nelle scelte di parole, invisibile a chi legge ma rilevabile da chi possiede la chiave.

Il watermark di Claude non aggiunge testo, caratteri nascosti o token, quindi non incide sul costo. Non contiene inoltre informazioni che identificano una persona, un'organizzazione o una chat.

Anthropic applica il watermark in tutto il mondo, perché non ha ancora un modo affidabile per limitarlo per regione. Il rilevamento funziona male sui testi brevi e non dimostra che un testo sia stato scritto da una persona. Per i modelli lanciati prima del 2 agosto 2026 la legge prevede un periodo di transizione, e Anthropic sta aggiungendo il watermark anche a quei modelli. Se la Sua azienda ha regole interne sui testi generati, conviene aggiornarle nella policy AI su cosa possono inserire i dipendenti in Claude.

Prossimi passi per chi ha un sistema in produzione su Opus 5

Il primo passo concreto per chi usa Opus 5 in produzione è l'inventario. Esporti dalla Claude Console l'utilizzo per chiave API e modello e individui ogni applicazione che chiama claude-opus-5. Senza questo elenco non sa quanto spende oggi né quale codice deve modificare.

Per ogni applicazione individuata, i passi successivi sono questi:

  1. cercare nel codice il thinking disattivato, i budget_tokens manuali e il tool_choice forzato;
  2. preparare venti casi reali già chiusi, ciascuno con il risultato atteso;
  3. farli girare su Opus 5 e su Opus 5.5 all'effort predefinito;
  4. confrontare instradamento, formato e costo, e decidere se alzare l'effort.

Se in qualche processo Opus 5.5 non raggiunge la qualità richiesta nemmeno con un effort più alto, Anthropic indica Claude Fable 5.1 per il ragionamento impegnativo. Se il processo è semplice, può valere la pena considerare un modello più leggero, come spiega la guida Opus, Sonnet o Haiku: quale modello Claude usare. Per vedere un sistema di questo tipo al lavoro, il post sugli agenti AI in un service desk aziendale descrive un caso reale in produzione.

Fonti

  1. 1. Introducing Claude Opus 5.5 (Anthropic)
  2. 2. Newsroom (Anthropic)
  3. 3. What's new in Claude Opus 5.5 (Claude Platform Docs)
  4. 4. Claude Opus 5.5 (Claude Platform Docs)
  5. 5. Claude Opus 5 (Claude Platform Docs)
  6. 6. Pricing (Claude Platform Docs)
  7. 7. Model deprecations (Claude Platform Docs)
  8. 8. Models overview (Claude Platform Docs)
  9. 9. How Claude's text watermarking works (Anthropic)

Articoli correlati