Svennis AI
10 min di lettura

Claude Sonnet 5 come modello di tutti i giorni nei sistemi aziendali

Claude Sonnet 5 costa la metà di Opus 5.5 per token ed è il punto di partenza per il lavoro ripetitivo. Come impostarlo, quando cambiare modello e dove vanno i dati.

Forme geometriche ripetute che scorrono in un flusso regolare, con un modulo più ampio che si stacca dal gruppo

Claude Sonnet 5 come modello di tutti i giorni: la risposta breve

Claude Sonnet 5 come modello di tutti i giorni è la scelta più sensata per gran parte del lavoro ripetitivo di un sistema aziendale. Rientrano qui la classificazione dei ticket, i riassunti di note, le bozze di risposta e l'estrazione di dati. Costa la metà di Claude Opus 5.5 per token. Anthropic lo presenta come la migliore combinazione di velocità e intelligenza.

Un modello predefinito è il modello che un'integrazione, un agente o un utente chiama quando nessuno ne sceglie esplicitamente un altro. La scelta conta perché la maggior parte delle chiamate passa da quel modello. Ogni differenza di prezzo o di qualità si moltiplica quindi per ogni richiesta.

Questo post fa parte di una serie di tre sui modelli Claude attuali. Claude Fable 5.1 è il modello per il ragionamento più impegnativo e per il lavoro agentico di lungo periodo. La guida su quando serve Claude Fable 5.1 ne descrive i casi d'uso. Claude Opus 5.5 è il gradino intermedio, pensato per il lavoro agentico lungo.

Claude Sonnet 5 è il modello quotidiano. Questa guida spiega come impostarlo, quando lasciarlo per un modello più potente e cosa cambia per chi ha già un'integrazione.

Claude Sonnet 5 in sintesi: rilascio, prezzi, contesto e piani

Claude Sonnet 5 è uscito il 30 giugno 2026 ed è la nuova generazione della famiglia Sonnet di Anthropic. Gli sviluppatori lo richiamano con l'ID API claude-sonnet-5. Le pagine di Anthropic riportano questi dati essenziali:

  • Prezzo: 2 dollari per milione di token in input e 10 dollari per milione in output.
  • Batch API: sconto del 50% su input e output per le richieste elaborate in modo asincrono.
  • Cache: una lettura dalla cache costa 0,20 dollari per milione di token.
  • Contesto: 1 milione di token, che è sia il valore predefinito sia il massimo.
  • Output massimo: 128.000 token per risposta.
  • Piani Claude: modello predefinito su Free e Pro, disponibile su Max, Team ed Enterprise.
  • Ritiro: non prima del 30 giugno 2027.

Un token è un frammento di testo: in inglese vale circa 4 caratteri, o tre quarti di parola. Il prezzo di 2 e 10 dollari era nato come introduttivo. Il 10 agosto 2026 Anthropic lo ha reso permanente. Il listino di 3 e 15 dollari previsto dal 1° settembre non si applica più. Tutti i prezzi sono in dollari USA.

Sonnet 5 accetta testo e immagini e restituisce testo. La sua conoscenza affidabile arriva a gennaio 2026. Il modello è disponibile sulla Claude API, su Amazon Bedrock, Google Cloud, Microsoft Foundry e Claude Platform on AWS.

Perché Sonnet 5 è il punto di partenza per il lavoro quotidiano

Sonnet 5 è il punto di partenza giusto perché unisce un prezzo basso a una qualità che Anthropic avvicina a quella dei suoi modelli Opus. Secondo l'annuncio, le sue prestazioni sono vicine a quelle di un recente modello Opus, a prezzi più bassi. I progressi maggiori rispetto al Sonnet precedente riguardano la programmazione e i compiti agentici. Nei compiti agentici il modello usa strumenti e compie più passaggi da solo.

Per un sistema aziendale contano tre elementi. Anthropic riporta meno allucinazioni, cioè risposte inventate presentate come fatti, rispetto al Sonnet precedente. Riporta anche meno compiacenza, la tendenza a dare ragione all'utente. Infine, il modello è uscito con le protezioni cyber attive per impostazione predefinita. Queste protezioni rilevano e bloccano in tempo reale gli usi informatici pericolosi.

Anthropic dichiara anche un limite. Nel suo audit comportamentale automatico, Sonnet 5 ha mostrato tassi un po' più alti di comportamento non allineato rispetto ai modelli più capaci presi a confronto. La panoramica dei modelli, inoltre, suggerisce a chi non sa quale scegliere di partire da Claude Opus 5.5.

Noi di Svennis, quando configuriamo Claude nei processi di un cliente, usiamo Sonnet 5 come modello predefinito sui compiti ben definiti e ad alto volume. Passiamo a Opus 5.5 solo sul singolo passaggio che non supera i test su casi reali, non sull'intero flusso.

Haiku 4.5, Sonnet 5, Opus 5.5 e Fable 5.1 a confronto: prezzo, contesto e uso

La scelta del modello dipende da tre dimensioni: prezzo per token, dimensione del contesto e profondità di ragionamento predefinita. La tabella confronta quattro modelli Claude attuali con i dati delle pagine di prezzo e della panoramica dei modelli di Anthropic.

ModelloInput / output (USD per milione di token)ContestoEffort predefinitoUso indicato da Anthropic
Claude Haiku 4.51 / 5200.000 tokenNon supportatoIl modello più veloce, con intelligenza vicina alla frontiera
Claude Sonnet 52 / 101 milione di tokenhighLa migliore combinazione di velocità e intelligenza
Claude Opus 5.54 / 201 milione di tokenmediumLavoro agentico lungo di programmazione e knowledge work
Claude Fable 5.110 / 501 milione di tokenhighRagionamento impegnativo e lavoro agentico di lungo periodo

L'effort è il parametro che regola quanto a fondo il modello ragiona prima di rispondere. Il contesto è la quantità di testo che il modello considera in una sola richiesta. Per il lavoro quotidiano, Sonnet 5 offre lo stesso contesto di Opus 5.5 e Fable 5.1 a una frazione del prezzo. Haiku 4.5 costa ancora meno, ma ha un contesto più piccolo e non regola l'effort. Conviene quindi soprattutto per compiti brevi e molto semplici.

Quando passare a Opus 5.5: i segnali che un compito supera Sonnet 5

Un compito ha bisogno di Claude Opus 5.5 quando Sonnet 5 non supera i test su casi reali, anche con l'effort al livello predefinito high. Il prezzo da solo non decide: Opus 5.5 costa il doppio per token, 4 e 20 dollari per milione. Anthropic lo indica per il lavoro agentico lungo, di programmazione e di knowledge work.

I segnali tipici che un compito supera Sonnet 5 sono questi:

  • Il compito richiede molti passaggi autonomi in sequenza, e l'errore di un passaggio si propaga ai successivi.
  • Le risposte di Sonnet 5 sugli stessi esempi di prova restano incoerenti da una chiamata all'altra.
  • Il compito chiede di ragionare tra molti documenti lunghi, non solo di riassumerli.
  • Un errore costa più della differenza di prezzo, come in un'offerta commerciale o in una risposta contrattuale.

Secondo Anthropic, Opus 5.5 lavora al livello di Claude Fable 5.1 sulla maggior parte dei compiti. Costa inoltre il 40% in meno di Claude Opus 5. Il suo effort predefinito è medium, non high. Claude Fable 5.1, a 10 e 50 dollari, serve quando anche Opus 5.5 con effort più alto non supera i test.

I token di ragionamento si pagano come token di output, anche quando il testo del ragionamento non viene restituito. Alzare l'effort su qualsiasi modello aumenta quindi il consumo di token e il costo.

Sonnet 5 resta il modello predefinito, Opus 5.5 serve quando i passaggi autonomi si concatenano. Claude Sonnet 5 / Claude Opus 5.5. Uso indicato da Anthropic: Migliore combinazione di velocità e intelligenza / Lavoro agentico lungo, programmazione e

Esempio pratico: Sonnet 5 per smistare ticket di Zoho Desk e riassumere Zoho CRM

Un esempio tipico di lavoro quotidiano per Sonnet 5 è lo smistamento dei ticket di Zoho Desk, con un riassunto serale delle note di Zoho CRM. Le impostazioni seguenti vengono dalla documentazione di Anthropic su Sonnet 5 e sui prezzi.

  1. Modello: ogni chiamata usa claude-sonnet-5, impostato come valore predefinito nella configurazione dell'integrazione.
  2. Istruzioni in cache: il prompt caching riutilizza le parti già elaborate di un prompt tra una chiamata e l'altra. Istruzioni fisse, categorie ed esempi restano uguali. Letti dalla cache costano 0,20 dollari per milione di token, il 10% del prezzo di input.
  3. Ragionamento spento per lo smistamento: assegnare una categoria a un ticket non richiede un ragionamento lungo. La richiesta passa thinking: {type: "disabled"} e non paga token di ragionamento come output.
  4. Riassunto serale in batch: le note della giornata partono con la Batch API, che dimezza il prezzo a 1 dollaro in input e 5 in output per milione di token.
  5. Gestione dei rifiuti: un rifiuto del modello arriva come HTTP 200 con stop_reason: "refusal", non come errore. Il codice deve controllare questo campo, altrimenti il rifiuto finisce nel ticket come se fosse una risposta.
  6. Limite di output: max_tokens copre insieme ragionamento e testo della risposta, quindi va dimensionato su entrambi.

Per collegare Claude ai dati del CRM, la guida su come collegare Claude a Zoho CRM con MCP descrive permessi e controlli. Se i ticket nascono da una chat interna, lo schema è quello del post su Claude in Slack per il supporto interno.

Su Sonnet 5 la lettura dalla cache costa 0,20 dollari per milione di token, l'input standard 2: Input standard Sonnet 5 2 USD per milione di token, Lettura dalla cache 0,20 USD per milione di token, Scrittura in cache per 5 minuti 2,50 USD per milion
Fonte: platform.claude.com

Aggiornare un'integrazione dal Sonnet precedente: tre modifiche di comportamento

Per chi usa il Sonnet della generazione precedente, Sonnet 5 è un aggiornamento diretto: si cambia l'ID del modello, ma tre comportamenti cambiano. Anthropic li elenca nella pagina sulle novità di Sonnet 5:

  1. Adaptive thinking attivo per impostazione predefinita. L'adaptive thinking è la modalità in cui il modello decide da solo quanto ragionare, guidato dall'effort. Le richieste senza campo thinking ora girano con questo ragionamento. Per spegnerlo si passa thinking: {type: "disabled"}.
  2. Extended thinking manuale rimosso. Una richiesta con thinking: {type: "enabled", budget_tokens: N} restituisce un errore 400. Questa modalità era già deprecata sul Sonnet precedente.
  3. Parametri di campionamento bloccati. Impostare temperature, top_p o top_k su valori diversi dal predefinito restituisce un errore 400.

Con Sonnet 5 cambia anche il conteggio dei token. Il modello usa un nuovo tokenizer, cioè il componente che divide il testo in token. Lo stesso testo produce circa il 30% di token in più. Il prezzo per token scende da 3 e 15 a 2 e 10 dollari, ma il costo di una richiesta equivalente non cala nella stessa proporzione.

Prima del passaggio conviene verificare altri tre punti. Priority Tier non è disponibile su Sonnet 5. Il testo del ragionamento non viene restituito per impostazione predefinita, perché thinking.display vale "omitted". Il precompilamento del messaggio dell'assistente restituisce ancora un errore 400. La guida di migrazione a Sonnet 5 di Anthropic riporta i dettagli tecnici.

Chi usa ancora un Sonnet di due generazioni fa: cosa fare prima del 29 settembre 2026

Un'azienda che usa ancora il modello Sonnet di due generazioni fa deve pianificare ora il passaggio a Sonnet 5. Anthropic ne indica il ritiro non prima del 29 settembre 2026. Dopo il ritiro, le richieste a quel modello falliscono. Per i modelli pubblici, Anthropic avvisa i clienti con implementazioni attive almeno 60 giorni prima.

Queste date valgono per le piattaforme gestite da Anthropic: Claude API, Claude Platform on AWS e Microsoft Foundry. Amazon Bedrock e Google Cloud fissano calendari propri, quindi stato e date possono differire.

Il passaggio dal vecchio Sonnet a Sonnet 5 si organizza in quattro mosse:

  1. Scarichi dalla pagina Usage della Claude Console il CSV di utilizzo, suddiviso per chiave API e modello.
  2. Individui ogni integrazione, automazione o script che chiama ancora il vecchio modello.
  3. Controlli che il codice non usi extended thinking manuale né parametri di campionamento non predefiniti, che su Sonnet 5 restituiscono errore 400.
  4. Provi Sonnet 5 su casi reali e verifichi il costo con il nuovo tokenizer prima di cambiare in produzione.

Il passaggio porta anche un vantaggio sulla gestione dei dati. Il parametro inference_geo fissa dove gira l'elaborazione. Sui modelli di quella generazione restituisce un errore 400, mentre Sonnet 5 lo supporta.

Dove vanno i dati con Sonnet 5: API di Anthropic, Amazon Bedrock e altre piattaforme cloud

Con l'API diretta di Anthropic i dati restano memorizzati negli Stati Uniti, e Anthropic non offre una residenza dei dati in UE o nel Regno Unito. La residenza dei dati indica dove i dati vengono conservati ed elaborati. Sulla Claude Platform la governano due impostazioni indipendenti:

  • Workspace geo: decide dove i dati sono conservati a riposo. Oggi l'unico valore disponibile è "us", e non si cambia dopo la creazione del workspace.
  • Inference geo: decide dove gira l'elaborazione, richiesta per richiesta. Il valore predefinito "global" ammette qualsiasi area geografica, mentre "us" costa 1,1 volte la tariffa standard.

Per tenere l'elaborazione in Europa, un'azienda deve passare da Amazon Bedrock, Google Cloud o Microsoft Foundry. Bedrock offre tre modalità di instradamento, riassunte qui per Sonnet 5:

Modalità BedrockDove gira la richiestaSonnet 5 per un'azienda europea
In-RegionSolo nella regione AWS sceltaIn UE solo nella regione Irlanda
Geo, profilo EUIn una regione dell'area EU; prompt e output non escono dall'areaIl resto dell'UE
GlobalIn qualsiasi regione commerciale supportata nel mondoDisponibile, ma i dati possono lasciare l'UE

Nessun modello Claude gira In-Region nella regione AWS di Londra. L'instradamento tra regioni su Bedrock non ha sovrapprezzo e si paga alla tariffa della regione di origine. Google Cloud e Microsoft Foundry applicano prezzi regionali propri. Su Foundry, il moltiplicatore di 1,1 vale per le implementazioni Azure di tipo US Data Zone Standard. Le opzioni europee di queste due piattaforme per Sonnet 5 vanno verificate nella loro documentazione.

Cosa significa Sonnet 5 per un'azienda italiana: piattaforma, valuta e piani

Per un'azienda italiana la prima decisione su Sonnet 5 riguarda la piattaforma, perché è la piattaforma a stabilire dove vanno i dati. Se i contratti con i clienti o la policy interna chiedono che i dati restino nell'UE, l'API diretta di Anthropic non basta. La strada è allora Bedrock in Irlanda o con il profilo EU. In alternativa si valuta una delle altre due piattaforme cloud, dopo averne verificato le regioni.

Altri tre aspetti pratici riguardano le aziende italiane:

  • I prezzi di Anthropic sono in dollari USA, quindi il budget in euro varia con il cambio.
  • Sonnet 5 supporta la zero data retention per le organizzazioni che hanno un accordo ZDR con Anthropic.
  • Sonnet 5 è il modello predefinito solo su Free e Pro; su Team ed Enterprise è disponibile, e l'amministratore verifica quale modello usa il team.

Molte aziende italiane lavorano già in Microsoft 365. In quel caso il post su Claude in Microsoft 365 e Teams spiega come il connettore si inserisce negli strumenti esistenti.

Prossimi passi per impostare Sonnet 5 come modello predefinito

Il modo più sicuro per adottare Sonnet 5 come modello predefinito è procedere per flussi, uno alla volta, con test su casi reali. La sequenza pratica è questa:

  1. Esporti il CSV di utilizzo dalla Claude Console e annoti quali modelli usa ogni chiave API.
  2. Decida la piattaforma in base a dove devono restare i dati: API di Anthropic, Bedrock con Irlanda o profilo EU, Google Cloud o Microsoft Foundry.
  3. Imposti claude-sonnet-5 come valore predefinito nelle integrazioni. In Claude Code usi il comando /model, oppure la variabile ANTHROPIC_MODEL per tutte le sessioni future, e controlli il risultato con /status.
  4. Rimuova extended thinking manuale e parametri di campionamento non predefiniti, poi misuri i token con il nuovo tokenizer.
  5. Passi a Opus 5.5 solo sui passaggi che non superano i test, e a Fable 5.1 solo se anche Opus 5.5 non basta.

Se il Suo team usa Claude anche sul desktop per il lavoro d'ufficio, il passo successivo è la guida su come usare Claude Cowork in azienda, che parte dai processi che già funzionano.

Fonti

  1. 1. Anthropic, Introducing Claude Sonnet 5
  2. 2. Anthropic, Newsroom
  3. 3. Claude Platform Docs, Claude Sonnet 5
  4. 4. Claude Platform Docs, What's new in Claude Sonnet 5
  5. 5. Claude Platform Docs, Migrating to Claude Sonnet 5
  6. 6. Claude Platform Docs, Models overview
  7. 7. Claude Platform Docs, Pricing
  8. 8. Claude Platform Docs, Model deprecations
  9. 9. Claude Platform Docs, Data residency
  10. 10. Amazon Bedrock, Regional availability by models
  11. 11. Claude Help Center, Claude Code model configuration

Articoli correlati