Claude Opus 5
Il modello Opus di punta di Anthropic, uscito il 24 luglio 2026: intelligenza vicina alla frontiera a metà del prezzo di Claude Fable 5, con il ragionamento attivo per impostazione predefinita e l'intera scala di effort, da low a max.
1M tokens · Text / Vision / Code · Prompt cache
Claude Opus 5 è l'attuale modello Opus di punta di Anthropic, uscito il 24 luglio 2026 come successore di Opus 4.8. Si avvicina all'intelligenza di frontiera di Claude Fable 5 a metà prezzo e, su diverse valutazioni di coding e lavoro di conoscenza — tra cui Frontier-Bench v0.1 e GDPval-AA v2 — lo supera del tutto. Il prezzo resta quello di Opus 4.8, 5 $ in input e 25 $ in output per milione di token: è quindi una sostituzione diretta per gli agenti già in esecuzione sul livello Opus.
Vale la pena conoscere i cambiamenti di comportamento prima di passare. Il ragionamento è attivo per impostazione predefinita, mentre Opus 4.8 non ragionava se non richiesto; l'effort copre l'intera scala da low a max; e la catena di pensiero grezza non viene mai restituita. Su VM0 ha un moltiplicatore di crediti ×2, lo stesso di Opus 4.8, e fa parte del catalogo di modelli integrati per le nuove organizzazioni.
Cos'è Claude Opus 5?
Uscito il 24 luglio 2026 · Il livello di punta Opus di Anthropic: sotto Fable 5 come tetto assoluto, davanti a lui in diverse valutazioni agentiche e di lavoro di conoscenza, a metà del prezzo per token. La scelta predefinita su VM0 per il lavoro agentico impegnativo.
Anthropic ha rilasciato Claude Opus 5 il 24 luglio 2026 su API Claude, app Claude, Amazon Bedrock, Google Cloud e Microsoft Foundry; VM0 lo ha aggiunto come modello integrato il 25 luglio 2026. Succede a Opus 4.8 a parità di prezzo e ne raddoppia quasi il punteggio su Frontier-Bench v0.1: è questa la promessa centrale, molta più capacità allo stesso costo per token.
È posizionato come il cavallo di battaglia per il coding agentico e il lavoro di conoscenza aziendale — funzionalità che toccano più file, refactoring importanti, lunghe esecuzioni autonome e deliverable end-to-end — piuttosto che come il tetto assoluto di capacità. Fable 5 resta in testa sul set più difficile SWE-bench Pro e sull'ampiezza fattuale; Opus 5 vince sul costo per attività completata, il numero che compare in fattura quando il traffico agentico cresce.
Rispetto a Opus 4.8 cambiano due comportamenti dell'API. Il ragionamento è attivo per impostazione predefinita, quindi una richiesta che non configura nulla ora ragiona prima di rispondere, e disattivarlo è possibile solo con effort high o inferiore. Il prompt minimo memorizzabile in cache scende inoltre a 512 token, così i prompt di sistema brevi che prima non erano memorizzabili ora lo sono. Opus 5 arriva anche con tutele rafforzate sulla cybersicurezza: le richieste in ambiti vietati o ad alto rischio possono tornare come rifiuto.
Cosa rende notevole Claude Opus 5
Caratteristiche principali di architettura e capacità.
Opus 5 ha una finestra di contesto da 1 milione di token — il massimo coincide con il valore predefinito — e fino a 128K token di output, con conoscenza aggiornata a maggio 2026. Il ragionamento è attivo per impostazione predefinita e la profondità si imposta con i livelli di effort low, medium, high, xhigh e max; la catena di pensiero grezza non viene mai esposta, solo un riepilogo leggibile. Il prefill del messaggio dell'assistente non è supportato e i parametri di campionamento (temperature, top_p, top_k) vengono rifiutati: il comportamento si guida dal prompt. Gli input comprendono testo, visione ad alta risoluzione e codice.
Specifiche in breve
Benchmark di Claude Opus 5
Punteggi dichiarati dal fornitore, tratti dai materiali di lancio di Anthropic. Gli osservatori indipendenti riportano cifre diverse per gli stessi benchmark a seconda del dataset, del livello di effort e dello scaffold dell'agente: consideratele quindi dipendenti dalla configurazione.
Prezzi di Claude Opus 5
Prezzo di listino del provider, per 1M di token.
Come si comporta Claude Opus 5 nella pratica
Comportamento osservato dalle esecuzioni di agenti in produzione.
Costo per attività completata
Il motivo più chiaro per scegliere Opus 5 al posto di Fable 5: risultati comparabili sul lavoro agentico a circa metà del prezzo per token. Su AutomationBench di Zapier il tasso di successo è circa 1,5 volte quello del miglior modello successivo a parità di costo per attività e, anche al livello di effort più basso, completa più attività di qualsiasi altro modello.
Ragionamento attivo per impostazione predefinita
A differenza di Opus 4.8, una richiesta che omette il parametro di ragionamento riflette prima di rispondere. Tenetene conto: max_tokens limita insieme ragionamento e risposta, quindi un limite tarato su carichi senza ragionamento può troncare l'output. Disattivare il ragionamento è possibile solo con effort high o inferiore.
L'effort è la leva principale sui costi
low e medium sono insolitamente validi su questo modello e spesso eguagliano ciò che i modelli di punta precedenti producevano alle impostazioni massime. Partite da high — xhigh per le esecuzioni di coding e agentiche più difficili — poi scendete e mantenete il livello più economico che le vostre valutazioni continuano ad accettare.
Verifica il proprio lavoro
Opus 5 controlla il proprio output senza che glielo si chieda, quindi le istruzioni di verifica ereditate da modelli più vecchi tendono a produrre passaggi ridondanti. Scrive anche risposte più lunghe per impostazione predefinita: una breve istruzione di concisione funziona meglio che abbassare l'effort.
I migliori task per agenti con Claude Opus 5
La funzionalità multi-file che si chiude in una sola esecuzione
Dategli la specifica completa fin dall'inizio e lasciatelo lavorare. I guadagni di Opus 5 rispetto a Opus 4.8 sono massimi sul lavoro di ingegneria difficile e a più passaggi — refactoring ampi, funzionalità end-to-end — e minimi sulle modifiche in un solo turno: puntatelo quindi sulla parte alta della vostra scala di difficoltà.
L'agente notturno che potete permettervi di lasciare acceso
È nelle lunghe esecuzioni autonome che la differenza di prezzo si accumula. Con qualità vicina a Fable e metà del costo per token, un agente notturno di triage, migrazione o ricerca costa circa la metà per attività completata.
Il flusso di lavoro che deve concludersi, non solo rispondere
Attività a più passaggi con strumenti e uno stato finale reale: aprire ticket, aggiornare fogli di calcolo, riconciliare record. I risultati AutomationBench e OSWorld di Anthropic indicano la stessa cosa: porta a termine attività end-to-end che altri modelli abbandonano a metà.
Quando evitare Claude Opus 5
Evitate Opus 5 per lavori ad alto volume, sensibili alla latenza o semplici: Sonnet 5 copre i loop di agente di routine a metà del moltiplicatore e GPT 5.6 Luna costa ancora meno. Preferite Fable 5 quando un'attività si trova al tetto della vostra scala di difficoltà o si appoggia a coding difficile in stile SWE-bench Pro e a un'ampia memoria fattuale. La ricerca sulla sicurezza e altri ambiti ad alto rischio possono attivare le tutele di Opus 5 e restituire un rifiuto.
Claude Opus 5 vs altri modelli
Claude Opus 5 vs Claude Fable 5
Fable 5 è il tetto più alto; Opus 5 è l'affare migliore. Opus 5 guida su Frontier-Bench (43,3% contro 33,7%), GDPval-AA v2 e SWE-bench Verified, mentre Fable 5 mantiene SWE-bench Pro e l'ampiezza fattuale. Opus 5 costa la metà (5 $/25 $ contro 10 $/50 $) e ha un moltiplicatore VM0 di ×2 contro il ×4 di Fable 5: mandate i passaggi più difficili a Fable 5 e tutto il resto qui.
Claude Opus 5 vs Claude Opus 4.8
Stesso prezzo, stesso livello, capacità decisamente superiore: Opus 5 quasi raddoppia il punteggio Frontier-Bench di Opus 4.8 e aggiunge sette punti su SWE-bench Verified. La migrazione è il cambio dell'ID modello più la ritaratura dei prompt: ora il ragionamento è attivo per impostazione predefinita, quindi ricontrollate max_tokens ed eliminate le istruzioni tipo «verifica il tuo lavoro», che oggi generano solo passaggi ridondanti.
Claude Opus 5 vs Claude Sonnet 5
Sonnet 5 (×1) è la scelta economica predefinita per i loop di agente di routine; a Opus 5 (×2) si promuove un'attività quando smette di concludersi in modo affidabile. Lo schema più diffuso è Opus 5 che orchestra e Sonnet 5 che esegue il lavoro in parallelo.
Claude Opus 5 vs GPT 5.6 Sol
Entrambi sono modelli agentici di primo livello. Opus 5 supera Sol su Frontier-Bench (43,3% contro 34,4%); Sol guida su DeepSWE v1.1 (72,7% contro 68,8%). Su VM0 è una decisione di routing, non di acquisto: fate girare lo stesso agente su entrambi e confrontate.
In sintesi: dovresti usare Claude Opus 5?
Il modello di punta predefinito su VM0. Opus 5 si avvicina abbastanza al tetto di Fable 5 da rendere il prezzo il fattore decisivo per la maggior parte del lavoro agentico, e sostituisce senza attriti tutto ciò che gira già su Opus 4.8. Tenete Sonnet 5 per i loop di routine e riservate Fable 5 alle poche attività che richiedono davvero la parte alta della scala.
Domande frequenti
Quando è uscito Claude Opus 5?
Anthropic ha rilasciato Opus 5 il 24 luglio 2026 su API Claude e app Claude, oltre che su Amazon Bedrock, Google Cloud e Microsoft Foundry. VM0 lo ha aggiunto come modello integrato il 25 luglio 2026 (ID modello claude-opus-5).
Quanto costa Claude Opus 5?
5 $ per milione di token in input e 25 $ per milione in output — invariato rispetto a Opus 4.8 ed esattamente la metà dei 10 $/50 $ di Claude Fable 5. Le letture dalla cache costano 0,50 $ per milione. Su VM0 ha un moltiplicatore di crediti ×2.
Claude Opus 5 è migliore di Claude Fable 5?
Su diverse valutazioni sì: Opus 5 supera Fable 5 su Frontier-Bench v0.1, GDPval-AA v2 e SWE-bench Verified. Fable 5 resta in testa sul set più difficile SWE-bench Pro e sull'ampiezza fattuale, e rimane il tetto più alto per il ragionamento più arduo. Per la maggior parte del lavoro agentico, Opus 5 vince sul costo per attività completata.
Il ragionamento è attivo per impostazione predefinita su Claude Opus 5?
Sì. Una richiesta che omette il parametro di ragionamento riflette prima di rispondere: è un cambiamento rispetto a Opus 4.8, dove il ragionamento era disattivato salvo richiesta esplicita. La profondità si controlla con l'effort (low fino a max) e la disattivazione è possibile solo con effort high o inferiore. La catena di pensiero grezza non viene mai restituita, solo un riepilogo leggibile.
Cosa cambia migrando da Opus 4.8?
L'ID del modello e poi la taratura dei prompt. Con il ragionamento attivo per impostazione predefinita, max_tokens copre ora sia il ragionamento sia la risposta; le istruzioni di verifica vanno rimosse anziché riscritte, perché Opus 5 si verifica da solo; e le risposte risultano più lunghe per impostazione predefinita, quindi aggiungete un'istruzione esplicita di concisione se la lunghezza conta.
Alternative
Usare Claude Opus 5 su VM0
Due modi per accedere a Claude Opus 5 su VM0
VM0 supporta Claude Opus 5 come modello Built-in fatturato in crediti VM0 e tramite bring-your-own con una Anthropic API key. Il percorso Built-in usa il routing VM0 Managed e il moltiplicatore di crediti spiegato di seguito; il percorso bring-your-own ti fattura direttamente con il fornitore upstream e salta del tutto la conversione in crediti VM0.
La raccomandazione di VM0
VM0 posiziona Claude Opus 5 come modello agente core, consigliato insieme a Claude Opus 4.7, Claude Opus 4.6 e Claude Sonnet 4.6 per i passi che determinano il risultato effettivo di un'esecuzione di un agente. Sono i modelli che sceglieremmo per il ruolo di orchestratore, per gli agenti che toccano il codice e per qualsiasi passo in cui una risposta sbagliata è costosa.
Crediti e il moltiplicatore ×2
Ogni modello Built-in su VM0 è prezzato come un multiplo di Claude Sonnet 4.6, che si colloca alla baseline di crediti ×1. Claude Opus 5 viene fatturato a ×2 crediti. Il moltiplicatore è ciò che compare sulla tua fattura VM0; il prezzo di listino del fornitore nella tabella prezzi sopra è ciò che il provider upstream addebita prima che VM0 lo converta in crediti.
Claude Opus 5 viene fatturato a ×2, il che significa che un passo qui costa 2× i crediti di un passo equivalente su Sonnet 4.6 (la baseline ×1). È un tier premium su VM0, quindi il pattern conveniente è quello di usare come predefinito un modello più economico e indirizzare a Claude Opus 5 solo i passi che hanno davvero bisogno della profondità di ragionamento aggiuntiva.
Disponibile su VM0 dal July 25, 2026.