Claude Opus 5: Anthropic rilascia il modello near-frontier a metà prezzo di Fable 5

Disponibile da oggi su Claude Max e Pro. Nuovo stato dell'arte su Frontier-Bench, ARC-AGI 3 triplicato, CursorBench entro 0.5% da Fable. Coding, knowledge work, scienze della vita.

Claude Opus 5: Anthropic rilascia il modello near-frontier a metà prezzo di Fable 5

In sintesi

Anthropic lancia Claude Opus 5 (24 luglio 2026): modello near‑frontier che avvicina Fable 5 offrendo prestazioni top a circa mezzo prezzo. • Rilasciato 24 lug 2026: Opus 5 è near‑frontier e costa ~50% di Fable 5. • Frontier‑Bench: Opus 5 ~45% performance, raddoppia Opus 4.8 e supera Fable (34%). • ARC‑AGI 3: Opus 5 ~30% vs ~8% del miglior competitor; risultato a circa $20K. • Default su Claude Max e top su Claude Pro; include demo 3D e due demo interattive.

Anthropic ha rilasciato oggi, 24 luglio 2026, Claude Opus 5. È il modello più potente della famiglia Opus e «arriva vicino all'intelligenza di frontiera di Claude Fable 5 a metà del prezzo». Opus 5 è il nuovo modello predefinito su Claude Max ed è il modello più potente disponibile su Claude Pro. Su coding e knowledge work, è il nuovo stato dell'arte assoluto.

Claude Opus 5 — Il nuovo modello near-frontier di Anthropic
Cover ufficiale di Claude Opus 5: illustrazioni vintage di uova di uccelli che formano il numero 5 — simbolo di nascita e potenziale. Fonte: anthropic.com/news/claude-opus-5

Posizionamento e pricing: near-frontier a metà costo

Opus 5 si posiziona strategicamente tra Opus 4.8 e Fable 5. Anthropic lo descrive come «thoughtful and proactive» — un modello che verifica il proprio lavoro, itera fino al successo, e costruisce tool ausiliari quando necessario. Il rapporto qualità-prezzo è il migliore nella lineup Anthropic.

ModelloRatingCosto relativoDisponibilità
Claude Fable 5100 (frontier)100%Claude Max
Claude Opus 5~95 (near-frontier)~50%Default Claude Max, Top Claude Pro
Claude Opus 4.8~85~50%Claude Max / Pro
Claude Sonnet 5~70~20%Claude Pro

Benchmark coding: Opus 5 è il nuovo stato dell'arte

Su Frontier-Bench v0.1, il benchmark più esigente per il coding agentico, Opus 5 supera ogni altro modello e raddoppia le performance di Opus 4.8 — il tutto a un costo per task inferiore. Su CursorBench 3.2, a massimo sforzo arriva entro lo 0.5% del punteggio di Fable 5, ma a metà del costo.

Frontier-Bench v0.1: Agentic coding by effort level
Frontier-Bench v0.1: performance vs costo per tentativo (scala log). Opus 5 (arancione) domina nettamente. A $15 ottiene ~45%, contro ~34% di Fable 5 a $30 e ~40% di GPT-5.6 Sol a $12. Fonte: Anthropic
BenchmarkOpus 5 (max)Fable 5Opus 4.8GPT-5.6 Sol
Frontier-Bench v0.1~45%~34%~18%~40%
CursorBench 3.2-0.5% da Fabletop
AA Coding Agent IndexNuovo SOTA

Knowledge work e ragionamento: numeri che fanno storia

Su ARC-AGI 3, il test di ragionamento astratto più difficile al mondo, Opus 5 ottiene ~30% — il triplo del miglior competitor (GPT-5.6 Sol: ~8%). È un salto che Anthropic descrive come «three times as high as the next-best model».

ARC-AGI 3: Novel problem-solving by cost
ARC-AGI 3: Opus 5 raggiunge ~30% a ~$20K, mentre GPT-5.6 Sol arriva a ~8% a ~$25K e Opus 4.8 si ferma a ~3%. Fonte: Anthropic

Risultati chiave su knowledge work:

Benchmark aggiuntivi Opus 5
Panoramica completa dei benchmark: GDPval-AA, OSWorld, HLE, AutomationBench, DeepSearchQA. Fonte: Anthropic

Scienze della vita: Opus 5 come scienziato computazionale

Opus 5 migliora su ogni valutazione di life sciences di Anthropic — biologia strutturale, chimica organica, bioinformatica:

Benchmark scienze della vita
Miglioramenti nelle scienze della vita: +10.2pp in chimica organica, +7.7pp in analisi proteica vs Opus 4.8. Fonte: Anthropic

Versione audio dell'articolo

Ascolta l'articolo in versione podcast. Voce: Isabella (edge-tts). Durata: ~3 minuti.

Claude Opus 5 — Video dimostrativo ufficiale

Anthropic ha pubblicato un video dimostrativo che mostra una delle capacità più impressionanti di Opus 5: la creazione di scene 3D interattive. Nel video, Opus 5 ha generato un modello 3D di un'auto sportiva rossa posizionata su una griglia prospettica in un ambiente virtuale. L'utente può ruotare l'auto a 360° tramite un cursore "TURN THE CAR" — un'interfaccia completa scritta dal modello in WebGL/Three.js.

Questo è uno dei due "artifacts" interattivi menzionati da Anthropic: il Wind Tunnel (visualizzazione del flusso d'aria su oggetti aerodinamici e non) e il Cell Artifact (illustrazione interattiva di una cellula). Il video mostra come Opus 5 non si limiti a generare codice, ma produca applicazioni web complete e funzionanti con rendering 3D in tempo reale.

Cosa rende Opus 5 diverso: agenzia e autonomia

Opus 5 non è solo più potente — è più agente. Anthropic riporta tre esempi chiave che mostrano un comportamento qualitativamente diverso dai modelli precedenti:

1. Ricostruzione 3D da un disegno

Su un task Frontier-Bench, a Opus 5 è stato dato un disegno di un pezzo meccanico senza alcun modo di visualizzarlo direttamente. Il modello ha scritto la propria pipeline di computer vision per estrarre la geometria dai pixel grezzi, poi ha ricostruito l'intero pezzo in FreeCAD. Nessun modello concorrente con lo stesso setup è riuscito a risolverlo in cinque tentativi. Opus 5 ci è riuscito ripetutamente.

2. Debugging root-cause, non sintomi

Dato un bug reale in un popolare package manager open-source, Opus 5 ha trovato la root cause e corretto un edge case che la patch della community aveva completamente mancato. Un modello concorrente ha sistemato solo il sintomo superficiale e ha dichiarato il bug risolto.

3. Trading feed da zero in una sessione

Un ingegnere di una trading firm ha usato Opus 5 per costruire un feed di dati di mercato per un nuovo exchange in una singola sessione. I modelli precedenti non riuscivano a completare il task nemmeno con piani dettagliati. Non trovando un feed live per validare, Opus 5 ha costruito il proprio test harness per verificare che il parsing dei dati dell'exchange fosse corretto.

Demo interattive: Wind Tunnel e Cell Artifact

Oltre al video 3D, Anthropic ha pubblicato due demo interattive create interamente da Opus 5:

Entrambe sono accessibili dalla pagina ufficiale dell'annuncio e dimostrano la capacità di Opus 5 di produrre output visuali molto più ricchi rispetto ai modelli precedenti.

Testimonianze dai partner early-access

Cursor (Scott Wu, CEO): «Su FrontierCode 1.1, Opus 5 si avvicina alle performance di Fable a metà costo. In Devin mostra particolare forza su debugging difficile e analisi root-cause.»

Lovable (Fabian Hedin, Co-Founder): «Il più grande salto nella famiglia Opus da 4.5. Sul frontend: le migliori animazioni, giochi e 3D mai visti da un Opus. Per i milioni di builder su Lovable, la consistenza è tutto.»

Hex (Izzy Miller, AI Research Lead): «Per il lavoro analitico open-ended del nostro agente, è uno strict upgrade su Opus 4.8. I guadagni sono più grandi proprio dove conta: i task più difficili e vaghi. Risposte più chiare e concise.»

Zapier (Wade Foster, CEO): «Opus 5 ha raggiunto il 100% su AutomationBench: ha preso un workbook di account health e ha eseguito una sequenza completa di churn prevention end-to-end — flagging account a rischio, alerting, summarization.»

Box (Ben Kus, CTO): «Opus 5 supera Opus 4.8 dell'8%, con guadagni notevoli in analisi dati (+11%) e due diligence (+17%) — workflow usati quotidianamente da tecnologia, healthcare e settore pubblico.»

Anthropic (Cristian Rivera, Staff SWE): «In un weekend gli ho dato un ruolo da chief-of-staff sui miei ambienti di sviluppo: ha costruito il suo monitor, gestito ogni macchina, e mi ha coinvolto solo per le decisioni strategiche.»

Hex (Shirley Zhang, Senior AI Engineer): «Per i workflow di ricerca finanziaria, Opus 5 si distingue su ragionamento numerico, lavoro con tabelle e pensiero critico dove la precisione conta.»

La valutazione di Velthub

Voto: 9.2/10

Claude Opus 5 è il miglior modello Anthropic per rapporto qualità-prezzo. Non è Fable 5 — Anthropic lo dice esplicitamente — ma per il 95% dei casi d'uso quotidiani è la scelta ottimale. I benchmark su coding (Frontier-Bench: 2× Opus 4.8, CursorBench: -0.5% da Fable a metà costo) e knowledge work (ARC-AGI 3: 3× GPT-5.6 Sol, OSWorld 2.0: supera Fable a 1/3 del costo) sono impressionanti non solo per i numeri assoluti ma per l'efficienza.

L'aspetto più interessante è l'agenzia: Opus 5 verifica il proprio lavoro, itera, e — cosa mai vista prima — costruisce tool ausiliari (pipeline di computer vision, test harness) quando l'ambiente non glieli fornisce. È un comportamento da agente autonomo, non da modello reattivo. La demo del 3D interattivo (auto rossa ruotabile generata in WebGL) ne è la prova visiva.

Punti di forza (verificati dal blog ufficiale Anthropic):

Limitazioni (dichiarate da Anthropic):

Domande frequenti

Opus 5 sostituisce Fable 5?

No. Opus 5 è un gradino sotto Fable 5 ma a metà prezzo. Anthropic lo posiziona come il modello "everyday" per coding e knowledge work. Fable 5 resta il top per i task più complessi (es. cybersecurity con Mythos 5).

Quanto costa Opus 5 rispetto a Opus 4.8?

Stesso costo di Opus 4.8, ma con performance enormemente superiori. È il miglior rapporto qualità-prezzo nella lineup Anthropic.

Opus 5 è disponibile via API?

Sì. È il modello predefinito su Claude Max e il più potente su Claude Pro. Disponibile anche via API Anthropic per sviluppatori.

Quali sono i benchmark più impressionanti?

Frontier-Bench v0.1 (2× Opus 4.8), ARC-AGI 3 (3× GPT-5.6 Sol), OSWorld 2.0 (supera Fable 5 a 1/3 del costo), Zapier AutomationBench (100% su task reale).

Il video 3D è una demo reale?

Sì. Il video mostra un'auto sportiva 3D generata interamente da Opus 5 in WebGL/Three.js, ruotabile a 360° dall'utente. Fa parte delle demo "Wind Tunnel" e "Cell Artifact" pubblicate da Anthropic.

Perché la copertina ha delle uova?

È lo stile artistico distintivo di Anthropic per la serie Opus 5: illustrazioni in stile trattati scientifici dell'Ottocento. Le uova che formano il numero 5 simboleggiano nascita e potenziale — il "dischiudersi" di una nuova generazione di modelli.

Cosa non sappiamo ancora

https://velthub.ai/blog/claude-opus-5-anthropic-nuovo-modello-frontier-coding-luglio-2026