Claude Opus 5: Anthropic rilascia il modello near-frontier a metà prezzo di Fable 5
Disponibile da oggi su Claude Max e Pro. Nuovo stato dell'arte su Frontier-Bench, ARC-AGI 3 triplicato, CursorBench entro 0.5% da Fable. Coding, knowledge work, scienze della vita.
In sintesi
Anthropic lancia Claude Opus 5 (24 luglio 2026): modello near‑frontier che avvicina Fable 5 offrendo prestazioni top a circa mezzo prezzo. • Rilasciato 24 lug 2026: Opus 5 è near‑frontier e costa ~50% di Fable 5. • Frontier‑Bench: Opus 5 ~45% performance, raddoppia Opus 4.8 e supera Fable (34%). • ARC‑AGI 3: Opus 5 ~30% vs ~8% del miglior competitor; risultato a circa $20K. • Default su Claude Max e top su Claude Pro; include demo 3D e due demo interattive.
Anthropic ha rilasciato oggi, 24 luglio 2026, Claude Opus 5. È il modello più potente della famiglia Opus e «arriva vicino all'intelligenza di frontiera di Claude Fable 5 a metà del prezzo». Opus 5 è il nuovo modello predefinito su Claude Max ed è il modello più potente disponibile su Claude Pro. Su coding e knowledge work, è il nuovo stato dell'arte assoluto.
Posizionamento e pricing: near-frontier a metà costo
Opus 5 si posiziona strategicamente tra Opus 4.8 e Fable 5. Anthropic lo descrive come «thoughtful and proactive» — un modello che verifica il proprio lavoro, itera fino al successo, e costruisce tool ausiliari quando necessario. Il rapporto qualità-prezzo è il migliore nella lineup Anthropic.
| Modello | Rating | Costo relativo | Disponibilità |
|---|---|---|---|
| Claude Fable 5 | 100 (frontier) | 100% | Claude Max |
| Claude Opus 5 | ~95 (near-frontier) | ~50% | Default Claude Max, Top Claude Pro |
| Claude Opus 4.8 | ~85 | ~50% | Claude Max / Pro |
| Claude Sonnet 5 | ~70 | ~20% | Claude Pro |
Benchmark coding: Opus 5 è il nuovo stato dell'arte
Su Frontier-Bench v0.1, il benchmark più esigente per il coding agentico, Opus 5 supera ogni altro modello e raddoppia le performance di Opus 4.8 — il tutto a un costo per task inferiore. Su CursorBench 3.2, a massimo sforzo arriva entro lo 0.5% del punteggio di Fable 5, ma a metà del costo.
| Benchmark | Opus 5 (max) | Fable 5 | Opus 4.8 | GPT-5.6 Sol |
|---|---|---|---|---|
| Frontier-Bench v0.1 | ~45% | ~34% | ~18% | ~40% |
| CursorBench 3.2 | -0.5% da Fable | top | — | — |
| AA Coding Agent Index | Nuovo SOTA | — | — | — |
Knowledge work e ragionamento: numeri che fanno storia
Su ARC-AGI 3, il test di ragionamento astratto più difficile al mondo, Opus 5 ottiene ~30% — il triplo del miglior competitor (GPT-5.6 Sol: ~8%). È un salto che Anthropic descrive come «three times as high as the next-best model».
Risultati chiave su knowledge work:
- Zapier AutomationBench: pass rate ~1.5× il miglior competitor allo stesso costo. Anche al minimo sforzo, Opus 5 completa più task di qualsiasi altro modello. Ha raggiunto il 100% su un task reale di churn prevention.
- GDPval-AA v2: nuovo stato dell'arte.
- OSWorld 2.0 (computer use): supera Fable 5 a un terzo del costo. A qualsiasi livello di costo, Opus 5 batte ogni altro modello.
- DeepSearchQA: nuovo stato dell'arte.
- HLE (Humanity's Last Exam): nuovo stato dell'arte.
Scienze della vita: Opus 5 come scienziato computazionale
Opus 5 migliora su ogni valutazione di life sciences di Anthropic — biologia strutturale, chimica organica, bioinformatica:
- Chimica organica: +10.2 punti percentuali nell'inferenza di strutture molecolari da dati spettroscopici
- Proteine: +7.7 punti percentuali nella predizione dell'effetto delle variazioni di sequenza sulla funzione
- Biologia strutturale e bioinformatica: miglioramenti su tutti i benchmark interni
Versione audio dell'articolo
Ascolta l'articolo in versione podcast. Voce: Isabella (edge-tts). Durata: ~3 minuti.
Claude Opus 5 — Video dimostrativo ufficiale
Anthropic ha pubblicato un video dimostrativo che mostra una delle capacità più impressionanti di Opus 5: la creazione di scene 3D interattive. Nel video, Opus 5 ha generato un modello 3D di un'auto sportiva rossa posizionata su una griglia prospettica in un ambiente virtuale. L'utente può ruotare l'auto a 360° tramite un cursore "TURN THE CAR" — un'interfaccia completa scritta dal modello in WebGL/Three.js.
Questo è uno dei due "artifacts" interattivi menzionati da Anthropic: il Wind Tunnel (visualizzazione del flusso d'aria su oggetti aerodinamici e non) e il Cell Artifact (illustrazione interattiva di una cellula). Il video mostra come Opus 5 non si limiti a generare codice, ma produca applicazioni web complete e funzionanti con rendering 3D in tempo reale.
Cosa rende Opus 5 diverso: agenzia e autonomia
Opus 5 non è solo più potente — è più agente. Anthropic riporta tre esempi chiave che mostrano un comportamento qualitativamente diverso dai modelli precedenti:
1. Ricostruzione 3D da un disegno
Su un task Frontier-Bench, a Opus 5 è stato dato un disegno di un pezzo meccanico senza alcun modo di visualizzarlo direttamente. Il modello ha scritto la propria pipeline di computer vision per estrarre la geometria dai pixel grezzi, poi ha ricostruito l'intero pezzo in FreeCAD. Nessun modello concorrente con lo stesso setup è riuscito a risolverlo in cinque tentativi. Opus 5 ci è riuscito ripetutamente.
2. Debugging root-cause, non sintomi
Dato un bug reale in un popolare package manager open-source, Opus 5 ha trovato la root cause e corretto un edge case che la patch della community aveva completamente mancato. Un modello concorrente ha sistemato solo il sintomo superficiale e ha dichiarato il bug risolto.
3. Trading feed da zero in una sessione
Un ingegnere di una trading firm ha usato Opus 5 per costruire un feed di dati di mercato per un nuovo exchange in una singola sessione. I modelli precedenti non riuscivano a completare il task nemmeno con piani dettagliati. Non trovando un feed live per validare, Opus 5 ha costruito il proprio test harness per verificare che il parsing dei dati dell'exchange fosse corretto.
Demo interattive: Wind Tunnel e Cell Artifact
Oltre al video 3D, Anthropic ha pubblicato due demo interattive create interamente da Opus 5:
- Wind Tunnel: visualizzazione del flusso d'aria su oggetti aerodinamici (e non). L'utente può caricare forme e vedere come l'aria fluisce intorno.
- Cell Artifact: illustrazione interattiva semplificata di una cellula, con elementi esplorabili.
Entrambe sono accessibili dalla pagina ufficiale dell'annuncio e dimostrano la capacità di Opus 5 di produrre output visuali molto più ricchi rispetto ai modelli precedenti.
Testimonianze dai partner early-access
Cursor (Scott Wu, CEO): «Su FrontierCode 1.1, Opus 5 si avvicina alle performance di Fable a metà costo. In Devin mostra particolare forza su debugging difficile e analisi root-cause.»
Lovable (Fabian Hedin, Co-Founder): «Il più grande salto nella famiglia Opus da 4.5. Sul frontend: le migliori animazioni, giochi e 3D mai visti da un Opus. Per i milioni di builder su Lovable, la consistenza è tutto.»
Hex (Izzy Miller, AI Research Lead): «Per il lavoro analitico open-ended del nostro agente, è uno strict upgrade su Opus 4.8. I guadagni sono più grandi proprio dove conta: i task più difficili e vaghi. Risposte più chiare e concise.»
Zapier (Wade Foster, CEO): «Opus 5 ha raggiunto il 100% su AutomationBench: ha preso un workbook di account health e ha eseguito una sequenza completa di churn prevention end-to-end — flagging account a rischio, alerting, summarization.»
Box (Ben Kus, CTO): «Opus 5 supera Opus 4.8 dell'8%, con guadagni notevoli in analisi dati (+11%) e due diligence (+17%) — workflow usati quotidianamente da tecnologia, healthcare e settore pubblico.»
Anthropic (Cristian Rivera, Staff SWE): «In un weekend gli ho dato un ruolo da chief-of-staff sui miei ambienti di sviluppo: ha costruito il suo monitor, gestito ogni macchina, e mi ha coinvolto solo per le decisioni strategiche.»
Hex (Shirley Zhang, Senior AI Engineer): «Per i workflow di ricerca finanziaria, Opus 5 si distingue su ragionamento numerico, lavoro con tabelle e pensiero critico dove la precisione conta.»
La valutazione di Velthub
Voto: 9.2/10
Claude Opus 5 è il miglior modello Anthropic per rapporto qualità-prezzo. Non è Fable 5 — Anthropic lo dice esplicitamente — ma per il 95% dei casi d'uso quotidiani è la scelta ottimale. I benchmark su coding (Frontier-Bench: 2× Opus 4.8, CursorBench: -0.5% da Fable a metà costo) e knowledge work (ARC-AGI 3: 3× GPT-5.6 Sol, OSWorld 2.0: supera Fable a 1/3 del costo) sono impressionanti non solo per i numeri assoluti ma per l'efficienza.
L'aspetto più interessante è l'agenzia: Opus 5 verifica il proprio lavoro, itera, e — cosa mai vista prima — costruisce tool ausiliari (pipeline di computer vision, test harness) quando l'ambiente non glieli fornisce. È un comportamento da agente autonomo, non da modello reattivo. La demo del 3D interattivo (auto rossa ruotabile generata in WebGL) ne è la prova visiva.
Punti di forza (verificati dal blog ufficiale Anthropic):
- Nuovo stato dell'arte su Frontier-Bench v0.1 — 2× Opus 4.8 a costo inferiore
- ARC-AGI 3: ~30% — il triplo del miglior competitor (GPT-5.6 Sol: ~8%)
- CursorBench 3.2: entro 0.5% da Fable 5 a metà costo
- OSWorld 2.0: supera Fable 5 a un terzo del costo
- Agenzia autonoma: costruisce pipeline CV, test harness, debug root-cause
- Demo 3D interattiva: WebGL generato dal modello, auto ruotabile 360°
- Disponibile oggi su Claude Max (default) e Claude Pro (top model)
- +10.2pp in chimica organica, +7.7pp in analisi proteica
- 100% su Zapier AutomationBench in un task reale
Limitazioni (dichiarate da Anthropic):
- Dietro a Mythos 5 su compiti di cybersecurity
- Non raggiunge Fable 5 su task estremamente complessi
- Pricing API esatto non pubblicato (solo "metà di Fable 5")
- Dimensioni del modello non dichiarate
Domande frequenti
Opus 5 sostituisce Fable 5?
No. Opus 5 è un gradino sotto Fable 5 ma a metà prezzo. Anthropic lo posiziona come il modello "everyday" per coding e knowledge work. Fable 5 resta il top per i task più complessi (es. cybersecurity con Mythos 5).
Quanto costa Opus 5 rispetto a Opus 4.8?
Stesso costo di Opus 4.8, ma con performance enormemente superiori. È il miglior rapporto qualità-prezzo nella lineup Anthropic.
Opus 5 è disponibile via API?
Sì. È il modello predefinito su Claude Max e il più potente su Claude Pro. Disponibile anche via API Anthropic per sviluppatori.
Quali sono i benchmark più impressionanti?
Frontier-Bench v0.1 (2× Opus 4.8), ARC-AGI 3 (3× GPT-5.6 Sol), OSWorld 2.0 (supera Fable 5 a 1/3 del costo), Zapier AutomationBench (100% su task reale).
Il video 3D è una demo reale?
Sì. Il video mostra un'auto sportiva 3D generata interamente da Opus 5 in WebGL/Three.js, ruotabile a 360° dall'utente. Fa parte delle demo "Wind Tunnel" e "Cell Artifact" pubblicate da Anthropic.
Perché la copertina ha delle uova?
È lo stile artistico distintivo di Anthropic per la serie Opus 5: illustrazioni in stile trattati scientifici dell'Ottocento. Le uova che formano il numero 5 simboleggiano nascita e potenziale — il "dischiudersi" di una nuova generazione di modelli.
Cosa non sappiamo ancora
- Pricing API esatto per 1M token input/output
- Benchmark indipendenti su LMArena, LiveBench, Artificial Analysis
- Dimensione esatta del modello (parametri totali e attivi)
- Disponibilità in Europa e tempistiche precise
- Confronto diretto con GPT-5.6 Sol su benchmark non-Anthropic
https://velthub.ai/blog/claude-opus-5-anthropic-nuovo-modello-frontier-coding-luglio-2026