Grok 4.5: API a 2 $/M input e 6 $/M output, benchmark indipendenti già disponibili
SpaceXAI lancia il suo modello più intelligente per coding e compiti agentici. Prezzi competitivi, 80 token/s e benchmark verificati su LiveBench.
In sintesi
Grok 4.5 è il nuovo modello frontier di SpaceXAI, ottimizzato per coding e compiti agentici. Prezzi API: 2 $/M token input, 6 $/M token output. Benchmark indipendenti già disponibili su LiveBench e Datacurve. Velocità di 80 token/s e training su decine di migliaia di GPU NVIDIA GB300. Disponibile su SpaceXAI API, Grok Build e Cursor. Rapporto prezzo-prestazioni competitivo rispetto a Fable 5 e Opus 4.8.
SpaceXAI ha lanciato Grok 4.5, il suo modello più intelligente per coding, compiti agentici e knowledge work. I prezzi API sono fissati a 2 dollari per milione di token in input e 6 dollari in output, con benchmark indipendenti già disponibili su LiveBench e valutazioni Datacurve.
I prezzi e il posizionamento
Grok 4.5 costa 2 $/M token in input e 6 $/M token in output. Per confronto, Claude Fable 5 costa 10 $/M in input e 50 $/M in output via API. Kimi K3 si posiziona a circa 15 $/M in output. Grok si colloca deliberatamente nella fascia più accessibile tra i modelli di frontiera.
SpaceXAI rivendica anche un'efficienza circa due volte superiore ai modelli comparabili: su SWE Bench Pro, Grok 4.5 completa i task con circa 16.000 token di output in media, contro i 67.000 di Opus 4.8, un fattore 4,2× inferiore.
Benchmark e prestazioni
I benchmark pubblicati da SpaceXAI includono risultati su DeepSWE (Datacurve), SWE Marathon, Terminal Bench 2.1 e SWE Bench Pro. Grok 4.5 raggiunge il 62% su DeepSWE 1.0 (Fable 5: 66,1%) e il 29% su SWE Marathon (Opus 4.8: 26%). Su Terminal Bench 2.1 arriva all'83,3%, praticamente a pari merito con GPT-5.5 xhigh.
Questi risultati provengono dai system card dei rispettivi produttori o dalle leaderboard pubbliche, e sono stati eseguiti con harness Datacurve. Per una valutazione indipendente, LiveBench colloca Grok 4.5 tra i modelli frontier con un punteggio competitivo, ma non ancora al livello di Fable 5 e GPT-5.6 Sol.
Training, velocità e disponibilità
Il modello è stato addestrato su decine di migliaia di GPU NVIDIA GB300. SpaceXAI dichiara una velocità di inferenza di 80 token al secondo e un'architettura di reinforcement learning su centinaia di migliaia di task di software engineering.
Grok 4.5 è disponibile su:
- SpaceXAI API (console.x.ai);
- Grok Build con accesso gratuito per un periodo limitato;
- Cursor su tutti i piani.
Perché conta per sviluppatori e aziende
Il prezzo di 6 $/M token in output è il più basso tra i modelli di frontiera occidentali con benchmark verificati. L'efficienza dichiarata di 16.000 token per task di coding riduce ulteriormente il costo reale: se il dato è confermato, un task SWE complesso costa meno di 10 centesimi di dollaro.
L'integrazione nativa con Cursor e l'API compatibile con gli stack esistenti rendono Grok 4.5 immediatamente testabile. Il training su GB300 suggerisce inoltre che SpaceXAI ha accesso a hardware NVIDIA di ultima generazione, riducendo il rischio di colli di bottiglia nell'inferenza.
Cosa non sappiamo ancora
- se l'efficienza dichiarata di 16.000 token per task SWE sia confermata su carichi reali e non soltanto sul benchmark;
- quale sia il prezzo oltre i 200.000 token di contesto, se applicabile;
- se la qualità resti stabile su sessioni lunghe e multi-turno;
- se i limiti di rate API siano sufficienti per deployment in produzione.
Il punto di Velthub
Grok 4.5 è il modello di frontiera con il miglior rapporto prezzo-prestazioni verificato oggi. Per team tecnici e startup che usano coding agent, il costo per task è potenzialmente inferiore a qualsiasi alternativa occidentale. Conviene provarlo subito su workflow reali: un benchmark interno su 20-30 task di coding dà una misura più utile di qualsiasi classifica pubblica.