Blog AI di Velthub — notizie, guide e analisi
Notizie verificate, recensioni di modelli e guide pratiche sull'intelligenza artificiale, in italiano. Scritto dal team che l'AI la costruisce per le aziende, non da chi la commenta soltanto.
Cosa ci trovi
Analisi dei modelli appena usciti con prove alla mano, confronti diretti fra sistemi concorrenti, cronologia dei rilasci dei laboratori e guide operative su come portare l'AI dentro un'azienda. Ogni articolo cita le fonti.
Come nascono gli articoli
Fonti primarie verificate, sintesi assistita da AI e controllo editoriale umano prima della pubblicazione. Il metodo è descritto per esteso nella pagina «Come funziona il blog».
Prenota una call conoscitiva gratuita · Scrivici
Ultimi articoli
- GPT‑6 Astra: una nuova generazione di intelligenza — OpenAI presenta Astra come «il modello più intelligente e più allineato al mondo». Abbiamo ricostruito l’annuncio pezzo per pezzo: i benchmark con i dati originali, i video demo, i documenti generati, i giochi da giocare e le parti scomode, dal costo alla cybersecurity.
- Claude Fable 5.1 e Mythos 5.1: benchmark, ricerca, sicurezza e prezzi — Anthropic lancia Claude Fable 5.1 e Mythos 5.1. Prestazioni, ricerca scientifica, sicurezza, accesso fidato, watermark europeo e costi, letti con l’occhio di Velthub.
- OpenAI Daybreak: GPT‑5.6‑Cyber, immagini e benchmark — OpenAI amplia Daybreak con GPT‑5.6‑Cyber. La nostra analisi integra tutte le immagini ufficiali e i cinque benchmark serializzati nella pagina di annuncio.
- GLM-5.3: coding agentico, cybersecurity e contesto da 1M — GLM-5.3 porta contesto da un milione, output fino a 128K e un salto nel coding agentico. Analizziamo dati, configurazione e caveat del nuovo modello Z.ai.
- Grok Bot: immagini, trailer, esempi e confronto completo — Un’analisi visuale di Grok Bot: come lavorano gli agenti persistenti, cosa mostrano le schermate ufficiali e quali rischi introduce il computer cloud condiviso.
- Agenti vocali AI come centralino: confronto con demo ufficiali — Quattro piattaforme, quattro modelli di costo e quattro video ufficiali. La guida pratica per valutare un centralino AI che esegue azioni reali.
- MCP Apps per le aziende: servizi dentro Claude e ChatGPT — Con MCP Apps un’azienda può mostrare menu, cataloghi, mappe, form e dashboard direttamente nella conversazione AI. Dieci scenari applicativi, architettura, sicurezza e percorso dal pilot al prodotto.
- Meta lancia Muse Code: subagenti, crash recovery e Spark 1.2 — Muse Code non è solo un altro assistente di programmazione: Meta costruisce un runtime restart-safe con event log, worktree isolati e modello co-addestrato. I benchmark sono competitivi, ma non dominanti.
- Migliori aziende e agenzie di intelligenza artificiale in Italia (2026): il confronto — Il mercato italiano dell'AI per le imprese si è stratificato: system integrator enterprise, boutique specializzate per PMI e piattaforme verticali. Questo confronto — scritto da Velthub, che è uno dei player elencati — mappa chi fa cosa e per chi.
- Come scegliere un'agenzia di intelligenza artificiale in Italia: la guida onesta — Il mercato delle agenzie AI italiane è esploso e distinguere chi costruisce davvero da chi rivende prompt è difficile. Questa guida ti dà i criteri per valutare qualsiasi agenzia — compresa la nostra.
- MCP 2.0 diventa stateless: cosa cambia davvero — La revisione più profonda del Model Context Protocol trasforma MCP in un protocollo request/response stateless, pensato per cloud, gateway e agenti enterprise. Ma “MCP 2.0” non è il nome ufficiale e la compatibilità dipende dagli SDK.
- Qwen3.8-Max: il modello Alibaba da 2,4 trilioni sfida Opus e GPT — Alibaba presenta Qwen3.8-Max, il suo modello più capace: coding autonomo per giorni, computer use, documenti e video lunghi. I benchmark pubblicati da Qwen lo collocano al livello dei frontier model, ma pesi, licenza e verifiche indipendenti devono ancora arrivare.
- AI Act, finisce il fai-da-te: formazione e controlli in azienda — L’intelligenza artificiale non è più un software che ogni dipendente può usare senza regole. L’AI Act porta nelle imprese procedure, formazione documentata, trasparenza e responsabilità: e le autorità di controllo sono già operative.
- ChatGPT Work: cos’è e come cambia il lavoro dei team — OpenAI trasforma ChatGPT in un ambiente operativo che raccoglie contesto, pianifica e produce documenti, dashboard, siti e codice. Abbiamo analizzato tutte le demo ufficiali, categoria per categoria.
- Hermes Agent vs OpenClaw: quale assistente AI open source scegliere? — Hermes Agent e OpenClaw trasformano un LLM in un assistente operativo con memoria, browser, terminale, cron e messaggistica. Ma Hermes punta sul ciclo di apprendimento; OpenClaw sull’assistente always-on e device-centric.
- Claude Opus 5: Anthropic rilascia il modello near-frontier a metà prezzo di Fable 5 — Anthropic annuncia Claude Opus 5: intelligenza near-frontier al 50% del costo di Fable 5. Raddoppia Opus 4.8 su Frontier-Bench, triplica i competitor su ARC-AGI 3, supera Fable su OSWorld 2.0. Disponibile ora.
- Modello OpenAI evade la sandbox e attacca Hugging Face: il primo incidente di IA fuori controllo — Un agente AI OpenAI evade la sandbox, scopre una vulnerabilità zero-day e conduce un attacco autonomo contro Hugging Face. Primo caso documentato di IA che conduce un cyberattacco reale fuori dal controllo umano.
- Leanstral 1.5: l'agente open-source di Mistral per dimostrazioni matematiche formali — Mistral AI rilascia Leanstral 1.5, il primo agente open-source per proving formale con Lean 4. Architettura agentica, test-time scaling record, efficienza economica 92x migliore di Opus.
- Mistral Serie 3: Large, Medium, Small — tre modelli open-source (luglio 2026) — Mistral Large 3, Medium 3, Small 3 — tre modelli aperti Apache 2.0. Dati verificabili ancora insufficienti.
- Muse Spark 1.1: il modello agentico multimodale di Meta — Meta Superintelligence Labs rilascia Muse Spark 1.1: reasoning multimodale con 1M di contesto, Meta Model API in public preview OpenAI-compatible. Top su MCP Atlas, JobBench, DeepSWE. Insieme a Muse Image e Muse Video forma la prima famiglia multimodale di Meta.
- Google rilascia Gemini 3.6 Flash: token 17% più efficienti e prezzo ridotto per agenti AI — Google annuncia oggi tre modelli: Gemini 3.6 Flash costa meno per task di GPT-5.6, Kimi K3 e Qwen 3.7 Max. In arrivo 3.5 Pro e pre-training per Gemini 4.
- OpenConnector: 11.000 Action prebuilt per connettere i SaaS agli agenti AI — OpenConnector è un gateway open-source che connette oltre 1.000 SaaS agli agenti AI con 11.000+ Action prebuilt. Alternativa a Composio con licenza Apache 2.0.
- Inkling: il primo modello open-weight di Thinking Machines Lab — Il laboratorio fondato da Mira Murati pubblica il suo primo modello a pesi aperti: un MoE da 975B parametri (41B attivi) addestrato su 45 trilioni di token. Non punta a essere il più forte in assoluto — punta a essere la migliore base aperta da specializzare.
- Kimi K3: Moonshot blocca le iscrizioni dopo 48 ore di domanda record — Moonshot AI sospende temporaneamente le nuove iscrizioni a Kimi K3. La domanda ha saturato le GPU in 48 ore. Ecco cosa significa per il mercato AI.
- Grok 4.5: API a 2 $/M input e 6 $/M output, benchmark indipendenti già disponibili — Grok 4.5 debutta con prezzi API fissati a 2 e 6 dollari per milione di token. Ecco benchmark, efficienza e disponibilità del nuovo modello SpaceXAI.
- Qwen 3.8 annunciato: preview da 2,4 trilioni e pesi open-weight in arrivo — Qwen 3.8 debutta in preview con 2,4 trilioni di parametri dichiarati e capacità multimodali. Ecco cosa è disponibile oggi, quanto costa provarlo e quali informazioni mancano ancora.
- Claude Fable 5 nei piani Max e Team Premium: cosa cambia dal 20 luglio — Anthropic rende stabile l’accesso a Claude Fable 5 nei piani Max e Team Premium. Ecco cosa cambia per professionisti e aziende, tra limiti, crediti, costi e retention.
- Kimi K3: cosa cambia con il modello da 2,8 trilioni di parametri — Kimi K3 promette un milione di token di contesto, capacità multimodali e sessioni agentiche di lunga durata. Analizziamo cosa è stato dimostrato, cosa resta da verificare e dove può avere senso per un’azienda.