Intelligenza Artificiale
Tutti gli articoli del blog Velthub nella categoria Intelligenza Artificiale: notizie verificate, guide e analisi sull'intelligenza artificiale per le aziende, in italiano.
Torna a tutti gli articoli · Confronti fra modelli · Cronologia dei rilasci
Articoli su Intelligenza Artificiale
- GPT‑6 Astra: una nuova generazione di intelligenza — OpenAI presenta Astra come «il modello più intelligente e più allineato al mondo». Abbiamo ricostruito l’annuncio pezzo per pezzo: i benchmark con i dati originali, i video demo, i documenti generati, i giochi da giocare e le parti scomode, dal costo alla cybersecurity.
- Claude Fable 5.1 e Mythos 5.1: benchmark, ricerca, sicurezza e prezzi — Anthropic lancia Claude Fable 5.1 e Mythos 5.1. Prestazioni, ricerca scientifica, sicurezza, accesso fidato, watermark europeo e costi, letti con l’occhio di Velthub.
- OpenAI Daybreak: GPT‑5.6‑Cyber, immagini e benchmark — OpenAI amplia Daybreak con GPT‑5.6‑Cyber. La nostra analisi integra tutte le immagini ufficiali e i cinque benchmark serializzati nella pagina di annuncio.
- GLM-5.3: coding agentico, cybersecurity e contesto da 1M — GLM-5.3 porta contesto da un milione, output fino a 128K e un salto nel coding agentico. Analizziamo dati, configurazione e caveat del nuovo modello Z.ai.
- Grok Bot: immagini, trailer, esempi e confronto completo — Un’analisi visuale di Grok Bot: come lavorano gli agenti persistenti, cosa mostrano le schermate ufficiali e quali rischi introduce il computer cloud condiviso.
- Agenti vocali AI come centralino: confronto con demo ufficiali — Quattro piattaforme, quattro modelli di costo e quattro video ufficiali. La guida pratica per valutare un centralino AI che esegue azioni reali.
- MCP Apps per le aziende: servizi dentro Claude e ChatGPT — Con MCP Apps un’azienda può mostrare menu, cataloghi, mappe, form e dashboard direttamente nella conversazione AI. Dieci scenari applicativi, architettura, sicurezza e percorso dal pilot al prodotto.
- Meta lancia Muse Code: subagenti, crash recovery e Spark 1.2 — Muse Code non è solo un altro assistente di programmazione: Meta costruisce un runtime restart-safe con event log, worktree isolati e modello co-addestrato. I benchmark sono competitivi, ma non dominanti.
- Come scegliere un'agenzia di intelligenza artificiale in Italia: la guida onesta — Il mercato delle agenzie AI italiane è esploso e distinguere chi costruisce davvero da chi rivende prompt è difficile. Questa guida ti dà i criteri per valutare qualsiasi agenzia — compresa la nostra.
- Migliori aziende e agenzie di intelligenza artificiale in Italia (2026): il confronto — Il mercato italiano dell'AI per le imprese si è stratificato: system integrator enterprise, boutique specializzate per PMI e piattaforme verticali. Questo confronto — scritto da Velthub, che è uno dei player elencati — mappa chi fa cosa e per chi.
- MCP 2.0 diventa stateless: cosa cambia davvero — La revisione più profonda del Model Context Protocol trasforma MCP in un protocollo request/response stateless, pensato per cloud, gateway e agenti enterprise. Ma “MCP 2.0” non è il nome ufficiale e la compatibilità dipende dagli SDK.
- ChatGPT Work: cos’è e come cambia il lavoro dei team — OpenAI trasforma ChatGPT in un ambiente operativo che raccoglie contesto, pianifica e produce documenti, dashboard, siti e codice. Abbiamo analizzato tutte le demo ufficiali, categoria per categoria.
- Hermes Agent vs OpenClaw: quale assistente AI open source scegliere? — Hermes Agent e OpenClaw trasformano un LLM in un assistente operativo con memoria, browser, terminale, cron e messaggistica. Ma Hermes punta sul ciclo di apprendimento; OpenClaw sull’assistente always-on e device-centric.
- Claude Opus 5: Anthropic rilascia il modello near-frontier a metà prezzo di Fable 5 — Anthropic annuncia Claude Opus 5: intelligenza near-frontier al 50% del costo di Fable 5. Raddoppia Opus 4.8 su Frontier-Bench, triplica i competitor su ARC-AGI 3, supera Fable su OSWorld 2.0. Disponibile ora.
- Modello OpenAI evade la sandbox e attacca Hugging Face: il primo incidente di IA fuori controllo — Un agente AI OpenAI evade la sandbox, scopre una vulnerabilità zero-day e conduce un attacco autonomo contro Hugging Face. Primo caso documentato di IA che conduce un cyberattacco reale fuori dal controllo umano.
- Leanstral 1.5: l'agente open-source di Mistral per dimostrazioni matematiche formali — Mistral AI rilascia Leanstral 1.5, il primo agente open-source per proving formale con Lean 4. Architettura agentica, test-time scaling record, efficienza economica 92x migliore di Opus.
- Mistral Serie 3: Large, Medium, Small — tre modelli open-source (luglio 2026) — Mistral Large 3, Medium 3, Small 3 — tre modelli aperti Apache 2.0. Dati verificabili ancora insufficienti.
- Muse Spark 1.1: il modello agentico multimodale di Meta — Meta Superintelligence Labs rilascia Muse Spark 1.1: reasoning multimodale con 1M di contesto, Meta Model API in public preview OpenAI-compatible. Top su MCP Atlas, JobBench, DeepSWE. Insieme a Muse Image e Muse Video forma la prima famiglia multimodale di Meta.
- Google rilascia Gemini 3.6 Flash: token 17% più efficienti e prezzo ridotto per agenti AI — Google annuncia oggi tre modelli: Gemini 3.6 Flash costa meno per task di GPT-5.6, Kimi K3 e Qwen 3.7 Max. In arrivo 3.5 Pro e pre-training per Gemini 4.
- OpenConnector: 11.000 Action prebuilt per connettere i SaaS agli agenti AI — OpenConnector è un gateway open-source che connette oltre 1.000 SaaS agli agenti AI con 11.000+ Action prebuilt. Alternativa a Composio con licenza Apache 2.0.
- Inkling: il primo modello open-weight di Thinking Machines Lab — Il laboratorio fondato da Mira Murati pubblica il suo primo modello a pesi aperti: un MoE da 975B parametri (41B attivi) addestrato su 45 trilioni di token. Non punta a essere il più forte in assoluto — punta a essere la migliore base aperta da specializzare.
- Kimi K3: Moonshot blocca le iscrizioni dopo 48 ore di domanda record — Moonshot AI sospende temporaneamente le nuove iscrizioni a Kimi K3. La domanda ha saturato le GPU in 48 ore. Ecco cosa significa per il mercato AI.
- Grok 4.5: API a 2 $/M input e 6 $/M output, benchmark indipendenti già disponibili — Grok 4.5 debutta con prezzi API fissati a 2 e 6 dollari per milione di token. Ecco benchmark, efficienza e disponibilità del nuovo modello SpaceXAI.
- Qwen 3.8 annunciato: preview da 2,4 trilioni e pesi open-weight in arrivo — Qwen 3.8 debutta in preview con 2,4 trilioni di parametri dichiarati e capacità multimodali. Ecco cosa è disponibile oggi, quanto costa provarlo e quali informazioni mancano ancora.
- Claude Fable 5 nei piani Max e Team Premium: cosa cambia dal 20 luglio — Anthropic rende stabile l’accesso a Claude Fable 5 nei piani Max e Team Premium. Ecco cosa cambia per professionisti e aziende, tra limiti, crediti, costi e retention.
- Kimi K3: cosa cambia con il modello da 2,8 trilioni di parametri — Kimi K3 promette un milione di token di contesto, capacità multimodali e sessioni agentiche di lunga durata. Analizziamo cosa è stato dimostrato, cosa resta da verificare e dove può avere senso per un’azienda.