Google rilascia Gemini 3.6 Flash: token 17% più efficienti e prezzo ridotto per agenti AI

Insieme a 3.5 Flash-Lite (350 token/s) e 3.5 Flash Cyber per la cybersicurezza. Disponibile subito in GitHub Copilot e Gemini API.

Google rilascia Gemini 3.6 Flash: token 17% più efficienti e prezzo ridotto per agenti AI

In sintesi

Google lancia Gemini 3.6 Flash (21 luglio 2026): modello più efficiente e più economico per agenti AI, affiancato da 3.5 Flash‑Lite e 3.5 Flash Cyber. • 3.6 Flash usa fino al 17% di token di output in meno rispetto a 3.5 Flash (Artificial Analysis). • Prezzi 3.6 Flash: $1,50/1M token input e $7,50/1M token output. • 3.5 Flash‑Lite è il più veloce della serie: 350 token al secondo, pensato per carichi ad alto volume. • 3.5 Flash Cyber è specializzato per cybersicurezza e sarà inizialmente solo per governi e partner via CodeMender.

Google ha rilasciato oggi, 21 luglio 2026, tre nuovi modelli Gemini: 3.6 Flash, 3.5 Flash-Lite e 3.5 Flash Cyber. Il annuncio principale è Gemini 3.6 Flash, un modello che consuma fino al 17% in meno di token di output rispetto a 3.5 Flash e arriva a costare meno per task di GPT-5.6 Terra Max, Kimi K3 e Qwen 3.7 Max, secondo i dati Artificial Analysis. Insieme arrivano 3.5 Flash-Lite, il modello più veloce della famiglia 3.5 con 350 token al secondo, e 3.5 Flash Cyber, un modello specializzato per la cybersicurezza che sarà disponibile in via esclusiva per governi e partner certificati tramite CodeMender.

Google ha anche confermato che Gemini 3.5 Pro è in测试 con partner selezionati e che il pre-training per Gemini 4 è già iniziato — il più ambizioso mai avviato dall'azienda.

Gemini 3.6 Flash: specifiche e prezzi

Gemini 3.6 Flash è descritto da Google come il modello di punta per carichi di lavoro agentici: migliore nel coding, nel knowledge work e nelle capacità multimodali rispetto a 3.5 Flash, ma con un consumo di token ridotto e un prezzo inferiore.

SpecificaGemini 3.6 Flash
Prezzo input$1,50 / 1M token
Prezzo output$7,50 / 1M token
Efficienza token output-17% vs 3.5 Flash (Artificial Analysis Index)
Input massimo1.048.576 token
Output massimo65.536 token
Tipi di dato supportatiTesto, immagine, video, audio, PDF
Computer useSupportato (anteprima)
Chiamata di funzioneSupportata
Esecuzione codiceSupportata
GroundingGoogle Search, Google Maps
Output strutturatiSupportati (In pensiero)

Benchmark: 3.6 Flash vs 3.5 Flash

I benchmark seguenti sono stati pubblicati da Google. I dati sono dichiarati dal produttore.

Benchmark3.6 Flash3.5 FlashMiglioramento
DeepSWE49,0%37,0%+12 pp
MLE Bench63,9%49,7%+14,2 pp
OSWorld-Verified83,0%78,4%+4,6 pp
GDPval-AA v214211349+72

Secondo i dati Artificial Analysis, il modello consuma il 17% meno token di output rispetto a 3.5 Flash. Su DeepSWE (benchmark di coding di Datacurve), Google osserva una riduzione fino al 65% dei token generati. Il modello è anche più economico per task rispetto a GPT-5.6 Terra Max, Kimi K3 e Qwen 3.7 Max, secondo i prezzi pubblici.

Gemini 3.5 Flash-Lite: velocità e volume

Gemini 3.5 Flash-Lite è il modello più veloce della famiglia 3.5: 350 token di output al secondo secondo Artificial Analysis. È pensato per carichi ad alto volume e task di piccoli agenti all'interno di sistemi agentici più grandi.

Specifica3.5 Flash-Lite3.1 Flash-Lite
Prezzo input$0,30 / 1M token
Prezzo output$2,50 / 1M token
Token output al secondo350 /s
Terminal-Bench 2.154%31%
SWE-Bench Pro54,2%
OSWorld-Verified74,0%
GDPval-AA v21140642
GDM-MRCR v272,2%60,1%

Su SWE-Bench Pro (54,2%) e OSWorld-Verified (74,0%), 3.5 Flash-Lite supera addirittura Gemini 3 Flash (49,6% e 65,1% rispettivamente). Supporta computer use, chiamata di funzione e grounding. È disponibile anche in Google Search oltre che nell'API Gemini.

Gemini 3.5 Flash Cyber: la risposta a Mythos

Gemini 3.5 Flash Cyber è un modello specializzato per la cybersicurezza, costruito su 3.5 Flash e fine-tunato per trovare e correggere vulnerabilità a un costo per token inferiore rispetto a modelli più grandi. Opera all'interno di CodeMender, dove più agenti 3.5 Flash Cyber lavorano insieme per produrre un report combinato. Raggiunge performance competitive al frontiera sul benchmark CyberGym.

Secondo CNBC, 3.5 Flash Cyber rappresenta la risposta più chiara di Google al modello Mythos di Anthropic nel campo della cybersicurezza automatizzata. Il modello sarà inizialmente disponibile solo per governi e partner certificati attraverso un programma pilota limitato.

Disponibilità immediata

3.6 Flash e 3.5 Flash-Lite sono disponibili da oggi:

Posizionamento competitivo

Il lancio arriva alla vigilia dei risultati trimestrali di Alphabet. Google punta su prezzo ed efficienza per compensare i ritardi nei cicli di rilascio rispetto ad Anthropic e OpenAI. Secondo l'analisi di CNBC, 3.6 Flash è più economico per task di GPT-5.6 Terra Max, Kimi K3 e Qwen 3.7 Max.

Google ha anche rivelato di essere al lavoro su un chip specializzato per eseguire Gemini con un'efficienza fino a 10 volte superiore, parte di una spinta più ampia per ridurre il costo di serving dell'AI.

Confermato anche che Gemini 3.5 Pro è in testing con partner e che il pre-training per Gemini 4 — il più ambizioso mai avviato da Google — è già iniziato.

La valutazione di Velthub

Gemini 3.6 Flash è un rilascio importante per Google: arriva in un momento in cui la competizione sui prezzi dei modelli è al centro del mercato enterprise. La combinazione di token efficiency (-17%), prezzo competitivo ($1.50/$7.50 per milione) e miglioramenti reali sui benchmark lo rende un contendente serio nel segmento Flash. L'integrazione immediata in GitHub Copilot è un segnale forte per i team di sviluppo. Per le aziende italiane che già usano l'ecosistema Google Cloud, 3.6 Flash è un upgrade significativo con costi inferiori. La novità più strategica è però 3.5 Flash Cyber: la mossa di Google nel mercato della cybersicurezza agentica è chiara, e il modello specializzato via CodeMender potrebbe diventare uno standard per il settore pubblico.

Cosa non sappiamo ancora

Domande frequenti

Quanto costa Gemini 3.6 Flash?

$1,50 per milione di token in input, $7,50 per milione di token in output.

Dove posso usare Gemini 3.6 Flash?

In Google AI Studio, Android Studio, GitHub Copilot, Google Antigravity, Gemini Enterprise Agent Platform e nell'app Gemini.

3.6 Flash è meglio di 3.5 Flash?

Sì, su tutti i benchmark pubblicati: DeepSWE +12pp, MLE Bench +14,2pp, OSWorld +4,6pp. Inoltre consuma il 17% meno token di output.

Gemini 3.5 Pro quando arriva?

È in testing con partner selezionati. Google non ha fornito una data di rilascio pubblico.

Cos'è Gemini 3.5 Flash Cyber?

Un modello specializzato per la cybersicurezza, disponibile solo per governi e partner certificati tramite CodeMender. È la risposta di Google a Mythos di Anthropic.

https://velthub.ai/blog/gemini-3-6-flash-google-rilascio-2026