HomeAITre nuovi modelli AI Gemini: -17% di token e uno riservato solo...

Tre nuovi modelli AI Gemini: -17% di token e uno riservato solo ai governi

Google ha lanciato tre nuovi modelli AI Gemini che ridisegnano il rapporto tra costo, velocità e specializzazione nell’intelligenza artificiale applicata. Gemini 3.6 Flash, Gemini 3.5 Flash-Lite e Gemini 3.5 Flash Cyber arrivano in un momento in cui la concorrenza — da Anthropic a OpenAI, fino ai rivali cinesi come Moonshot AI e Alibaba — non dà tregua. Il messaggio di Google è chiaro: efficienza e prezzo possono compensare il ritardo in alcune categorie di prodotto.

Punti chiave

  • Gemini 3.6 Flash riduce l’utilizzo di token in output del 17% rispetto a 3.5 Flash, con prestazioni migliori in coding, knowledge work e capacità multimodali.
  • Gemini 3.5 Flash-Lite è il modello più veloce della famiglia 3.5, con 350 token di output al secondo e un costo di soli $0,30 per milione di token in input.
  • Gemini 3.5 Flash Cyber è ottimizzato per la sicurezza informatica e sarà disponibile esclusivamente per governi e partner selezionati tramite un programma pilota limitato.
  • 3.6 Flash e 3.5 Flash-Lite sono già disponibili via Gemini API, Google AI Studio, Android Studio, Gemini Enterprise Agent Platform, app Gemini e Google Search.
  • Google ha avviato il pre-training di Gemini 4, definito il run più ambizioso di sempre, mentre Gemini 3.5 Pro è in fase di test con i partner.

Google presenta tre nuovi modelli AI Gemini

La serie Flash di Gemini nasce con un obiettivo preciso: trovare il punto di equilibrio tra qualità e efficienza per chi costruisce agenti AI in produzione. Con i tre nuovi modelli, Google risponde a una domanda concreta degli sviluppatori — più throughput, meno costi, meno latenza — senza sacrificare le prestazioni.

Gemini 3.6 Flash è il modello principale del nuovo trittico. Costruito direttamente sul feedback ricevuto dagli sviluppatori su 3.5 Flash, migliora le prestazioni in coding, knowledge work e capacità multimodali, ma lo fa consumando meno risorse. Secondo i dati dell’Artificial Analysis Index, utilizza il 17% di token in output in meno rispetto al predecessore. In alcuni benchmark specifici, come DeepSWE di Datacurve, il risparmio arriva fino al 65%.

Non è solo un vantaggio tecnico astratto: meno token in output significa costi operativi più bassi per chi gestisce workflow agentico ad alto volume. E il pricing riflette questa logica: $1,50 per milione di token in input e $7,50 per milione di token in output, meno del predecessore 3.5 Flash.

Prestazioni a confronto: cosa cambia davvero

I benchmark interni mostrano miglioramenti distribuiti su più fronti. In DeepSWE, 3.6 Flash raggiunge il 49% contro il 37% di 3.5 Flash, con meno modifiche indesiderate al codice e meno cicli di esecuzione. In MLE Bench, il salto è ancora più netto: 63,9% contro 49,7%. Sul fronte del computer use, OSWorld-Verified segna 83,0% contro 78,4%.

Clienti come Hebbia e Harvey hanno già riscontrato capacità particolarmente solide nei task multimodali: parsing di documenti, analisi di grafici e dati, redazione di report. Sono esattamente i casi d’uso enterprise dove la combinazione di velocità, accuratezza e costo fa la differenza.

Velocità e costo: il ruolo di Gemini 3.5 Flash-Lite

Se 3.6 Flash è il modello da lavoro, Gemini 3.5 Flash-Lite è il motore per chi ha bisogno di volume. È il modello più veloce dell’intera famiglia 3.5: 350 token di output al secondo secondo le misurazioni di Artificial Analysis. Con un prezzo di $0,30 per milione di token in input e $2,50 per milione in output, offre un rapporto prezzo/prestazioni pensato per traffico in produzione ad alto throughput.

Il confronto con le generazioni precedenti è significativo. In Terminal-Bench 2.1, 3.5 Flash-Lite segna 54% contro il 31% di 3.1 Flash-Lite. In GDM-MRCR v2 per i contesti lunghi, 72,2% contro 60,1%. E in alcuni benchmark agentico e di coding, supera persino 3 Flash: su SWE-Bench Pro, 54,2% contro 49,6%; su OSWorld-Verified, 74,0% contro 65,1%.

Il modello supporta diversi livelli di “thinking” configurabili: da modalità minimale per task ad alto volume e bassa latenza, a livelli più alti per workflow multi-step con sottoagenti. Il computer use è ora uno strumento integrato nativo, disponibile sia via Gemini API che su Gemini Enterprise.

Modello specializzato in cybersecurity e limiti di accesso

Il lancio più strategicamente rilevante è forse quello di Gemini 3.5 Flash Cyber, il primo modello della famiglia Gemini ottimizzato specificamente per la sicurezza informatica. Costruito su 3.5 Flash e fine-tuned per il rilevamento e la correzione di vulnerabilità nel codice, opera all’interno di CodeMender, l’agente di sicurezza del codice di Google.

L’architettura è pensata per un problema reale: i modelli AI sono già in grado di trovare vulnerabilità più velocemente di quanto i sistemi attuali possano correggerle. CodeMender utilizza più agenti 3.5 Flash Cyber in parallelo per produrre un report combinato, raggiungendo prestazioni competitive sul benchmark CyberGym.

Accesso riservato a governi e partner fidati

La natura duale di questa tecnologia — utile per la difesa, potenzialmente pericolosa se usata in modo offensivo — ha spinto Google a un approccio deliberatamente cauto. L’accesso a 3.5 Flash Cyber è limitato esclusivamente a governi e partner fidati tramite un programma pilota a disponibilità ristretta via CodeMender.

La logica dichiarata è dare ai difensori in prima linea un vantaggio temporale nell’identificare e correggere vulnerabilità critiche prima che possano essere sfruttate, contenendo al tempo stesso il rischio di abusi. È una scelta che posiziona Google in diretta competizione con Anthropic, che con il suo modello Mythos ha costruito un vantaggio precoce nell’automazione della difesa del codice.

Disponibilità e protezioni di sicurezza integrate

Gemini 3.6 Flash e Gemini 3.5 Flash-Lite sono disponibili da subito attraverso una serie di canali: Gemini API via Google AI Studio e Android Studio per gli sviluppatori, Gemini Enterprise Agent Platform per le imprese, l’app Gemini per gli utenti finali. 3.5 Flash-Lite sta inoltre arrivando su Google Search.

Le protezioni Frontier Safety in Gemini 3.6 Flash

Sul fronte della sicurezza, 3.6 Flash introduce salvaguardie Frontier Safety potenziate nei domini CBRN — chimico, biologico, radiologico, nucleare — e nella prevenzione degli abusi in ambito cyber offensivo. Il modello è stato progettato per essere più resistente ai jailbreak, mantenendo al contempo una soglia di rifiuto bassa per gli usi legittimi.

È un equilibrio difficile da trovare, e Google lo riconosce implicitamente: la sfida non è solo rendere i modelli più capaci, ma farlo in modo che la capacità aggiuntiva non si trasformi in un vettore di rischio.

Sullo sfondo, Google ha confermato che il pre-training di Gemini 4 è già iniziato — definito il run più ambizioso mai avviato dall’azienda — mentre Gemini 3.5 Pro è in fase di test con i partner prima del rilascio generale. La traiettoria è tracciata: efficienza prima, poi potenza. Ma la vera domanda è se Google riuscirà a mantenere il ritmo di rilascio necessario per non perdere terreno nei segmenti dove Anthropic, OpenAI e i rivali cinesi stanno accelerando.

FAQ

Quali sono i principali miglioramenti di Gemini 3.6 Flash rispetto a 3.5 Flash?

Gemini 3.6 Flash riduce l’utilizzo di token in output del 17%, migliora le prestazioni in coding e knowledge work, e abbassa il costo per token rispetto a 3.5 Flash. Il prezzo è di $1,50 per milione di token in input e $7,50 per milione in output.

Chi può accedere al modello Gemini 3.5 Flash Cyber?

L’accesso a Gemini 3.5 Flash Cyber è riservato esclusivamente a governi e partner fidati attraverso un programma pilota a disponibilità limitata, tramite la piattaforma CodeMender.

Dove sono disponibili Gemini 3.6 Flash e 3.5 Flash-Lite?

Sono disponibili tramite Gemini API, Google AI Studio, Android Studio, Gemini Enterprise Agent Platform, l’app Gemini e Google Search, a partire dal 21 luglio 2026.

Quali misure di sicurezza include Gemini 3.6 Flash?

Gemini 3.6 Flash include salvaguardie Frontier Safety potenziate nei domini chimico, biologico, radiologico, nucleare e cyber offensivo, con una maggiore resistenza ai jailbreak e una soglia di rifiuto ridotta per gli utilizzi legittimi.

Contenuto realizzato con l’assistenza dell’intelligenza artificiale e con revisione editoriale umana.

Francesco Antonio Russo
Francesco Antonio Russo è un analista e divulgatore nel settore delle criptovalute, del Web3 e dell’Intelligenza Artificiale. Da più di 6 anni studia l’evoluzione dei mercati digitali e delle tecnologie decentralizzate, con particolare attenzione all’impatto economico e sociale della blockchain. Su Cryptonomist approfondisce trend, regolamentazioni e innovazioni, offrendo contenuti accurati e comprensibili anche ai non addetti ai lavori.
RELATED ARTICLES

Stay updated on all the news about cryptocurrencies and the entire world of blockchain.

Featured video

LATEST