Radar · 21/07/2026 · modelli

Gemini 3.6 Flash costa meno, 3.5 Flash Cyber punta alla sicurezza del codice

Google annuncia tre nuovi modelli Gemini: 3.6 Flash, 3.5 Flash-Lite e 3.5 Flash Cyber. Il primo è il modello general-purpose, il secondo è il modello economico per compiti veloci, il terzo è specializzato nella sicurezza del codice.

Se usi modelli Google via API o dentro il tuo IDE, la notizia concreta è il prezzo. 3.6 Flash costa $1.50 per milione di token in input e $7.50 in output, meno della generazione precedente. Secondo l’Artificial Analysis Index consuma il 17% di token in meno per lo stesso compito, con punte del 65% in meno su benchmark di coding come DeepSWE.

3.5 Flash Cyber è la novità più interessante per chi fa sicurezza: un modello leggero addestrato per trovare e correggere vulnerabilità, abbinato a CodeMender, l’agente di sicurezza del codice di Google. The Verge lo descrive come alternativa economica a modelli di sicurezza più costosi come Mythos di Anthropic.

3.6 Flash è già disponibile in GitHub Copilot e su Amazon Bedrock.

Nel dettaglio

Cosa cambia davvero.

La serie Flash di Google è sempre stata la scelta per chi vuole qualità a un prezzo accessibile. 3.6 Flash aggiorna quella promessa: stessa classe di qualità di 3.5 Flash, ma con meno token spesi e un costo inferiore per token. Per chi fa girare agenti in produzione, dove un task può richiedere decine di chiamate al modello, la differenza si accumula in fretta.

I numeri vanno letti con cautela. Il dato del 17% di riduzione dei token viene dall’Artificial Analysis Index, un benchmark indipendente. Il dato del 65% su DeepSWE viene da Google stessa e si riferisce a un benchmark specifico di coding. Il risparmio reale dipenderà dal tuo caso d’uso.

Flash Cyber e il pattern modello + agente.

3.5 Flash Cyber è il segnale più interessante dell’annuncio, non per il modello in sé ma per come è presentato. Google non lo lancia come un modello isolato: lo abbinano a CodeMender, un agente che orchestri le chiamate al modello per scansionare il codice, trovare vulnerabilità e proporre patch. È lo stesso pattern che abbiamo visto funzionare altrove: un modello specializzato governato da un’infrastruttura agente che decide quando chiamarlo, con quali contesti e come verificare il risultato.

La mossa è diretta contro Mythos di Anthropic, il modello di sicurezza che The Verge descrive come più costoso. Google posiziona Flash Cyber come alternativa accessibile per chi non ha il budget per i modelli frontier.

Cosa non sappiamo ancora.

Google non ha pubblicato benchmark indipendenti su Flash Cyber. Non è chiaro quali dataset di vulnerabilità siano stati usati per l’addestramento, né quanto sia ampia la copertura rispetto a un modello generalista usato con un buon prompt di sicurezza. Il confronto con Mythos è dichiarativo: finché non ci sono test comparativi, resta una claim di marketing.

La disponibilità di Flash Cyber è limitata all’ecosistema Google (API Gemini, Vertex AI). Se la tua infrastruttura gira su altro, per ora non è accessibile.

Gli altri due modelli.

3.5 Flash-Lite è il modello più veloce della serie: 350 token al secondo, secondo l’Artificial Analysis Index. Per compiti dove la latenza conta più della qualità (classificazione, estrazione dati, routing), è un’opzione concreta.

Google annuncia anche che Gemini 3.5 Pro è in testing con partner e che Gemini 4 ha iniziato il pre-training. Nessuna data per nessuno dei due.

Scrivi per cercare fra corso, playbook, skill, paper…