Dov'è Gemini 3.5 Pro? L'offensiva Gemini di Google: quando la velocità diventa più importante dell'ingegnosità
Pre-release di Xpert
Disponibile in 27 lingue 📢
Preferisco Xpert.Digital su GoogleⓘPubblicato il: 23 luglio 2026 / Aggiornato il: 23 luglio 2026 – Autore: Konrad Wolfenstein

Dov'è il Gemini 3.5 Pro? L'offensiva Gemini di Google: quando la velocità diventa più importante dell'ingegno – Immagine: Xpert.Digital
Calo dei prezzi nell'IA: come Google sta rivoluzionando il mercato con Gemini 3.6 Flash
Più economico anziché geniale: il sorprendente cambio di strategia di Google al Gemini
Il nuovo piano di Google per l'IA: l'azienda sta abbandonando la corsa all'intelligenza artificiale più avanzata?
Google sta cambiando radicalmente le regole del gioco nella corsa globale all'intelligenza artificiale. Invece di impegnarsi in una battaglia isolata con concorrenti come OpenAI e Anthropic per il modello di punta più intelligente – e quindi più costoso – il gigante tecnologico si sta concentrando sull'efficienza radicale. Con la sua nuova famiglia di modelli incentrata su Gemini 3.6 Flash, l'estremamente efficiente dal punto di vista energetico Flash-Lite e il modello Cyber, altamente specializzato ma attualmente top secret, un nuovo parametro sta diventando centrale: la riduzione dei costi con la massima praticità. Mentre l'attesissimo modello di punta Gemini 3.5 Pro non è ancora disponibile, Google si sta riposizionando come fornitore fondamentale e indispensabile per la crescita rapida dell'economia degli agenti. Ma cosa significa questo cambio di strategia per il futuro dell'IA generativa? E perché Google considera il suo ultimo modello di sicurezza troppo rischioso per il grande pubblico? Il seguente articolo analizza il percorso pragmatico di Google verso la prossima generazione di IA ed esamina il suo enorme impatto su aziende e sviluppatori.
Perché Google preferisce realizzare tre piccoli modelli piuttosto che mantenere un'unica grande promessa
L'ultima mossa di Google nella corsa tra i principali fornitori di intelligenza artificiale segue uno schema che sta diventando sempre più la norma nel settore: invece di un singolo progresso monolitico, l'azienda sta offrendo un'intera famiglia di modelli pensati per diversi casi d'uso. Con Gemini 3.6 Flash, Gemini 3.5 Flash-Lite e Gemini 3.5 Flash Cyber, Google lancia la prossima fase evolutiva a pochi mesi dall'introduzione di Gemini 3.5 Flash a maggio. Ciò che è notevole non è tanto la sostanza tecnica delle singole innovazioni, quanto il messaggio strategico sottostante: Google non si posiziona più principalmente come fornitore del modello più intelligente, ma piuttosto come fornitore dell'ecosistema di intelligenza artificiale più efficiente dal punto di vista economico.
La frugalità come nuovo status symbol nella corsa all'intelligenza artificiale
Il principale punto di forza di Gemini 3.6 Flash non è l'aumento dell'intelligenza, bensì la riduzione dei costi. Google pubblicizza una riduzione di circa il 17% nel consumo di token rispetto al suo predecessore, la versione 3.5 Flash, basandosi sulle misurazioni dell'Artificial Analysis Index. In alcuni benchmark, come DeepSWE, si afferma che il costo per token di output generato si riduca addirittura del 65%. Allo stesso tempo, anche il prezzo nominale è stato ridotto: mentre Gemini 3.5 Flash veniva fatturato a 1,50 dollari per milione di token di input e 9 dollari per milione di token di output, Gemini 3.6 Flash costa solo 7,50 dollari per milione di token di output, con costi di input invariati. Questa combinazione di minori consumi e un prezzo unitario inferiore si traduce in un effetto chiaramente percepibile sui costi operativi delle aziende che implementano l'IA generativa su larga scala.
Questa attenzione all'efficienza non è casuale, ma piuttosto l'espressione di una realtà economica che sta plasmando l'intero settore. I modelli linguistici di grandi dimensioni comportano costi computazionali per ogni singola query, che si sommano a cifre considerevoli quando si tratta di milioni o miliardi di query giornaliere. I fornitori di servizi cloud e gli operatori di piattaforme che desiderano scalare sistemi di agenti in grado di gestire autonomamente attività a più fasi devono ridurre drasticamente il consumo di token per ogni passaggio; in caso contrario, i benefici economici di tali sistemi saranno annullati dai costi dell'infrastruttura. Google affronta proprio questo problema offrendo un nuovo modello che, secondo quanto dichiarato dall'azienda stessa, richiede un minor numero di processi di pensiero e di chiamate a strumenti per completare flussi di lavoro a più fasi.
Progressi tecnologici che vanno oltre la mera questione dei costi
Oltre a una maggiore efficienza, Gemini 3.6 Flash mostra miglioramenti anche nei benchmark di performance classici. Nei compiti di programmazione, misurati dal test DeepSWE, il tasso di successo sale dal 37 al 49%. Nel benchmark di ricerca ML MLE Bench, il modello migliora dal 49,7 al 63,9%. Progressi sono evidenti anche nei compiti basati sulla conoscenza: il punteggio GDPval-AA sale da 1349 a 1421 punti. Particolarmente degno di nota è il miglioramento nell'alfabetizzazione informatica, nello specifico la capacità dell'IA di navigare autonomamente nelle interfacce utente grafiche: il punteggio OSWorld-Verified aumenta dal 78,4 all'83%. Inoltre, la base di conoscenza del modello è stata aggiornata da gennaio 2025 a marzo 2026, un vantaggio pratico significativo nell'odierno panorama tecnologico in rapida evoluzione.
Nonostante questi progressi, Gemini 3.6 Flash rimane chiaramente un modello di fascia media. Nei test comparativi diretti su piattaforme come Arena.ai, si posiziona dietro a modelli di punta come Claude Opus o il nuovo GPT 5.6-Sol. Non si tratta di un punto debole, bensì di una scelta progettuale deliberata: Google rinuncia all'affermazione di offrire il modello più potente in assoluto e si concentra invece su un segmento in cui velocità, costo e qualità sufficiente sono più importanti del massimo teorico in termini di intelligenza. Questa strategia ricorda la classica segmentazione del mercato in altri settori tecnologici, come quello dei processori, dove i produttori offrono costantemente prodotti di fascia media efficienti per applicazioni di massa, accanto a chip ad alte prestazioni.
Il nuovo strato di base per l'economia degli agenti
Con Gemini 3.5 Flash-Lite, Google persegue un obiettivo di efficienza ancora più ambizioso. Questo modello è esplicitamente progettato come base per la creazione e la scalabilità di agenti di intelligenza artificiale, ovvero sistemi in grado di elaborare autonomamente attività complesse in più fasi, senza richiedere l'intervento umano in ogni passaggio. Supera significativamente il suo predecessore, 3.1 Flash-Lite, nei benchmark sia per le attività basate sulla conoscenza che per quelle di programmazione, mentre i costi operativi rimangono eccezionalmente bassi, pari a 0,30 dollari per milione di token di input e 2,50 dollari per milione di token di output. La flessibilità del modello è notevole: a seconda del caso d'uso, può essere configurato per operare in modo particolarmente rapido ed economico oppure per fare maggiore affidamento sulle sue capacità di ragionamento. Quest'ultima opzione si rende necessaria quando le attività devono essere elaborate in modo collaborativo da diverse subroutine specializzate, note come subagenti.
Questa scelta architetturale rivela la direzione in cui si sta muovendo l'intero settore. Molti osservatori di mercato ritengono che il futuro dell'IA non risieda in modelli individuali sempre più grandi, bensì in sistemi in rete di modelli più piccoli e specializzati che, lavorando insieme, mappano processi complessi. Un singolo calcolo di grandi dimensioni eseguito da un modello potente viene sostituito da molte query piccole ed economiche a modelli snelli che collaborano in parallelo o in sequenza. Un modello come Flash-Lite si adatta perfettamente a questa architettura perché riduce il costo per query a tal punto da rendere economicamente sostenibile un elevato numero di query. L'annuncio che Flash-Lite fornirà risultati di IA anche nella ricerca web di Google sottolinea ulteriormente il ruolo centrale che Google attribuisce a questo modello snello nel mercato di massa.
Uno strumento dalle due facce: la sicurezza informatica come settore imprenditoriale
La terza nuova versione, Gemini 3.5 Flash Cyber, segna una significativa espansione della serie Flash in un'area altamente sensibile. Questo modello è stato specificamente addestrato per individuare e analizzare le vulnerabilità di sicurezza nel codice software e per suggerire misure correttive. Questa specializzazione si basa sull'efficiente Gemini 3.5 Flash, ulteriormente perfezionato attraverso un addestramento mirato per analizzare grandi codebase. Invece di inviare un'unica, onerosa query a un modello molto grande, l'agente di sicurezza generale Codemender richiama più volte il modello Cyber ottimizzato per esaminare in parallelo diversi percorsi di esecuzione di un programma. I singoli risultati parziali vengono quindi consolidati in un report completo.
Le prestazioni di questo approccio sono evidenti in cifre concrete. In un test sul complesso motore JavaScript V8, il modello di sicurezza informatica ha identificato 55 vulnerabilità distinte e confermate, mentre il modello Flash generico ne ha trovate solo 47 e Claude Opus 4.6 di Anthropic appena 36. Dieci delle vulnerabilità scoperte sono state individuate esclusivamente dal modello di sicurezza informatica specializzato. Nel benchmark CyberGym, che valuta gli agenti di intelligenza artificiale rispetto a centinaia di vulnerabilità software reali, il modello, in combinazione con più esecuzioni, raggiunge un livello di prestazioni paragonabile a modelli di sicurezza significativamente più grandi e costosi di fornitori come Anthropic e OpenAI. In un test interno condotto dal team di sicurezza cloud di Google, il modello ha scoperto diverse vulnerabilità critiche nei sistemi di produzione in sole due ore, tra cui una vulnerabilità di corruzione della memoria per la quale ha anche generato un exploit funzionante che aggirava i comuni meccanismi di protezione come la randomizzazione dello spazio degli indirizzi.
Questa enorme capacità di identificare le vulnerabilità nel codice rappresenta anche il rischio maggiore del modello. Google stessa riconosce apertamente la duplice natura della tecnologia: la stessa capacità che consente ai difensori di colmare le vulnerabilità potrebbe essere utilizzata dagli aggressori per sfruttare proprio quelle stesse falle prima che vengano corrette. Per questo motivo, Google ha deciso di non rendere il modello pubblicamente disponibile per il momento, ma di condividerlo esclusivamente attraverso il proprio strumento di sicurezza, Codemender, nell'ambito di un programma pilota strettamente controllato con governi e partner selezionati e fidati. Non è stata fornita alcuna tempistica precisa per l'ampliamento dell'accesso. Questa riluttanza riflette una crescente consapevolezza nel settore che i sistemi di intelligenza artificiale altamente specializzati nel campo della sicurezza non possono essere rilasciati con le stesse regole delle applicazioni chatbot generiche.
Una nuova dimensione della trasformazione digitale con 'Managed AI' (Intelligenza Artificiale) - Piattaforma e soluzione B2B | Xpert Consulting

Una nuova dimensione della trasformazione digitale con 'Managed AI' (Intelligenza Artificiale) – Piattaforma e soluzione B2B | Xpert Consulting - Immagine: Xpert.Digital
Qui scoprirai come la tua azienda può implementare soluzioni di intelligenza artificiale personalizzate in modo rapido, sicuro e senza elevate barriere all'ingresso.
Una piattaforma di intelligenza artificiale gestita è la soluzione completa e senza pensieri per l'intelligenza artificiale. Invece di dover gestire tecnologie complesse, infrastrutture costose e lunghi processi di sviluppo, riceverai una soluzione pronta all'uso, su misura per le tue esigenze, da un partner specializzato, spesso entro pochi giorni.
I principali vantaggi in sintesi:
⚡ Implementazione rapida: dall'idea all'applicazione pronta all'uso in pochi giorni, non mesi. Forniamo soluzioni pratiche che creano un valore aggiunto immediato.
🔒 Massima sicurezza dei dati: i tuoi dati sensibili restano con te. Garantiamo un'elaborazione sicura e conforme alle normative, senza condividere i dati con terze parti.
💸 Nessun rischio finanziario: paghi solo per i risultati. Gli elevati investimenti iniziali in hardware, software o personale vengono completamente eliminati.
🎯 Concentrati sul tuo core business: concentrati su ciò che sai fare meglio. Ci occupiamo dell'intera implementazione tecnica, del funzionamento e della manutenzione della tua soluzione di intelligenza artificiale.
📈 A prova di futuro e scalabile: la tua IA cresce con te. Garantiamo ottimizzazione e scalabilità continue e adattiamo i modelli in modo flessibile alle nuove esigenze.
Maggiori informazioni qui:
Google posticipa Gemini 3.5 Pro e si concentra su un'importante offensiva incentrata su Flash
Il mistero che avvolge il modello di punta scomparso
Ciò che colpisce dell'intero annuncio è ciò che manca: Gemini 3.5 Pro, il modello più potente dell'attuale generazione, era già atteso al Google I/O di maggio e da allora non si è ancora concretizzato. Google si limita a spiegare che la nuova versione è attualmente in fase di test con partner selezionati e sarà resa disponibile dopo il completamento con successo di tali test. L'azienda non ha ancora fornito una data di rilascio precisa, ma sottolinea che l'attesa non dovrebbe essere ancora lunga. Dal punto di vista di diversi osservatori del settore, questo ripetuto rinvio suggerisce che la versione Pro non abbia ancora raggiunto internamente i risultati desiderati in compiti complessi di programmazione e ragionamento, motivo per cui Google apparentemente preferisce aspettare piuttosto che rilasciare un prodotto che non soddisfi i propri standard di qualità o le aspettative dei concorrenti.
Questa reticenza getta una luce interessante sulle dinamiche competitive tra i principali fornitori di IA. Mentre OpenAI e Anthropic stanno rilasciando nuovi modelli di punta in rapida successione, Google si sta attualmente concentrando visibilmente sui segmenti di prestazioni di fascia media e base. Questo può essere interpretato come un segno di cautela, ma anche come un'astuta strategia di mercato: invece di presentare un modello di punta potenzialmente ancora in fase di sviluppo, Google si sta assicurando quote di mercato a tutto campo con modelli accessibili, veloci e pratici che coprono già in modo affidabile la stragrande maggioranza delle applicazioni aziendali quotidiane. Per molti casi d'uso aziendali, come l'elaborazione di documenti, la creazione di report o semplici attività di programmazione, le prestazioni massime assolute di un modello sono comunque di secondaria importanza, purché velocità e costi siano adeguati.
Disponibilità e integrazione nell'ecosistema esistente
L'adozione pratica dei nuovi modelli è straordinariamente rapida e diffusa. Gemini 3.6 Flash e Gemini 3.5 Flash-Lite sono già disponibili in Google AI Studio, Android Studio e nella piattaforma Gemini Enterprise Agent. Inoltre, la versione 3.6 Flash è stata integrata nell'ambiente di sviluppo Antigravity e nell'app Gemini Enterprise, mentre entrambi i modelli sono disponibili anche nella normale app Gemini per utenti finali. Particolarmente degno di nota è l'annuncio che Flash-Lite fornirà presto anche i risultati generati dall'IA per le ricerche web di Google, il che, dato l'enorme volume di query provenienti da questo motore di ricerca, sottolinea l'importanza di un modello economicamente vantaggioso per Google in una dimensione completamente nuova. La rapida adozione è evidente anche al di fuori dell'ecosistema di Google: Gemini 3.6 Flash è stato integrato in GitHub Copilot il giorno stesso del suo annuncio, evidenziando la crescente integrazione dei principali fornitori di IA con gli strumenti di sviluppo consolidati.
Questa integrazione ampia e simultanea su diverse linee di prodotto dimostra l'approccio sistematico di Google per il lancio senza soluzione di continuità di nuove generazioni di modelli in tutto il suo portfolio di prodotti. A differenza dei precedenti cambiamenti di modello, che spesso comportavano intervalli evidenti tra l'annuncio e l'effettiva disponibilità nelle varie applicazioni, questo lancio sembra essere un processo meticolosamente orchestrato. Ciò suggerisce un'infrastruttura interna matura che consente l'implementazione quasi simultanea di un nuovo modello su tutti i punti di contatto con sviluppatori e utenti finali.
Uno sguardo al futuro: l'annuncio di Gemini 4
Oltre alle tre versioni specifiche del modello, l'annuncio di Google include anche un'anticipazione della prossima generazione principale. L'azienda conferma che il cosiddetto pre-addestramento, la fase iniziale fondamentale per l'addestramento di Gemini 4, è già iniziato. Google non fornisce dettagli tecnici specifici riguardanti l'architettura, le dimensioni o le capacità previste del prossimo modello su larga scala, ma sottolinea il suo entusiasmo per i progressi compiuti finora. Questa formulazione volutamente vaga è tipica della strategia di comunicazione dei grandi laboratori di intelligenza artificiale, che da un lato alimentano le aspettative, ma dall'altro non vogliono fare promesse verificabili che potrebbero poi rivelarsi premature.
Considerando il ciclo di rilascio degli ultimi anni, in cui Google ha tipicamente introdotto nuovi modelli di base alla sua conferenza per sviluppatori I/O in primavera, per poi realizzare importanti salti generazionali in autunno o in inverno, un rilascio di Gemini 4 verso la fine di quest'anno sembra plausibile. Per le aziende che pianificano la propria strategia di intelligenza artificiale a lungo termine, ciò significa che chiunque investa oggi nella famiglia Flash lo fa con la consapevolezza che una nuova base tecnologica potrebbe essere introdotta nel giro di pochi mesi, il che a sua volta richiederebbe nuove decisioni di migrazione. Questa breve emivita delle generazioni di modelli di intelligenza artificiale pone i reparti IT e gli architetti del software di fronte alla continua sfida di progettare i propri sistemi in modo tale che un cambiamento nei modelli sottostanti possa essere implementato nel modo più agevole possibile.
Contesto: Cosa rivela questa strategia modello sulla posizione di mercato di Google
Nel complesso, il recente annuncio dimostra che la competizione tra le principali aziende di intelligenza artificiale si sta sempre più dividendo in due dimensioni parallele. Da un lato, c'è la corsa al modello più intelligente e potente, un campo in cui Anthropic e OpenAI dominano attualmente i titoli dei giornali con i loro prodotti di punta, e in cui Google è visibilmente in ritardo con la sua versione Pro, il cui lancio è stato posticipato. Dall'altro lato, sta emergendo un secondo campo di battaglia, potenzialmente più significativo dal punto di vista economico: la competizione per l'infrastruttura più efficiente, conveniente e scalabile per l'implementazione quotidiana e su larga scala dell'IA nelle aziende, nei motori di ricerca e nei sistemi di agenti. In questo secondo ambito, Google si sta posizionando in modo molto deliberato e coerente all'avanguardia con la sua famiglia di prodotti Flash.
Questa duplice strategia è economicamente valida. Per la stragrande maggioranza delle applicazioni pratiche in ambito aziendale, dall'elaborazione automatizzata dei documenti e dai chatbot per l'assistenza clienti alle semplici attività di programmazione, l'intelligenza di altissimo livello di un modello non è il fattore determinante, bensì l'equilibrio tra costi, velocità e qualità sufficiente. I fornitori di servizi cloud che devono elaborare milioni di richieste al giorno traggono maggior vantaggio da una riduzione percentuale a due cifre dei costi dei token rispetto a un miglioramento marginale delle capacità di ragionamento di un costoso modello di fascia alta. Google sembra tradurre costantemente questa intuizione nella propria strategia di prodotto, inviando al contempo un segnale a sviluppatori e clienti aziendali: chiunque desideri creare agenti di intelligenza artificiale scalabili o integrazioni di ricerca economicamente vantaggiose troverà oggi una solida base, economicamente sostenibile, nella famiglia Flash, indipendentemente da quando verrà rilasciato il modello Pro di fascia alta.
Al contempo, l'introduzione del modello informatico specializzato rivela una nuova sfaccettatura del panorama competitivo dell'IA che va oltre le mere considerazioni di efficienza: il crescente utilizzo dell'IA come strumento attivo nella sicurezza informatica, con tutte le opportunità che ne derivano per i difensori e i rischi in caso di abuso. Il rilascio controllato e graduale di questo modello dimostra che Google è consapevole della propria responsabilità sociale nel rilasciare strumenti di sicurezza particolarmente potenti ed è disposta a limitare la portata commerciale, almeno temporaneamente, a favore di esigenze di sicurezza. L'evoluzione futura di questo equilibrio tra ampia disponibilità e accesso controllato diventerà probabilmente uno degli aspetti più interessanti da osservare, man mano che i modelli di IA diventeranno sempre più capaci di analizzare e manipolare autonomamente sistemi tecnici complessi.
Il tuo partner globale per il marketing e lo sviluppo aziendale
☑️ La nostra lingua aziendale è l'inglese o il tedesco
☑️ NOVITÀ: Corrispondenza nella tua lingua madre!
Io e il mio team saremo lieti di essere a tua disposizione come tuo consulente personale.
Puoi contattarmi compilando il modulo di contatto qui [email protected]:o semplicemente chiamandomi al numero +49 7348 4088 965. Il mio indirizzo email è
Non vedo l'ora di iniziare il nostro progetto comune.
☑️ Supporto alle PMI in strategia, consulenza, pianificazione e implementazione
☑️ Creazione o riallineamento della strategia digitale e digitalizzazione
☑️ Espansione e ottimizzazione dei processi di vendita internazionali
☑️ Piattaforme di trading B2B globali e digitali
☑️ Sviluppo aziendale pionieristico / Marketing / PR / Fiere
🎯🎯🎯 Hub B2B basato sui dati come soluzione quasi interna

La soluzione quasi interna: come Xpert.Digital colma le lacune operative nel marketing e nelle vendite B2B – Smart Content-Driven Business - Immagine: Xpert.Digital
Xpert.Digital è un hub industriale B2B basato sui dati, guidato da Konrad Wolfenstein . L'azienda funge da soluzione esterna, quasi interna, per i partner industriali, colmando le lacune operative in marketing, contenuti e vendite, senza richiedere risorse aggiuntive al cliente.
Maggiori informazioni qui:




















