A Mountain View è andato in scena il Google I/O, la liturgia annuale dell’azienda fondata in un garage della Silicon Valley nel 1998. All’epoca esisteva il web ma i siti erano pochi e difficili da trovare. Creare un indice che portasse alle fonti di qualità fu l’idea che permise ai due fondatori di Google, Sergey Brin e Larry Page, di costruire un impero.
In (quasi) trent’anni Big G è diventata un colosso e l’ascesa dell’IA generativa ha contribuito ad amplificare la sua influenza e il suo valore.
Google vale oggi più di 4 trilioni di dollari e ha quasi 200mila dipendenti in tutto il mondo.
Alla guida dell’azienda, che oggi si chiama Alphabet e controlla oltre a Google anche YouTube, c’è Sundar Pichai, ingegnere di origini indiane promosso ad amministratore delegato quando Brin e Page hanno lasciato il timone dell'azienda, ormai diversi anni fa. Ed è stato proprio Pichai, recentemente celebrato dalla rivista Time come colui che “ha portato Google al comando della corsa all’IA”, a snocciolare sul palco dello Shoreline Amphiteatre i numeri di un'industria che cresce più in fretta di quanto chiunque riesca a metabolizzare.
Il dato simbolo è quello dei token, cioè le unità di base con cui i modelli linguistici "spezzettano" e processano qualsiasi input: una parola, una porzione di parola, un pezzo di codice, un frame video. Ogni volta che una persona chiede qualcosa a un'IA, il modello macina token per capire la domanda e per generare la risposta: sono la valuta computazionale dell'era dei modelli generativi.
Pichai ha usato proprio i token per misurare la corsa all’intelligenza artificiale moderna. Due anni fa Google ne processava 9,7 trilioni al mese sulle sue piattaforme. All'I/O dell'anno scorso erano 480 trilioni. Quest'anno il numero è ancora moltiplicato per sette: oltre 3,2 quadrilioni di token al mese.
“È una crescita davvero incredibile”, ha detto il CEO, comunicando che le API per gli sviluppatori macinano circa 19 miliardi di token al minuto e che i programmatori che costruiscono sopra i modelli Google sono diventati 8,5 milioni.
Il discorso di Pichai è quello tipico di una Big Tech in cima all'onda: Google vanta tredici prodotti con oltre un miliardo di utenti, l'app Gemini passata da 400 a 900 milioni di utenti attivi mensili nell’ultimo anno, le richieste giornaliere cresciute di sette volte, 50 miliardi di immagini generate con Nano Banana, il modello che permette di creare foto realistiche a partire da una descrizione testuale. E un investimento in infrastrutture che fa girare la testa: “Nel 2022 spendevamo 31 miliardi di dollari in CapEx - dice il CEO di Google -. Quest'anno ci aspettiamo che quel numero sia circa sei volte tanto, approssimativamente tra i 180 e i 190 miliardi di dollari”.
Però, fuori dal Shoreline Amphitheatre
Mentre Pichai parla di "iper-progresso" e di un momento in cui “le persone vogliono vedere un valore reale nei prodotti”, il mondo là fuori sta cominciando a fare i conti con l'altra faccia della corsa.
I licenziamenti nel comparto tech americano hanno superato i 113.000 a maggio 2026 -una media di circa 825 al giorno - e Meta sta eseguendo proprio in questi giorni il taglio più significativo dell'anno: 8.000 posizioni che secondo Reuters potrebbero arrivare al 20% della forza lavoro globale. Aziende che tagliano al ritmo più alto degli ultimi tre anni stanno contemporaneamente riportando i ricavi più alti della loro storia. Oltre 92.000 lavoratori tech licenziati nel solo 2026, quasi 900.000 dal 2020 secondo il sito Layoffs.fyi.
I colossi come Google non stanno solo spendendo centinaia di miliardi per costruire l'infrastruttura dell'IA, stanno costruendo una tecnologia che ha impatti positivi sulla società - nel settore medico per esempio, con AlphaFold, oppure nella individuazione precoce di incendi boschivi o rischi di alluvioni - ma che al tempo stesso spaventa per la possibilità che un giorno le macchine possano sostituire l’uomo nei compiti cognitivi complessi.
Qualche giorno prima dell'I/O, all'Università dell'Arizona, l'ex CEO di Google Eric Schmidt è stato fischiato più volte mentre parlava di intelligenza artificiale durante un commencement speech. “So cosa molti di voi stanno provando. Vi sento”, ha detto Schmidt rivolgendosi alla platea mentre molti continuavano a fischiarlo. “C'è una paura nella vostra generazione che il futuro sia già scritto, che le macchine stiano arrivando, che i posti di lavoro stiano evaporando”. “Quando qualcuno ti offre un posto sul razzo, non chiedi quale posto. Sali e basta”, ha aggiunto, ottenendo altri fischi. Non è un caso isolato: poche settimane prima, alla University of Central Florida, l'imprenditrice Gloria Caulfield era stata accolta dagli stessi fischi quando aveva definito l'IA “la prossima rivoluzione industriale”.
Il quadro su cui si appoggia l'I/O di Google, insomma, è uno in cui l'entusiasmo industriale e il malessere sociale, negli ultimi tempi, crescono in parallelo. Ma la conferenza di Mountain View non è un momento di riflessione.
La ricerca sul web diventa più di una conversazione
Il prodotto più iconico di Google, il motore di ricerca, è stato al centro dell’intervento di Liz Reid, la vicepresidente che ne supervisiona lo sviluppo. L’AI Mode - una ricerca conversazionale lanciata ormai da alcuni mesi anche in Italia - ha superato il miliardo di utenti mensili, le AI Overview - le sintesi dell’IA che danno una panoramica di un argomento cercato su Google - ne contano 2,5 miliardi e la barra di ricerca si prepara al suo restyling più radicale in 25 anni: diventa più grande, accetta domande lunghe e conversazionali, con suggerimenti di domande potenziati dall'IA e input multimodali [vuol dire che si potranno caricare foto o documenti per dare più contesto all’intelligenza artificiale prima di una ricerca].
“Le persone esprimono appieno le loro domande in modo estremamente dettagliato, ponendo quelle domande di follow-up e cercando attraverso diverse modalità”, ha detto Reid. La modalità AI verrà aggiornata a Gemini 3.5 Flash - un nuovo modello annunciato proprio a I/O - e AI Overviews e AI Mode si fondono in un'unica esperienza fluida: una panoramica generata dall'IA, poi la possibilità di passare alla modalità conversazionale per i follow-up, sia su mobile che desktop.
La parte interessante – e quella che racconta meglio dove sta andando Google – sono gli agenti dentro la Ricerca: si impostano una volta e lavorano in background per monitorare informazioni nel tempo. L'esempio fatto da Reid è efficace: si imposta un agente perché tenga d'occhio i movimenti di un mercato finanziario secondo parametri specifici, e l’IA aggiorna l’utente soltanto quando si verificano determinate condizioni, con un riassunto e link su cui approfondire.
Anche in questo caso Google spinge su una narrazione che mette un po’ alle corde gli esseri umani, perché parla di agenti di ricerca “attivi in background 24 ore su 24, 7 giorni su 7”. Sono aiutanti instancabili, che svolgono compiti con una continuità insostenibile per una persona.
L'altra novità grossa sulla ricerca - tramite Google - è la capacità dell’IA di generare al volo un'interfaccia che approfondisca o gestisca la domanda dell’utente: il motore di ricerca si trasforma in una sorta di strumento di coding autonomo, e infatti questa funzione è basata su Antigravity, la piattaforma di Big G dedicata alla programmazione agentica.
Se si chiede per esempio "in che modo i buchi neri influenzano lo spazio-tempo?", Google costruisce in tempo reale una visualizzazione interattiva del fenomeno - interattivo e modificabile - al posto del classico elenco di risultati.
A far girare il tutto, dietro le quinte, è Gemini 3.5 Flash che scrive il codice dell'interfaccia mentre l’utente aspetta la risposta. “In precedenza avevamo bisogno di ingegneri per costruire ogni singola funzionalità del Search”, ha spiegato Reid. “Ora le persone possono semplicemente chiedere, e ottengono funzionalità interattive costruite apposta per loro”. In pratica, ogni ricerca può diventare una piccola app monouso.
Gemini Omni: i “world model” entrano nei video
Koray Kavukcuoglu, Chief AI Architect di Google e CTO di Google DeepMind, ha presentato Gemini Omni, il primo modello di Google capace di accettare qualunque tipo di input - testo, immagine, audio, video - e restituire qualunque tipo di output. Cosa cambia rispetto ai generatori video che abbiamo già visto, da Veo (della stessa Google) a Sora (di OpenAI) e ai successori?
La differenza principale è l’applicazione dei world model: invece di limitarsi a prevedere il prossimo frame plausibile, Omni attinge alla conoscenza generale di Gemini sulla fisica, sulle relazioni causali, sulla coerenza degli oggetti nello spazio.
“Modelli come Veo, Nano Banana e Gemini sono in grado di creare video, immagini e persino simulazioni interattive estremamente realistici”, ha detto Kavukcuoglu. “Non sono simulazioni perfette del mondo, ma dimostrano una comprensione della fisica intuitiva, che è fondamentale”.
In pratica, mentre i modelli di generazione video precedenti faticavano con prompt astratti o scientifici, qui basta scrivere "video esplicativo in plastilina del ripiegamento proteico" per ottenere qualcosa di sensato.
Omni accetta in input audio, immagini e video insieme, e ragiona su tutti gli input in una volta sola per produrre una clip coerente. È anche un editor: si può prendere un proprio video e modificarne il personaggio, lo stile, i dettagli, senza dover ricostruire la scena da capo.
Il primo modello della famiglia, Gemini Omni Flash, è disponibile per gli abbonati Google AI Plus, Pro e Ultra dentro l'app Gemini, Google Flow e YouTube Shorts. È in arrivo anche Omni Pro, più potente.
Tutti i contenuti prodotti vengono marchiati con il watermark invisibile SynthID, su cui Google ha messo dentro in tre anni più di 100 miliardi di immagini e video, e che ora viene esteso a Search e Chrome: basterà un clic destro su un'immagine per chiedere: “è stata generata con l'IA?”.
Gemini 3.5 Flash, il nuovo modello di punta parte dalla rapidità
A Mountain View, nella vetrina dell’I/O, è stato messo in mostra anche un nuovo modello: Gemini 3.5 Flash.
Pichai sostiene che nonostante sia un modello pensato per le risposte più semplici e veloci, è comunque in grado di far meglio di Gemini 3.1 Pro - il più potente della versione precedente - su quasi tutti i benchmark, con un salto particolarmente vistoso su GDPVal, il test che misura compiti del mondo reale ed economicamente rilevanti.
Secondo lo studio di Artificial Analysis citata sul palco, Gemini 3.5 Flash è quattro volte più veloce degli altri modelli di frontiera in token al secondo. E Kavukcuoglu ha annunciato una versione ulteriormente ottimizzata, dodici volte più veloce a parità di qualità, riservata agli utenti di Antigravity.
“Internamente, i nostri sviluppatori stanno utilizzando 3.5 Flash con una versione ripensata della nostra piattaforma di sviluppo orientata agli agenti, Antigravity 2.0, e ha accelerato drammaticamente il modo in cui costruiamo”, ha detto Pichai.
Il messaggio commerciale è esplicito: se le aziende stanno bruciando i budget annuali dei token già a maggio, spostare l'80% dei carichi di lavoro su un mix di 3.5 Flash e modelli più grandi farebbe risparmiare, secondo Pichai, “oltre 1 miliardo di dollari all'anno” per le aziende più grandi su Google Cloud.
Gemini 3.5 Pro è già in uso interno e arriverà a tutti il mese prossimo.
Le capacità “agentiche” costituiscono la promessa più spinta: il modello è stato co-sviluppato con Antigravity, la piattaforma agentica di Google, che ora esce dall'ambiente di sviluppo e diventa un'app desktop indipendente per orchestrare squadre di agenti: uno che scrive un sito, ad esempio, uno che genera asset di brand, uno che pianifica l'architettura del prodotto. Tutti al lavoro contemporaneamente.
Gemini Spark, un agente IA “per tutti”
Sul versante consumer, l'agente personale si chiama Gemini Spark: gira su macchine virtuali dedicate in Google Cloud, è attivo 24/7 in background, si integra prima con gli strumenti Google e poi via MCP con applicazioni di terze parti.
Pichai l'ha presentato come l'inizio della strategia dell’azienda per portare gli agenti “a chiunque, in modo molto sicuro e protetto”.