Mostra sommario Nascondi sommario
- Numeri e adozione: il boom dei token, degli sviluppatori e degli utenti
- Interazione conversazionale: voce, video e ricerca che parlano all’utente
- Investimenti e chip: le TPU di ottava generazione e l’efficienza energetica
- Modelli di nuova generazione: Gemini Omni e 3.5 Flash
- Agenti autonomi e assistenti personali: Antigravity 2.0 e Gemini Spark
- Strumenti per lavoro creativo e produttività: Workspace rinnovato
- Verifica dei contenuti e collaborazioni per l’affidabilità
- Scienza e dispositivi: agenti per la ricerca e occhiali intelligenti
A Google I/O 2026 Mountain View ha tracciato una nuova mappa dell’innovazione: l’azienda dichiara il passaggio dall’era delle idee all’universo delle applicazioni quotidiane basate su intelligenza artificiale. Sundar Pichai ha descritto una strategia “full-stack” che intreccia chip, modelli e servizi per portare i generatori di contenuti nella vita di miliardi di persone.
Numeri e adozione: il boom dei token, degli sviluppatori e degli utenti
I dati presentati mostrano una crescita impressionante nell’uso dei modelli generativi e nell’infrastruttura necessaria a sostenerli.
Garmin Cirqa: smart band senza schermo per salute e fitness, scopri i prezzi
Saldi Epic Games Store: offerte shock fino al 90% su centinaia di giochi
- Token processati: da 9,7 trilioni mensili due anni fa a oltre 3,2 quadrilioni oggi.
- API AI: circa 19 miliardi di token al minuto.
- Comunità di sviluppatori: oltre 8,5 milioni.
- Client enterprise: più di 375 aziende su Google Cloud hanno superato il trilione di token ciascuna.
- Prodotti su larga scala: 13 servizi con oltre un miliardo di utenti; cinque superano i tre miliardi.
Al cuore della diffusione c’è l’ecosistema Gemini, che alimenta funzioni avanzate nella Ricerca e nell’app dedicata, con numeri di utenti che si avvicinano al miliardo.
Interazione conversazionale: voce, video e ricerca che parlano all’utente
Le interfacce stanno diventando conversazioni. La voce, il testo e il video si fondono per rendere più naturale il rapporto con i servizi.
- Ask YouTube: cerca risposte nei video e porta l’utente al punto esatto del contenuto.
- Ask Maps: navigazione complessa con istruzioni conversazionali.
- Docs Live: crea documenti complessi dettando idee; l’AI struttura il testo e, con il permesso, recupera dati da Gmail, Drive e dal web.
- Funzionalità vocali simili arriveranno anche in Keep e Gmail Live.
Investimenti e chip: le TPU di ottava generazione e l’efficienza energetica
Per sostenere il carico di lavoro l’azienda aumenta gli investimenti e rinnova il proprio stack hardware.
- CapEx stimato per il 2026: 190 miliardi di dollari.
- Nuova architettura TPU: un approccio a due chip.
- TPU 8t: progettata per l’addestramento su larga scala; offre circa 3x la potenza grezza della generazione precedente.
- TPU 8i: ottimizzata per l’inferenza, con latenza ridotta e maggior efficienza.
- Entrambi i chip raddoppiano le prestazioni per watt rispetto al passato.
Grazie a questi progressi è possibile distribuire i carichi su una scala globale e ridurre i tempi di addestramento da mesi a settimane.
Modelli di nuova generazione: Gemini Omni e 3.5 Flash
Sono state presentate due novità principali che ridefiniscono capacità e costi dei modelli linguistici e multimodali.
Gemini Omni
Definito come un “world model”, Omni non si limita a predire testo. Interpreta e genera output in molteplici modalità.
- Comprende principi fisici di base, come gravità e dinamica.
- Permette modifiche video iterative e trasformazioni stilistiche tramite comandi conversazionali.
- Disponibile subito nella variante Omni Flash su app Gemini, Google Flow e per YouTube Shorts.
Gemini 3.5 Flash
Un modello pensato per efficienza e costi ridotti, ma con performance elevate.
- Più economico di molti concorrenti di fascia alta.
- Supera la versione precedente in quasi tutti i benchmark e in capacità di programmazione.
- Output fino a 4 volte più veloce rispetto ai modelli comparabili.
- Per grandi aziende che spostano l’80% del carico su questo modello, il risparmio operativo può superare 1 miliardo di dollari all’anno.
La versione potenziata Gemini 3.5 Pro è prevista per il mese successivo.
Agenti autonomi e assistenti personali: Antigravity 2.0 e Gemini Spark
La direzione è quella di delegare compiti a agenti sempre più autonomi, sotto controllo umano.
- Antigravity 2.0: piattaforma per sviluppatori ora disponibile come app desktop. Orchestra coorti di agenti su una variante di Flash finemente ottimizzata.
- Prestazioni: agenti fino a 12 volte più veloci rispetto agli standard del settore.
- Gemini Spark: assistente personale che opera 24/7 su macchine virtuali in Google Cloud. Esegue compiti complessi in autonomia sotto supervisione.
- Integrazione prevista con email, chat, browser e dispositivi mobili tramite Android Halo.
La Ricerca si arricchirà di agenti informativi personali per produrre report continui, dashboard e interfacce dinamiche.
Strumenti per lavoro creativo e produttività: Workspace rinnovato
Gli aggiornamenti interessano editing, collaborazione e gestione della posta, con funzioni AI integrate.
- Google Pics: nuova app per generazione e ritocco delle immagini guidata da Nano Banana.
- Caratteristiche di Pics: segmentazione accurata, spostamento di elementi, modifica del testo nelle grafiche mantenendo font e design.
- Daily Brief: agente che sintetizza email, calendario e attività per offrire un briefing quotidiano.
- Google Flow: ambiente per progetti complessi con editing, brainstorming e “vibe coding” per effetti visivi.
- AI Inbox: bozze personalizzate, estrazione automatica di documenti citati e gestione semplificata delle attività.
Verifica dei contenuti e collaborazioni per l’affidabilità
La lotta ai deepfake e alla disinformazione resta centrale.
- SynthID: filigrana digitale che ha già marcato oltre 100 miliardi di immagini e video.
- Audio sintetico: oltre 60.000 anni di frammenti catalogati.
- Standard C2PA: protocolli di verifica che saranno integrati in Chrome e nella Ricerca.
- Collaborazioni con Nvidia, OpenAI, Kakaw ed Eleven Labs per adottare SynthID come riferimento comune.
Scienza e dispositivi: agenti per la ricerca e occhiali intelligenti
Le tecnologie vengono applicate anche a laboratori e all’elettronica di consumo.
- Gemini for Science: collega agenti Antigravity a più di trenta banche dati biomediche.
- Applicazioni: automazione di sperimentazione, analisi di dati e creazione di report scientifici.
- Occhiali intelligenti in arrivo in autunno: due modelli, audio-only e con display visivo.
- Funzioni: assistenza vocale hands-free e sovrapposizione digitale di informazioni nel campo visivo.











