• Tutta l'Informazione Ninja nella tua mail

  • Google entra nell’era agentica: Gemini smette di rispondere e inizia ad agire

    20 Maggio 2026

    Durante il Google I/O 2026, Google ha annunciato una nuova fase dell’intelligenza artificiale: Gemini diventa agentica, proattiva e multimodale, con integrazioni in Search, Workspace, YouTube e nuovi dispositivi.

    Gemini smette di rispondere e inizia ad agire

    Per anni l’intelligenza artificiale è stata raccontata come uno strumento capace di comprendere linguaggio, generare contenuti o rispondere alle domande degli utenti. Ora Google prova a spostare ancora più avanti il confine.

    Al Google I/O 2026, Sundar Pichai ha definito questo passaggio come l’ingresso nell’“era agentica” di Gemini: una fase in cui l’AI non si limita più a reagire ai prompt, ma può prendere iniziative, eseguire azioni e accompagnare le persone nelle attività quotidiane.

    È probabilmente il cambio di paradigma più importante presentato da Google dopo il debutto dell’AI generativa nella Ricerca.

    L’AI di Google cresce a ritmo record

    I numeri condivisi durante il keynote mostrano la scala raggiunta dall’ecosistema Gemini.

    AI Mode nella Ricerca ha superato il miliardo di utenti attivi mensili, mentre AI Overviews viene utilizzato da oltre 2,5 miliardi di persone ogni mese.

    Anche l’app Gemini continua a crescere rapidamente: in un anno è passata da 400 a oltre 900 milioni di utenti attivi mensili.

    Sul fronte sviluppo, Google ha dichiarato che più di 8,5 milioni di developer utilizzano ogni mese i modelli Gemini per creare applicazioni e servizi AI.

    La Ricerca diventa una conversazione continua

    Secondo Pichai, la Search di Google non sta più evolvendo come un semplice motore di query, ma come un ambiente conversazionale persistente.

    Le persone fanno domande più lunghe, articolate e contestuali. E quando utilizzano le funzionalità AI, tendono anche a cercare di più.

    Una trasformazione che cambia il modo in cui Google interpreta il rapporto tra utenti, informazioni e web.

    Ask YouTube cambia il modo di cercare video

    Tra gli annunci più interessanti c’è Ask YouTube, nuova esperienza che usa Gemini per reinterpretare la ricerca all’interno della piattaforma video.

    A search results page from "Ask YouTube" answering the question, "How to teach my 3 year old how to ride a pedal bike, they already know how to ride a balance bike?" and showing a video of a child on a bike.

    Invece di mostrare soltanto risultati tradizionali, il sistema aggrega contenuti pertinenti tra video lunghi e Shorts e accompagna direttamente l’utente nei passaggi più utili.

    L’obiettivo è ridurre il tempo necessario per trovare informazioni concrete dentro librerie video sempre più immense.

    YouTube diventa un motore di risposta

    La novità conferma una tendenza evidente: Google vuole trasformare YouTube in uno spazio dove non si va soltanto per intrattenimento, ma anche per ottenere risposte immediate, contestualizzate e conversazionali.

    I test di Ask YouTube sono già partiti negli Stati Uniti e il rollout più ampio è previsto durante l’estate.

    Workspace punta tutto sulla voce

    L’altra grande area di evoluzione riguarda la produttività.

    Con Docs Live, Google introduce la possibilità di creare e modificare documenti semplicemente parlando. Invece di scrivere prompt strutturati, gli utenti potranno descrivere idee, appunti o concetti vocalmente e lasciare che Gemini organizzi il contenuto.

    Funzioni vocali simili arriveranno anche in Gmail e Keep.

    Google Pics porta l’editing AI dentro Workspace

    Google ha annunciato anche Google Pics, nuovo strumento integrato in Workspace dedicato alla generazione e modifica immagini.

    Basato sul modello Nano Banana, consentirà di spostare elementi, ridimensionarli o trasformarli attraverso controlli conversazionali e istruzioni naturali.

    È un altro tassello della strategia multimodale di Gemini: testo, voce, immagini e video convergono dentro un unico ecosistema operativo.

    Gemini Omni è il nuovo modello multimodale

    Sul piano tecnologico, uno degli annunci centrali riguarda Gemini Omni, descritto da Google come un modello capace di generare qualsiasi tipo di contenuto partendo da qualsiasi input.

    La prima implementazione sarà focalizzata sui video, ma l’obiettivo è estendere progressivamente il sistema anche a immagini e testo.

    Omni Flash punta su velocità e azione

    Google ha presentato anche Gemini Omni Flash, versione ottimizzata per rapidità operativa e capacità agentiche.

    Secondo l’azienda, il modello combina frontier intelligence e azione con prestazioni fino a quattro volte superiori rispetto a modelli comparabili.

    Omni Flash sarà disponibile nell’app Gemini, su Google Flow e su YouTube Shorts, mentre le API arriveranno nelle prossime settimane per sviluppatori e aziende.

    Arrivano gli agenti personali proattivi

    Il vero cuore del Google I/O 2026, però, resta la visione agentica.

    Google ha presentato Gemini Spark, descritto come un agente personale operativo 24 ore su 24, insieme a Daily Brief, sistema che genera riepiloghi quotidiani azionabili e personalizzati.

    La Ricerca stessa si evolve con agenti di contesto, interfacce generative dinamiche e un carrello intelligente universale capace di assistere gli utenti nelle decisioni.

    L’obiettivo è anticipare le esigenze degli utenti

    La differenza rispetto all’AI generativa degli ultimi anni è sottile ma sostanziale.

    Non si parla più soltanto di strumenti che rispondono quando interrogati, ma di sistemi capaci di osservare il contesto, anticipare bisogni e collaborare attivamente con le persone.

    È qui che Google vede il prossimo terreno competitivo dell’intelligenza artificiale.

    Gli occhiali smart tornano al centro della strategia

    Google ha anche annunciato nuovi occhiali intelligenti con audio integrato e Gemini.

    Il dispositivo offrirà assistenza vocale privata direttamente nell’orecchio, lasciando mani e sguardo liberi. Una direzione che riporta Google nel mercato wearable dopo i tentativi pionieristici dei Google Glass.

    Fiducia, sicurezza e verifica dei contenuti AI

    Accanto alla corsa tecnologica, Google prova anche a rafforzare il tema della fiducia.

    L’azienda porterà la verifica SynthID e C2PA dentro Ricerca, Chrome e Gemini per aiutare gli utenti a riconoscere contenuti sintetici e materiale generato artificialmente.

    È stato inoltre annunciato Code Mender di DeepMind, sistema pensato per migliorare la sicurezza delle piattaforme, insieme a Gemini for Science, suite AI dedicata alla ricerca scientifica.

    Il prossimo passo passa dal marketing

    Il Google I/O non si chiuderà con gli annunci consumer.

    Google ha già anticipato che durante il prossimo Google Marketing Live verranno mostrati nuovi strumenti AI per aziende e inserzionisti, con particolare attenzione alle applicazioni commerciali dell’era agentica.

    La sensazione, però, è che il messaggio principale sia già chiaro: per Google il futuro dell’intelligenza artificiale non sarà fatto soltanto di chatbot, ma di sistemi capaci di agire, organizzare, creare e prendere iniziative insieme agli utenti.

    Tags: