Google rilancia Gemini con Spark, Omni e Project Genie

Immagine realizzata con Ideogram

Google ha scelto di concentrare in poco tempo tre annunci di peso, ciascuno dei quali, preso singolarmente, avrebbe meritato un palcoscenico dedicato. Insieme, però, raccontano una strategia precisa, ovvero trasformare Gemini da assistente reattivo a presenza continua nella vita digitale degli utenti, capace di agire, creare e persino ricostruire il mondo reale in forma esplorabile.

Il primo tassello si chiama Gemini Spark, un agente personale persistente, pensato per occuparsi di attività ricorrenti, competenze specifiche e flussi di lavoro che si ripetono nel tempo. La differenza rispetto al classico chatbot è sostanziale, perché Spark – da bravo agente AI – non attende una richiesta per attivarsi, ma resta operativo ventiquattro ore su ventiquattro, monitorando contesti, scadenze e abitudini. Un modello di interazione, questo, che sposta il baricentro dall’utente che interroga la macchina alla macchina che anticipa le esigenze dell’utente, con tutte le implicazioni che ne derivano in termini di affidabilità e fiducia.

Il secondo annuncio, Gemini Omni, affronta il terreno della creazione video. La promessa è quella di un editing conversazionale e nativamente multimodale, con la possibilità di generare avatar personalizzati e modificare contenuti video semplicemente descrivendo a parole ciò che si desidera ottenere.

Il terzo, frutto del lavoro di Google DeepMind, è forse il più suggestivo, perché Project Genie incontra Street View per trasformare luoghi reali degli Stati Uniti in mondi interattivi esplorabili. La distribuzione iniziale passa attraverso Google Labs ed è riservata agli abbonati Google AI Ultra.

L’integrazione fra dati cartografici e modelli generativi apre scenari concreti per turismo virtuale, formazione, simulazioni urbanistiche e, naturalmente, intrattenimento. Che la prima ondata sia limitata al territorio statunitense e a un piano premium dice molto sul posizionamento commerciale, perché Google sta costruendo un’offerta a livelli, dove le funzioni più avanzate diventano leva per giustificare abbonamenti di fascia alta.

Letti insieme, i tre annunci tracciano una direzione chiara. L’IA non è più uno strumento da invocare, ma un ambiente da abitare, fatto di agenti che persistono, contenuti che si plasmano con la voce, spazi geografici che diventano scenari interattivi. La sfida vera, nei prossimi mesi, sarà capire se una simile pervasività porterà valore reale o se si tradurrà in una saturazione di funzionalità difficili da governare. La concorrenza, da OpenAI ad Anthropic passando per i player cinesi, non resterà certo a guardare.