Google Gemini Agent è ufficiale: l’AI che lavora al posto nostro..

Condividi:
Facebook
X
Telegram
Threads
WhatsApp

Google ha presentato ieri Gemini Agent, un assistente basato sull’intelligenza artificiale che rappresenta un cambio di paradigma radicale nel rapporto tra utenti e tecnologia. Non si tratta più di un chatbot che risponde a domande, ma di un vero collaboratore digitale capace di svolgere operazioni concrete al posto vostro: organizzare la casella email, gestire l’agenda, prenotare viaggi e completare attività complesse che normalmente richiederebbero decine di clic attraverso diverse applicazioni.

La novità arriva insieme a Gemini 3, l’ultima generazione del modello di intelligenza artificiale di Mountain View, ed è disponibile da oggi per gli abbonati Google AI Ultra negli Stati Uniti, esclusivamente in ambiente desktop. Per il momento si tratta di un’anteprima controllata, ma l’intenzione di Google è chiara: trasformare l’assistente da strumento conversazionale a operatore autonomo capace di agire nel mondo digitale.

Come funziona Gemini Agent

Il sistema si basa sulle capacità avanzate di ragionamento di Gemini 3 e sull’eredità di Project Mariner, il prototipo di ricerca svelato da Google DeepMind lo scorso dicembre. Gemini Agent può gestire compiti articolati scomponendoli in passaggi discreti, mostrando i progressi in tempo reale e chiedendo conferma prima di azioni critiche come invii di email o acquisti online.

Un esempio concreto: potete chiedergli di “organizzare la mia casella email raggruppando i messaggi correlati e creando promemoria per quelli urgenti”. L’agente analizzerà la vostra posta, identificherà i pattern, creerà le etichette appropriate e aggiungerà nuove attività su Google Tasks, il tutto senza ulteriore intervento da parte vostra se non l’approvazione finale.

Gemini Agent si integra profondamente con l’ecosistema Google: Gmail, Calendar, Drive, Reminders e altre applicazioni diventano strumenti che l’agente può orchestrare. Potete chiedergli di cercare l’ultima email di un determinato mittente, localizzare un allegato salvato su Drive relativo a un progetto specifico e preparare una bozza di risposta. L’automazione raggiunge un livello che avvicina l’assistente a un vero collaboratore capace di muoversi tra i servizi mantenendo sicurezza e permessi ben delineati.

La navigazione web autonoma

Una delle funzionalità più impressionanti deriva direttamente da Project Mariner: la capacità di navigare e interagire con i siti web come farebbe un essere umano. Quando necessario, Gemini Agent può aprire una sessione isolata di Chrome in modalità sandbox, progettata per limitare l’accesso a informazioni sensibili.

All’interno di questo ambiente controllato, l’assistente può scorrere pagine, cliccare link, compilare moduli e raccogliere dati utili al completamento del task. Il processo funziona attraverso un ciclo continuo: il sistema cattura screenshot della finestra del browser, li invia a Gemini nel cloud per l’analisi, riceve istruzioni su quale azione compiere e le esegue, ripetendo il processo fino al completamento dell’attività.

Rimane sempre presente un pulsante che consente di prendere il controllo diretto della sessione in qualsiasi momento. Google ha volutamente scelto di non permettere all’agente di accettare cookie o firmare accordi sui termini di servizio, mantenendo il controllo nelle mani dell’utente.

Differenze con altri agenti AI

Gemini Agent si inserisce in un panorama competitivo che include soluzioni come Operator di OpenAI, Atlas di Anthropic e Nova Act di Amazon. Tuttavia, l’architettura di Google presenta alcune peculiarità. A differenza di alcuni concorrenti, Gemini Agent non è incorporato direttamente nel browser: questo significa che non accede automaticamente alla cronologia, ai cookie o agli account dell’utente.

Una scelta che può ridurre la flessibilità operativa ma che Google considera un compromesso necessario per preservare la sicurezza e limitare l’esposizione dei dati personali. L’azienda ha inoltre implementato specifici protocolli di sicurezza (“Safety Rails”) per impedire azioni irreversibili senza conferma esplicita.

Il sistema può gestire fino a dieci attività differenti contemporaneamente, grazie all’esecuzione su macchine virtuali nel cloud. Questo significa che potete continuare a lavorare sul vostro computer mentre Gemini Agent completa i task in background, un netto miglioramento rispetto alle prime versioni del prototipo che bloccavano l’intero browser durante l’operatività.

Verso l’assistente universale

Tulsee Doshi, senior director di Google DeepMind, ha sottolineato durante il briefing con i giornalisti l’obiettivo strategico: “Uno dei traguardi che volevamo raggiungere con questo modello è distribuirlo ampiamente”. Gemini Agent rappresenta un passo concreto verso quella che Demis Hassabis, CEO di Google DeepMind, chiama internamente “AlphaAssist”: un assistente universale capace di operare autonomamente in qualsiasi dominio digitale.

Le applicazioni pratiche sono immediate. Per chi lavora in una piccola azienda, l’agente può gestire attività come recuperare dettagli dei clienti da un sito web, aggiungerli a un CRM e programmare appuntamenti di follow-up. Per l’organizzazione personale, può pianificare viaggi completi coordinando voli, hotel, sincronizzazione del calendario e conferme via email.

Google sta inoltre testando l’integrazione in AI Mode, l’esperienza di ricerca potenziata dall’intelligenza artificiale, dove Gemini Agent potrà acquistare biglietti: basterà chiedere “Trova 2 biglietti economici per la partita di sabato nei posti bassi” e il sistema analizzerà centinaia di opzioni su diversi siti, gestendo prezzi in tempo reale e disponibilità, compilando i moduli necessari.

Sfide e prospettive future

La tecnologia è ancora nelle fasi iniziali. Gli agenti AI attualmente disponibili sul mercato hanno dimostrato di essere lenti e soggetti a errori, come confermato dai test condotti da diverse testate tecnologiche. Google sta raccogliendo feedback dai tester per migliorare l’affidabilità e la velocità di esecuzione.

Rimangono questioni aperte sulla sicurezza e sul controllo: affidare a un’intelligenza artificiale la capacità di compiere azioni concrete al nostro posto richiede un livello di fiducia che va costruito nel tempo. Google ha lavorato per garantire che il modello impari a dare priorità alle istruzioni dell’utente rispetto a tentativi esterni di prompt injection, identificando potenziali istruzioni malevole nascoste in email, documenti o siti web.

Con Gemini Agent disponibile inizialmente a 249,99 dollari al mese tramite l’abbonamento Google AI Ultra, l’azienda punta chiaramente a utenti professionali e aziende disposte a investire in automazione avanzata. L’espansione ad altri paesi e l’integrazione con più prodotti Google sono previste nel corso dell’anno, segnando l’ingresso definitivo nell’era degli agenti digitali autonomi.

Fonti:

Per rimanere aggiornato sulle novità e sulle offerte del mondo della tecnologia, seguici su Telegram e Whatsapp

Articoli correlati

Il riquadro giallo in chat dice che il codice di sicurezza con quel contatto è cambiato. Non dice che qualcuno...

Disney+ ha inviato agli abbonati italiani una mail sulle nuove Condizioni generali. Entrano in vigore trenta giorni dopo l’avviso. Non...

Matteo Del Fante ha detto la frase che chiude la parte di Borsa e apre quella da organigramma. Al TG...

Oggi, lunedì 14 settembre, Apple apre il rubinetto di iOS 27, iPadOS 27, watchOS 27, tvOS 27, visionOS 27 e...

WhatsApp sta allargando alle chiamate quello che ha già fatto con le chat da ospite: far entrare chi non ha...

Samsung Display sta per dare alla serie Galaxy S il primo cambio serio di materiale OLED in tre anni. Secondo...