← Torna al blog
Aicirca 7 min di lettura

L'agent si sposta nel browser, e le app standalone dovrebbero preoccuparsi

Pubblicato 2 ott 2026
L'agent si sposta nel browser, e le app standalone dovrebbero preoccuparsi

Google ha aggiunto a Chrome un agent di navigazione basato su Gemini, capace di svolgere attività multi-step da solo: cercare, confrontare, compilare moduli, prenotare. Presentato come una funzionalità, è un evento competitivo, perché il browser è dove avviene gran parte del lavoro online, e un agent che vive al suo interno non ha bisogno di convincere nessuno a installare nulla.

La mossa segue uno schema che si è consolidato nel corso dell'anno. OpenAI ha rilasciato una suite di strumenti più specifici, tra cui un prodotto di traduzione e Prism per i flussi di lavoro scientifici, invece di far passare tutto attraverso un unico assistente generale. I laboratori cinesi e occidentali hanno rilasciato agent open source always-on che mantengono permessi e memoria tra le sessioni. La domanda che sta sotto a tutto questo è dove vivranno gli agent, e al momento il browser sta vincendo questa discussione per default.

La distribuzione batte le capacità

Le app agent standalone hanno un problema difficile che non ha nulla a che fare con la qualità del modello. L'utente deve decidere di aprirle. Ogni attività inizia con una scelta, e uno strumento che richiede una decisione viene usato meno di uno strumento che è semplicemente presente. Un agent integrato in un browser ribalta questo rapporto. È già aperto quando l'utente lavora, e la distanza tra il volere che qualcosa venga fatto e il farlo si riduce a un prompt.

La leva di Google qui è la stessa che ha reso Chrome una piattaforma per tutto il resto. L'azienda può spingere una funzionalità verso una base installata enorme senza alcun download, e può migliorare l'agent usando il comportamento di navigazione che già osserva. Per una startup che vende un agent standalone, è un confronto difficile. Puoi avere il modello migliore e perdere comunque contro quello che è a un solo tasto di distanza.

La controargomentazione è che gli agent integrati sono vincolati dalla superficie in cui vivono. Un browser agent è bravo nei compiti che avvengono in una scheda del browser e goffo in qualsiasi cosa che coinvolga più dispositivi, file o messaggistica. È un limite reale, ed è lì che gli agent standalone mantengono un vantaggio. Il problema è che la maggior parte dei compiti delle persone avviene in una scheda del browser, quindi il vantaggio si applica a una minoranza dell'utilizzo.

Il problema dei permessi peggiora, non migliora

Integrare gli agent amplifica anche il rischio che deriva dall'accesso persistente. Gli agent open source always-on che hanno guadagnato terreno quest'anno si distinguono per conservare permessi e memoria tra le sessioni, ed è ciò che li rende utili ma anche pericolosi. Un agent che può leggere la tua email, guardare il tuo calendario e agire su una pagina web è a un'istruzione mal giudicata dal fare qualcosa che non intendevi, e l'errore è difficile da annullare.

C'è un dettaglio rivelatore nella tempistica. Il nuovo modello frontier di Google, Gemini 4 Argon, è stato distribuito prima a un gruppo limitato di tester fidati, e una delle ragioni è che un modello capace di trovare e correggere vulnerabilità è anche capace di trovarle per la persona sbagliata. La stessa logica vale al livello del consumatore, su scala più piccola. Un agent che può navigare, digitare e cliccare per conto di un utente ha bisogno della capacità di fermarsi, e la fermata deve costare poco.

Brian Chesky di Airbnb ha sostenuto questo pubblicamente, dicendo che i chatbot non sono l'interfaccia finale per la scoperta di viaggi, la navigazione o gli acquisti. Le persone vogliono esplorare, confrontare, scrivere agli host, guardare mappe, verificare l'identità e pianificare insieme, e gran parte di questo non entra in una finestra di chat. La sua conclusione è che le applicazioni diventano livelli di dati e azioni che gli agent esterni richiamano, e che Airbnb potrebbe esporre le proprie capacità attraverso un SDK più solido e alla fine rendere i propri agent interoperabili tramite MCP.

È una scommessa diversa da quella del browser agent, e vale la pena prenderla sul serio. Se Chesky ha ragione, la piattaforma vincente non è quella con il chatbot più accattivante. È quella con la superficie di strumenti più chiara e sicura, perché è quella che gli altri agent chiameranno. Una piattaforma che consente a un agent esterno di prenotare, annullare e modificare con permessi ben definiti cattura la distribuzione senza dover possedere la conversazione.

Il browser è un fossato, e questo taglia in entrambe le direzioni

Il vantaggio di Chrome è lo stesso che ha preoccupato i regolatori per anni: è un canale di distribuzione di dimensioni enormi. Ma la stessa concentrazione che aiuta Google a spingere un agent rende anche il browser un singolo punto di guasto per tutti coloro che vi costruiscono sopra. Se il comportamento, i permessi e i termini del browser agent cambiano con un aggiornamento del browser, ogni prodotto che dava per scontata una superficie stabile deve adattarsi. Costruire dentro il browser di qualcun altro è comodo fino al momento esatto in cui non lo è più, e una startup che ha fatto quella scommessa è ora esposta a una roadmap che non può influenzare.

Vale la pena nominare questa asimmetria perché plasma la strategia. Un'app agent standalone combatte in salita per l'attenzione ma possiede il proprio destino. Un agent integrato in un browser vince sulla distribuzione ma siede su un terreno in affitto. La via MCP, quella che Chesky ha indicato, è un tentativo di evitare entrambi i problemi: esporre le capacità come un servizio che qualsiasi agent può chiamare, e lasciare che l'integrazione avvenga da qualche parte che non devi possedere. Se questa diventi una vera terza via o solo uno standard che tutti sostengono nominalmente e nessuno finanzia è ancora aperto.

La variabile finale è la fiducia. Un agent che agisce per conto di una persona sul web aperto è utile solo se la persona è disposta a lasciarglielo fare. Quella disponibilità è fragile, e si costruisce una decisione sicura alla volta. Un browser agent che prenota silenziosamente il volo sbagliato o clicca il pulsante sbagliato fa retrocedere l'intera categoria. Il modello distribuito e permessato su cui i servizi competono sarebbe più robusto ai fallimenti individuali, perché un singolo attore cattivo in un'integrazione non affonda l'intera idea.

Due teorie su dove vivono gli agent

Quindi ci sono due futuri plausibili sul tavolo. In uno, gli agent sono integrati nelle superfici che le persone già usano, e il browser, il sistema operativo e l'app di messaggistica diventano le porte d'ingresso. Nell'altro, gli agent sono servizi interoperabili, e le piattaforme competono sulla qualità della loro superficie di strumenti piuttosto che sulla loro interfaccia. Entrambe possono essere vere contemporaneamente, e probabilmente lo saranno.

Su ciò che entrambe le teorie concordano è che l'app agent standalone, quella che ti chiede di aprirla e ti parla in una casella di chat, è la posizione più debole. Non è né nativa rispetto a dove avviene il lavoro né un servizio pulito che altri agent possono chiamare. I prodotti che hanno tenuto il campo quest'anno sono quelli che hanno fatto qualcosa che una finestra di chat non può fare, o che si sono collegati a una superficie con una portata già esistente.

Il consiglio pratico per chiunque costruisca in questo spazio è di smettere di trattare l'interfaccia di chat come il prodotto. Decidi a quale superficie sei nativo, o quale superficie di strumenti esponi. Poi rendi leggibili i permessi, perché è questo che deciderà se una piattaforma ti lascia entrare. Un agent competente con un modello di permessi chiaro verrà integrato in posti dove un agent più forte con un modello fumoso non lo sarà mai.

L'agent di navigazione automatica di Chrome non è la fine della competizione. È il momento in cui la competizione si è spostata sul terreno di casa di Google, che è un posto difficile dove battere qualcuno. Le app agent standalone hanno fino al prossimo giro di aggiornamenti del browser per trovare una ragione di esistere che una scheda non possa copiare.

Articoli correlati