← Retour au blog
AiEnviron 8 min de lecture

L'agent s'installe dans le navigateur, et les applications autonomes devraient s'inquiéter

Publié le 2 oct. 2026
L'agent s'installe dans le navigateur, et les applications autonomes devraient s'inquiéter

Google a ajouté à Chrome un agent de navigation propulsé par Gemini, capable d'accomplir seul des tâches en plusieurs étapes : rechercher, comparer, remplir des formulaires, réserver. Présenté comme une fonctionnalité, c'est en réalité un événement concurrentiel, car le navigateur est le lieu où s'accomplit une grande partie du travail en ligne, et un agent qui y vit n'a besoin de convaincre personne d'installer quoi que ce soit.

Ce mouvement suit un schéma qui se dessine depuis le début de l'année. OpenAI a lancé une suite d'outils plus ciblés, dont un produit de traduction et Prism pour les flux de travail scientifiques, plutôt que de tout faire passer par un assistant généraliste unique. Des laboratoires chinois et occidentaux ont publié des agents open source toujours actifs, qui conservent les autorisations et la mémoire d'une session à l'autre. La question qui sous-tend tout cela est de savoir où vivront les agents, et le navigateur remporte pour l'instant ce débat par défaut.

La distribution l'emporte sur la capacité

Les applications d'agents autonomes ont un problème difficile qui n'a rien à voir avec la qualité du modèle. L'utilisateur doit décider de les ouvrir. Chaque tâche commence par un choix, et un outil qui exige une décision est moins utilisé qu'un outil simplement présent. Un agent intégré à un navigateur inverse cette logique. Il est déjà ouvert lorsque l'utilisateur travaille, et la distance entre vouloir qu'une chose soit faite et le fait qu'elle le soit se réduit à une instruction.

Le levier de Google ici est celui-là même qui a fait de Chrome une plateforme pour tout le reste. L'entreprise peut diffuser une capacité à une base installée très vaste sans téléchargement, et elle peut améliorer l'agent grâce au comportement de navigation qu'elle observe déjà. Pour une startup qui vend un agent autonome, la comparaison est difficile. Vous pouvez avoir le meilleur modèle et perdre tout de même face à celui qui se trouve à une frappe de distance.

L'argument inverse est que les agents intégrés sont contraints par la surface dans laquelle ils vivent. Un agent de navigateur excelle dans les tâches qui se déroulent dans un onglet et se révèle maladroit pour tout ce qui touche aux appareils, aux fichiers ou à la messagerie. C'est une vraie limite, et c'est là que les agents autonomes gardent un avantage. Le hic, c'est que la plupart des tâches des gens se déroulent dans un onglet de navigateur, si bien que cet avantage ne concerne qu'une minorité des usages.

Le problème des autorisations s'aggrave, il ne s'améliore pas

Intégrer des agents amplifie aussi le risque lié à un accès permanent. Les agents open source toujours actifs qui ont gagné du terrain cette année se distinguent par le fait qu'ils conservent autorisations et mémoire d'une session à l'autre, ce qui les rend utiles et, en même temps, dangereux. Un agent capable de lire vos e-mails, de consulter votre agenda et d'agir sur une page web n'est qu'à une instruction mal interprétée de faire quelque chose que vous ne vouliez pas, et l'erreur est difficile à annuler.

Le calendrier comporte un détail révélateur. Le nouveau modèle de pointe de Google, Gemini 4 Argon, a d'abord été déployé auprès d'un ensemble restreint de testeurs de confiance, et l'une des raisons est qu'un modèle capable de trouver et de corriger des vulnérabilités est aussi capable de les trouver pour la mauvaise personne. La même logique s'applique du côté du grand public, à moindre échelle. Un agent capable de naviguer, de taper et de cliquer à la place d'un utilisateur doit pouvoir s'arrêter, et cet arrêt doit être peu coûteux.

Brian Chesky, d'Airbnb, a défendu cette idée publiquement, affirmant que les chatbots ne sont pas l'interface finale pour découvrir des voyages, naviguer ou faire ses achats. Les gens veulent explorer, comparer, écrire aux hôtes, consulter des cartes, vérifier une identité et planifier ensemble, et la majeure partie de tout cela ne tient pas dans une fenêtre de chat. Sa conclusion est que les applications deviennent des couches de données et d'actions que des agents externes appellent, et qu'Airbnb pourrait exposer ses capacités via un SDK plus robuste et, à terme, rendre ses propres agents interopérables via MCP.

C'est un pari différent de celui de l'agent de navigateur, et il mérite d'être pris au sérieux. Si Chesky a raison, la plateforme gagnante n'est pas celle qui propose le chatbot le plus séduisant. C'est celle dont la surface d'outils est la plus claire et la plus sûre, car c'est elle que les autres agents appelleront. Une plateforme qui permet à un agent extérieur de réserver, d'annuler et de modifier avec des autorisations bien définies capte la distribution sans avoir à posséder la conversation.

Le navigateur est une forteresse, et cela joue dans les deux sens

L'avantage de Chrome est celui qui inquiète les régulateurs depuis des années : c'est un canal de distribution d'une taille énorme. Mais la même concentration qui aide Google à diffuser un agent fait aussi du navigateur un point de défaillance unique pour tous ceux qui construisent dessus. Si le comportement, les autorisations et les conditions de l'agent de navigation changent à chaque mise à jour du navigateur, tout produit qui présupposait une surface stable doit s'adapter. Construire dans le navigateur de quelqu'un d'autre est pratique jusqu'au moment où ça ne l'est plus, et une startup qui a fait ce pari se retrouve exposée à une feuille de route qu'elle ne peut pas influencer.

Cette asymétrie mérite d'être nommée, car elle façonne la stratégie. Une application d'agent autonome se bat en montée pour attirer l'attention, mais maîtrise son propre destin. Un agent intégré à un navigateur gagne sur la distribution, mais repose sur un terrain loué. La voie MCP, celle que Chesky a désignée, est une tentative d'éviter les deux problèmes : exposer des capacités comme un service que tout agent peut appeler, et laisser l'intégration se faire là où vous n'avez pas besoin d'être propriétaire. Reste à savoir si cela deviendra une véritable troisième voie ou simplement une norme que tout le monde soutient de nom et que personne n'alimente vraiment.

La variable finale, c'est la confiance. Un agent qui agit au nom d'une personne sur le web ouvert n'est utile que si la personne accepte de le laisser faire. Cette acceptation est fragile, et elle se construit une décision sûre à la fois. Un agent de navigateur qui réserve discrètement le mauvais vol ou clique sur le mauvais bouton fait reculer toute la catégorie. Le modèle distribué et encadré par des autorisations sur lequel les services se font concurrence serait plus résistant aux défaillances individuelles, car un seul mauvais acteur dans une intégration ne coule pas l'idée entière.

Deux théories sur le lieu de vie des agents

Il y a donc deux avenirs plausibles sur la table. Dans l'un, les agents sont intégrés aux surfaces que les gens utilisent déjà, et le navigateur, le système d'exploitation et l'application de messagerie deviennent les portes d'entrée. Dans l'autre, les agents sont des services interopérables, et les plateformes se font concurrence sur la qualité de leur surface d'outils plutôt que sur leur interface. Les deux peuvent être vrais en même temps, et le seront probablement.

Ce sur quoi les deux théories s'accordent, c'est que l'application d'agent autonome, celle qui vous demande de l'ouvrir et vous parle dans une fenêtre de chat, est la position la plus faible. Elle n'est ni native là où le travail se fait, ni un service propre que d'autres agents peuvent appeler. Les produits qui ont tenu bon cette année sont ceux qui faisaient quelque chose qu'une fenêtre de chat ne peut pas faire, ou qui se branchaient sur une surface à la portée déjà établie.

Le conseil pratique pour quiconque construit dans ce domaine est d'arrêter de traiter l'interface de chat comme le produit. Décidez de la surface dont vous êtes natif, ou de la surface d'outils que vous exposez. Rendez ensuite les autorisations lisibles, car c'est ce qui décidera si une plateforme vous laisse entrer. Un agent compétent doté d'un modèle d'autorisation clair sera intégré à des endroits où un agent plus puissant au modèle d'autorisation opaque n'entrera jamais.

L'agent de navigation automatique de Chrome ne marque pas la fin de la concurrence. C'est le moment où la concurrence s'est déplacée sur le terrain de Google, un endroit où il est difficile de battre quelqu'un. Les applications d'agents autonomes ont jusqu'à la prochaine vague de mises à jour des navigateurs pour trouver une raison d'exister qu'un onglet ne peut pas copier.

Articles associés