La ruée vers les agents de codage gagne le bureau

Le 21 septembre, trois entreprises issues de trois segments différents du marché chinois des développeurs ont commercialisé le même type de produit le même jour. Moonshot a lancé Kimi Code Desktop pour macOS et Windows. Alibaba a mis Qoder, son atelier d'agent de codage, sur la boutique d'applications PC HarmonyOS. Huawei Cloud a mis à niveau CodeArts avec un modèle dédié à HarmonyOS, un agent et un centre de pratique pour développeurs.
Trois lancements, un seul message. La bataille pour l'agent de codage ne porte plus sur le modèle qui écrit le meilleur code. Elle porte sur la fenêtre qu'un développeur ouvre en premier le matin.
Pourquoi le bureau, et pourquoi maintenant
Un agent qui ne vit que dans un onglet de navigateur ou un terminal a un plafond. Pour terminer une tâche réelle, il doit lire et écrire des fichiers, exécuter des commandes, examiner une page rendue et vérifier l'état d'une pull request. Ces quatre choses vivent à des endroits différents, et un navigateur ou une CLI ne peut généralement en atteindre qu'une ou deux.
Une application de bureau peut atteindre les quatre. C'est l'argument pour sortir les agents de la boîte de chat et les installer sur la machine. Le bureau est l'environnement le plus restreint où un agent peut exécuter une tâche de bout en bout sans qu'un humain fasse la navette de contexte entre les outils. Le client de Moonshot est construit autour de cela. Il est livré avec un terminal intégré, un navigateur, l'annotation de captures d'écran et une vue de l'état Git et de l'avancement de la revue de pull request.

Les noms des modes dans Kimi Code Desktop indiquent ce que l'entreprise estime nécessaire aux agents. Plan permet à l'agent de proposer avant d'agir. Goal cible un travail de plus longue durée. Swarm exécute plusieurs agents en parallèle, et un mode expérimental appelé Tower les coordonne. Ce sont autant de réponses au même problème : un agent capable de toucher le système de fichiers et le terminal est puissant, et il est aussi facile de le laisser s'exécuter quelque part que vous n'aviez pas prévu. Vérifier avant d'agir n'est pas un luxe quand l'agent peut supprimer un répertoire.
HarmonyOS comme mur de distribution
Le mouvement d'Alibaba est celui qui mérite l'attention, pour une autre raison. L'arrivée de Qoder sur la boutique d'applications PC HarmonyOS tient moins au produit qu'au canal. Huawei revendique environ 11 millions de développeurs HarmonyOS enregistrés. Si ce chiffre est proche de la réalité, la boutique est le point d'entrée par défaut d'une population de développeurs assez large pour faire vivre un outil à elle seule.
Les chiffres de Huawei sont à prendre avec des pincettes. L'entreprise affirme que son modèle de codage HarmonyOS réduit le taux d'erreur pour mille lignes de plus de 80 % et augmente les taux de réussite à la première compilation de plus de 78 %. Ce sont des chiffres de fournisseur sans méthodologie publiée, et un taux de réussite à la première compilation dépend énormément de ce qui est compilé. Considérez-les comme du marketing jusqu'à ce que quelqu'un d'extérieur à Huawei les reproduise.
Ce qui n'est pas du marketing, c'est la position structurelle. Quand un agent est livré comme point d'entrée sur la boutique de développeurs d'une plateforme, le propriétaire de la plateforme contrôle la distribution, et la distribution est la barrière concurrentielle la plus difficile à franchir. Un concurrent doté d'un meilleur modèle doit encore convaincre les développeurs de quitter la boutique qu'ils ouvrent déjà.
JetBrains répond avec la gouvernance
La sortie la plus intéressante de la semaine est venue un jour plus tard, et elle portait sur un autre problème. JetBrains a lancé Air le 22 septembre, un système ouvert qui, selon l'entreprise, couvre l'IDE, la livraison en équipe et la gouvernance organisationnelle. Trois produits le composent : Air pour orchestrer et vérifier les agents dans l'IDE, Air Teams pour coordonner les développeurs et les agents autonomes à travers un flux de livraison, et Air Governance pour les politiques, la visibilité, l'audit et la gestion des coûts.
Les noms importent moins que la répartition. La génération a cessé d'être la partie difficile du développement agentique. Si un agent peut écrire le code, les questions qui restent sont : qui l'a relu, qui en est responsable, combien cela a coûté, et si cela respecte la politique de l'entreprise. JetBrains vend sur ces questions plutôt que sur la qualité de génération.
C'est un pari délibéré sur la prochaine destination de l'argent. C'est aussi un moyen pour un fournisseur d'IDE historique d'éviter de rivaliser sur la qualité des modèles avec Cursor et Codex, ce qu'il perdrait probablement. Au lieu d'affirmer que son agent est plus intelligent, JetBrains affirme que son agent est gouvernable, et il a construit la tuyauterie pour l'étayer. Air fonctionne avec Claude Agent, Codex, Copilot, OpenCode et tout ce qui parle l'Agent Client Protocol, sur IDE, web, CLI et mobile. Une équipe peut apporter son propre abonnement de modèle ou payer JetBrains aux prix des API publiques.
Une connexion MCP partagée est le petit détail qui révèle la stratégie. Configurez une connexion d'outil une fois, et toute l'équipe en hérite. C'est le genre de fonctionnalité qui ne compte qu'à l'échelle organisationnelle, exactement l'échelle que JetBrains cible.
Le schéma sous-jacent
Prenez du recul, et les sorties de la semaine s'alignent. Microsoft a étendu Copilot avec un agent persistant qui continue de travailler en arrière-plan. UiPath a permis à des agents de codage tiers de générer des ressources d'automatisation que sa couche d'orchestration exécute. Webex et Zendesk ont ajouté des contrôles d'agents aux outils de centre de contact et de support. Le même basculement apparaît partout : les agents passent d'un objet avec lequel on discute à un objet qui s'exécute en arrière-plan face à de vrais systèmes.
Ce basculement crée un nouvel ensemble de problèmes, et les annonces produits en sont une carte. La vérification, parce qu'un agent produisant plus de résultats qu'un humain ne peut en relire n'est pas forcément un gain. L'attribution, parce que quelqu'un doit valider ce qui est livré. Le coût, parce qu'un agent persistant dépense des tokens pendant que personne ne regarde. La gouvernance, parce qu'un agent ayant accès au système de fichiers est une surface de sécurité.
Le même mouvement, hors du monde des développeurs
La ruée vers le bureau est la version orientée développeurs d'un basculement qui touche l'ensemble du logiciel d'entreprise. Microsoft a étendu Microsoft 365 Copilot fin septembre avec Autopilot, un agent persistant qui continue de travailler en arrière-plan, aux côtés de nouveaux contrôles de gouvernance et de primitives de communication entre agents. UiPath a permis à des agents de codage tiers comme Claude Code, GitHub Copilot et Cursor de générer des ressources d'automatisation que sa couche d'orchestration exécute ensuite. Webex et Zendesk ont tous deux ajouté des contrôles d'agents à leurs outils de centre de contact.
Chacun de ces mouvements fait passer un agent d'un objet avec lequel on discute à un objet qui s'exécute face à de vrais systèmes pendant que vous ne regardez pas. C'est ce qui fait de la gouvernance une catégorie de produit plutôt qu'une fonctionnalité. Un agent avec accès au système de fichiers, un compte de facturation et la capacité d'agir de manière autonome est un petit morceau d'infrastructure, et l'infrastructure se fait auditer.
Ce qu'il faut surveiller
Pour un développeur qui choisit un outil ce trimestre, la question a changé. Il ne s'agit plus de savoir quel agent écrit le meilleur code, car les principaux modèles sont assez proches pour que la différence soit difficile à mesurer. Il s'agit de savoir quel agent correspond à la façon dont votre équipe travaille et à la façon dont votre organisation contrôle ce qu'il produit.
Pour un fournisseur, le bureau est encombré et la différenciation se déplace vers le haut. La qualité des modèles est un prérequis. La bataille porte sur les canaux de distribution, comme une boutique livrée avec une plateforme matérielle, et sur la gouvernance, comme les contrôles d'audit et de coûts qu'une entreprise achète avant de laisser des agents toucher à la production.
L'indice sera l'endroit où atterrira la prochaine vague de lancements. Si le mois suivant apporte plus d'agents et moins d'outils de gouvernance, l'industrie court encore après la capacité. S'il apporte des contrôles, des pistes d'audit et des tableaux de bord de coûts, la course s'est déplacée vers la partie qui décide si tout cela survit à un examen d'achat.
Articles associés
Agility Digit 5 arrive avec un dossier de sécurité, pas seulement une fiche technique
Un entrepôt n'est pas un laboratoire. La certification est la porte d'entrée, pas la démo.
Les agents de pointe ont terminé 30 % d’un flux de travail de recherche. C’est le chiffre qui compte.
Les agents peuvent exécuter de la recherche. Inventer la procédure reste hors de portée.
Figure AI engage 3,5 milliards de dollars de capacité de calcul avant même d'avoir un produit à vendre
Le pari : la généralisation est un problème de calcul. Le secteur n'a pas tranché.
OpenAI ajoute enfin les arrière-plans transparents à son API d’images
Une petite fonctionnalité qui supprime toute une étape du pipeline.