← Retour au blog
News8 min

Les marchés de prédiction mettent de l'argent réel sur le gagnant de l'IA d'image, et les cotes sont déséquilibrées

Publié le 27 sept. 2026
Les marchés de prédiction mettent de l'argent réel sur le gagnant de l'IA d'image, et les cotes sont déséquilibrées

Polymarket propose une série continue de questions qui auraient semblé absurdes il y a deux ans : quelle entreprise aura la meilleure IA d'édition d'image à la fin octobre ? Quelle entreprise aura le meilleur modèle texte-image d'ici fin novembre ? De l'argent réel est échangé sur les réponses, et les cotes actuelles vous disent ce que la foule croit réellement, dépouillé du vernis des communiqués de presse.

Fin septembre, le tableau est sans ambiguïté. OpenAI est à environ 84 % pour le meilleur modèle texte-image jusqu'à fin novembre. Le marché de l'édition d'image place OpenAI près de 90 %. Du côté image-vidéo, l'argent s'est déplacé vers MiniMax, qui se négocie au-dessus de 90 % pour la meilleure IA image-vidéo, un bond notable compte tenu de l'encombrement de cette catégorie plus tôt dans l'année.

Ce que les cotes mesurent, et ce qu'elles ne mesurent pas

Ces marchés sont des références établies par la foule. Les traders réagissent aux mêmes signaux que nous voyons tous : notes de version, comparaisons d'utilisateurs, classements d'arènes, le post viral qui fait paraître l'édition d'un modèle magique. Cela fait des cotes un bon indicateur de sentiment et une piètre mesure de la réalité. « Meilleur » n'est pas défini par nature, et la foule le résout comme Internet le fait toujours, par les comparaisons qui sont devenues virales cette semaine-là.

Pourtant, ce déséquilibre est porteur d'information. Un consensus de 84 à 90 % sur OpenAI dans deux catégories, c'est le marché qui dit que l'écart est large. La position de MiniMax sur l'image-vidéo, c'est le marché qui dit qu'un spécialiste a battu les généralistes dans ce domaine, du moins pour l'instant. Le volume derrière ces marchés, des dizaines de milliers de dollars de liquidité sur les plus importants, est trop faible pour être qualifié d'institutionnel, mais la direction est cohérente semaine après semaine.

Ce que les catégories couvrent réellement

Il est utile de préciser ce que « meilleur » signifie dans chaque marché, car les catégories ne sont pas interchangeables. Le texte-image mesure la qualité brute de génération : quelle est la qualité de l'image qu'un modèle produit à partir d'un prompt. L'édition d'image mesure la modification : on fournit une photo existante et on demande au modèle de la modifier, ce qui teste la cohérence, le suivi des instructions et la capacité du modèle à préserver ce qu'on ne lui a pas demandé de changer. L'image-vidéo est la catégorie la plus jeune et la plus difficile techniquement : elle demande à un modèle d'animer une image fixe de manière cohérente, et la cohérence dans le temps est impitoyable là où les images uniques ne le sont pas.

Les cotes se répartissent nettement selon ces lignes, et cette répartition est plausible. La génération brute et l'édition récompensent les plus grands cycles d'entraînement et le plus de retours utilisateurs, ce qui favorise les plus grands laboratoires. L'image-vidéo récompense un autre objectif d'optimisation, la cohérence temporelle, où une équipe concentrée peut prendre l'ascendant. MiniMax au-dessus de 90 % tandis qu'OpenAI domine les deux autres catégories, c'est exactement le schéma auquel on s'attend si la spécialisation compte encore, ce qui est en soi une affirmation sur le domaine : la frontière n'est pas une seule course, elle en compte plusieurs, et les leaders diffèrent selon la piste.

Une mise en garde sur la précision de la foule

Les marchés de prédiction ont un bon bilan sur les événements discrets à résolution claire, élections et décisions de taux, et un bilan moins bon sur les jugements de qualité continus, ce qui est le cas ici. « Meilleure IA d'édition d'image » n'a pas de juge officiel, donc le marché se résout comme les règles de résolution le prévoient, généralement en citant les classements ou les classements d'arènes à l'échéance. Cela fait des cotes une prévision de ce que diront les classements de référence, ce qui est à un pas de la vérité qui intéresse sans doute les traders.

L'épisode des meme-stocks de janvier 2021 et divers marchés crypto ont démontré que des marchés minces peuvent être poussés. Ces marchés d'images ne sont pas aussi minces, mais ils sont loin d'avoir la profondeur des marchés politiques, et le vivier de participants est assez petit pour qu'une poussée coordonnée d'une communauté motivée ne soit visible qu'avec le recul. Lisez les niveaux comme un sentiment auquel de l'argent est attaché, pas comme une mesure.

La structure du marché, lue de près

La série d'événements se déroule mois après mois, ce qui transforme chaque échéance en référendum sur la précédente. Le marché image-vidéo de fin septembre se réglait tandis que celui de fin octobre ouvrait, et les mouvements d'une semaine à l'autre sont là où se trouve l'information : le marché vidéo d'octobre a grimpé de 15 % en une seule semaine, ce qui signifie que quelque chose a été publié ou a fuité, changeant l'avis de la foule. Le marché texte-image de novembre a progressé de 4 % sur la semaine. Une dérive silencieuse comme celle-ci est généralement l'accumulation de petits indices, résultats d'arènes et comparaisons d'utilisateurs, plutôt qu'une réaction à un titre.

La liquidité sur ces marchés est réelle mais modeste, des dizaines de milliers en volume avec une liquidité comparable, donc quelques grandes positions peuvent faire bouger les prix à court terme. Traitez les pics soudains avec la même méfiance qu'un graphique d'altcoin mince. Le consensus lent, des cotes soutenues sur plusieurs semaines, est le signal le plus durable.

Pourquoi la communauté open-weights devrait s'en soucier

Voici le hic : aucun de ces marchés ne suit les modèles ouverts, et la communauté open source vient de vivre un mois retentissant. Qwen Image 2.1, un modèle open-weights de 7B, est arrivé avec des benchmarks revendiquant la parité avec Nano Banana 2.0 et a suscité un fil Hacker News de 739 points. Des outils locaux, des ports et des comparaisons côte à côte sont apparus en quelques jours. Un modèle que l'on peut télécharger n'est pas éligible à la question « quelle entreprise a le meilleur » telle que les marchés la posent, ce qui signifie que le consensus de la foule ne mesure que la frontière hébergée.

Cet écart compte pour la façon dont vous lisez les cotes. Le marché dit qu'OpenAI mène le peloton des modèles hébergés. Le fil r/StableDiffusion dit qu'un modèle gratuit tourne sur un ordinateur portable et fait honte à certaines sorties hébergées. Les deux peuvent être vrais, car ils répondent à des questions différentes : meilleur globalement contre meilleur rapport qualité-prix, meilleur fini contre meilleur contrôle. Les marchés de prédiction réduisent cette nuance à un seul chiffre, et ce chiffre flatte celui qui publie les versions les plus documentées.

Les marchés encodent aussi une date limite de soumission. « Fin octobre » est une véritable échéance, et les modèles publiés après ne comptent pas, peu importe leur qualité. Les utilisateurs réels n'ont pas d'échéance. Un meilleur modèle qui sort le 1er novembre est déjà meilleur le 1er novembre. C'est une faiblesse générale des marchés événementiels appliqués au logiciel : ils mesurent des courses instantanées, et la qualité logicielle est une moyenne mobile.

Lire le marché en tant qu'utilisateur

Si vous décidez où dépenser votre argent ou votre attention, les cotes sont surtout utiles comme raccourci pour « ce qui a le vent en poupe ». L'élan compte pour les utilisateurs d'API, car la qualité des modèles change chaque mois et les coûts de changement sont réels. Les 90 % sur l'édition d'OpenAI disent que s'en détourner reviendrait à engager une dispute avec la foule. Les cotes de MiniMax en vidéo disent que leur pipeline image-vidéo est celui que les gens testent réellement en ce moment.

Pour les décisions d'approvisionnement en particulier, les cotes fonctionnent comme un filtre de pré-diligence. Si le marché donne 90 % à un fournisseur dans la catégorie que vous achetez, la charge de la preuve incombe à l'alternative. Si le marché est à 50-50, vous êtes dans un territoire réellement contesté, ce qui signifie généralement que la catégorie est jeune et que la bonne réponse dépend de votre cas d'usage plutôt que d'un classement.

Les paris les plus intéressants sont ceux que la foule n'a pas encore ouverts : des benchmarks pour les modèles ouverts face aux modèles hébergés, ou un marché sur la catégorie qui connaîtra le prochain bond de qualité. D'ici là, les marchés fonctionnent comme un agrégateur étrangement honnête du battage médiatique communautaire. Ils peuvent se tromper. Ils sont rarement confus.

Articles associés