← 返回博客
News10 分钟

预测市场正押注真金白银,赌谁将赢得图像 AI,而赔率严重一边倒

发布于 2026年9月27日
预测市场正押注真金白银,赌谁将赢得图像 AI,而赔率严重一边倒

Polymarket 上有一系列持续进行的问题,放在两年前听起来会很荒谬:截至 10 月底,哪家公司会拥有最好的图像编辑 AI?截至 11 月底,哪家公司会拥有最好的文生图模型?答案上有真金白银在交易,而当前赔率告诉你的,是去掉新闻稿粉饰后,人群真正相信什么。

截至 9 月下旬,情况很直白。OpenAI 在截至 11 月底的最佳文生图模型上约为 84%。图像编辑市场中,OpenAI 接近 90%。在图生视频方面,资金已转向 MiniMax,其在最佳图生视频 AI 上交易价格高于 90%,考虑到年初这个类别看起来多么拥挤,这是一个显著跃升。

赔率在衡量什么,又不在衡量什么

这些市场是群体基准。交易者反应的是我们其他人也看到的相同信号:发布说明、用户对比、竞技场排行榜、让某个模型的编辑看起来神奇的那条爆火帖子。这让赔率成为不错的人气指标,却是糟糕的真实答案。“最佳”在设计上就没有定义,而人群解决它的方式,和互联网一向的方式一样:哪一周的对比火了就算哪一周。

不过,这种一边倒仍然携带信息。两个类别中 OpenAI 都获得 84% 到 90% 的共识,这是市场在说差距很大。MiniMax 在图生视频上的位置,则是市场在说一个专才在那里击败了通才,至少目前如此。这些市场背后的交易量——较大市场上数万美元的流动性——太薄,称不上机构级,但方向逐周一致。

这些类别实际涵盖什么

有必要精确说明每个市场中的“最佳”意味着什么,因为这些类别并不能互换。文生图衡量原始生成质量:模型根据提示词画出的图有多好。图像编辑衡量修改能力:输入一张现有照片,要求模型修改它,这测试一致性、指令遵循,以及模型能多好地保留未要求改动的内容。图生视频是最年轻的类别,技术上最难:它要求模型连贯地让一张静态图动起来,而随时间保持连贯性的苛刻程度,是单帧无法比拟的。

赔率沿着这些界线清晰分化,而且这种分化合情合理。原始生成和编辑奖励最大规模的训练运行和最多的用户反馈,这有利于最大的实验室。图生视频奖励另一种优化目标——时间一致性,专注的团队可以在这里实现反超。MiniMax 交易价格高于 90%,而 OpenAI 在另外两个类别领先,这正是你会预期的模式——如果专业化仍然重要的话。这本身也是关于该领域的一种主张:前沿不是一场竞赛,而是好几场,且不同赛道的领先者不同。

关于群体准确性的一点提醒

预测市场在具有清晰结果的离散事件上——选举和利率决议——有不错的记录,而在连续质量判断上记录较差,而这些市场正属于后者。“最佳图像编辑 AI”没有官方评分者,所以市场按结算规则指定的方式结算,通常是在到期时引用排行榜或竞技场排名。这让赔率成为对参考排名将说什么的预测,而参考排名与交易者大概关心的真相之间,又隔了一层。

2021 年 1 月的 meme 股票事件和各种加密市场表明,稀薄的市场可以被推动。这些图像市场没有那么稀薄,但远不及政治市场的深度,而且参与者池子足够小,以至于一个有动机的社区协同推动,只有在事后才会显现。把这些价位解读为附带资金的情绪,而不是测量值。

细读市场结构

这一事件系列逐月运行,这让每次到期都变成对上一次的公投。9 月底的图生视频市场正在结算,而 10 月底的市场已经开盘,逐周变化才是信息所在:10 月视频市场单周上涨 15%,这意味着有东西发布或泄露,改变了人群的想法。11 月文生图市场一周内爬升 4%。这种安静的漂移通常是微小证据——竞技场结果和用户对比——的累积,而不是对某条头条的反应。

这些市场的流动性真实但有限,交易量数万美元,流动性相当,所以少数大仓位可以推动短期价格。对待突然飙升,要像对待一张稀薄的山寨币图表一样怀疑。缓慢形成的共识、持续数周的赔率,才是更持久的信号。

为什么开放权重阵营应该关心

问题在于:这些市场没有一个追踪开放模型,而开放社区刚经历了一个喧闹的月份。Qwen Image 2.1,一个 7B 开放权重模型,带着声称与 Nano Banana 2.0 持平的基准发布,并引发了 739 分的 Hacker News 讨论帖。本地工具、移植版和并排对比几天内就出现了。一个你能下载的模型,不符合市场框架下“哪家公司拥有最佳”的资格,这意味着人群共识只衡量托管前沿。

这个缺口影响你如何解读赔率。市场说 OpenAI 领先托管阵营。r/StableDiffusion 信息流说一个免费模型能在笔记本上运行,并让某些托管输出难堪。两者都可能为真,因为它们回答的是不同问题:总体最佳还是每美元最佳,最佳打磨还是最佳控制。预测市场把这种细微差别压缩成一个数字,而这个数字会美化发布信息披露最多的那家。

这些市场还编码了一个提交截止日期。“10 月底”是真实截止线,之后发布的模型无论多好都不算数。真实用户没有截止日期。一个 11 月 1 日发布的更好模型,在 11 月 1 日就已经更好。这是事件市场应用于软件时的一个普遍弱点:它们衡量的是快照竞赛,而软件质量是移动平均。

以用户身份解读市场

如果你正在决定把钱或注意力花在哪里,最好把赔率当作“什么有势头”的捷径。势头对 API 用户很重要,因为模型质量月度变化,而切换成本真实存在。OpenAI 编辑上的 90% 意味着,弃用它就是在购买一个与人群相左的论点。MiniMax 的视频赔率意味着,他们的图生视频管线是眼下人们真正在测试的那个。

具体到采购决策,赔率充当预尽职调查过滤器。如果市场在你正在购买的类别中给某供应商 90%,那么举证责任就落在替代方案身上。如果市场在 50-50,你身处真正有争议的领域,这通常意味着该类别还很年轻,正确答案取决于你的用例,而不是排行榜。

更有趣的押注,是人群尚未开盘的那些:开放模型与托管模型对垒的基准,或者下一个质量跃升出现在哪个类别的市场。在那之前,这些市场充当一个奇怪地诚实的社区炒作聚合器。它们可能出错。但它们很少困惑。

相关文章