← 返回博客
News8 分钟

微软 MAI-Image-2.6 正悄然逼近 GPT Image 2

发布于 2026年9月26日
微软 MAI-Image-2.6 正悄然逼近 GPT Image 2

2026 年的大部分时间里,AI 图像领域一直是 OpenAI 和 Google 之间的双雄争霸。这种说法开始显得不完整了。微软的 MAI-Image-2.6-Preview 在排行榜上攀升得足够快,它与 GPT Image 2 之间的差距现在只剩 21 个 Elo 分。

这个数字之所以重要,在于它的变化方式。在 4 月 21 日 GPT Image 2 发布后,其领先优势从 7 月的大约 67 Elo 扩大到 8 月的约 97 Elo。然后微软在 9 月之前把它压缩到 21。这不是一款产品保持稳定,而是一个挑战者在加速。

排行榜一览

截至 2026 年 9 月,GPT Image 2 在 Artificial Analysis 的文生图竞技场中以 1,370 Elo 位居第一。MAI-Image-2.6-Preview 为 1,349。在图像编辑竞技场中,GPT Image 2 以 1,255 分位居第一,但同样的趋势也在上演:微软正在逼近。

在目前大家最关注的具体能力——文字渲染方面,并列领先的是 GPT Image 2 和 Google 的 Nano Banana Pro。FLUX.2 被认为是排版方面最好的开放模型。微软的模型尚未在这一类别中夺冠,但其整体攀升表明它在各个方面都具备竞争力。

两位竞争者并驾齐驱,排行榜差距缩小的可视化图

为什么微软的处境不同

这个领域的大多数挑战者要么是初创公司,要么是没有现有企业客户基础的研究实验室。微软不是这样。MAI-Image-2.6 是微软生态系统中可部署的模型,这意味着 Azure、Copilot 以及整个企业技术栈都成为分发渠道。

这才是这个故事中安静的部分。OpenAI 和 Google 通过消费级产品和 API 销售图像。微软可以通过已经为微软基础设施付费的公司的采购流程来销售。对于一家决定将图像生成路由到哪里的企业来说,“它已经在 Azure 里了”是一个实实在在的理由。

该模型本身也反映了多模态集成的趋势。微软一直在将图像生成嵌入其助手界面,而一款强大、可自托管的图像模型让这些界面有了不依赖竞争对手 API 而存在的理由。

仍然悬而未决的问题

有几个注意事项值得明确说明。

Elo 差距是 21 分,这很有意义,但还谈不上碾压。排行榜排名逐月变化,预览模型可能在非生产条件下跑出亮眼分数,却未必能在生产环境中保持。MAI-Image-2.6 仍然被标注为预览版。

微软图像模型的定价也不如 OpenAI 或 Google 公布的按张计费价格透明。对于正在评估这一选项的公司来说,这是一个摩擦点,尽管企业许可通常本来就按定制条款运作。

而且排行榜本身只衡量某些方面。盲投 Elo 分数奖励的是提示词遵循度和整体吸引力。它们无法体现许可条款、水印政策,或模型在内容审核下的表现——对于一家要把输出呈现在客户面前的企业来说,这些都比几个 Elo 分更重要。

该模型真正擅长的地方

抛开排行榜数字,关于 MAI-Image-2.6 的早期报告表明,它强在当前市场需要的地方:通用提示词遵循度,以及跨多种风格的干净、连贯输出。

微软并没有将它定位为“风格大师”。其卖点是实用性。这是一个能嵌入 Copilot 和 Azure 的模型,可以为产品原型图、营销材料和内部设计工作生成可靠的图像,而且没有 Midjourney 的美学个性,也没有 Nano Banana Pro 那种原始的真实感。

这种“无聊但可靠”的定位在企业采购中是一种优势。一家每月生成上千张符合品牌规范图像的公司,不想要一个有“想法”的模型。它要的是一致性,而微软押注的正是:一致性加上 Azure 渠道,足以从两大领先者手中抢下一部分市场份额。

前方是多模型并存的现实

更大的故事并不是微软可能追上 OpenAI,而是图像生成正在变成一种有多个可信供应商的大众商品,而这会改变买家的思考方式。

一年前,明智的默认选择是“用最好的模型”。现在,明智的默认选择是“用适合你的技术栈、预算和许可需求的模型”。一家已经在 Azure 上的公司会默认使用微软的模型,就像一家在 Google Cloud 上的公司会默认使用 Nano Banana 一样:使用其他任何方案都会带来实实在在的集成成本。

这就是为什么 21 分的 Elo 差距没有表面上那么重要。Elo 衡量的是提示词遵循度,而不是总拥有成本。而在真正驱动企业采购的那个指标上,微软拥有一种结构性优势,其他公司仅靠发布一款模型是无法匹敌的。

需要关注什么

三个信号会告诉你,这是一次真正的格局变化,还是排行榜上的短暂波动。

第一,预览标签。如果 MAI-Image-2.6 发布正式版并保持其 Elo 排名,那就是确认信号。预览版可以跑出亮眼分数,而不必承受正式发布模型所面临的生产环境限制。

第二,定价透明度。微软在按张计费价格方面一直比 OpenAI 和 Google 更沉默。当这些信息公布时,总成本比较才成为可能,许多采购决策也将随之而来。

第三,Copilot 的动作。当 MAI-Image-2.6 开始在 Copilot 中大规模生成图像时,它就不再是一个基准测试故事,而成为一个分发故事。这才是真正会推动市场的指标。

就目前而言,稳妥的总结是:GPT Image 2 仍然领先,但“明确领导者”的定位已经来日无多。微软拥有模型、渠道和势头。它只需要让这三者继续指向同一个方向。

对未来几个月意味着什么

实际结论是,“选哪个模型”的问题只会变得更加复杂,而不是更简单。如果你一直因为 GPT Image 2 是明确领导者而将其标准化,那么 2026 年 9 月是重新进行评估的合理时机。

这并不意味着要切换。GPT Image 2 仍然领先,21 分的领先优势也是领先。这意味着 AI 图像生成领域单一明显答案的时代正在结束,而微软是主要原因。

对于开发者来说,信号更简单:关注 MAI-Image-2.6 何时结束预览,并关注微软在 Azure 和 Copilot 内部如何运用它。市场影响将落在那里,而不是任何排行榜数字上。

相关文章