Creatify 为广告对 MiniMax H3 进行后训练,将成本降至每秒四美分

--- title: Creatify 为广告对 MiniMax H3 进行后训练,将成本降至每秒四美分 meta_title: Boreal-H3 展示了后训练广告模型能带来什么 meta_description: Creatify Labs 对 MiniMax H3 进行后训练,打造出 Boreal-H3,声称广告通过率更高,且每秒 0.04 美元的价格约为 Seedance 2.5 的十二分之一。 ---
视频模型竞赛大多围绕哪个实验室拥有最好的通用生成器展开。Creatify Labs 走了另一条路:从别人强大的基础模型出发,然后专门针对广告必须完成的工作来训练它。
Boreal-H3 是与 MiniMax 本身合作后训练的 MiniMax H3 模型,于 10 月 2 日发布。它是 Creatify 的 Boreal 系列中的第二个成员,继最初为每秒一美分实时生成而构建的 Boreal 之后。
Boreal-H3 被训练来做什么
Creatify 将训练目标描述为广告必须完成的三项工作:保持参考图像中的产品完好无损、呈现自然的创作者表演,并按照书面简报执行。
这种表述比听起来更具体。通用视频模型优化的是好看。广告模型必须让标签保持可读、在片段中保持包装的形状,并确保镜头前的人从第一帧到最后一帧都可辨认是同一个人。这些是一致性要求,不是美学要求,而这正是通用模型容易出问题的地方。
该公司在发布的同时,还推出了由 Claude Opus 5.5 驱动的 Ad Agent,它负责工作流中的创意指导部分。
数字,以及由谁产生
Creatify 报告称,Boreal-H3 在其自有的广告质量指数上为 133.3,而 MiniMax H3 以 100 为基准。该指数衡量模型生成可用作广告的片段的频率:只有当提示词遵循、参考一致性和视觉真实感均达到 10 分中的 6 分或以上时,片段才算通过。
与其基础模型相比,Creatify 称主体一致性从 83.3% 提升至 94.4%,在困难制作简报上的简报完成度从 27.8% 提升至 50.0%,可见缺陷从每个片段 1.11 降至 0.33,减少了 70%。
该公司称其自动评判器已根据人类偏好进行验证,并且人工研究使用了匿名化、随机化的输出。这些细节正是你想看到的,但评估仍然是 Creatify 自己的,尚未有外部方复现该指数。
价格才是更具颠覆性的主张
Boreal-H3 在 768p 下标价为每秒 0.04 美元。Creatify 将其与 Seedance 2.5 约为每秒 0.47 美元相比,称后者贵约十二倍。
生成速度据称在 768p 下为每 1 秒视频耗时 1.1 秒,这意味着一段 10 秒片段大约需要 11 秒,成本为 0.40 美元。Seedance 2.5 列为每 1 秒视频耗时 46.5 秒,这将使 Boreal-H3 大约快 42 倍。在同项比较中,MiniMax H3 本身为每 1 秒视频耗时 32.3 秒。

在一段已发布的 15 秒产品演示中,Creatify 称 Boreal-H3 渲染耗时 84 秒,而 Seedance 2.5 为 411 秒。
这一比较中埋藏着一个有用的提醒。速度与成本数据在很大程度上取决于分辨率和设置,而 768p 输出与 1080p 输出并非同一回事。正确的解读是,Boreal-H3 被定位为面向高用量、对成本敏感的工具,而非质量优先的工具,价格也反映了这一点。
为什么用广告数据做后训练是明智策略
这里的战略逻辑值得详细说明,因为它指向了许多视频生成的发展方向。
通用视频模型用互联网上能找到的任何数据训练。这带来了广泛的能力,但在任何特定任务上只有平庸的可靠性。广告主不需要一个能渲染纪录片或动漫片段的模型。它需要的是一个能可靠生成这样的片段的模型:产品看起来正确,人物不会说到一半就变形。
用真实广告项目数据进行后训练,会让模型朝着这个目标收窄。基础能力来自本就很强的 MiniMax H3,而专业化则来自基础模型实验室所没有的数据。Creatify 的优势在于,它多年运营广告项目,知道什么会失败。
这是一种模式,说明较小公司如何在不从零训练基础模型的情况下参与竞争。它需要一个强大的开放基础模型、专有数据集,以及对任务的清晰定义。产出的是针对某一任务更好的生成器,而不是总体上更好的生成器。
这笔账也有利于基础模型实验室,这正是 MiniMax 参与合作的原因。每个基于 H3 构建的专用模型都扩展了基础模型的影响力,而无需 MiniMax 亲自服务每个垂直领域。这与开放权重模型对其发布者具有战略价值的逻辑相同:生态系统会完成原始实验室认为无利可图的工作。
有一个值得指出的局限。专业化会使模型变窄,而更窄的模型在其领域之外用处较小。Boreal-H3 不会适合独立电影、音乐视频,或需要非常规运镜的产品可视化。只要买家明白自己在购买什么,这就是特性而非缺陷。
两种控制机制
Boreal-H3 为创意团队提供了两种指导镜头的方式。
图生视频中的关键帧控制会保留开场帧的主体和视觉风格,并可通过可选的结束帧设定镜头落点。这是让产品镜头按品牌要求精确开始和结束的机制。
参考生视频中的多参考控制可将最多九张图像、三段视频和三段音频片段组合成一个连贯镜头。这是将营销活动现有素材引入新片段而无需重拍的机制。
也支持文生视频,具备镜头方向和场景之间的自然转场。对营销团队来说,有用的模式是用关键帧控制锁定品牌关键帧,并让模型处理连接部分。
值得关注什么
有三件事可以确认这是否不止是一份新闻稿。
对广告质量指数的独立评估。只有其创造者能衡量的通过率,在别人测试之前只是营销说法。Creatify 的方法比大多数更谨慎,有人工验证和随机化输出,但该指数仍由销售该模型的公司发布。
真实世界中的分辨率。如果 Boreal-H3 在 1080p 而不只是 768p 下也站得住脚,那么“便宜十二倍”的比较会可信得多,因为一旦需要更高输出,替代方案就不再具有可比性。需要广播或大幅面投放的广告主无论价格如何都不会接受 768p。
由广告主而非代理商采用。如果品牌围绕该工具构建工作流,这个工具就重要,而这会体现在该模型的输出是否开始出现在实际投放的营销活动中。代理商测试工具与品牌依赖工具是不同的信号。
还有第四个适用于整个类别的问题。后训练模型会继承基础模型的限制,包括任何许可限制。MiniMax H3 排除了若干地区,基于它构建的 Boreal-H3 可能带有相同限制。全球运营的广告主在将营销活动流程投入使用之前,应检查地区覆盖范围。
Boreal-H3 瞄准的是预算项,而不是基准测试冠军头衔。根据 Creatify 发布的数字,它有一个说得通的理由,而这个理由与其说靠质量,不如说靠一个事实:一条能可靠用作广告的片段,比一条仅仅令人印象深刻的片段更有价值。