华为云围绕智能体重建技术栈,然后给账单定好了日期

华为云在 9 月的年度 Connect 大会上表示,其企业级 AI 产品组合已全面上市,而这套组合的设计核心是智能体。华为云 CEO 周跃峰将这一转变定义为为行业智能体时代打造一朵“智能体云”,与之配套发布的内容则大多关于底层管道。
准确地说,是四段管道。华为云将其新的基础设施范式描述为高效 Token、增强记忆、通用算力与 AI 算力统一调度,以及安全自治。该公司称,由此构建的平台已在全球服务超过 3,500 家客户。这个说法听上去像营销话术,直到你去看每一段管道针对的是什么——因为每一项都在解决智能体在生产环境中会遭遇、而聊天机器人不会遇到的故障。
Token、记忆,与十分钟恢复
算力层是灵衢昇腾 950 集群服务。华为云称其采用五级快速恢复机制并具备全链路可观测能力,其上的训练任务已连续运行 40 天不中断,故障可在十分钟内恢复。该公司称其 Token 吞吐量比上一代高出 20%。该服务已于 9 月 30 日在中国商用,海外上线定于 11 月 30 日。

十分钟恢复这一目标,与跑分成绩是完全不同的规格指标。长时间训练会失败,而失败的代价以损失的 GPU 小时数和重启开销来衡量,因此恢复时间才是客户财务团队真正在意的数字。
记忆层针对的是长时运行智能体的一种特定故障模式。华为云将该产品称为 CMS 记忆存储,称其提供 PB 级记忆空间,容量约为同类产品的两倍,并具备 TB 级读取速度以实现高速访问,性能提升 50%。其卖点在于:处理长任务的智能体需要一个地方保存它学到的东西,而这个东西不能是上下文窗口,因为无限增长的上下文窗口既昂贵又不可靠。
接下来是模型接入层。AgenticMaaS 被描述为让开发者一键调用主流最先进模型,无需任何部署工作。MiniMax 在同一场活动上演示了在该平台上运行的多模态模型,这提醒人们:在中国,模型厂商和云厂商往往面对同一个企业买家。
商业版与开源版,一起卖
应用层是华为云的做法区别于纯粹基础设施打法的地方。它采取双轨策略:商业化的 ZhiGuo AgentArts 平台,以及名为 openJiuwen 的开源对应物。公司称,二者合计已发布超过 5,000 个通用资产和 1,000 多个行业资产,指的是可复用的技能、模板和连接器,而非原始模型。
该平台已在百余家政府机构、银行、科研院所和企业中使用,包括深圳市龙岗区政府、中国邮政储蓄银行、南方电网和金山办公。金山办公将 WPS 365 文档中心与 Comate 助手结合,在该平台上构建了面向办公场景的智能体——这种整合是云厂商无法独自完成的,也是应用厂商无法独自承载的。
ZhiGuo AgentArts 计划于 12 月 30 日在海外市场商用。openJiuwen 的开源社区报告称已获得超过 50,000 个 star 和 329 万次下载。同时推出商业平台和开源版本,是一种在开发者群体中播种的方式——这些人最终会需要付费版本,这也是如今多家中国厂商都在沿用的套路。
私有化部署的另一种理由
在中国,华为云并非唯一销售智能体基础设施的公司,而 9 月一系列更低调的活动展示了市场的其余面貌。神达(Mitac)与 AMD 合作,在无锡和贵阳举办了部署研讨会,推广一款名为 Agent Builder 的企业级智能体一体机,该产品基于 AMD 锐龙 AI Max 处理器打造,以数据主权为卖点。它的主张与公有云正相反:把模型、算力、知识库和业务系统都留在公司内部,让智能体在办公室的一台盒子里运行。
两种路线回应的是同一种采购顾虑。企业想要能触及真实业务流程的智能体,而真实业务流程中包含的数据,它们并不放心放到别人的端点之后。
采购方本就在追踪的四个数字
这四大基础设施支柱对应着四项成本。Token 是每一次推理的价格,这也是为什么发布内容以吞吐量而非跑分打头。记忆是当上下文窗口不再够用时,长时任务所付出的代价。调度是在共享硬件上运行通用负载与 AI 负载所带来的利用率损失。安全则是合规部门在有任何东西接触生产数据之前会追问的问题。
华为云的说法是,它已在一套技术栈中解决了全部四项,而之所以能做到,是因为它自己拥有芯片。这对竞争对手来说更难对标,对客户来说却更容易验证,因为结果会体现在采购团队本就在衡量的三个地方:每百万 Token 的成本、长时任务失败率,以及 GPU 时间中真正在做事的占比。
为什么主角是基础设施而非模型
今年中国智能体讨论中一个有趣的论点是:模型能力已经趋同,价值已经转移到它周围的东西上。上海高级金融学院的一位实践教授 9 月在上海的一场论坛上给出了这一论点的经济学版本:与边际成本趋近于零、网络效应强烈的互联网平台不同,大模型在每一次推理时都消耗资源,而用户可以在几分钟内切换模型。仅靠模型建立的护城河很浅。
如果这一判断成立,那么可防御的层面就是迁移成本高昂的那一层,也就是 Token、记忆、调度和安全,而不是权重。
在这一框架下,华为的优势是垂直整合。它同时拥有芯片、互联、云和模型平台,这就是为什么昇腾 950 的发布以恢复时间和 Token 吞吐量打头,而不是排行榜名次。没有芯片业务的竞争对手卖的是一套整合叙事,而整合叙事更容易被复制。
反方观点是:高度整合也意味着你是单点故障,而企业越来越想要一个可迁移的智能体层,而不是一个被厂商定形的层。这种张力将在未来两个季度接受检验,起点是 9 月 30 日的中国商用日期和 11 月底的海外上线。海外的时间节点比国内更重要,因为一套围绕国产芯片构建的技术栈,必须证明它能服务那些数据不能离开自己司法辖区的客户。