← 返回博客
News预计阅读 10 分钟

智能体治理层到来,且正在快速落地

发布于 2026年10月4日
智能体治理层到来,且正在快速落地

两年来,关于 AI 智能体的问题一直是能力。它能不能订机票、提交工单、结清理赔。这个问题基本上已经解决了,至少对于企业真正关心的那些狭窄任务而言。新的问题是治理:当一个智能体带着真实凭证在生产环境中运行时,企业如何让它不越界。

十月涌现了一批正是为此打造的产品,其中的规律很难视而不见。

OpenAI 为自己的智能体构建运营层

OpenAI 推出了 Presence,被描述为用于部署语音和聊天智能体的运营层。其卖点是结构化控制:为每个智能体定义工作范围,限制它可触及的知识,约束它被允许执行的动作,并默认附带评估与人工升级。发布时的示例很能说明问题,因为它们点名的正是企业最不愿交出去的那些职能。账单支持。保险理赔。员工 IT 请求。

这些正是智能体能够接触资金、个人数据和记录系统的任务。也是出错代价高昂、且难以逆转的任务。Presence 读起来像是 OpenAI 在承认:一个能力强大的模型还不够。模型回答的是问题。运营层决定这个答案是否被允许变成一次行动。

为已经在运行的智能体而生的第二款产品

Classie 围绕同样的需求推出了 Supervise,定位为对已在生产环境中的智能体进行实时追踪、控制和核算。这一区别很重要。Presence 面向的是你即将部署的智能体。Supervise 针对的则是更混乱的现实:那些六个月前就已上线、并累积了一堆没人记得授权过的权限的智能体。

这两款产品从两端描述同一个市场,合起来标志着一次转变。买家不再问智能体能否完成任务。买家在问:当它某天做出意料之外的事时会发生什么,以及是否有一个控制平面能抓住它。

治理厂商把智能体纳入自家平台

OneTrust 围绕运行时 AI 治理扩展了其平台:一个控制平面、一个指挥中心,以及与 ChatGPT、Claude、Copilot 和 Glean 的集成。其论点是,治理不能是部署前做的一次文档演练。它必须适用于动作发生的当下,保留决策证据,并与企业已有的隐私和风险项目相连。

这个集成点才是真正的关键。OneTrust 的客户不想要一块新仪表盘。他们想要智能体监督住在同一个已经处理同意、隐私和数据风险的系统里,因为审计轨迹必须在那里留存下来。

安全厂商则从另一侧提出同样的论点。红帽 CTO 一直在推动一个观点:当智能体能够跨企业系统执行动作的那一刻,模型层面的防护就不再足够。安全边界从模型转移到围绕它的身份、运行时和网络层。按这种解读,智能体是一种戴着工牌的新型内部人员,而不是更聪明的聊天机器人。

审计轨迹就是产品

剥去品牌包装,这些产品都收敛到同一样交付物:一份记录。谁启动了智能体、它有什么权限范围、它读了什么、改了什么,以及谁批准了结果。受监管行业对人类已经这么做了几十年。把这件事延伸到自主行动的软件上是新的,而正是这一点在解锁采用。

Salesforce 和 AWS 用 Agentforce 360 下了同样的赌注:为每个智能体决策生成不可篡改的审计轨迹,并通过 Bedrock 在 Claude 上运行其推理引擎。CrowdStrike 早早加入,理由是紧挨安全采购能简化流程。当客户能在同一份合同里既买到能力又买到治理方案时,成交就更容易。

为什么监督比听起来更难

这些产品听起来像仪表盘。但在表层之下,智能体治理必须解决一个在本世纪之前并不存在的问题:你如何描述一个会即兴发挥的系统的正确行为。

传统服务只做它被编程去做的事。人类员工懂规则,也能被要求解释某个决定。智能体介于两者之间。它有一个目标和一套工具,然后自己选择步骤。那份自由正是价值的来源,也正是风险所在,因为让智能体能够处理异常请求的那份灵活性,同样让它可能采取没人批准过的异常动作。

治理产品从几个角度切入这个问题。范围限制界定智能体被允许尝试什么。知识边界决定它能读什么。动作审批在任何不可逆的事情之前插入检查点。评估捕捉随时间出现的退化,人工升级则处理智能体标记为不确定的情况。每一项控制都不完美。叠加在一起,它们缩小了坏决策能在无人监督下不断放大的空间。

微妙的要求在于:一切正常时,这些控制必须是无形的。一层拖慢每项日常任务的监督层,会在一个月内被关掉,通常还是由当初要求它的那个团队来关。好的产品只在边缘介入,而这比交付一个策略引擎要难得多。

购买模式也随之改变

这些发布里有一个容易被忽略的商业信号。治理产品并不是作为模型订阅的附加项来卖的。它们被当作平台来卖,有时卖家甚至与模型训练毫无关系。

这告诉你感知价值正在向哪里转移。当模型稀缺又惊艳时,模型就是产品。如今已有好几款模型对同一份工作都足够好,差异化就变成了围绕它们的东西:控制、日志、集成,以及向审计人员证明发生了什么的能力。买家开始把智能体视为受治理系统中的一个组件,而不是系统本身。

这也意味着买家变了。为治理平台签字的人,往往不是为模型签字的那个人。安全、风险和合规团队正在进入决策,他们带来的是另一套问题。不是它有多聪明,而是谁能关掉它、它会留下什么、证据存放在哪里。为这类受众打造的产品,放在演示片旁边显得乏味,而正是它们让演示片变得可部署。

这对下一阶段意味着什么

治理产品成批出现,通常意味着能力阶段结束、信任阶段开始。云是这样:合规工具在基础设施之后几年才出现。移动也是这样:设备管理追上了应用爆发。智能体在同一条曲线上,只是被压缩了。

对于现在正在部署智能体的人,务实的解读很直白。从一开始就把监督建进去。给一个已经自由运行了一年的智能体事后加装控制平面,比在发布前就搭好要难,而做这件事的工具终于已经上架了。「我们以后再补治理」听起来还算合理的窗口期已经关闭。

相关文章