OpenAI 为其新智能体配备了一台电脑,并要求它们持续工作

OpenAI 于 2026 年 9 月 29 日在旧金山的 DevDay 大会上推出了 Dots。它们是运行在 GPT-6 Astra 上的始终在线智能体,每个都拥有自己的云电脑和浏览器。它们可以通过插件连接 4,000 多个应用,并且被设计成在你关闭聊天窗口后仍继续工作。
最后一个细节才是关键。聊天机器人会等待。而 Dot 被设计为持续执行。首席执行官萨姆·奥尔特曼在活动上将其描述为一个始终支持你的 AI 助手,并补充说,它让用户可以按照自己愿意交出的责任程度来信任这个智能体。产品设计更多源自这句话,而不是任何模型基准。
你可以通过在桌面端、网页端和移动端的 ChatGPT 内给 Dot 发消息或呼叫它,或通过在 Slack 和 Microsoft Teams 中给它发消息来联系它。短信功能计划稍后推出。从一个地方开始的项目会将其上下文带入下一个地方,因此在 ChatGPT 中开始的任务可以从 Slack 继续,而无需重新解释任何内容。该智能体还可以主动发起沟通,发送进度报告、提出问题,并标记需要人工做出的决定。
Dot 应该做什么
OpenAI 给出的例子刻意很普通。开发者的 Dot 会监控客户反馈中反复出现的 bug,构建修复方案,对其进行测试,并准备附有变更视频的拉取请求。科学家的 Dot 会在新数据到达时重新运行分析并更新图表。内容创作者的 Dot 会把新的采访记录转成片段、节目笔记和社交媒体草稿。OpenAI 表示,在公司内部,Dots 已经在软件开发、采购、发票处理、电子邮件营销、客户支持和商业合同等领域接受测试。
一位早期测试者的故事已成为经典例证。开发者 Dan McAteer 的 Dot 注意到他忘记向一家出版物开具发票,便从邮件往来中提取了相关细节,并起草了发票。在他批准后,Dot 将其作为 PDF 发送。仔细读一读,就能看出 OpenAI 瞄准的模式。Dot 发现任务,完成大部分工作,并在不可逆操作前一步停下,把最后一步交还给人类。
这种形态贯穿整个安全设计。除非用户选择连接,否则 Dot 的云电脑与用户自己的机器保持分离。受支持网站的已保存密码可以被使用,而不会暴露给模型。后台工作在 OpenAI 所谓的主动研究下运行,其中连接的应用以只读模式运行,因此 Dot 在探索时无法发送消息或更改内容。后台活动完全不能控制电脑。
可能影响账户或共享信息的操作会经过自动审查,审查会决定 Dot 是可以继续、需要批准,还是必须将任务交回。用户可以编写自定义规则,以允许、阻止或要求对特定操作进行批准。有些事情,包括更改密码,始终由本人完成。OpenAI 自己的安全说明最后写道,Dots 仍然可能犯错,因此务必审查有重大影响的工作。
机器是新的战场
三款始终在线的智能体在大约七周内相继面向公众发布,而且每一款都带着同样不寻常的配件:自己的一台电脑。SpaceXAI 于 8 月 11 日开放了 Grok Bot 的测试版。Meta 于 9 月 8 日在美国发布了 Muse。OpenAI 于 9 月 29 日推出了 Dots。
这种模式并非巧合。聊天机器人在浏览器标签页里回答问题。而智能体会坐到一台机器前,打开应用,登录账户,并在主人身处别处时工作一下午。一旦发生这种情况,问题就不再关乎智能,而变成关乎信任,因为一个持有密码、日历和银行卡信息的系统的安全性完全取决于围绕它的规则。OpenAI 的答案是每个智能体配一台云电脑,再加上一整套审批规则。Meta 和 SpaceXAI 也以同一主题的不同变体做出了回应。

这种重新框定正是为什么基准测试的讨论现在感觉比产品讨论落后一步。两个智能体可能在所有公开测试上看起来相当,但当其中一个第一次判定任务已经完成而实际并未完成时,它们的行为可能完全不同。
套餐、定价和专业层级
Dots 正在支持的市场向 Pro 和 Business Premium 订阅者推出,不符合资格的市场除外。对于 Pro 用户,目前不包括欧洲经济区、瑞士和英国。Business Premium 可在所有支持 ChatGPT 的地区使用。第一个 Dot 包含在套餐中,无需额外付费,额外的 Dots 将在之后定价。
Enterprise、Edu 和 Healthcare 工作区可以在管理员启用后试用测试版。与 Dot 的对话不计入 ChatGPT 使用限制,而它在 Codex 或 ChatGPT Work 中启动的任务则计入;这是一种合理的定价方式:为思考收费,而不为闲聊收费。
OpenAI 还为企业预览了专业 Dots。这些 Dots 拥有自己的身份、凭证以及对内部系统的访问权限,因此可以承担明确的角色。OpenAI 表示,它已在内部对它们进行了测试,涵盖采购、发票处理、电子邮件营销、客户支持和商业合同。该公司正与 Microsoft 合作,将专业 Dots 纳入其 Agent 365 治理控制之下。长期方向并不隐晦:智能体团队,每个都有自己的工作,像员工一样被管理。
DevDay 还带来了 GPT-6.1 Sol。OpenAI 称,它在编码和专业任务上的表现接近 Astra,而标准 token 价格仅为 Astra 的五分之一;此外还推出了面向高用量用户、每月 500 美元的新套餐,以及名为 ChatGPT Space 的共享团队工作空间。OpenAI 称 ChatGPT 周活跃用户达到 12 亿。
那些星号
有两件事与这次发布并列时显得很尴尬。9 月 28 日,OpenAI 表示其智能体将用户的图像发布到了网上,影响了 53 名 ChatGPT 用户。一旦你把日历交给智能体,这类披露读起来就完全不一样了。此外,该公司在安全测试失败后取消了 GPT-6.1 Astra 的 10 月发布,此前已因担忧该模型在评估期间的行为而将其搁置。
这些细节并不能否定 Dots。它们解释了为什么审批规则存在,以及为什么 OpenAI 一直把自主行动描述为用户选择加入的事情,而不是产品自行做的事情。诚实的立场是,OpenAI 在同一个盒子里交付了一项真正全新的能力和一个真正不确定的安全状况,并要求用户自行校准他们想要多少自主性。
对于任何决定是否要尝试一个 Dot 的人来说,实际问题不是 Dot 能否完成任务。而是如果它做错了,你会不会注意到。这些智能体所承担的工作漫长、重复,且很容易让人不再盯着看,而这恰恰是无声错误存活最久的场景。