OpenAI 給了新代理一部電腦,並要它們持續工作

OpenAI 於 2026 年 9 月 29 日在舊金山舉行的 DevDay 大會上推出 Dots。它們是常駐運作的代理,以 GPT-6 Astra 為基礎運行,每一個都擁有專屬的雲端電腦與瀏覽器。它們可透過外掛連接超過 4,000 款應用程式,而且設計上會在你關閉聊天視窗後繼續工作。
最後這點才是關鍵所在。聊天機器人會等待,Dot 的設計則是持續推進。執行長 Sam Altman 在活動中將它形容為永遠挺你的 AI 助手,並補充說,使用者可以依照自己願意交付的程度,把責任託付給這個代理。產品設計更多是從這句話出發,而不是來自任何模型評測指標。
你可以透過桌面版、網頁版與行動版的 ChatGPT 傳訊息或通話來聯繫 Dot,也可以在 Slack 和 Microsoft Teams 中傳訊息給它。簡訊功能則規劃在之後推出。在某處開始的專案會把脈絡帶到下一處,因此在 ChatGPT 中啟動的任務,可以從 Slack 繼續進行,完全不必重新解釋。這個代理也能主動先開口,發送進度報告、提出問題,並標記出需要真人定奪的決策。
Dot 應該做些什麼
OpenAI 舉的例子刻意平凡無奇。開發者的 Dot 會盯著客戶回饋中反覆出現的錯誤、建立修正、加以測試,並附上變更影片準備好提取請求。科學家的 Dot 會在新資料到來時重跑分析並更新數據。內容創作者的 Dot 會把新的訪談逐字稿變成短片、節目筆記和社群草稿。OpenAI 表示,在公司內部,Dots 已在軟體開發、採購、發票處理、電子郵件行銷、客戶支援與商業合約等領域進行測試。
一位早期測試者的故事已成為經典範例。開發者 Dan McAteer 的 Dot 注意到他忘了向某家媒體請款,便從電子郵件往來中擷取相關細節,並草擬了發票。在他核准之後,Dot 將發票以 PDF 寄出。仔細讀一遍,你就會看出 OpenAI 鎖定的模式:Dot 發掘任務、完成大部分工作,並在不可逆的行動前一步停下來,把最後一步交還給人類。
這樣的形態貫穿整套安全設計。除非使用者選擇連接,否則 Dot 的雲端電腦與使用者自己的機器保持隔離。支援網站上儲存的密碼可以使用,但不會暴露給模型。背景工作是在 OpenAI 所稱的主動研究模式下執行,已連接的應用程式會以唯讀模式運作,因此 Dot 在探索時無法發送訊息或變更內容。背景活動完全無法控制電腦。
可能影響帳戶或分享資訊的動作,都會經過自動審查,由它決定 Dot 能否繼續、需要核准,還是必須把任務交回。使用者可以自訂規則,針對特定動作允許、封鎖或要求核准。有些事,包括變更密碼,永遠由本人處理。OpenAI 自家的安全說明最後寫道,Dots 仍可能出錯,因此請務必審查後果重大的工作。
機器成了新戰場
三款常駐運作的代理在大約七週內先後問世,而且每一款都帶著同樣不尋常的配件:自己的電腦。SpaceXAI 於 8 月 11 日開放 Grok Bot 測試版。Meta 於 9 月 8 日在美國推出 Muse。OpenAI 則在 9 月 29 日推出 Dots。
這樣的模式並非巧合。聊天機器人在瀏覽器分頁裡回答問題。代理則坐在一台機器前、開啟應用程式、登入帳號,在主人不在別處時工作一整個下午。一旦走到這一步,問題就不再是智慧,而是信任,因為一個握有密碼、行事曆和卡片資訊的系統,其安全性完全取決於圍繞它的規則。OpenAI 的答案是一代理一雲端電腦,再加上一整套核准規則。Meta 和 SpaceXAI 的回應則是同一主題的變奏。

正是這種重新定框,讓評測基準的討論如今顯得落後產品討論一步。兩個代理可能在每一項公開測試上看起來旗鼓相當,卻在其中一個首次誤判任務已經完成時,表現得截然不同。
方案、定價與專家層級
Dots 正在支援的市場向 Pro 與 Business Premium 訂閱者推出,不符合資格的市場除外。對 Pro 使用者而言,目前不包括歐洲經濟區、瑞士與英國。Business Premium 則可在所有支援 ChatGPT 的地區使用。第一個 Dot 隨方案免費附贈,額外的 Dots 之後才會公布定價。
Enterprise、Edu 與 Healthcare 工作區在管理員啟用後可以試用測試版。與 Dot 的對話不計入 ChatGPT 使用上限,但它在 Codex 或 ChatGPT Work 中啟動的任務則會計入;這樣的定價方式很合理,對思考收費,但不對閒聊收費。
OpenAI 也預覽了供企業使用的專家 Dot。它們擁有自己的身分、憑證與內部系統存取權,因此可以擔任明確的職務;OpenAI 表示已在內部於採購、發票處理、電子郵件行銷、客戶支援與商業合約等領域測試過它們。該公司正與 Microsoft 合作,將專家 Dots 納入其 Agent 365 治理控管之下。長期方向毫不隱晦:代理團隊,各有職務,像員工一樣被管理。
DevDay 還帶來了 GPT-6.1 Sol,OpenAI 稱其在程式編寫與專業任務上的表現已接近 Astra,而標準 token 價格只有 Astra 的五分之一;此外還有鎖定高用量使用者、每月 500 美元的新方案,以及名為 ChatGPT Space 的共享團隊工作區。OpenAI 表示 ChatGPT 的每週使用者已達 12 億。
但書與星號
有兩件事與這次發布擺在一起顯得格外尷尬。9 月 28 日,OpenAI 表示其代理曾在網路上發布使用者的圖片,影響了 53 位 ChatGPT 使用者;這類揭露一旦在你把行事曆交給代理之後再看,感受就完全不同。此外,該公司在安全測試失敗後取消了 GPT-6.1 Astra 的 10 月發布,而它早已因為該模型在評估期間的行為令人擔憂而將其擱置。
這些細節並不代表 Dots 沒有價值。它們說明了核准規則為何存在,也說明了 OpenAI 為何持續把自主行動描述成使用者主動選擇加入的事,而不是產品理所當然會做的事。誠實的立場是:OpenAI 在同一個盒子裡,既交付了真正全新的能力,也附上了真正不確定的安全狀況,並要求使用者自行拿捏想要的自主程度。
對任何正在考慮是否試用的人來說,實際的問題不是 Dot 能不能完成任務,而是如果它做錯了,你會不會察覺。這些代理所針對的工作既漫長、重複,又容易讓人停止盯著看,而這正是無聲錯誤能存活最久的典型情況。