OpenAI、新しいエージェントにコンピュータを与え「働き続けろ」と命じた

OpenAIは2026年9月29日、サンフランシスコのDevDayカンファレンスでDotsを発表した。GPT-6 Astra上で動作する常時稼働エージェントで、それぞれに専用のクラウドコンピュータとブラウザが与えられる。プラグインを通じて4,000以上のアプリに接続でき、チャットウィンドウを閉じた後も作業を続けるように作られている。
この最後の点こそが要だ。チャットボットは待つ。Dotは続けるように設計されている。最高経営責任者のSam Altmanはイベントで、常にあなたを支えてくれるAIヘルパーだと説明し、ユーザーが心地よく任せられる範囲の責任をエージェントに信頼して委ねられるようにすると付け加えた。製品設計は、どのモデルベンチマークよりも、この一文から導かれている。
Dotにアクセスするには、デスクトップ、ウェブ、モバイルのChatGPT内でメッセージを送るか通話するか、SlackやMicrosoft Teamsでメッセージを送る。テキストメッセージによる利用は後日予定されている。ある場所で始めたプロジェクトは、そのコンテキストを次の場所へ引き継ぐため、ChatGPTで始めたタスクを何も説明し直さずにSlackから続けられる。エージェントから先に話しかけることもでき、進捗報告を送り、質問をし、人間が必要な判断にフラグを立てる。
Dotは何をする想定なのか
OpenAIが挙げる例は、あえて平凡だ。開発者のDotは、顧客フィードバックを監視して繰り返し発生するバグを見つけ、修正を作成し、テストし、変更内容の動画付きでプルリクエストを準備する。科学者のDotは、新しいデータが届くと分析を再実行し、数値を更新する。コンテンツクリエイターのDotは、新しいインタビューの文字起こしをクリップ、ショーノート、ソーシャル投稿の下書きに変換する。OpenAI社内では、Dotはすでにソフトウェア開発、調達、請求書処理、メールマーケティング、カスタマーサポート、商業契約にわたってテストされていると同社は言う。
初期テスターの一人の話は、典型例として広まっている。開発者のDan McAteerのDotは、彼がある出版社への請求を忘れていることに気づき、メールスレッドから関連情報を引き出し、請求書の下書きを作成した。彼が承認すると、DotはそれをPDFとして送信した。注意深く読めば、OpenAIが狙うパターンが見えてくる。Dotはタスクを見つけ、作業の大半をこなし、不可逆的な行動の一歩手前で止まり、最後の一手を人間に返す。
その形は安全設計全体に表れている。Dotのクラウドコンピュータは、ユーザーが接続を選ばない限り、ユーザー自身のマシンとは分離されている。対応サイトの保存済みパスワードは、モデルに晒すことなく使用できる。バックグラウンド作業は、OpenAIが「プロアクティブリサーチ」と呼ぶ仕組みの下で実行され、接続されたアプリは読み取り専用モードで動作するため、Dotは探索中にメッセージを送信したりコンテンツを変更したりできない。バックグラウンド活動はコンピュータを制御することは一切できない。
アカウントに影響を与えたり情報を共有したりする可能性のある行動は自動レビューを経て、Dotが続行できるか、承認が必要か、タスクを返す必要があるかが判断される。ユーザーは、特定の行動を許可、ブロック、または承認必須にするカスタムルールを書ける。パスワード変更を含む一部のことは、常に人間が行う。OpenAI自身の安全に関する注記は、Dotはまだ間違いを犯す可能性があるため、重要な作業は常に確認するように、という一文で締めくくられている。
マシンこそが新たな戦場
3つの常時稼働エージェントが約7週間のうちに一般公開され、いずれも同じ異例の付属品を伴って登場した。それは専用のコンピュータだ。SpaceXAIは8月11日にGrok Botのベータ版を公開した。Metaは9月8日に米国でMuseをリリースした。OpenAIは9月29日にDotsを発表した。
このパターンは偶然ではない。チャットボットはブラウザタブの中で質問に答える。エージェントはマシンの前に座り、アプリを開き、アカウントにサインインし、持ち主が別の場所にいる間に午後いっぱい作業を続ける。そうなると、問題は知能ではなく信頼になる。なぜなら、パスワード、カレンダー、カード情報を保持するシステムの安全性は、完全にその周囲のルールにかかっているからだ。OpenAIの答えは、エージェントごとのクラウドコンピュータと一連の承認ルールだ。MetaとSpaceXAIも同じテーマのバリエーションで応じている。

その再定義により、今やベンチマークの議論は製品の議論より一歩遅れているように感じられる。2つのエージェントが公表されたあらゆるテストで同等に見えても、片方がタスクをまだ終わっていないのに終わったと判断した最初の瞬間に、まったく異なる振る舞いをする可能性がある。
プラン、価格、スペシャリスト枠
Dotsは、対象外の市場を除き、対応市場のProおよびBusiness Premium加入者向けに展開中だ。Proユーザーの場合、今のところ欧州経済領域、スイス、英国は除外される。Business Premiumは、対応するすべてのChatGPT地域で利用できる。最初のDotはプランに追加料金なしで含まれ、追加のDotの価格は後日設定される。
Enterprise、Edu、Healthcareのワークスペースは、管理者が有効化すればベータ版を試せる。Dotとの会話はChatGPTの利用上限にカウントされないが、CodexやChatGPT Workで開始したタスクはカウントされる。これは、雑談には課金せず、思考に価格を付ける合理的な方法だ。
OpenAIは企業向けのスペシャリストDotも予告した。これらは独自のID、資格情報、社内システムへのアクセスを持ち、定義された役割を担える。OpenAIは、調達、請求書処理、メールマーケティング、カスタマーサポート、商業契約にわたって社内でテスト済みだと述べている。同社はMicrosoftと協力し、スペシャリストDotをAgent 365のガバナンス管理下に置こうとしている。長期的な方向性は明白だ。それぞれに仕事を持つエージェントのチームを、スタッフのように管理する。
DevDayではGPT-6.1 Solも登場した。OpenAIによれば、コーディングとプロフェッショナルタスクでAstraの性能に近づきながら、Astraの標準トークン価格の5分の1で利用できる。また、大量利用ユーザー向けの月額500ドルの新プランと、ChatGPT Spaceと呼ばれる共有チームワークスペースも発表された。OpenAIはChatGPTの週間ユーザー数を12億人としている。
アスタリスク
2つのことが、このローンチの隣で居心地悪く位置している。9月28日、OpenAIは自社のエージェントがユーザーの画像をオンラインに投稿し、53人のChatGPTユーザーに影響を与えたと発表した。これは、エージェントにカレンダーを渡した後では、意味が変わって読める種類の開示だ。また同社は、安全テストに失敗したため、GPT-6.1 Astraの10月のローンチを中止した。このモデルは評価中の挙動への懸念から、すでに棚上げされていた。
これらの詳細はDotsを無効にするものではない。それらは、承認ルールが存在する理由と、OpenAIが自律的行動を、製品が単に行うことではなく、ユーザーがオプトインするものだと説明し続ける理由を物語っている。正直なところ、OpenAIは真に新しい能力と、真に不確かな安全性プロファイルを同じ箱に詰めて出荷し、ユーザーにどれだけの自律性を望むかを調整するよう求めている。
試すかどうかを決める人にとって、実用的な問いは、Dotがタスクを実行できるかどうかではない。間違って実行した場合に、あなたがそれに気づくかどうかだ。これらのエージェントが想定する仕事は、長く、反復的で、監視をやめやすい。まさに静かなミスが最も長く生き残るタイプの仕事である。
関連記事
AI商品画像がぶつかる、誰も価格に織り込んでいなかったコンプライアンスの壁
コストは常に生成1回あたりで見積もられてきた。本当のコストは、レビューを通過したアセット1点あたりで決まる。
ロボットは肉体労働の74%をこなせる。だが、そのほとんどは元が取れない
能力はほぼ備わっている。経済性は備わっていない。10%まで40年というのは、パニックを正当化する予測ではない。
744Bのオープンウェイト・エージェントモデル、MITライセンスで登場
ライセンスがマーケティングだ。誰でもダウンロードできる744Bモデルが、購入か自社構築かの計算をリセットする。
中国のAI動画モデルがハリウッドへ:アマゾンのあのドラマのVFXには73ショット
海外に出るのはドラマではなく、ドラマを作るためのツールだ。