← ブログに戻る
Ai読了目安 14 分

Huawei Cloud、エージェント中心にスタックを再構築し、課金開始日を明示

公開日 2026年10月4日
Huawei Cloud、エージェント中心にスタックを再構築し、課金開始日を明示

Huawei Cloudは9月の年次Connectカンファレンスで、企業向けAIポートフォリオが現在完全に市場投入されており、そのポートフォリオの設計の中心はエージェントであると述べた。Huawei CloudのCEO、Zhou Yuefeng氏は、この変化を業界エージェントの時代に向けた「Agentic Cloud」の構築と位置づけ、それに伴う発表は主に基盤の話だった。

正確には4つの基盤要素だ。Huawei Cloudは新しいインフラパラダイムを、効率的なトークン、強化されたメモリ、汎用とAIの統合スケジューリング、安全な自律性と表現した。その結果として得られたプラットフォームはすでに世界で3,500社以上に提供されているという。この表現はマーケティングのように聞こえるが、各要素が何を狙っているかを見ればそうではない。それぞれが、エージェントが本番環境で直面し、チャットボットは直面しない障害に応えるものだからだ。

トークン、メモリ、そして10分での復旧

コンピュート層はLingqu Ascend 950クラスタサービスだ。Huawei Cloudによると、フルリンク可観測性を備えた5段階の高速復旧メカニズムを採用し、その上でのトレーニングジョブは40日間中断なく稼働し、障害は10分以内に復旧するという。トークンスループットは前世代比20%増としている。このサービスは中国で9月30日に商用化され、海外展開は11月30日に予定されている。

黒い背景に輝く青い光ファイバー束

10分での復旧目標は、ベンチマークスコアとは異なる仕様だ。長時間のトレーニングは失敗するもので、失敗のコストは失われたGPU時間と再起動のオーバーヘッドで測られる。したがって、復旧時間こそが顧客の財務チームが実際に気にする数値である。

メモリ層は、長時間稼働するエージェント特有の障害モードに対処するものだ。Huawei Cloudはこの製品をCMSメモリストレージと呼び、ペタバイト規模のメモリ空間を提供すると説明する。これは同種の製品の約2倍の容量で、高速アクセスのためのテラバイトレベルの読み取り速度と50%の性能向上を実現する。狙いは、長いタスクに取り組むエージェントが、学習した内容をコンテキストウィンドウ以外のどこかに保持する必要があるということだ。無制限に成長するコンテキストウィンドウは高コストで信頼性が低いからである。

次にモデルアクセス層がある。AgenticMaaSは、開発者が主流の最先端モデルをワンクリックで呼び出せ、デプロイ作業が不要になると説明されている。MiniMaxは同じイベントで、プラットフォーム上で動作するマルチモーダルモデルをデモした。これは中国ではモデルベンダーとクラウドベンダーがしばしば同じ企業購買担当者に販売していることを思い起こさせる。

商用版とオープンソース版を一緒に販売

アプリケーション層は、Huawei Cloudのアプローチが純粋なインフラ戦略と異なる点だ。同社は二重戦略を取っている。商用のZhiGuo AgentArtsプラットフォームと、openJiuwenと呼ばれるオープンソース版だ。同社によると、両者を合わせて5,000以上の汎用アセットと1,000以上の業界アセットを公開している。これは生のモデルではなく、再利用可能なスキル、テンプレート、コネクタを意味する。

このプラットフォームは、深圳市龍崗区政府、中国郵政儲蓄銀行、中国南方電網、Kingsoft Officeを含む100以上の政府機関、銀行、研究機関、企業で使用されている。Kingsoftは、WPS 365ドキュメントセンターとComateアシスタントを組み合わせて、オフィス向けエージェントをプラットフォーム上で構築した。これはクラウドベンダーだけでは構築できず、アプリケーションベンダーだけではホストできない種類の統合である。

ZhiGuo AgentArtsは12月30日に海外市場で商用リリース予定だ。openJiuwenを中心とするオープンソースコミュニティは、5万以上のスターと329万ダウンロードを報告している。商用プラットフォームとオープン版の両方を提供することは、最終的に有料版を必要とする人々を開発者基盤に芽吹かせる方法であり、現在中国の複数のベンダーが追随しているパターンだ。

オンプレミスを選ぶもう一つの理由

Huawei Cloudは中国でエージェントインフラを販売している唯一の企業ではない。9月のより静かな一連のイベントは、市場の残りの動きを示している。MitacはAMDと協力し、AMDのRyzen AI Maxプロセッサを中心に構築され、データ主権を売りにする企業向けエージェントアプライアンス「Agent Builder」の導入セミナーを無錫と貴陽で開催した。そこでの訴えはパブリッククラウドの反対だ。モデル、コンピュート、ナレッジベース、業務システムを社内に置き、オフィス内のボックス上でエージェントを実行する。

どちらのアプローチも、同じ調達上の反対意見に応えている。企業は実際の業務プロセスに触れるエージェントを求めているが、実際の業務プロセスには、他人のエンドポイントの背後に置くことに抵抗があるデータが含まれている。

購買担当者がすでに追跡している4つの数値

4つのインフラの柱は、4つのコストに対応する。トークンは推論ごとの価格であり、だからこそ発表はベンチマークスコアではなくスループットを先に掲げている。メモリは、コンテキストウィンドウでは足りなくなったときに長時間タスクにかかるコストだ。スケジューリングは、汎用ワークロードとAIワークロードを共有ハードウェアで実行する際の利用率ペナルティである。セキュリティは、何かが本番データに触れる前にコンプライアンス部門が尋ねる事項だ。

Huawei Cloudの主張は、4つすべてを1つのスタックで対処し、それが可能なのは自社がシリコンを所有しているからだというものだ。これは競合他社にとって真似しにくい約束であり、顧客にとっては確認しやすい約束だ。なぜなら結果は、調達チームがすでに測定している3つの場所に現れるからである。100万トークンあたりのコスト、長時間実行の失敗率、そして実際に仕事をしているGPU時間の割合だ。

なぜモデルではなくインフラが本題なのか

今年の中国のエージェントに関する議論から出てきた興味深い主張は、モデル能力は収束し、価値はそれを取り巻くものへ移ったというものだ。上海高級金融学院の実務教授は、9月の上海のフォーラムでこの主張の経済版を述べた。限界費用がゼロに近づきネットワーク効果が強いインターネットプラットフォームとは異なり、大規模モデルは推論ごとに資源を消費し、ユーザーは数分でモデルを切り替えられる。モデルだけに築かれた堀は薄い。

もしその見方が正しければ、防御可能な層は移行にコストがかかる層であり、それは重みではなく、トークン、メモリ、スケジューリング、セキュリティを意味する。

その枠組みにおけるHuaweiの優位性は垂直統合にある。同社はチップ、インターコネクト、クラウド、モデルプラットフォームを所有しており、だからこそAscend 950の発表はリーダーボードの順位ではなく、復旧時間とトークンスループットを先に掲げている。チップ事業を持たない競合他社は統合のストーリーを売っているが、統合のストーリーは模倣されやすい。

反論は、統合されていることは単一障害点にもなるというものであり、企業はベンダー固有の形ではなくポータブルなエージェント層をますます求めている。この緊張関係が次の2四半期に試される。まず中国での9月30日の商用化と、11月末の海外展開から始まる。海外の期限は国内の期限よりも重要だ。国内シリコンを中心に構築されたスタックは、データを自国の管轄区域から出せない顧客にサービスを提供できることを証明しなければならないからである。

関連記事