Claude Sonnet 5.5は30%安くなった。それはモデルの話ではなく、調達の話だ。

Anthropicは2026年10月の最初の数日、Opus 5.5の約1週間後、Fable 5.1から1か月足らずでClaude Sonnet 5.5をリリースした。注目の数字は、前世代より約30%高速で、ほとんどの作業で最大30%安くなるというものだ。価格はSonnet 5と同一で、入力100万トークンあたり2ドル、出力100万トークンあたり10ドル、キャッシュ読み取りは0.20ドル、100万トークンのコンテキストウィンドウを備える。AnthropicはこれをAPI上のデフォルトのSonnetモデルにした。
これは抑制の効いたリリースだ。新しい能力のフロンティアを主張するでもなく、ベンチマーク記録を更新するでもなく、価格表も変わっていない。興味深いのは、Anthropicがこのモデルの用途として挙げている内容と、Opusとの仕事の分担の仕方だ。
分業そのものが発表内容だ
Anthropic自身の説明は2つのティアの線引きを示している。Opus 5.5は慎重な判断を要する複雑な作業向けに作られている。Sonnet 5.5は、範囲が明確な日常業務、バグ修正、洗練された文書・スライド・スプレッドシートの作成で最も強い。Haiku 5.5は今後数週間で提供予定だ。

これは見た目よりも具体的な製品主張だ。この2年のほとんどの間、モデルのリリースは新たに何ができるかという観点で語られてきた。今回のモデルは、日常的に任せても信頼できる水準に達したかという観点で説明されており、例は事務的なものだ。文書、スライド、バグ修正。これらは企業アカウント内で最も多くのトークンを消費するタスクであり、30%のコスト削減が最も速く複利的に効いてくるタスクでもある。
Opus 5.5自身の数字がこの分業を裏付けている。SimpleBenchで88.4%と首位に立ち、Terminal-Bench 4.0、FrontierCode、CursorBenchでFable 5.1を上回り、しかもトークンあたりの価格はFable 5.1の半分未満だ。推論の努力を上げるとTerminal-Bench-Scienceで24%から62%に上昇する。これは難しいケースのためのモデルだ。Sonnet 5.5は、難題を手頃なコストで難題のまま扱えるように、その下に置くモデルである。
この背後にはモデルファミリーのカレンダーがある。Opus 5.5は9月22日に出荷された。Sonnet 5.5が10月上旬に続いた。Haiku 5.5も登場する。Anthropicは今や数週間ごとにティアを出荷しており、企業の買い手は能力の問題より先にケイデンスの問題に直面する。9月にSonnet 5に合わせて利用パターンを調整したなら、10月に再評価が必要で、Haikuが登場したときにもまた必要になる。
なぜ賢くなるより安くなる方が重要なのか
フロンティアモデルをめぐる話題は能力の発表に報いる傾向がある。調達は作業単位あたりのコストに報いる。Sonnet 5.5はまさに調達向けのリリースだ。
エージェント型ワークフローを運用する企業内で30%削減が何をもたらすか考えてみよう。Anthropic自身がその話を積極的に売り込んでいる。Claude for Governmentは一般提供に達し、FedRAMP High環境で米国の連邦・州政府機関をカバーする。Claude CodeとMicrosoft 365の統合も同時にアーリーアクセスに入った。同社はまた、Claude Frontier Academyを通じて2027年末までに1万人のエンジニアを自社スタックで訓練するために1億ドルを投じると約束した。
最後の項目が本質を物語っている。自社ツールで訓練された資格を持つ人材を育てることは、今年締結した契約が更新されるようにする方法であり、更新の会話ではタスクあたりのコストが決め手の数字になる。同じ価格表のまま30%安く、範囲が明確な作業のデフォルトとして位置づけられたモデルは、顧客が競合と比較して計算するときに、営業活動が具体的に指し示せるものを与える。
もう一つの商業的論理が働いている。Sonnetクラスのモデルはボリュームが存在するところだ。フロンティアモデルは報道を制する。働き馬モデルは消費の行を制する。Anthropicが表向きの価格に触れずに働き馬を30%安くできるということは、割引を還元しているのではなく効率向上を収穫していることを意味する。これはベンダーにとって健全な立場であり、買い手が一般的なベンチマークではなく自社のワークロードで主張を実際に検証すべき理由でもある。
コーディングリーダーボードが示すもの
Sonnet 5.5、GPT-6.1 Sol、Gemini 4 Argonが今月のAnthropic自身のCoding Agent Indexの上位を占めている。これは妥当なスナップショットであり、同時にベンダー自身の測定器であるため慎重に扱う価値がある。3つ全体のパターンは、個々の順位よりも情報量が多い。OpenAIはGPT-6.1 Solを入力100万トークンあたり約2ドル、出力100万トークンあたり10ドルまで下げ、エージェント型コーディングでAstra級の性能に近づけた。これはAnthropicが維持しているのと同じ価格帯だ。GoogleはGemini 4 Argonを出力100万トークンの上限付きで出荷し、審査済みのサイバーセキュリティ専門家から始まる段階的アクセスを提供した。
3つのラボが同じ仕事に対して同じ価格帯に数週間のうちに収束した。これは偶然ではなく、競争がどこへ移ったかを教えてくれる。コーディングエージェントはフロンティアモデルにとって最大量の商用ワークロードになり、1つのラボが準フロンティアモデルを2ドルと10ドルで価格設定したら、他も合わせざるを得なかった。
リリースのケイデンス自体が問題だ
Anthropicの出荷スケジュールは再検討に値する。モデルの品質とは無関係な難しさを生むからだ。
Opus 5.5は9月22日に登場した。Sonnet 5.5は約1週間半で続いた。Haiku 5.5は今後数週間で提供が約束されている。約1か月で3つのティアであり、それぞれがわずかに異なる強みとわずかに異なるコスト曲線で登場する。
実験する個人開発者にとって、速いケイデンスは贈り物だ。数百のワークフローにわたって本番トラフィックを流す企業にとっては、メンテナンスの義務である。モデルの入れ替えのたびに、プロンプトテンプレートの再評価、出力形式の再確認、回帰スイートの再実行、特定のモデルの挙動に依存したものすべての再検証が必要になる。バージョンを固定して四半期ごとにアップグレードする方針を採っていたチームは、30%のコスト削減が四半期の途中での計画外の移行に値するかどうかを判断しなければならなくなる。
同じ力学が業界全体に流れている。OpenAIは大幅な値下げでGPT-6.1 Solを出荷し、Googleは審査済みユーザー向けの制限付きアクセスでGemini 4 Argonを段階的に提供し、AnthropicはSonnet 5.5で応じた。2026年10月にモデルを選ぶ買い手は動く標的を選んでいるのであり、企業の答えは通常抽象化だ。モデル層の前にルーターを置き、プロバイダー固有のロジックをアプリケーションコードから排除し、単一のモデルを交換可能として扱う。これは初期のエンジニアリング作業は増えるが、後の変動はかなり減る。
実際に確認すべきこと
30%という数字には注意書きが必要だ。ベンダーの割引主張は通常、代表的なワークロードに対して測定されており、あなたのワークロードは代表的ではない。削減は高速な推論、タスクあたりのトークン数減少、安価なキャッシュ読み取りの組み合わせから生じ、それぞれの割合はプロンプトの仕方によって大きく変わる。短くキャッシュされないリクエストを送るパイプラインは、ターンをまたいで長いコンテキストを保持するものとは異なる数字になる。
実践的な動きは、仮定する前に測定することだ。代表的なトラフィックを1週間分取り、両モデルで実行し、重要なタスクでトークン、レイテンシ、出力品質を比較する。100万トークンのコンテキストウィンドウも同じ理由で有用だが、使いすぎも簡単だ。再利用されない大きなコンテキストは高価なコンテキストだからだ。
Sonnet 5.5について息をのむような記事を書く人はいないだろう。それは見出しを変えずに予算を変える種類のリリースであり、企業アカウントではそれこそがより重大な結果なのだ。
関連記事
HPEが12億ドル相当のハードウェアを売った理由——ネットワークが主役になったから
5つのカテゴリーへの配分が非開示の12億ドル受注は、12億ドルのマージンと同じではない。
次なる一手を4モデル投票で決めるマルウェア
コマンド・アンド・コントロール基盤は、一握りの公開APIと1つのDiscord Webhookだ。
ShopifyはAIエージェントに「購入」ボタンを押させた。それでも係争は加盟店が負う。
エージェントプラットフォームが意図を取り次ぎ、リスクは加盟店が負う。
他人のAIプロンプトをそのまま使うのは著作権侵害になる?ある判決がプロンプトを著作権の門の外に置いた
レシピが保護されないからといって、そのレシピで作ったあの一皿の料理が保護されないわけではない。