ChatGPT Images 2.5はより高速、より高精細、そしてついにスケッチが可能に

OpenAIは2026年9月8日にChatGPT Images 2.5をリリースした。誰もが注目した主要数値は速度で、前バージョン比で最大50%のレイテンシ削減を実現した。それは重要な点だが、変化の本質を過小評価している。より興味深いのは、モデルがラフスケッチを描いて参照として渡せるようになったこと、そして編集が複数ラウンドにわたってドリフトせずに保持されることだ。
春にこれらのツールを最後に触った人なら、違いはすぐにわかるだろう。最初に気づくのは待ち時間だ。以前は6秒かかっていた生成が、今は約3秒で完了する。次に気づくのは、小さな変更を依頼したときに、画像の他の部分がそのまま維持されることだ。
実際に何が改善されたのか
公式のリストでは、速度、ディテール、編集の安定性の3つの領域が挙げられている。
速度は検証が簡単な項目だ。OpenAIによるとレイテンシは最大半分に低下し、モデルはデスクトップ、モバイル、ウェブで利用可能なため、改善はAPIだけでなくあらゆる場所に及ぶ。
ディテールはモデルに最も成長の余地があった部分だ。以前のバージョンは構図に強みがあったが、細かいテクスチャがにじんだり、素材の質感が失われたりすることがあった。2.5はライティングとマテリアルレンダリングを強化し、肌、布、金属が滑らかな近似ではなく、そのものとして見えるようになっている。
編集の安定性は、実際にこれらのツールを使う人々が最も重視する部分だ。画像モデルに対する長年の不満は、複数ターンの編集でドリフトが起きることだった。シャツの色を変えたら突然顔が変わってしまう。2.5は、ターゲットを絞った変更を依頼したときに、被写体、製品の形状、構図、全体のスタイルを維持するように設計されている。この1つの修正は、どのレイテンシ数値よりも実用的な時間を節約する。

スケッチ機能は意外な注目株
最大の製品追加はSketchだ。ChatGPT内で直接ラフなレイアウトを描くと、モデルがそれを完成画像に変換する。絵を描くスキルは不要だ。いくつかのボックス、棒人間、水平線、色のメモがあれば、3段落のプロンプトで説明しなければならない意図を伝えるのに十分だ。
これは最初のテキストから画像を生成するツール以来存在していたギャップを埋めるものだ。プロンプトは空間的な思考が苦手だ。「製品を左に、見出しを右上に、人物を下三分の一に配置」というのは、スケッチなら10秒で伝えられることを何語も使って説明するものだ。Sketchはモデルにストーリーボードに近いものを与え、ストーリーボードこそがビジュアルワークが実際にブリーフされる方法なのだ。
2つの異なる用途のための2つのAPIバリアント
API側では、OpenAIはリリースを明確な役割を持つ2つのバリアントに分割した。
GPT-Image-2.5 Flareは汎用モデルだ。2.5シリーズの速度、品質、編集機能を備え、ソーシャルメディア用アセット、製品プロトタイプ、大量の画像を迅速に生成する必要がある大量生成向けをターゲットにしている。
GPT-Image-2.5 Sunburstは精密モデルだ。スループットよりもコントロールが重要となる広告スチールや商業製品撮影向けに構築されている。画像に対するより強力なコントロールが得られるが、その代償として生成時間がかかる。
この分割は市場が成熟したことを示す有用なシグナルだ。2年前は1つのモデルがあらゆるユーザーに対応しようとしていた。今ではベンダーはワークロードごとに切り分けている。「ミームを100個作る」と「キャンペーンのヒーロー画像を1枚作る」は本質的に異なる仕事だからだ。
実践的な転換:ジェネレーターではなくエディターとして扱う
このアップグレードが最も役立つのは、モデルをスロットマシンとして扱うのをやめて、エディターとして扱い始めたときだ。以前のワークフローは、プロンプトを書き、4枚の画像を生成し、最良のものを選び、どれも機能しない場合はより良いプロンプトを書いて再び生成するというものだった。そのループこそがフラストレーションの大半の原因だった。
2.5のワークフローは異なる。ラフなアイデアから始め、まずまずのものを生成し、その後、一連の小さなターゲットを絞った編集で洗練させていく。背景を変更し、ライティングを調整し、1つのオブジェクトを移動する。編集によって画像の残りの部分が安定して維持されるため、各ステップはギャンブルではなく実際の改善となる。
ここでSketchもその価値を発揮する。空間的な配置が重要な場合、下手な絵でも長い説明より優れている。見出しの位置、製品の位置、人物の立ち位置を描く。モデルが品質を埋め、あなたが意図を提供する。
一つだけ維持すべき習慣がある。完成と宣言する前に細部を確認することだ。完璧なモデルは存在せず、2.5でも時折、崩れた手や誤った文字を生成することがある。今の違いは、エラーが十分に稀になったため、もう1回編集する価値があるということであり、画像を放棄して最初からやり直す理由にはならないということだ。ベンチマーク以上に、それこそが「使える」ということの意味だ。
これが業界に与える影響
知っておくべき文脈はスケールだ。OpenAIによると、ChatGPT ImagesファミリーとそのAPIは週に30億枚以上の画像を生成している。これは2023年には荒唐無稽に聞こえた数字だが、今では単なるベースラインにすぎない。
これはOpenAIが統合に踏み切れる理由も説明している。2.5をリリースした同じ週に、同社はChatGPT内の旧DALL-E GPTを静かに廃止し、全員をChatGPT Imagesへ誘導した。DALL-Eという名前は消えるかもしれないが、その役割はより高速でより高精細なパイプラインに完全に吸収された。
競合にとってプレッシャーは具体的だ。Midjourneyは依然として純粋な美的範囲を支配しており、これに真剣に異議を唱える者はいない。Adobe Fireflyは慎重な企業向けの商用ライセンスの側面を依然として押さえている。GoogleのNano Bananaラインはネイティブな高解像度とキャラクターの一貫性で依然として勝っている。ChatGPT Images 2.5はそれぞれの得意分野で彼らを打ち負かそうとしているわけではない。最高のデフォルトになろうとしているのだ。十分に速く、十分に高精細で、そして今や編集が十分に優れているため、2つ目のツールに手を伸ばすのをやめられるほどに。
正直な結論としては、2.5は革命ではなく反復だ。しかし、実際の作業で画像モデルを使いにくくしていたまさに3つの点に対する反復なのだ。速度、ディテール、編集の安定性は華やかではない。それらは人がツールを諦める理由にすぎない。OpenAIは今回のリリースで、それらの理由を一つずつ取り除いていった。
関連記事
9月国産オープンソース画像生成モデルが相次ぎ仕掛ける:商湯、アント、書生も黙っていられない
商湯の8B、アントの6B、書生のInternLumina-U2が相次ぎオープンソース化。本記事では3社のアプローチの違いと、オープンソース化の波がクリエイターに与える実際の影響を読み解く。
腾讯混元がAI画像生成を映像制作の現場へ:HyImage 3.5プレビュー版を試す
HyImage 3.5 previewはブラインドテストで約30%向上、5枚の参照画像と2K出力に対応。WorkRallyに導入され『行镖』で実戦投入。本記事ではその能力と利用経路を解説する。
2026年9月版 最高のAI画像生成ツールランキング
GPT Image 2.5、Midjourney V8.2、Nano Banana 2、Flux 2ほかを、価格と仕事別のおすすめ付きでランキング。
MicrosoftのMAI-Image-2.6がGPT Image 2に静かに迫っている
Microsoftの挑戦モデルがElo差を21ポイントに縮めた。MAI-Image-2.6の台頭がAI画像市場に意味するもの。