腾讯混元がAI画像生成を映像制作の現場へ:HyImage 3.5プレビュー版を試す

9月22日、腾讯混元(Tencent Hunyuan)は最新のプロ向け画像生成モデル「HyImage 3.5 preview」を公開した。まずはTencent Video傘下の映像インテリジェントプラットフォーム「WorkRally」に導入され、2週間はプラットフォームのクリエイターに無料開放される。このニュースはAI界隈よりも映像業界で早く広まった。理由はシンプルだ。これは単なる「画像を出せる」モデルではなく、ドラマの絵コンテ、映像素材、キャラクター・シーン設定を狙ったプロダクションツールだからだ。
今回、混元はプロ向け制作に賭けた
この2年、中国国産の画像生成モデルが最も競ってきた方向は「コンシューマー向け」だった。誰が速く生成できるか、誰が無料枠が多いか、誰が普通の人に一言で画像を出させられるか。HyImage 3.5 previewは、より狭く、より難しい道を選んだ。プロの制作チームのためのツールになることだ。
公式データによると、数百名のプロクリエイターによるブラインドテストでは、このモデルはHyImage 3.0と比べて能力が約30%向上した。テキストからの画像生成(text-to-image)と画像からの画像生成(image-to-image)の両方に対応し、1回につき最大5枚の画像を参照としてアップロードでき、最大2K解像度で出力できる。向上が集中しているのは、テキストのレンダリングとレイアウト、リアリティとスタイル表現力、編集の一貫性という3つの軸だ。
この3つの軸は非常に的確だ。映像制作に携わる人が最も頭を悩ませる3つのこと、まさに「画面内の文字とレイアウトが正しいか」「質感や光影が十分リアルか」「同じキャラクターが別のカットで同じ顔をしているか」だ。要するに、今回混元が解決しようとしたのは「本当に撮影現場で使えるか」であり、「画像がきれいかどうか」ではない。

『行镖』とともに実装された、一連の制作フロー
HyImage 3.5 previewは単体のモデルとして発表されたわけではなく、一連の制作パイプラインとともに打ち出された。9月20日、Tencent Videoは実写出演のAIプレミアムドラマ『行镖』を配信開始した。実写撮影とAI生成を組み合わせた方式を採用している。公式によると、同作品の絵コンテ生成、実写素材と生成コンテンツの融合、複数バージョンのカット反復は、すべてWorkRally上で行われたという。
これが何を意味するか。混元のこのモデルは、実験室のデモではなく、実際に配信されたドラマの中で一通り使われたということだ。「まず作品があり、その後に能力を語る」というこの流れは、中国国産のAI画像生成では珍しい。
WorkRallyはクリエイターに3つの利用経路を用意している。1つ目はホーム画面の「無限キャンバス」で、インテリジェントディレクターが直接画面を生成し、方向性を素早く試すのに適している。2つ目は、新しいキャンバスを作成した後、画像生成ノードでHyImage 3.5 previewを選び、単一カットを繰り返し微調整する方法。3つ目はドラマワークフローで、脚本に基づいてアセットと絵コンテを一括生成する。3つの経路はそれぞれ、迅速なテスト、単一カットの微調整、エピソード全体の量産に対応し、コンセプトデザインから完成絵コンテまでの主要な工程をカバーしている。
その背後にある自社開発機能
モデル自体に加えて、WorkRallyは新しい基盤モデルをベースに、映像向けの独自機能をいくつか開発した。マルチカメラ生成、画像のリライティング、絞り調整、ビジュアル指示編集だ。これらの機能は専門的に聞こえるが、現場の人間にとっては実用的な必須機能だ。
例えば画像のリライティングは、従来なら3Dソフトでライティングを調整するか、ポストプロダクションで1フレームずつ修正していた。今は一言で、画面内の光を夕暮れから真昼に変えられ、人物と環境の明暗関係も一緒に変化する。単にフィルターを重ねるだけではない。マルチカメラ生成が解決するのは非常に現実的な問題だ。同じシーンで、監督が切り返し、全景、アップなど複数のカメラアングルを求める場合、これまでは1バージョンずつ生成する必要があったが、今はシーンの一貫性を保ったままカメラを展開できる。
ビジュアル指示編集も触れておく価値がある。「左の人が持っているカップをスマホに変えて」といった自然言語で画像を修正できる。プロンプトに戻って画像全体を説明し直す必要はない。この精度の編集能力は、現場では何十回もの作り直しを省くことにつながる。
モデルの先にある、本当の参入障壁とは
WorkRallyのプロダクト責任者の言葉は率直だ。AIはクリエイティブ開発、ビジュアルプレビズ、コンセプトデザイン、スタイル探索、ポストプロダクション支援、宣伝素材生成といった工程に入り込み、これまで高かった技術のハードルを一歩ずつツール化・フロー化している。しかし、コンテンツの長期的な価値を最終的に決めるのは、やはりキャラクター、人間関係、世界観、そして感情的なつながりだ。
この言葉は、映像業界におけるAI画像生成の位置づけを鋭く言い当てている。モデルの能力が決めるのは下限だ。美術の基礎がない絵コンテ担当者でも、使える画面を生み出せるようになる。しかし、ドラマが人の心を動かせるかどうかは、やはり物語そのものにかかっている。AIは「描く」ことのハードルを下げられるが、「何を語りたいか」を代わることはできない。
一般のクリエイターにとって、今回のアップデートにはもう一つの意味がある。映像レベルの画像生成能力を、比較的低いコストで開放したことだ。2週間の無料期間中は、WeChatまたは携帯電話番号でWorkRallyに登録・ログインすれば、HyImage 3.5 previewを直接利用できる。また、海外向けAI創作ツール「OnSolo」もこのモデルを導入し、会員向けに2週間の無料開放を行う。
この価値をどう判断するか
もしWeChat公式アカウントの記事に添える画像が欲しいだけなら、HyImage 3.5 previewは最も使いやすい選択とは限らない。コンシューマー向けの「Jimeng(即梦)」や「Doubao(豆包)」で十分だろう。しかし、キャラクターやシーン、複数カットが必要な創作に取り組んでいるなら、コミックドラマ、短編、本格的な映像プレビズのいずれであっても、このツールの価値が浮かび上がる。
これが本当に変えたのは、「映像レベルのAI画像生成」を大手企業の内部ツールから、一般のクリエイターでも手が届くものにしたことだ。このモデルが最終的にどこまで進めるかは、『行镖』の後に、それを受け止められる実際の作品がさらに出てくるかどうかにかかっている。
関連記事
ChatGPT Images 2.5はより高速、より高精細、そしてついにスケッチが可能に
Images 2.5はレイテンシを最大50%削減し、スケッチ機能を追加、複数ターンの編集を安定化。何が変わったのか、誰が注目すべきか。
9月国産オープンソース画像生成モデルが相次ぎ仕掛ける:商湯、アント、書生も黙っていられない
商湯の8B、アントの6B、書生のInternLumina-U2が相次ぎオープンソース化。本記事では3社のアプローチの違いと、オープンソース化の波がクリエイターに与える実際の影響を読み解く。
2026年9月版 最高のAI画像生成ツールランキング
GPT Image 2.5、Midjourney V8.2、Nano Banana 2、Flux 2ほかを、価格と仕事別のおすすめ付きでランキング。
MicrosoftのMAI-Image-2.6がGPT Image 2に静かに迫っている
Microsoftの挑戦モデルがElo差を21ポイントに縮めた。MAI-Image-2.6の台頭がAI画像市場に意味するもの。