Deep-Live-Cam 2.1.6:たった1枚の写真でリアルタイム顔交換
ライブビデオ通話で有名人と顔を入れ替えたり、映画のキャラクターにリアルタイムで変身したりすることを想像してみてください。それも、たった1枚の写真だけで。それがまさにDeep-Live-Cam 2.1.6でできることです。このオープンソースプロジェクトはインターネットで大旋風を巻き起こしています。このガイドでは、その概要、インストール方法、そして責任ある使い方をご紹介します。
Deep-Live-Camとは?
Deep-Live-Camは、リアルタイムの顔交換およびビデオディープフェイクツールです。人物の顔の画像を1枚与えると、ウェブカメラのストリームや録画済みビデオ内のその顔を、ライブで置き換えます。モデルのトレーニングは不要です。CPUだけでも動作しますが、スムーズなパフォーマンスを得るには、NVIDIA GPU、Apple Silicon、または適切な実行プロバイダーを備えたIntelプロセッサーが必要です。
倫理的な使用は必須です
楽しさの前に、重要な話をします。このプロジェクトには、ヌード、過激なコンテンツ、戦争映像などのセンシティブな素材をブロックする組み込みのチェック機構があります。開発者はまた、実在する人物の顔を使用する場合は、同意を得て、出力物をディープフェイクと明示することを求めています。このソフトウェアを使って何をするかについての責任はあなたにあります。
何ができるのか?
手動インストールの手順
Deep-Live-Camはインストールするだけですぐ使えるアプリではありませんが、それほど難しくもありません。Python(3.11〜3.14、推奨は3.14)、pip、git、ffmpeg、WindowsではVisual Studio 2022ランタイムが必要です。まずリポジトリをクローンします。
次に、Hugging Faceモデルリポジトリから gfpgan-1024.onnx と inswapper_128_fp16.onnx の2つのモデルファイルをダウンロードし、modelsフォルダーに配置します。その後、仮想環境を作成し、依存関係をインストールします。
Apple Silicon(M1〜M5)搭載Macユーザーは、まずHomebrewでPython 3.14とpython-tk@3.14をインストールし、その後同じvenvコマンドを実行してください。tkinterが見つからない場合は、python-tkを再インストールしてください。
Deep-Live-Camの使い方
すべてのインストールが完了したら、python run.py を実行してGUIを起動します。ソースの顔画像を選択し、カメラを選んで、Liveをクリックします。約10〜30秒の読み込み後、プレビューウィンドウが表示されます。その映像はOBSでキャプチャしてストリーミングできます。新しい顔に交換するには、別のソース画像を選択するだけです。
画像モードとビデオモードもあります。対象の画像またはビデオを選び、Startを押すと、出力は新しいフォルダーに保存されます。CLIモードは、ソース引数を指定してスクリプトを呼び出すと有効になり、詳細オプションには --many-faces、--mouth-mask、--live-resizable などがあります。
GPUアクセラレーションのオプション
CPUでも動作しますが、処理が途切れることがあります。NVIDIAユーザーはCUDA Toolkit 12.8とcuDNNをインストールし、onnxruntimeをonnxruntime-gpuに置き換えて、--execution-provider cuda を指定して起動できます。Macユーザーは内蔵のCoreMLプロバイダーを利用できます。WindowsユーザーはAMD向けにDirectMLを試せますし、IntelユーザーはOpenVINOを使用できます。それぞれの設定手順はREADMEに記載されているので、正確なパッケージバージョンをそこで確認してください。
セットアップ不要のバージョンが欲しい?
Pythonのバージョンやモデルファイルを扱いたくない場合は、Deep-Live-Cam Ultimateと呼ばれる公式のプリビルド版ディストリビューションがあります。Windows、Mac Silicon、CPU、NVIDIA、AMD向けの最適化ビルドに加え、30以上の追加機能と優先サポートが含まれています。有料ですが、時間を節約できます。公式ソースはGitHubリポジトリとdeeplivecam.netだけなので、怪しいサードパーティのダウンロードは避けてください。
まとめ
Deep-Live-Camは、AI駆動のメディアツールにおける目覚ましい進歩です。強力で、一度インストールすれば使いやすく、実験するのは本当に楽しいものです。同意とコンテンツに関するルールを守って利用してください。さあ、責任を持って、自分に映画スターの顔を与えましょう。
関連記事
LocalAI:あらゆるハードウェアでLLM・画像・動画を実行、GPU不要
LocalAIは、オープンソースでセルフホスト型のAIエンジンです。GPUを必要とせず、あらゆるハードウェア上でLLMや画像・動画・音声モデルを実行できます。Dockerでインストールし、任意のモデルを読み込んで、データをプライベートに保てます。
Hermes Agent:あらゆるタスクから学習する自己改善型AI
Hermes Agentは、Nous ResearchによるオープンソースのAIエージェント。時間とともにスキルを学び、あなたのコンテキストを記憶し、スマートフォン、ノートパソコン、5ドルのVPSで動作します。
Humanizer:AIの文章を人間らしくするオープンソースツール
Humanizerは、Wikipediaの「Signs of AI writing」の35のパターンを用いて、AIらしいテキストを自然な人間の散文に書き換える。仕組みの説明、ビフォー・アフターの例、インストール手順を紹介。
VoiceStudio紹介:646言語に対応した無料・ローカルファーストの音声クローン
VoiceStudioは、無料のオープンソースでローカルファーストの音声スタジオをデスクトップに提供します。3秒のオーディオでどんな声でもクローンし、一切費用をかけずに646言語で生成できます。