MiniMax H3をローカルで動かす|ComfyUIで音声つきAI美女動画を"無料で無限に"生成する【2026年最新】

※本ページはプロモーションが含まれています

AI美女MiniMaxHailuo 3ComfyUIローカル生成動画生成

MiniMax H3をローカルで動かす|ComfyUIで音声つきAI美女動画を"無料で無限に"生成する【2026年最新】

2026年8月3日、MiniMax H3(Hailuo 3.0)のオープンウェイトが公開され、ComfyUIが同日ネイティブ対応しました。つまり自分のPCで、従量課金なしに音声つき動画を無限に生成できます。必要なVRAMはGPU別にどれくらいか、モデルファイルの配置、T2V/I2V/R2Vの3ワークフロー、参照9枚でキャラを固定する方法、そしてホスト版との原価比較まで。AI美女の動画量産をローカルで回すための実践ガイドです。

2026年08月14日約10分で読める

概要

AI美女の動画生成には、ずっと「従量課金」という足かせがありました。1本作るたびに数百円。試行錯誤するほど財布が痛む。

それが2026年8月3日に変わりました。MiniMax が H3(Hailuo 3.0)のオープンウェイトを公開し、ComfyUIが同日ネイティブ対応(PR #15224)。つまり、自分のPCで、生成し放題になったということです。

しかもH3は音声がネイティブ。映像と一緒にセリフ・効果音・BGMが生成され、1つのMP4に同期して出力されます。「動画を作って、あとで声を当てる」工程が丸ごと消えます。

この記事では、ローカルでH3を回すための実践情報必要なGPU、モデル配置、3つのワークフロー、キャラ固定の方法までを解説します。

まず結論:ローカルで何ができるか

項目内容
解像度ネイティブは短辺768px(16:9なら1344×768)。32の倍数に丸められる
長さ・fps最大約15秒 / 24fps固定
音声ネイティブのステレオ音声。映像と同時生成、1本のMP4に同期
参照画像9枚+動画3本+音声3本
ライセンスMiniMax Community License(年商$20M未満は商用OK・要帰属表示)
費用電気代のみ。生成回数の課金なし

「無料で、音声つきで、キャラを固定したまま、何本でも」これがローカルH3の姿です。

必要なGPU:VRAM別の現実解

一番の関門がここです。モデルのピーク時VRAMは約31.7GB。素直に読むと32GBクラスが必要ですが、量子化とオフロードで下げられます。実際の報告はこうです。

VRAMGPU例実際のところ
6GBRTX 2060動くが品質が落ちる。短いクリップで10〜15分。映像の甘さ・音声の粗さが出る
8GBApple Silicon4bit量子化(NF4)なら可能。精度は落ちる
12〜16GBRTX 4060明らかに実用的。480p・5秒で約6分
24GBRTX 4090快適。720p・5秒が数分。LoRA学習の余裕もある
32GB〜RTX 5090 / RTX 6000公式推奨。15秒・高解像度を妥協なく

現実的な最低ラインは12〜16GBです。6GBでも起動はしますが、AI美女コンテンツとして売り物にするなら品質が厳しい。24GBあればLoRA学習まで同じマシンで回せます。

ディスクも必要です。T2V/I2V用で約42.5GB、R2V用の追加チェックポイントが約21GB。フルで揃えると約63GBを見ておいてください。

セットアップ(ComfyUI)

ComfyUIでMiniMax H3を動かしている画面ComfyUIでMiniMax H3を動かしている画面

1. ComfyUIを 0.30.0 以降に更新

これが必須条件です。古いバージョンではノードが出てきません。

2. モデルファイルを配置する

T2V / I2V(テキスト→動画、画像→動画):

ファイル配置先
minimax_h3_fl2va_pruned_int8_convrot.safetensorsComfyUI/models/diffusion_models/
qwen3vl_32b_minimax_h3_nvfp4_awq.safetensorsComfyUI/models/text_encoders/
minimax_h3_video_vae_fp16.safetensorsComfyUI/models/vae/
minimax_h3_audio_vae_fp32.safetensorsComfyUI/models/vae/

R2V(参照→動画)を使う場合は追加で:

ファイル配置先
minimax_h3_ref2va_pruned_int8_convrot.safetensorsComfyUI/models/diffusion_models/

※テキストエンコーダーとVAEはT2V/I2Vと共通です。VAEが2つ(映像用と音声用)ある点に注意してください。音声がネイティブ生成される所以です。

3. 公式ワークフローを読み込む

ComfyUIの公式テンプレートにH3のワークフローが用意されています。VRAMが足りない場合は、量子化版や動的オフロードを使う構成に切り替えます。

3つのワークフローとAI美女での使い分け

ワークフロー入力AI美女での使いどころ
T2V(テキスト→動画)プロンプトのみ世界観・背景素材づくり
I2V(画像→動画)静止画1枚手持ちのAI美女画像を動かす。最も使う
R2V(参照→動画)画像9+動画3+音声3キャラ・動き・声を固定して量産

日常的には I2V が主戦場です。Seedream 5.0やLoRAで作った静止画を動かす。そしてシリーズものを作るときにR2Vへ移行する、という流れが効率的です。

R2Vの参照指定:キャラを固定する実務

R2Vでは、接続した順にタグが割り当てられ、プロンプト内でそのタグを使って指示します。

TEXT
<Picture 1> の女性が、<Video 1> と同じ歩き方で、
<Audio 1> の声で「おはよう」と話しかける
  • <Picture 1> 〜 <Picture 9>:顔・体型・衣装を固定
  • <Video 1> 〜 <Video 3>:動き方・仕草のクセを継承
  • <Audio 1> 〜 <Audio 3>:声を固定

つまり 「同じ顔・同じ動き・同じ声」 を明示的に指定できる。キャラ設計した"その子"を、動画でもブレさせない仕組みがモデル側に用意されているわけです。

なお長さは17フレーム単位のグリッドにスナップされます。秒数を細かく指定しても、内部的に丸められる点は覚えておいてください。

実際に生成した動画

ローカルのComfyUIで出力したサンプルです。音声つきなので、音を出して確認してください。

H3のローカル生成サンプル(音声つき)プロンプト(A dance video. She appears in <Image 1>. She dances with a smile, captivating the viewers.)

ローカル vs ホスト版:どこで元が取れるか

ホスト版(API)は2Kで$0.13/秒。15秒なら$1.95=約293円(1ドル150円換算)です。ローカルは電気代のみ。

月の生成本数ホスト版(15秒2K)ローカル
10本約2,900円電気代のみ
30本(毎日1本)約8,800円電気代のみ
100本(試行錯誤込み)約29,300円電気代のみ

効いてくるのは「失敗作」です。 動画生成は一発で決まりません。10本作って使えるのが1本、ということも普通にある。ホスト版だと失敗するたびに課金されますが、ローカルなら何度でも回せます。

試行錯誤しながら量産する運用ほど、ローカルが圧倒的に有利です。逆に「月に数本だけ、最高画質で」ならホスト版(2K)を使う方が合理的。両方を使い分けるのが正解です。

商用ライセンス(個人には実質フリー)

オープンウェイト版は MiniMax Community License。

年商$20M(約30億円)未満の組織は商用利用が可能(目立つ形での帰属表示が条件)

個人クリエイターや小規模事業者は、まず問題なく商用利用できます。Fanvueのサブスク、写真集・動画販売、企業案件どれにも使えるということです。ただし帰属表示(クレジット)の要件があるので、公開前にライセンス条文を確認してください。

AI美女運用での使いどころ

  • ショート動画の量産:24fps・縦型で、そのままTikTok・YouTube Shortsへ
  • 声つきコンテンツ:音声がネイティブなので、ボイス収益化の工程を丸ごと省略できる
  • サブスク特典:限定動画は静止画より単価を上げやすい
  • 試作の高速化:課金を気にせず回せるので、伸びるパターン探しが加速する

注意点

  • 実在人物を参照に使わない:H3は声まで参照できるぶん、他人の顔・声を使うリスクは画像以上です。肖像権侵害・犯罪になります
  • AI生成であることを表示する:各SNSのAIラベルは必須の流れ
  • 露骨・無修正の公開はNG:ローカルなら何でも作れてしまいますが、公開すれば日本の法律の対象です
  • 帰属表示の要件を守る:商用利用にはクレジットが必要
  • 低VRAMでは品質が落ちる:6GBで「動く」ことと「売れる品質」は別

よくある質問(FAQ)

Q. 最低どれくらいのGPUが必要ですか?

6GB(RTX 2060)でも動きますが、映像の甘さ・音声の粗さが出て、短いクリップに10〜15分かかります。実用ラインは12〜16GB(RTX 4060クラス)、快適に使うなら24GB以上。公式推奨は32GBクラスです。

Q. ディスクはどれくらい必要?

T2V/I2V用で約42.5GB、R2Vの追加チェックポイントが約21GB。フル構成で約63GBを確保してください。

Q. 音声は別に作る必要がありますか?

不要です。映像と同時に生成され、1本のMP4に同期して出力されます。セリフ・効果音・環境音がまとめて出てきます。

Q. キャラの顔と声を固定するには?

R2Vワークフローを使い、参照画像(最大9枚)と参照音声(最大3本)を接続します。プロンプト内では <Picture 1> <Audio 1> のようにタグで指定します。完全固定を狙うならLoRAとの併用が確実です。

Q. ローカルとホスト版、どちらを使うべき?

試行錯誤しながら量産するならローカル(何本作っても電気代のみ)。月数本を最高画質(2K)で仕上げたいならホスト版。ローカルのネイティブ解像度は短辺768pxなので、2Kが必要な場面ではホスト版が有利です。

Q. 商用利用できますか?

年商$20M未満なら可能です(MiniMax Community License、帰属表示が条件)。個人クリエイターは実質的に問題ありませんが、公開前にライセンス条文を確認してください。

まとめ

MiniMax H3のオープンウェイト公開で、AI美女の動画量産は「課金」から解放されました。

  • 2026年8月3日にオープンウェイト公開、ComfyUIが同日対応
  • 音声がネイティブ。映像と同時生成で1本のMP4に同期
  • 参照は画像9+動画3+音声3。R2Vで顔・動き・声を固定できる
  • 実用ラインはVRAM 12〜16GB、快適なら24GB以上、ディスクは約63GB
  • 年商$20M未満は商用OK(帰属表示が条件)
  • 100本試して課金約29,300円 → 0円。試行錯誤するほどローカルが効く

静止画でキャラを固め、ローカルH3で動かして喋らせる。課金を気にせず何度でも回せる環境が手に入った今、ショート動画での集客は一段やりやすくなっています。


出典:ComfyUI 公式ドキュメント(MiniMax H3: T2V, I2V, R2V Workflows)/ComfyUI Wiki(MiniMax H3 Open Weights Land With Native ComfyUI Support)/MindStudio(Run MiniMax H3 Locally: VRAM Guide)

PR関連サービス

Fanvue

AI生成コンテンツに対応した、クリエイター向けの月額サブスクプラットフォーム。登録無料・成果報酬型。

公式サイトを見る

AI NECO LIBRARY

AI Neco・ニュース

AIの作り方、活用法、収益化に役立つ記事を探せます。

人気のタグ

107件の記事

MiniMax H3のプロンプトの書き方|最小テンプレから0秒アンカー・話者ID・文字化けの対処まで【2026年最新】
AIImage

MiniMax H3のプロンプトの書き方|最小テンプレから0秒アンカー・話者ID・文字化けの対処まで【2026年最新】

H3は自由文ではなく決まった構造で書くモデルです。公式のフォーマットに沿うと、セリフの口の動き・カメラの振れ幅・カットの時刻まで指示が通ります。まず動かすための最小テンプレ、縦型の配信風と番組風の応用テンプレ、そして実際に出た崩れ方(文字化け・ロゴの増殖・カットで別人になる)と、その対処をまとめます。

2026-10-03
AI美女でバラエティ番組風の動画を作る|ChatGPTでテロップごと画像を作り、MiniMax H3で動かす【2026年最新】
AIImage

AI美女でバラエティ番組風の動画を作る|ChatGPTでテロップごと画像を作り、MiniMax H3で動かす【2026年最新】

番組ロゴ・ワイプ・テロップまで1枚の画像に焼き込んでから動かすと、10秒でテレビの企画コーナーに見える動画になります。ChatGPTで画像を作り、MiniMax H3の image-to-video で喋らせるまでを、実際に作った3本のプロンプトごと公開します。カウントダウンのテロップを生成だけで動かす書き方まで。

2026-10-02
Eleven v4でAI美女に「番組」を持たせて稼ぐ|ポッドキャスト1本をSNS動画・Fanvue限定回・DMボイスに使い回す方法【2026年最新】
AIMedia

Eleven v4でAI美女に「番組」を持たせて稼ぐ|ポッドキャスト1本をSNS動画・Fanvue限定回・DMボイスに使い回す方法【2026年最新】

ElevenLabsが2026年9月28日に公開したEleven v4は、再生成しても話者の声が変わりにくくなりました。AI美女キャラの声を毎週固定できるので、キャラに「番組」を持たせられます。10分のエピソード1本を、TikTok・リールの縦動画、Fanvueの限定回、DMのボイス、YouTubeとApple Podcastsの番組に分けて使い回す方法と、番組の型、制作の流れをまとめます。

2026-09-30
myfansでAI美女は稼げるのか|2026年8月に生成AIが解禁、手数料22%と出金の実際、二次元が出せない件【2026年最新】
AIWriting

myfansでAI美女は稼げるのか|2026年8月に生成AIが解禁、手数料22%と出金の実際、二次元が出せない件【2026年最新】

myfansは2026年8月14日の規約改定で、それまで全面禁止だった生成AIコンテンツを条件付きで認めるようになり、9月15日には「AIコンテンツガイドライン」を新設しました。ただし公式ヘルプの別ページには旧方針が残っています。何が解禁されて何がダメなのか、手数料は種別ごとに17.6%・20%・22%のどれになるのか、出金は最低1万円で翌々月25日という実際、アダルトで求められるモザイクの基準まで、公式の一次情報だけで整理します。

2026-09-27
10Eros完全ガイド|LTX 2.3版とMiniMax H3版「10Eros Max」の違い、GGUF量子化の選び方、ComfyUI導入手順【2026年最新】
AIImage

10Eros完全ガイド|LTX 2.3版とMiniMax H3版「10Eros Max」の違い、GGUF量子化の選び方、ComfyUI導入手順【2026年最新】

10Erosは2026年8月に系統が2つに分かれました。もとのLTX 2.3ベース(最新v1.5)と、MiniMax H3をベースにした「10Eros Max」です。Maxは音声つきで生成でき、ライセンスも別物になります。2系統の違い、VRAM別にどのファイルを落とすか、配布されているGGUFのサイズ一覧、公式ワークフローと10S Nodesの導入、作者が公開しているサンプラー設定、そして壊れているbeta_3・beta_4を掴まないための注意点まで。

2026-09-23
AI美女はスマホだけで作れる?Sulphur 2や10Erosがスマホで動かない理由と、実際にできる3つの方法【2026年最新】
AIImage

AI美女はスマホだけで作れる?Sulphur 2や10Erosがスマホで動かない理由と、実際にできる3つの方法【2026年最新】

「Sulphur 2 スマホ」で検索しても動かす方法は出てきません。無検閲の動画モデルは1ファイルで10GBから40GBあり、スマホの共有メモリには載らないためです。ではスマホで何ができるのか。ブラウザとアプリで完結する生成サービス、iPhoneとAndroidで本当にローカル生成できるアプリ(Draw Things・Local Dream)、そして自宅のPCで動かしてスマホから操作する方法まで、モデルのファイルサイズと端末のメモリの数字で線を引きます。

2026-09-23
AI美女を作るPCのスペックはどれがいい?VRAM別にできること早見表とグラボの選び方【2026年最新】
AIImage

AI美女を作るPCのスペックはどれがいい?VRAM別にできること早見表とグラボの選び方【2026年最新】

AI美女の画像や動画を手元のPCで作るとき、何ができるかを決めるのはグラボのVRAM(ビデオメモリ)の量です。Krea 2、Sulphur 2、10Eros、LTX-2.5、MiniMax H3のモデルのサイズから、VRAM 8GB・12GB・16GB・24GB・32GBでそれぞれ何が動くかを早見表にまとめ、RTX 3060 12GB・メモリ32GBでの実測、目的別のおすすめ、グラボ以外のパーツの目安まで。

2026-09-20
PatreonでAI美女のR18は出せる?イラスト・アニメ調なら18+ページでOK、リアル系は不可|始め方・手数料・出金【2026年最新】
AIWriting

PatreonでAI美女のR18は出せる?イラスト・アニメ調なら18+ページでOK、リアル系は不可|始め方・手数料・出金【2026年最新】

Patreonはクリエイター登録時にページを「Adult/18+」に設定でき、有料会員向けに成人向けの作品を配信できます。ただしAI生成の作品は画風で扱いが分かれ、写実的(hyperrealistic)な人物を描いた成人向け作品は、実在する本人の同意がない限り認められていません。イラスト・アニメ調のAIキャラクターなら、18+ページの有料会員向けに成人向け作品を出せます。公式のコミュニティガイドラインをもとに、出せるもの・出せないもの、イラスト調で18+ページを始める手順、公開部分のルール、アプリでの表示、2025年8月以降に始めたクリエイターの手数料、出金の仕組みまで。

2026-09-17
ChatGPT Images 2.5でAI美女をつくる|同じ顔を保つ手順と、note・インスタで稼ぐ使い方【2026年最新】
AIImage

ChatGPT Images 2.5でAI美女をつくる|同じ顔を保つ手順と、note・インスタで稼ぐ使い方【2026年最新】

2026年9月8日に公開されたChatGPT Images 2.5は、無料プランを含むChatGPTの全ユーザーが使える画像生成モデルです。参照写真の人物を保つ力と、指示した部分だけを直す編集が強化されました。基準画像の作り方、参照画像での場面替え、崩れた箇所だけの修正、インスタ向けの縦長設定までの手順と、noteとインスタでの稼ぎ方、AI表示ラベルと規約の線引きまで。

2026-09-14
AI美女でCM動画を作る方法|Grok Imagineにプロンプト1本で15秒CM、TikTok Shopの商品紹介まで【2026年最新】
AIImage

AI美女でCM動画を作る方法|Grok Imagineにプロンプト1本で15秒CM、TikTok Shopの商品紹介まで【2026年最新】

「今日のお昼ご飯迷ったらコレっ!」から「私に会いにきてね!」まで、セリフを7行書くだけでAI美女が喋る15秒のCMになります。Grok Imagineは1〜15秒の動画を音声つきで生成し、9:16の縦型にも対応。架空のハンバーガー店のCMと、TikTok Shopの商材(トレーニング機器)のCMの2本を実例に、そのまま使えるプロンプトの型、縦型CMの作り方、TikTok Shopアフィリエイトの参加条件(自分で申請するなら1,000人以上、招待経由はそれ未満でも可)とAI生成コンテンツの表示ルールまで。

2026-09-10
AI美女クリエイターのリンクまとめ(プロフィールサイト)の選び方|R18リンクを貼れるのはどれか、6サービスの規約を比較【2026年最新】
AIWriting

AI美女クリエイターのリンクまとめ(プロフィールサイト)の選び方|R18リンクを貼れるのはどれか、6サービスの規約を比較【2026年最新】

SNSのプロフィール欄に貼れるURLは1本。Fanvue・FANZA・X・Pixivをまとめるリンクまとめサービスは、成人向けリンクの扱いがサービスごとに違い、規約を読まずに貼るとアカウントが要注意扱いになったり、ページを消されたりします。lit.link・POTOFU・FANME・Linktree・Beacons・AllMyLinks の規約の該当条文と、AI美女クリエイターが用途別にどれを選ぶかの判断基準。

2026-09-10
ElevenLabsだけでAI美女の動画・音声・音楽まで作る完全ガイド|料金プランと商用利用の線引き【2026年最新】
AIMedia

ElevenLabsだけでAI美女の動画・音声・音楽まで作る完全ガイド|料金プランと商用利用の線引き【2026年最新】

ElevenLabsは音声合成ツールから、Veo 3.1・Seedance 2.5・Kling 3.0・Nano Banana Proといった外部モデルを1つの契約で動かせる制作ハブに変わりました。動画・画像・音声・音楽・リップシンクを1か所で完結させると何がどこまでできるのか、そして無料プランは商用利用不可・音楽だけはCreator以上という、プランごとの商用利用の線引き。

2026-09-09