
※本ページはプロモーションが含まれています
LTX-2.5をローカルで動かす|ComfyUIで音声つきAI美女動画を高速生成、LTX-2.3のLoRA資産も使える【2026年最新】
8月11日リリースのLTX-2.5を徹底解説。必要VRAM・ComfyUI導入手順・LTX-2.3のLoRA互換性・ライセンスまで、AI美女動画クリエイターが知りたいことを一次情報ベースでまとめました。
概要
2026年8月11日、Lightricksがオープンウェイトの動画生成モデル LTX-2.5 をリリースしました。LTX-2.3 でAI美女動画を作ってきた人にとって最大のニュースはこれです公式が「LTX-2.3で学習したLoRAの大多数はそのまま動く」と明言。積み上げたLoRA資産を持ったまま、生成速度と品質だけ上げられる世代交代です。
本記事では、Hugging Faceの公式モデルカードとComfyUI Wiki、RunPodの検証記事をもとに、導入に必要な情報を整理します。
LTX-2.5とは:何が新しいのか
LTX-2.5は22Bパラメータの非対称デュアルストリーム拡散トランスフォーマーで、テキスト・画像・動画を入力に、映像と音声を同時生成します。テキストエンコーダーにはGemma 4 12Bを採用。
LTX-2.3からの主な進化点:
- 生成速度 — 蒸留(distilled)版は8ステップ固定・CFG=1で動作。NVIDIA GB200×2の環境では10秒クリップを6.8秒で生成(VentureBeat)。ローカルのコンシューマGPUでここまでは出ませんが、世代として「リアルタイム側」に踏み込んだ設計です
- ネイティブマルチショット生成 — キャラクター・環境・ライティング・声を保ったまま、つながった複数シーンを一発生成。「同じAI美女で複数カット」がモデルレベルでサポートされた
- 尺の自動予測 — プロンプトで記述したアクションに応じて動画の長さを自動決定
- ネイティブ4K HDR出力と、シネマ品質EXR向けのDiffusion Fidelity Rendering(DFR)
- 新しい拡散ビデオデコーダー — 従来のVAE再構成ステージを置き換え、ディテール品質が向上
AI美女動画の文脈で言うと、「i2vで別人化する問題」との戦い(LTX-2.3時代の最大の悩み)に対して、マルチショットの一貫性維持がモデル側で強化されたのが実務上いちばん効きます。
最重要:LTX-2.3のLoRAはそのまま使えるのか
公式モデルカードの記載を引用します:
Based on our testing, the large majority of LoRAs and IC-LoRAs trained on LTX-2.3 run on LTX-2.5 without changes.(我々のテストでは、LTX-2.3で学習されたLoRA・IC-LoRAの大多数は変更なしでLTX-2.5上で動作する)
ただし「少数の例外がある」とも明記されています。顔LoRA・体型LoRAなど自作アダプタを持っている人は、本番運用の前に必ず自分の環境で動作検証してください。挙動が変わる可能性があるのは事実なので、「全部無条件で動く」とは考えないこと。
LoRAをこれから作る人は 顔LoRAの作り方ガイド も参考に。
Sulphur 2・10erosはLTX-2.5でどうなる?
結論から:どちらも当面LTX-2.3系のままです(2026年8月21日時点)。
ここで整理しておきたいのは、Sulphur 2(SulphurAI)も10eros(tenstrip)もLoRAではなく、LTX-2.3をベースにしたフルファインチューン(ベースモデルを丸ごと差し替えるチェックポイント)だという点です。10erosの配布ファイルはbf16版で約43GBのフルウェイト。つまり前セクションの「2.3のLoRAは大多数動く」という公式声明は、この2つには当てはまりません。ベースモデルそのものなので「LTX-2.5に載せる」という概念自体が成立せず、使うなら従来どおり2.3系ワークフローで動かします。
現状を整理すると:
- SulphurAI・tenstripとも、LTX-2.5ベースの新版は未発表(Hugging Face確認。Sulphur-2-base・10erosの最終更新はいずれも8月上旬=LTX-2.5リリース前)
- LTX-2.5が出たからといってSulphur 2 / 10erosが使えなくなるわけではない。2.3系パイプラインでこれまでどおり動き続けます
- 無検閲ファインチューンのエコシステムがLTX-2.5上に育つまで、NSFW用途の主力は当面2.3系のままと見るのが現実的です
逆に、Sulphur 2や10erosの上で自作の顔LoRA・体型LoRAを使ってきた人は、そのLoRA自体は公式声明の範囲ではLTX-2.5ベースでも動く可能性が高い。ただしLTX-2.5のベースモデルはNSFW特化ではないため、「LoRAだけ持って2.5に移る」のは表現の幅では後退になり得ます。当面はNSFW制作=2.3系(Sulphur 2 / 10eros)、SFWの高速量産・マルチショット=2.5、の使い分けが現実解です。
必要スペック:VRAM別の現実的なライン
RunPodの検証記事によるVRAM目安:
| ティア | VRAM | GPU例 | できること |
|---|---|---|---|
| エントリー | 16〜24GB | RTX 4090、A5000 | int8量子化版のみ。低解像度+オフロード前提 |
| 快適 | 32〜48GB | RTX 5090、L40S | int8版が快適。bf16蒸留版も視野に |
| 推奨 | 80〜96GB | H100、A100 80GB | bf16蒸留版フルパイプライン |
| 最大 | 141GB〜 | H200、B200 | 4K HDR、非蒸留dev版の2ステージ |
- 量子化版の最低ラインは16GBとされています。それ未満のVRAMでは、公式が案内する
fp8-cast + CPUオフロードでの動作になりますが、快適とは言えません - コミュニティによるGGUF量子化が登場済みです(Q2〜Q8の7段階、8.8〜23.6GB)。VRAM 12GB級からの運用はGGUF版の導入ガイドを参照してください
モデルバリアント一覧
Hugging Face(Lightricks/LTX-2.5)で配布されているのは:
ltx-2.5-22b-distilled-transformer-bf16— 蒸留版。8ステップ固定・CFG=1で高速。まずはこれltx-2.5-22b-dev-transformer-bf16— 非蒸留のフル版。学習・追い込み用- ComfyUI専用のint8量子化(
-comfy-int8-convrot)とNVFP4(Blackwell向け) - VAEは高品質のDiffVAEと軽量のConv VAEの2系統、音声用にAudio VAE+ボコーダー
Diffusers版は別リポジトリ(Lightricks/LTX-2.5-Diffusers)です。
ComfyUIでの導入手順
LTX-2.5はリリース初日からComfyUIネイティブ対応です。
- ComfyUIを最新版にアップデート(ComfyUI入門はこちら)
- 公式ワークフローテンプレートを開く — テンプレートライブラリに text-to-video / image-to-video / first-last-frame の公式テンプレートが追加されています
- テンプレートの指示に従い、Hugging Faceからモデル(int8版推奨)・テキストエンコーダー(Gemma 4 12B)・VAEをダウンロード
- Lightricks公式ラッパー ComfyUI-LTXVideo(GitHub)には、T2V/I2Vに加えてインペイント・モーショントラッキング・音声生成のサンプルワークフローも同梱
生成時の制約(公式モデルカードより):
- フレーム数は「8で割って余り1」(1, 9, 17, … 121, …)
- 幅・高さは32の倍数
- フレームレートの例は24fps
AI美女のi2vで同一性を保つプロンプト設計は LTX-2.3の同一性維持ガイド の考え方がそのまま応用できます。
AI美女作成イメージライセンス:商用利用は無料でできるか
- 年間収益1,000万ドル未満の個人・組織は、商用利用含め無料(LTX-2.x Community License)
- それ以上の規模は有償の商用契約が必要
- ファインチューンモデルの譲渡・再配布には有償ライセンスが必要になる場合あり — 学習済みモデルの販売を考えている人は要注意
個人のAI美女クリエイターなら実質無料で商用利用できる、という理解でOKです(ライセンス本文は必ず自分でも確認を)。
よくある質問(FAQ)
Q. LTX-2.5はNSFW生成できる?検閲はある?
オープンウェイトでローカル実行するモデルなので、クラウドサービスのようなAPI側検閲はありません。公式モデルカードにも明示的なNSFW禁止の記載はなく、「不適切なコンテンツを生成しうる」という注意書きがあるのみです。ただしライセンス・利用規約の遵守は自己責任。そして日本で無修正コンテンツを公開・配信することは刑法175条に触れるおそれがあり、絶対にしてはいけません。詳しくは 知っておくべき日本の法律 を必ず読んでください。
Q. Sulphur 2や10erosはLTX-2.5で使える?
使えません。この2つはLoRAではなくLTX-2.3のフルファインチューン(ベースモデルそのもの)なので、LTX-2.5に載せるという概念自体が当てはまりません。従来どおり2.3系ワークフローで動かしてください。LTX-2.5ベースの対応版は両者とも未発表です(2026年8月21日時点)。
Q. 自作の顔LoRA・体型LoRAは動く?
公式は「LTX-2.3で学習したLoRAの大多数は変更なしで動作する」と明言していますが、例外もあると明記されています。個別のLoRAが動くかどうかは、必ず自分の環境で検証してから本番運用してください。
Q. VRAMはいくら必要?
量子化(int8)版で最低16GBが現実的なライン。RTX 4090(24GB)ならエントリー運用、RTX 5090(32GB)なら快適運用です。さらに軽いGGUF版(8.8GB〜)も登場しており、詳しくはGGUF導入ガイドを参照してください。
Q. 商用利用は無料?
年間収益1,000万ドル未満なら、LTX-2.x Community Licenseのもとで商用利用も無料です。Fanvueなどでの収益化にも使えます。
Q. LTX-2.3から乗り換えるべき?
LoRA資産が公式に互換とされている以上、乗り換えのコストは歴代で最も低い世代交代です。VRAMが16GB以上あるなら試す価値は十分。16GB未満の環境もGGUF版のQ2〜Q3が選択肢になります。
まとめ:AI美女動画の「量産環境」がまた一段進んだ
- 2026年8月11日リリース、22Bのオープンウェイト動画+音声生成モデル
- LTX-2.3のLoRA資産がおおむねそのまま使える世代交代
- マルチショット一貫性・4K HDR・尺の自動予測で、「同じ子で連続カット」がやりやすく
- 量子化版でVRAM 16GBから。GGUF版ならさらに軽く8.8GBから
- 年間収益1,000万ドル未満は商用利用無料
生成した動画をどう収益に変えるかは Fanvue完全ガイド と AI美女副業で月5万円〜30万円稼ぐ方法 にまとめています。制作環境が速くなった分、稼ぐ側の仕組みも整えておきましょう。
※ 本ページにはアフィリエイトリンクが含まれています。











