Video Generation

Wan AI動画生成ツール

AlibabaのWanシリーズは、最も汎用的なオープンソース動画生成モデルファミリーの一つです。軽量なWan 2.1から15秒HD生成対応のフラッグシップWan 2.6まで、すべてのバージョンをComfyUI Webでトライアル実行 — GPU不要、セットアップ不要。

Wan AIの特長

画像から動画

写真をアップロードして、自然な動き、リアルな物理演算、カメラワークを持つダイナミックな動画に変換。Wan 2.5と2.6は720pと1080pの出力に対応。

テキストから動画

自然言語でシーンを記述してオリジナルの動画クリップを生成。カメラアングル、照明、モーションスタイル、被写体の動きをプロンプトで制御。

キャラクターアニメーション

Wan 2.2 Animateは静止画をダイナミックなキャラクターアニメーションに変換 — ポーズマップやデプスマップ不要でスムーズな動きと表情転写を実現。

5つのモデルバージョン

Wan 2.1、2.2、2.5、2.6に一つのプラットフォームからアクセス。各バージョンは速度、品質、機能のバランスが異なります。

100%クラウドベース

GPU不要、Pythonセットアップ不要、ローカルComfyUIインストール不要。クラウドインフラが任意のデバイスのブラウザでモデルを実行します。

トライアルプランあり

クレジットカード不要で動画生成を開始。トライアルアカウントには定期的にリフレッシュされるクレジットが付与されます。有料プランは月額$9から。

ComfyUI WebでWan AIを使う方法

2分以内で初めてのWan AI動画を生成。

ステップ 1

Wanバージョンを選択

目的に合ったWanモデルを選択。最高品質ならWan 2.6(15秒、1080p)、高速な画像から動画ならWan 2.5、キャラクターアニメーションならWan 2.2 Animate。

ステップ 2

画像をアップロードまたはプロンプトを入力

画像から動画の場合はソース写真をアップロード。テキストから動画の場合はシーン、カメラの動き、スタイルを記述。例:「カメラが被写体の周りをゆっくり回る、シネマティックな照明」。

ステップ 3

生成とダウンロード

生成ボタンをクリックして30〜120秒待機。結果をプレビューし、必要に応じてプロンプトを調整し、MP4形式でダウンロード。

Wan AIとは?

Wanは、Alibabaの通義研究所が開発したオープンソースの動画生成モデルファミリーです。2025年初頭にWan 2.1として初めてリリースされ、4つのメジャーバージョンを経て急速に進化してきました。

SoraやRunway Gen-3などのクローズドソースの競合とは異なり、Wanモデルはパーミッシブライセンスの下で自由に利用可能です。ComfyUIでローカル実行することも、ComfyUI Webのようなクラウドプラットフォームでハードウェア投資なしに動画を生成することもできます。

Wanモデルバージョンの比較

Wan 2.1は基盤となるアーキテクチャを導入し、Mochaバリアントはキャラクター置換に特化 — ポーズマップなどの明示的な構造ガイダンスなしで、参照画像を使用してソース動画のキャラクターを置き換えます。

Wan 2.2は専用のAnimateモデルによるキャラクターアニメーションと最適化された画像から動画パイプラインで機能を拡張。14Bパラメータの A14Bバリアントは、適度な生成速度で高いモーション品質を実現します。

Wan 2.5は生成速度に焦点を当て、視覚的品質を維持しながら生成時間を大幅に短縮する「高速」推論モードを提供。720pと1080pの出力で5秒または10秒に対応。

2025年12月にリリースされたWan 2.6は最も高性能なバージョンです。最大15秒の1080p HD動画生成、自動ストーリーボーディングによるマルチレンズナラティブ、シーン間でキャラクターの外見と声を保持するR2V(Reference-to-Video)モデルを導入。

技術仕様

Wanモデルは1.3Bと14Bのパラメータサイズで提供。14Bバリアントはモーションコヒーレンスが高い高品質な出力を生成し、1.3Bバージョンはラピッドプロトタイピングに適した高速生成を提供します。

対応アスペクト比は16:9、9:16、1:1、4:3、3:4。解像度オプションはモデルバージョンにより720pから1080pまで。Wan 2.6はオーディオ駆動動画生成をサポートするネイティブ音声視覚同期を追加。

すべてのWanモデルはテキストプロンプト(テキストから動画)と画像入力(画像から動画)を受け付けます。Wan 2.2 Animateはアニメーション用の静止キャラクター画像も、Wan 2.1 Mochaは置換用のキャラクター参照画像も受け付けます。

Wan AIとクローズドソースの代替との比較

WanはSora(OpenAI)、Runway Gen-3、Kling(快手)、Pikaと直接競合します。これらのクローズドソースモデルは洗練されたインターフェースを提供しますが、Wanは完全な透明性とベンダーロックインなしで同等の品質を提供します。

ComfyUI Webでは、Wanモデルのオープンさとフレキシビリティをクラウドホストプラットフォームの便利さと組み合わせた最良の体験が得られます。GPU購入不要、複雑なセットアップ不要、トライアルクレジットで開始できます。

よくある質問

Wan AIはトライアルで使えますか?
はい。Wanはオープンソースでローカルでの実行はトライアルです。ComfyUI Webではトライアルクレジットで動画を生成できます。有料プランは月額$9から。
Wan 2.5とWan 2.6の違いは何ですか?
Wan 2.6は最大15秒の1080p動画(Wan 2.5は10秒)に対応し、自動ストーリーボーディングによるマルチレンズナラティブと、シーン間でキャラクターの一貫性を保つReference-to-Videoを導入しています。
Wan AIはどの解像度に対応していますか?
Wanは720pと1080pの出力に対応。アスペクト比は16:9、9:16、1:1、4:3、3:4を含みます。動画の長さはモデルバージョンにより5〜15秒。
Wan AIを使うのにGPUは必要ですか?
ComfyUI Webでは不要です。クラウドGPUがすべての推論を処理します。ウェブブラウザのみで利用可能。ローカル使用の場合、Wan 14Bには約24GBのVRAMが必要です。
Wan AIはテキストのみから動画を生成できますか?
はい。Wanはテキストから動画と画像から動画の両方の生成に対応。自然言語でシーンを記述すると、モデルがオリジナルの動画コンテンツを生成します。
Wan 2.2 Animateは何に使いますか?
Wan 2.2 Animateは静止キャラクター画像をスムーズなアニメーションと表情転写でダイナミックな動画シーケンスに変換します。ポーズマップやデプスマップ不要 — ソース画像のみ必要です。
Wan動画生成にはどのくらい時間がかかりますか?
ComfyUI Webでは、モデルバージョン、解像度、動画の長さにより通常30〜120秒。Wan 2.5 Fastはより高速な結果に最適化されています。
Wan AIはオープンソースですか?
はい。すべてのWanモデルはAlibabaの通義研究所によりパーミッシブなオープンソースライセンスの下で公開されています。Hugging Faceからウェイトをダウンロードするか、ComfyUIで実行できます。