オープンな動画モデル

Wan 2.2表現を、自分の手で。

文章で描いたシーンや静止画を、動きのある物語へ。Wan 2.2 のオープンモデルシリーズを紹介します。

Wan3.video のワークスペースでは現在 W3.0 と W3.0 Pro を利用できます。このページはモデルの解説です。

映画の構図と動きの調整を表したコンセプトイラスト
制作イメージを表すイラストです。このモデルで生成した作例ではありません。
公開された重み
独自のワークフローを構築
テキスト + 画像
二つの素材から制作を開始
720P · 24 fps
TI2V-5B モデルで対応

Wan 2.2

Wan 2.2 シリーズを知る。

入力素材と制作方法に合ったモデルを選びましょう。モデルごとに用途と動作要件が異なります。

テキストから動画へ

T2V-A14B は文章を動画に変換し、480P と 720P の出力に対応します。

画像から動画へ

I2V-A14B は画像を起点に生成します。小型の TI2V-5B は一つのモデルでテキストと画像の入力に対応します。

独自の制作環境へ

公式のモデル重みと推論コードが公開され、ComfyUI や Diffusers と連携した独自のワークフローを構築できます。

明確なイメージから始める

  1. 出発点を決める

    シーンを文章で描写するか、モデルが対応している場合は参照画像を用意します。動かす要素と維持する要素を決めましょう。

  2. 一つのショットを具体的に描く

    被写体、動き、背景、照明、カメラワークを指定します。複雑な展開に進む前に、一つの場面を明確にしましょう。

  3. 確認して調整する

    動き、構図、被写体の一貫性を確認します。一度に一つの指示を変えると、改善点を把握しやすくなります。

Wan 2.2 のよくある質問。

Wan3.video で Wan 2.2 を選択できますか?

現在は選択できません。作成ボタンは W3.0 と W3.0 Pro のワークスペースを開きます。Wan 2.2 自体を利用する場合は、下記の公式リソースをご覧ください。

Wan 2.2 はオープンソースですか?

公式リポジトリは Apache 2.0 ライセンスでコードとモデル重みを公開しています。利用するモデルのライセンスと要件をご確認ください。

どのようなハードウェアが必要ですか?

モデルにより異なります。公式の TI2V-5B の例は、オフロードを使って VRAM 24 GB の GPU で動作します。より大きな A14B モデルには多くのリソースが必要です。

すべての Wan 2.2 モデルが音声を生成しますか?

いいえ。音声を使って動画を生成する S2V モデルは別に用意されています。基本のテキスト・画像からの動画生成モデルに音声生成機能があるとは限りません。

モデル情報の出典:公式ドキュメント。設定はモデルやサービスにより異なります。

次のアイデアを、映像に。

オンラインで制作を始めましょう。Wan 3.0 ワークスペースを開き、設定を選んで最初のショットを作成できます。