期間限定30% OFF!今すぐ確認
Artificial Analysisの音声付きテキストから動画ランキングで1位(2026年9月時点)

Wan 3.0:声も含めて、1つの場面を演出

1行の文章、開始画像、複数の参考素材から。セリフ、音楽、口の動きに合った音声までそろった、最大30秒の動画が届きます。

Agent モードを試すNEW

会話でアイデアを伝えて、そのまま仕上げていけます。

Agent を試す
アップロード必須
開始フレーム
終了フレーム
  • 画像:JPG、PNG、WebP
Duration (seconds)5s
2s16s30s

生成プレビュー

5s Living Oil Painting | 16:9 | Impressionist Post-Painterly Texture | Sea-Cliff Wind and Scattering Blossoms FIRST FRAME: strictly preserve the reference image's original composition, palette, and brushwork. Nothing is re-rendered as photoreal — the animation must look like an oil painting in motion, visible impasto strokes and palette-knife ridges holding their identity as they move. SUBJECT: young dark-haired woman in a sage-olive long-sleeved blouse with a patterned sash, head tilted down and to her right, eyes lowered, expression calm and inward. Both bare forearms lift toward a great bundle of white chrysanthemum blooms breaking apart in the air before her. Face structure, hair mass, sleeve folds, and skin tone stay consistent throughout.
公式作例

Wan 3.0の公式デモを見る

Alibabaの公式発表デモから、長回し、キャラクターの演技、映画のようなスケール感を紹介します。

途切れない、長いワンカット

雲の中のらせん階段を、小さな天使が1つの連続ショットで登ります。長く一貫したテイクを得意とするモデルの特徴がわかる作例です。

長回しを生成
雲の中の大理石のらせん階段を登る小さな天使 — Wan 3.0の長回し映像

場面を通して保たれるキャラクターの演技

夜中に冷蔵庫をあさるデフォルメされたキャラクター。表情、動き、照明が場面全体で一貫しています。

キャラクターを動かす
Wan 3.0 AI動画デモ:夜中に冷蔵庫を開くデフォルメされたキャラクター

ゲームのシネマティック映像のようなスケール

灯籠に照らされた廃墟、巨大な石仏、1人の戦士。モデルから直接生成された30秒のシネマティック映像です。

映画のような場面を作る
Wan 3.0動画生成デモ:灯籠に照らされた廃墟で、巨大な石仏の前に立つ戦士

Wan 3.0とは?

Wan 3.0はAlibabaの統合型動画モデルです。テキストから動画、画像から動画、参考素材を使った生成、編集、延長を1つで扱います。文章や開始画像から、最大1080p・30秒の映像を生成。音声も標準で同時生成するため、セリフ、効果音、BGMがそろい、話す言葉にキャラクターの口も連動します。2026年9月時点では、Artificial Analysisの音声付きテキストから動画ランキングでElo 1,242を記録し、Gemini Omni FlashとMiniMax H3 Maxを上回る1位に位置しています。

設定

Wan 3.0で、場面に必要な設定をまとめて指定

  • 1回で2〜30秒

    初期値は5秒。1秒単位で長さを選ぶか、動作に合う長さをモデルに任せられます。

  • 最大1080p・30 FPS

    試行中は480pを使い、残す動画は1080pで生成。どの動画も30 FPSで出力されます。

  • 音声も標準で生成

    セリフ、環境音、音楽を映像と一緒に生成し、セリフに合わせて口が動きます。

  • 5種類の画角、または自動調整

    16:9、4:3、1:1、3:4、9:16から選ぶか、画角を自動調整にできます。

  • 最大20点の参考素材

    画像、動画、音声に加え、PDF、スライド、ウェブページも参照し、それらを基に場面を作れます。

  • 編集と延長

    要素の置き換え、映像スタイルの変更、セリフの書き換え、前後への延長が可能です。合計は最大30秒です。

制作手順

Wan 3.0でAI動画を作る方法

  1. 1

    場面を組み立てる

    何が起こるかを書くか、開始画像、終了画像、複数の参考素材を追加します。

  2. 2

    画角を設定

    2〜30秒、480p〜1080p、16:9〜9:16から選択。長さは自動にもできます。

  3. 3

    音声付きで生成

    声、効果音、音楽が入った動画が届きます。そのまま残すか、セリフを編集したりテイクを延長したりできます。

活用例

Wan 3.0でチームが作れるもの

複数のツールが必要だった作業を、1回の生成にまとめられます。

  • 広告チーム

    1つの企画から、映像、ナレーション、音楽を含む30秒の広告を作成。テイクを重ねて調整できます。

  • 商品マーケター

    メインの商品写真1枚から動画へ。商品写真を冒頭に使い、モデルが動きを加えます。

  • 教育・解説制作

    PDF、スライド、ウェブページから、事前に絵コンテを作らずナレーション付きの解説動画へ。

  • SNSクリエイター

    セリフと口の動きが合った9:16の縦長シーンを、音声付きでフィード用に作れます。

  • 物語・ゲーム制作チーム

    キャラクターの一貫性を保ちながら、映画のような映像をカットごとに演出し、場面ごとに延長できます。

世代間の進化

Wan 3.0と前世代の比較

Alibabaの発表に基づき、Wan 2.7のAPIシリーズから変わった点を紹介します。

当サイトWan 3.0統合型の世代生成するWan 2.7前世代のAPI
1回の生成の最長時間最大30秒最大15秒
モデル構成参考素材の利用・編集・生成・延長を1モデルに統合別々のモデルに分離
入力テキストと画像に加え、文書やウェブページを含む最大20点の参考素材対応する入力の種類が少ない
料金

Wan 3.0のクレジット料金

サブスクリプションでクレジットを追加できます。$19.90で1,000クレジット。5秒の下書きなら25本、720p・10秒なら6本を生成できます。

期間限定オファー30% OFF

期間限定30% OFF!

07日00時間00分00秒
Loading…
よくある質問

Wan 3.0のよくある質問

1回の生成で、声までそろった場面に。

テイクを残す、セリフを書き換える、終わりを延ばす。最初の場面は、1つのプロンプトから。