1. テキストから動画、または画像から動画を選ぶ
生成画面を開き、手元の素材に合うWan 3.0 AIモードを選びます。文章から場面を作るならテキストから動画、アップロードした静止画を開始フレームとして動かすなら画像から動画を選択します。
タイムライン編集を挟まず、ラフなアイデアから完成したWan 3.0 AI動画まで進める4つの手順です。
生成画面を開き、手元の素材に合うWan 3.0 AIモードを選びます。文章から場面を作るならテキストから動画、アップロードした静止画を開始フレームとして動かすなら画像から動画を選択します。
被写体、動き、場所、照明、カメラワークを1ショットにつき1行で具体的に書きます。Wan 3.0 AIでは、雰囲気だけを表す言葉よりも、「ゆっくり寄る」「手持ちで追従する」といった具体的な指示のほうが意図を反映しやすくなります。
2〜30秒の範囲で1秒単位の長さを選び、480p、720p、1080pのいずれかで生成します。音声をオンにすると、Wan 3.0 AIが画面内の出来事に合わせた音を映像と同時に作成します。
結果を再生し、再生成する前に変更する要素を1つずつ調整します。Wan 3.0 AI動画が意図どおりに仕上がったら、MP4をダウンロードして編集に組み込むか、そのまま投稿できます。
Wan 3.0 AIは、AlibabaのWan動画モデルの第3世代です。従来のモデルでは動画を長くするほど安定性を保つのが難しくなりがちでしたが、1回の生成で最長30秒の動画を作りながら、顔、衣装、照明の一貫性を保ちます。さらに、生成後に音を重ねるのではなく、映像と同時に音声も生成します。
起こしたい出来事を入力すると、Wan 3.0 AIが構図、動き、周囲の雰囲気を組み立てます。プロンプト拡張が不足する情報を補うため、短い指示からでもまとまりのあるショットを生成できます。
開始画像をアップロードすると、Wan 3.0 AIが画像に動きを加えます。終了フレームも指定すれば、2枚を自然につなぐ動きを設計でき、商品写真を動画ショットへ手早く変換できます。
動画の長さは生成前に設定でき、別々のクリップをつなぎ合わせる必要はありません。1回の生成で最長30秒まで作れるため、動きと音声の流れが途中で途切れません。
複数の被写体を扱うショットでも、同じ人物だと分かる顔立ちを最初のフレームから最後まで保ちやすくします。Wan 3.0 AIの安定性により、デモだけでなく実際の編集に使えるシネマティックなシーケンスを作成できます。
Wan 3.0 AIなら、映像、カメラワーク、音声を同じモデルでまとめて生成できます。複数のツールを行き来する工程を減らし、編集に使えるクリップ案をより短時間で用意できます。

動画の見え方を左右する主な設定と、最初に押さえておきたい操作を紹介します。
短いプロンプトを、生成前により詳しい場面描写へ拡張します。毎回長い文章を書かなくても、簡潔な指示からショットに必要な情報を補い、生成品質を高めます。
画像から動画では、開始フレームのみ、または開始と終了の2枚を指定できます。2枚を指定すると、モデルがそれぞれのフレームをつなぐ動きを設計します。
環境音、足音、室内の響きなどを後から重ねるのではなく、映像と一緒に生成します。そのため、Wan 3.0 AIのシネマティックなショットは音と動きが同期した状態で仕上がります。
2〜30秒の範囲で、任意の整数秒を指定できます。短いSNS向けループも30秒の場面も、同じWan 3.0 AIモデルから生成できます。
ショットが動いても顔、衣装、小道具の見た目を安定させます。この一貫性により、複数のWan 3.0動画を1つのシーケンスに配置する際も、見た目をそろえやすくなります。
試作は低コストで、完成版は高精細に。生成ごとに解像度を選べるため、シネマティックなテストは480pで確認し、最終版だけを1080pで書き出せます。
Alibaba関連アカウント、評価者、クリエイターが公開したWan 3.0の投稿から、発表情報や生成動画の例を確認できます。
Wan 3.0の動画を視聴し、テキストから動画または画像から動画のリクエストを設定する前にモデルの概要を確認できます。
初めてWan 3.0 AIで動画を生成する前に知っておきたいポイントを、簡潔に回答します。
Looking for more related tutorials? Read the Model AI blog.