原生オーディオ同期
映像の動きに同期した高品質なサウンドを自動で同時生成し、動画の没入感と完成度を飛躍的に高めます。
1080Pの高画質動画と同期オーディオを生成できる高度なビデオ生成モデル。テキストや最大5枚の参照画像から、映画のようなダイナミックな映像を作成します。
各モデルには Playground、料金設定、入力仕様が用意されています。機能で絞り込み、必要なモデルを開いてください。
各機能のモデル ID と、用途の簡単な説明です。
| モデル | ID | 説明 |
|---|---|---|
| WAN Video 2.7(文章から動画へ) | wan-video-2.7-text-to-video | 映画品質の制御性と一貫性を実現する、次世代マルチ参照動画生成モデル |
| WAN Video 2.7(参考画像から動画へ) | wan-video-2.7-refs-image-to-video | 複数の参照画像から一貫した映画品質の映像を創り出す、高精度ビデオ生成モデル |
| WAN Video 2.7(画像から動画へ) | wan-video-2.7-image-to-video | 静止画から映画品質の映像を創り出す、高度な制御が可能な次世代動画生成モデル |
1080P高解像度、オーディオ同期、最大5枚のマルチ参照機能により、プロレベルのクリエイティブ表現を可能にします。
このシリーズの代表的なユースケースです。
テキストのプロンプトから最大15秒のダイナミックな映画級動画を生成し、ストーリーボードの制作や演出プランの策定を効率化します。
最大5枚の参照画像をインプットし、キャラクターの顔や服装の一致性を保ったまま自然なアニメーションを1080Pで出力します。
原生的なオーディオ同期機能を活かし、静止画からリアルな動きと効果音を同時に備えた高品質なプロモーション動画を生成します。
同じ用途で他のモデルを選択する前に、制作上の制限事項と基本クレジット消費量を確認してください。
| モデル | 最長クリップ時間(1回の生成) | マルチモーダルリファレンス | 最大解像度 | ネイティブ音声 | Sousaku の基本料金(目安) |
|---|---|---|---|---|---|
| WAN Video 2.7 | 最長 15 秒 | 最大 5 枚の画像 | 最大 1080P | ✅ | 120 クレジット/秒 |
| WAN Video 2.6 | 最長 15 秒 | 最大 3 本の動画 | 最大 1080P | ✅ | 120 クレジット/秒 |
| WAN 2.5 | 最長 10 秒 | ❌ | 最大 1080P | ❌ | 60 クレジット/秒 |
登録から初めての API 呼び出し成功までの手順です。どのモデルでも同じ流れで利用できます。
登録と認証を完了すると、API キーを発行して Playground を利用できます。
上のカードをクリックして、モデルの詳細、料金、入力パラメータの仕様を確認します。
自動化する前に、フォーム上で入力内容やパラメータを確認してください。
詳細ページのドキュメントに必須パラメータが記載されています。create_task でも同じフィールド名を使用してください。
API キーを使って生成 API を呼び出し、タスクが成功するまでポーリングを行って結果をダウンロードします。
モデルの料金ページとダッシュボードでクレジット消費を確認できます。
Sousaku で利用できる他のシリーズです。1つの API キー、1つのタスクフローで完結します。