原生的な音画同期と口型整合
生成される映像と音声が自然にシンクロし、口の動きも正確に合致したリアリティのある動画を出力します。
テキストや画像から音画同期した高品質動画を生成する全能型AIモデル。最大10秒の1080P動画に対応し、商用利用も可能です。
各モデルには Playground、料金設定、入力仕様が用意されています。機能で絞り込み、必要なモデルを開いてください。
各機能のモデル ID と、用途の簡単な説明です。
| モデル | ID | 説明 |
|---|---|---|
| Kling 3.0 Omni(文章から動画へ) | kling-video-v3-omni-text-to-video | 音声同期とキャラクター一貫性を極めた、映画級の万能AI動画生成モデル |
| Kling 3.0 Omni(参考画像から動画へ) | kling-video-v3-omni-refs-image-to-video | 映画級の表現力と一貫性を実現する、次世代の万能型動画生成モデル |
| Kling 3.0 Omni(画像から動画へ) | kling-video-v3-omni-image-to-video | 静止画から映画クオリティの映像を。キャラクターの一貫性を保つ万能AI動画生成モデル |
音声同期、一貫性の維持、リアルな物理演算を備え、映画のような高品質動画を容易に作成できる機能群です。
このシリーズの代表的なユースケースです。
テキストや画像から、ネイティブな音画同期とシネマティックな画質を備えた最大10秒の高品質プロモーション動画を生成します。
キャラクターや商品の特徴を維持したまま、自然な物理挙動を伴う動画を生成し、一貫性のある広告素材を作成できます。
最大7枚の参考画像を入力し、キャラクターやオブジェクトの一貫性を保ちながら、動きのあるダイナミックな映像を制作します。
同じ用途で他のモデルを選択する前に、制作上の制限事項と基本クレジット消費量を確認してください。
| モデル | 最長クリップ時間(1回の生成) | マルチモーダルリファレンス | 最大解像度 | ネイティブ音声 | Sousaku の基本料金(目安) |
|---|---|---|---|---|---|
| Kling 3.0 Omni | 最長 10 秒 | 最大 7 枚の画像 | 最大 1080P | ✅ | 120 クレジット/秒 |
| Kling 2.5 Turbo | 最長 10 秒 | ❌ | 最大 1080P | ❌ | 60 クレジット/秒 |
| Kling 2.1 | 最長 10 秒 | ❌ | 最大 1080P | ❌ | 120 クレジット/秒 |
登録から初めての API 呼び出し成功までの手順です。どのモデルでも同じ流れで利用できます。
登録と認証を完了すると、API キーを発行して Playground を利用できます。
上のカードをクリックして、モデルの詳細、料金、入力パラメータの仕様を確認します。
自動化する前に、フォーム上で入力内容やパラメータを確認してください。
詳細ページのドキュメントに必須パラメータが記載されています。create_task でも同じフィールド名を使用してください。
API キーを使って生成 API を呼び出し、タスクが成功するまでポーリングを行って結果をダウンロードします。
モデルの料金ページとダッシュボードでクレジット消費を確認できます。
Sousaku で利用できる他のシリーズです。1つの API キー、1つのタスクフローで完結します。