音声つき動画の同時生成
映像の生成と同時に、そのシーンにマッチした高品質なオーディオを生成し、音と映像が一体となった没入感のある動画を1ステップで作成します。
豊かな表現力とダイナミックな動き、そして自動生成オーディオが特徴の高性能動画生成モデル。テキストや画像、最大9枚の参考画像から、ポジティブで活力に満ちた1080P動画を創り出します。
各モデルには Playground、料金設定、入力仕様が用意されています。機能で絞り込み、必要なモデルを開いてください。
各機能のモデル ID と、用途の簡単な説明です。
| モデル | ID | 説明 |
|---|---|---|
| HappyHorse 1.1(文章から動画へ) | happyhorse-video-1.1-text-to-video | 明るくポジティブな世界観を、躍動感あふれる映像で高速に描き出す動画生成モデル |
| HappyHorse 1.1(参考画像から動画へ) | happyhorse-video-1.1-refs-image-to-video | 静止画に命を吹き込み、躍動感あふれるハッピーな動画に仕上げる高速生成モデル |
| HappyHorse 1.1(画像から動画へ) | happyhorse-video-1.1-image-to-video | 一枚の画像から、ポジティブで躍動感あふれる動画を高速生成するモデル |
映像と音声を同時に生み出すマルチモーダル生成や、最大9枚の画像をベースにした一貫性のある高度な動画クリエイションを実現します。
このシリーズの代表的なユースケースです。
温かみのあるキャラクターと生き生きとした動物の描写を得意とし、テキストの指示から音声を伴うストーリー性の高いアニメーションを生成します。
サイバーパンクやスチームパンクなどの多様なスタイルに対応し、最大15秒のダイナミックで質感豊かな1080Pシネマティック映像を創り出します。
最大9枚の参考画像をインプットし、一貫性を保ちながらキャラクターの豊かな表情や躍動感のある動きを動画として表現します。
明るくポジティブな世界観のビジュアルと高音質なオーディオを同時に生成し、SNSやWEB広告で目を引くキャッチーな動画を効率的に制作します。
同じ用途で他のモデルを選択する前に、制作上の制限事項と基本クレジット消費量を確認してください。
| モデル | 最長クリップ時間(1回の生成) | マルチモーダルリファレンス | 最大解像度 | ネイティブ音声 | Sousaku の基本料金(目安) |
|---|---|---|---|---|---|
| HappyHorse 1.1 | 最長 15 秒 | 最大 9 枚の画像 | 最大 1080P | ✅ | 120 クレジット/秒 |
| HappyHorse 1.0 | 最長 15 秒 | 最大 9 枚の画像 | 最大 1080P | ✅ | 120 クレジット/秒 |
登録から初めての API 呼び出し成功までの手順です。どのモデルでも同じ流れで利用できます。
登録と認証を完了すると、API キーを発行して Playground を利用できます。
上のカードをクリックして、モデルの詳細、料金、入力パラメータの仕様を確認します。
自動化する前に、フォーム上で入力内容やパラメータを確認してください。
詳細ページのドキュメントに必須パラメータが記載されています。create_task でも同じフィールド名を使用してください。
API キーを使って生成 API を呼び出し、タスクが成功するまでポーリングを行って結果をダウンロードします。
モデルの料金ページとダッシュボードでクレジット消費を確認できます。
Sousaku で利用できる他のシリーズです。1つの API キー、1つのタスクフローで完結します。