3分間の長尺生成
最大180秒(3分)のオーディオを、一貫したメロディやトーンを維持したまま途切れずに生成可能です。
テキストから最長3分間の高品質な音楽や効果音を生成するプロ向けオーディオモデル。映像やゲームに最適なサウンドを創造します。
各モデルには Playground、料金設定、入力仕様が用意されています。機能で絞り込み、必要なモデルを開いてください。
各機能のモデル ID と、用途の簡単な説明です。
| モデル | ID | 説明 |
|---|---|---|
| hotgen-audio-pro(文章から音声へ) | hotgen-audio-pro-text-to-audio | テキストから高品質な音楽や効果音を最長3分間生成するプロ仕様のオーディオモデル |
プロレベルの音響制作を支援する、最長3分間の高精度なオーディオ生成機能を提供します。
このシリーズの代表的なユースケースです。
テキストの指示からシネマティックな音楽を最長3分間生成し、動画や広告の雰囲気に合わせたオリジナル楽曲を用意できます。
ゲーム開発に必要なリアルな環境音や各種効果音をテキストから直接生成し、ゲームの世界観に合ったクリアな音質で出力します。
ポッドキャストや音声コンテンツ向けに、オープニング曲やトークの背景に流れる一貫したトーンのBGMを簡単に制作できます。
同じ用途で他のモデルを選択する前に、制作上の制限事項と基本クレジット消費量を確認してください。
| モデル | 最長クリップ時間(1回の生成) | マルチモーダルリファレンス | 最大解像度 | ネイティブ音声 | Sousaku の基本料金(目安) |
|---|---|---|---|---|---|
| hotgen-audio-pro | 最長 180 秒 | ❌ | ❌ | ❌ | 60 クレジット/秒 |
| hotgen-audio-clip | 最長 30 秒 | ❌ | ❌ | ❌ | 60 クレジット/秒 |
登録から初めての API 呼び出し成功までの手順です。どのモデルでも同じ流れで利用できます。
登録と認証を完了すると、API キーを発行して Playground を利用できます。
上のカードをクリックして、モデルの詳細、料金、入力パラメータの仕様を確認します。
自動化する前に、フォーム上で入力内容やパラメータを確認してください。
詳細ページのドキュメントに必須パラメータが記載されています。create_task でも同じフィールド名を使用してください。
API キーを使って生成 API を呼び出し、タスクが成功するまでポーリングを行って結果をダウンロードします。
モデルの料金ページとダッシュボードでクレジット消費を確認できます。
Sousaku で利用できる他のシリーズです。1つの API キー、1つのタスクフローで完結します。