Kling O1

テキストや最大7枚の参考画像から、オーディオ付きの高品質な1080P映像を出力できるKlingの最高峰マルチモーダル動画生成モデルです。

このシリーズのモデル

各モデルには Playground、料金設定、入力仕様が用意されています。機能で絞り込み、必要なモデルを開いてください。

Kling O1 シリーズの概要

各機能のモデル ID と、用途の簡単な説明です。

モデルID説明
Kling O1(文章から動画へ)kling-video-o1-text-to-video生成と編集を一体化。映像制作の常識を覆す最高峰の動画生成AI
Kling O1(参考画像から動画へ)kling-video-o1-refs-image-to-video生成と編集を高度に統合した、Kling史上最高峰の次世代AI動画モデル
Kling O1(画像から動画へ)kling-video-o1-image-to-video生成と編集を高度に融合した、Kling史上最高峰の次世代AI動画生成モデル

主要な革新機能

映像と音声を同時に紡ぎ出す高度なマルチモーダル設計で、圧倒的な一貫性とダイナミックな表現力を実現します。

統合マルチモーダル生成

統合マルチモーダル生成

テキスト、画像、さらに最大7枚の参照画像を組み合わせ、映像の動きとマッチした音声を一体として1080Pで生成します。

高度な被写体一貫性

高度な被写体一貫性

キャラクターや物体のビジュアルを崩すことなく、別角度からの視点や複雑なカメラワークを滑らかな物理シミュレーションで描画します。

商用利用とテキスト対応

商用利用とテキスト対応

商用利用可能なライセンスと高い文字描画力を備え、ビジネス向けのプレゼンや広告動画の制作に即戦力として活躍します。

注目のユースケース

このシリーズの代表的なユースケースです。

映画や短劇の絵コンテ

テキストや画像から、物理法則に則ったリアルなカメラワークと動きを持つ最長10秒のカットを生成し、映像制作の試作を効率化します。

キャラクターの一貫性維持

最大7枚の参考画像をインプットすることで、同一キャラクターの服装や特徴を維持したまま、別アングルの動きや演技の動画を作れます。

音声付き広告ビジュアル

映像の動きにマッチしたオーディオを同時に生成するため、SNS広告やプロモーション用のショート動画をこれ一本で完成させられます

他のモデルとの比較

同じ用途で他のモデルを選択する前に、制作上の制限事項と基本クレジット消費量を確認してください。

モデル最長クリップ時間(1回の生成)マルチモーダルリファレンス最大解像度ネイティブ音声Sousaku の基本料金(目安)
Kling O1最長 10 秒最大 7 枚の画像最大 1080P✅120 クレジット/秒
Kling 2.5 Turbo最長 10 秒❌最大 1080P❌60 クレジット/秒
Kling 2.1最長 10 秒❌最大 1080P❌120 クレジット/秒

クイックスタートガイド

登録から初めての API 呼び出し成功までの手順です。どのモデルでも同じ流れで利用できます。

ステップ 1

アカウントの作成

登録と認証を完了すると、API キーを発行して Playground を利用できます。

ステップ 2

このシリーズからモデルを選択

上のカードをクリックして、モデルの詳細、料金、入力パラメータの仕様を確認します。

ステップ 3

Playground で試す

自動化する前に、フォーム上で入力内容やパラメータを確認してください。

ステップ 4

モデル ID とフィールドをコピー

詳細ページのドキュメントに必須パラメータが記載されています。create_task でも同じフィールド名を使用してください。

ステップ 5

API の組み込みとポーリング

API キーを使って生成 API を呼び出し、タスクが成功するまでポーリングを行って結果をダウンロードします。

ステップ 6

利用状況の確認

モデルの料金ページとダッシュボードでクレジット消費を確認できます。

よくある質問

他のモデルファミリーを探す

Sousaku で利用できる他のシリーズです。1つの API キー、1つのタスクフローで完結します。