Veo 3.0

Googleが開発した先進的な動画生成モデル。テキストや画像から、オーディオ付きのリアルで映画のような高品質動画を最長8秒間生成できます。

このシリーズのモデル

各モデルには Playground、料金設定、入力仕様が用意されています。機能で絞り込み、必要なモデルを開いてください。

Veo 3.0 シリーズの概要

各機能のモデル ID と、用途の簡単な説明です。

モデルID説明
Veo 3.0(文章から動画へ)google-video-veo-3.0-text-to-videoGoogleの最先端AIが紡ぐ、圧倒的リアリズムと映画級の映像美を誇る動画生成モデル。
Veo 3.0(画像から動画へ)google-video-veo-3.0-image-to-video静止画から映画級の映像を創り出す、Googleの次世代AI動画生成モデル

高度な映像表現力

物理法則に基づいたビジュアル表現とオーディオ生成を組み合わせ、臨場感あふれるショート動画を生み出します。

テキストからの動画生成

テキストからの動画生成

テキストプロンプトから、高度なカメラワークと映画のような構図を持つ最長8秒の動画を直接生成します。

画像からの動画生成

画像からの動画生成

お手持ちの静止画を入力として、自然な動きや変化を加えた躍動感のある動画へと変換します。

オーディオの同時生成

オーディオの同時生成

映像の生成と同時にシーンにマッチしたオーディオを出力し、没入感のある作品をワンストップで制作します。

優れた指示追従性

優れた指示追従性

複雑なシーン指定や感情、カメラワーク、スタイルの指示を正確に捉え、ビジョンに忠実な映像を実現します。

注目のユースケース

このシリーズの代表的なユースケースです。

広告プロモーション制作

テキストの指示から物理法則に則ったリアルな映像をオーディオ付きで生成し、魅力的な商用広告ビジュアルを作成します。

静止画の動画化

手持ちの画像アセットから、カメラワークと自然な動き、そして効果音を伴う最長8秒の高品質動画を生成します。

映像のプリビズ制作

複雑な指示を正確に理解し、光影やカメラワークが精緻に表現されたシネマティックな映像プロトタイプを構築します。

他のモデルとの比較

同じ用途で他のモデルを選択する前に、制作上の制限事項と基本クレジット消費量を確認してください。

モデル最長クリップ時間(1回の生成)マルチモーダルリファレンス最大解像度ネイティブ音声Sousaku の基本料金(目安)
Veo 3.0最長 8 秒❌最大 720P✅180 クレジット/秒
Gemini Omni Flash最長 10 秒最大 10 本の動画最大 720P✅120 クレジット/秒
Veo 3.1最長 8 秒最大 3 枚の画像最大 1080P✅180 クレジット/秒

クイックスタートガイド

登録から初めての API 呼び出し成功までの手順です。どのモデルでも同じ流れで利用できます。

ステップ 1

アカウントの作成

登録と認証を完了すると、API キーを発行して Playground を利用できます。

ステップ 2

このシリーズからモデルを選択

上のカードをクリックして、モデルの詳細、料金、入力パラメータの仕様を確認します。

ステップ 3

Playground で試す

自動化する前に、フォーム上で入力内容やパラメータを確認してください。

ステップ 4

モデル ID とフィールドをコピー

詳細ページのドキュメントに必須パラメータが記載されています。create_task でも同じフィールド名を使用してください。

ステップ 5

API の組み込みとポーリング

API キーを使って生成 API を呼び出し、タスクが成功するまでポーリングを行って結果をダウンロードします。

ステップ 6

利用状況の確認

モデルの料金ページとダッシュボードでクレジット消費を確認できます。

よくある質問

他のモデルファミリーを探す

Sousaku で利用できる他のシリーズです。1つの API キー、1つのタスクフローで完結します。