Veo 3.1

Google DeepMindによる最先端モデル。4K高画質動画と同期音声を同時生成し、映画級のカメラワークと抜群の一貫性でプロの創作を支えます。

音声対応
商用利用可

入力

仕上がり

準備完了

生成準備完了

画像プレビューを生成するには、入力項目を設定して「実行」をクリックしてください。

Veo 3.1 モデル紹介

モデル概要

Google DeepMindが開発した「Veo 3.1」は、最高峰の映像クオリティを誇る次世代のマルチモーダル動画生成モデルです。テキストや画像から圧倒的なリアリズムを持つ動画を生成するだけでなく、対話、環境音、BGMなどの高品質な音声を映像と完全に同期(リップシンク対応)させて出力できるのが最大の特長です。

映画制作で使われるプロ仕様のカメラワーク(ドリーズームやタイムラプスなど)の指示に正確に従い、高度な物理シミュレーションと繊細なテクスチャ表現で、現実に迫るビジュアルを創出。さらに、複数の参考画像から一貫したキャラクターやオブジェクトを維持して動画化する「Ingredients to Video」機能も搭載。縦型(9:16)フォーマットにも対応し、TikTokやYouTube Shorts用の高品質なクリエイティブ制作、広告ビジュアル、ストーリーボード作成に最適な、クリエイター待望のゲームチェンジャーモデルです。

料金

解像度消費クレジット
720p(credits/s)180
1080p(credits/s)270

技術仕様

技術パラメータ仕様
コア機能テキスト・トゥ・ビデオ
解像度720p,1080p
アスペクト比16:9,9:16
時間4,6,8

類似モデルを探す