高度なプロンプト理解
複雑なテキスト指示の意図を正確に捉え、構図の崩れを防ぎながら指示通りのビジュアルを作り上げます。
OpenAIの高度なセマンティクス理解に基づき、4K品質の画像を高速に生成するモデル。リアリスティックな表現に優れ、商用デザインやマーケティング素材の制作を効率化します。
各モデルには Playground、料金設定、入力仕様が用意されています。機能で絞り込み、必要なモデルを開いてください。
各機能のモデル ID と、用途の簡単な説明です。
| モデル | ID | 説明 |
|---|---|---|
| GPT Image 2.0 Medium(文章から画像へ) | gpt-image-2-text-to-image | 高品質画像を高速生成するモデル |
| GPT Image 2.0 Medium(画像から画像へ) | gpt-image-2-image-to-image | 高品質画像を高速生成するモデル |
高度な文脈理解と高速な処理により、イメージ通りのビジュアルを最高水準の解像度で提供します。
このシリーズの代表的なユースケースです。
詳細なテキスト指示からプロ仕様の高品質なビジュアルを生成し、商用利用可能な4K品質でバナーやマーケティング素材を作成できます。
フォトリアリスティックなスタイルを得意とし、複雑な構図やディテールを維持したリアルな写真風ビジュアルを迅速に生成します。
手元の画像をベースに、最大5枚の参考データを組み合わせることで、構図を維持しながら異なるスタイルのビジュアルを生成できます。
同じ用途で他のモデルを選択する前に、制作上の制限事項と基本クレジット消費量を確認してください。
| モデル | マルチモーダルリファレンス | 最大解像度 | Sousaku の基本料金(目安) |
|---|---|---|---|
| GPT Image 2.0 Medium | 最大 5 枚の画像 | 最大 4K | 40 クレジット |
| GPT Image 2.0 High | 最大 5 枚の画像 | 最大 4K | 80 クレジット |
| GPT Image 2.0 Low | 最大 5 枚の画像 | 最大 4K | 20 クレジット |
登録から初めての API 呼び出し成功までの手順です。どのモデルでも同じ流れで利用できます。
登録と認証を完了すると、API キーを発行して Playground を利用できます。
上のカードをクリックして、モデルの詳細、料金、入力パラメータの仕様を確認します。
自動化する前に、フォーム上で入力内容やパラメータを確認してください。
詳細ページのドキュメントに必須パラメータが記載されています。create_task でも同じフィールド名を使用してください。
API キーを使って生成 API を呼び出し、タスクが成功するまでポーリングを行って結果をダウンロードします。
モデルの料金ページとダッシュボードでクレジット消費を確認できます。
Sousaku で利用できる他のシリーズです。1つの API キー、1つのタスクフローで完結します。