画像モデル
AI-School は テキストから画像へのモデルの中央カタログを使用します。どのモデルが表示されるかは、環境のプロバイダー設定に依存します。
現在のカタログ
| プロバイダー | コスト効果 | 高品質 |
|---|---|---|
| OpenAI | GPT Image 1 mini | GPT Image 2 |
| Nano Banana | Nano Banana 2 | |
| Black Forest Labs | FLUX.2 Flex | FLUX.2 Pro Preview |
Nano Banana は、AI-School が Gemini Flash Image モデルに対して使用している名称です。欧州の画像モデルは Black Forest Labs を通じて提供されます。
どのモデルを選ぶべきか
| モデル | 適している用途 |
|---|---|
| GPT Image 1 mini | 速いコンセプト画像、スケッチ、低コストでの試作と反復。 |
| GPT Image 2 | よりきれいな最終画像、画像内のテキストが明瞭、仕上がりの制御性が高い。 |
| Nano Banana | 速くて手頃な価格の画像、多くのバリエーションと簡単な編集。 |
| Nano Banana 2 | Google とのスムーズな画像生成とインタラクティブな編集。 |
| FLUX.2 Flex | 新規で汎用的な欧州向けのテキスト→画像生成に柔軟性。 |
| FLUX.2 Pro Preview | 現実的な画像と一貫したスタイルの高品質な欧州向け画像生成。 |
中央のフォーマット選択
AI-School はユーザーに四つの一般的なフォーマット選択を表示します:
| 選択 | 意味 |
|---|---|
| 自動 | 選択されたモデルに最適な設定をAI-Schoolが選択します。 |
| 正方形 | 正方形の画像。 |
| 横長 | 横長の画像、プレゼンテーションなどに適しています。 |
| 縦長 | 縦長の画像、ポスターなどに適しています。 |
中央のモデルカタログには、これらの選択がプロバイダーごとに適切な技術設定へどのように翻訳されるかが定義されています。したがって、ユーザーはプロバイダーが 16:9、1536x1024、幅/高さ、または他の値で動作しているかを知る必要はありません。
編集とインスピレーション画像
現代の画像モデルは、入力として画像を使用することもできます。AI-School は以下を区別します:
- インスピレーション画像:スタイル、色、構図、対象への方向性を示す参照画像。
- 編集画像:モデルによって修正されるべき元画像。
この機能は Black Forest Labs および Stability AI には適用されません。これらの提供者では、AI-School がすべての元画像・インスピレーション・参照画像をブロックし、プライバシー制限付きのテキスト・ツー・イメージ生成のみが可能です。
編集モードでは、ユーザーはアスペクト比を選択しません。AI-School は手動の寸法やフォーマット設定を送信せず、元画像の寸法と比率を保持できるようにします。
プロンプト改善
直接的な画像生成時には、AI-School がプロンプトと自動設定を改善する追加の AI ステップを使用することがあります。このステップは現在のプロンプト、設定、最近のチャット履歴を参照します。明示的に選択された設定は優先されます。自動設定や空の設定は補足されることがあります。
Black Forest Labs および Stability AI の場合は、別個の技術データフローになります。元のプロンプトは受け取られず、控えめにサーバー側で組み立てられたプロンプトのみが使用されます。個人情報が除外されているかどうかの技術的な説明は こちら をご覧ください: 個人データを技術的に除外する方法.