Зображувальні моделі
AI-School використовує центральний каталог моделей для текст-у-образи. Які моделі видно, залежить від налаштувань провайдера середовища.
Поточний каталог
| Постачальник | Ефективність за витратами | Висока якість |
|---|---|---|
| OpenAI | GPT Image 1 mini | GPT Image 2 |
| Nano Banana | Nano Banana 2 | |
| Black Forest Labs | FLUX.2 Flex | FLUX.2 Pro Preview |
Nano Banana — це назва, яку AI-School використовує для моделей Gemini Flash Image. Європейські зображувальні моделі постачаються через Black Forest Labs.
Для чого який вибір моделі?
| Модель | Підходить для |
|---|---|
| GPT Image 1 mini | Швидке створення концепт-образів, ескізи, тестування та ітерація за нижчою ціною. |
| GPT Image 2 | Чисті кінцеві зображення, чіткіший текст у зображеннях та більший контроль над обробкою. |
| Nano Banana | Швидкі та доступні зображення, багато варіантів та прості редагування. |
| Nano Banana 2 | Швидка генерація образів та інтерактивне редагування з Google. |
| FLUX.2 Flex | Гнучка європейська генерація тексту-у-зображення для нових, загальних образів. |
| FLUX.2 Pro Preview | Високоякісна європейська генерація зображень для реалістичних зображень та узгодженого стилю. |
Центральні формати
AI-School відображає користувачам чотири загальні формати:
| Вибір | Значення |
|---|---|
| Автоматично | AI-School обирає найкраще підходящу установку для вибраної моделі. |
| Квадрат | Квадратне зображення. |
| Ландшафт | Широке зображення, наприклад для презентацій. |
| Портрет | Вертикальне зображення, наприклад для постерів. |
У центральному каталозі моделей зафіксовано, як ці вибори перекладаються на відповідні технічні налаштування для кожного провайдера. Тому користувачу не обов’язково знати, чи працює провайдер з 16:9, 1536x1024, шириною/висотою чи іншою величиною.
Редагування та інспіраційні зображення
Сучасні зображувальні моделі також можуть використовувати зображення як вхід. AI-School розрізняє:
- Зображення-натхнення: зразки, які надають напрям стиль, колір, композицію або тему.
- Редаговані зображення: вихідне зображення, яке має бути адаптоване моделлю.
Ці можливості недоступні для Black Forest Labs та Stability AI. У цих постачальників AI-School блокує всі вихідні, натхненні та референсні зображення, та доступна лише приватно-обмежена текст-у-зображення генерація.
У режимі редагування користувач не вибирає співвідношення сторін. AI-School не надсилає вручну розміри чи настройки формату, щоб модель могла зберегти розміри та пропорції вихідного зображення.
Покращення підказки
Під час прямої генерації зображення AI-School може використати додатковий крок штучного інтелекту для покращення підказки та автоматичних налаштувань. Цей крок враховує актуальну підказку, налаштування та нещодавню історію чатів. Явно обрані налаштування залишаються пріоритетом; автоматичні або порожні налаштування можуть доповнюватися.
Для Black Forest Labs та Stability AI діє окрема лінія технічних даних. Вони не отримують початкову підказку, а лише серверно зібрану підказку з контрольованого каталогу. Дивіться, як персональні дані технічно ізолюються.