Короткий ответ
Откройте селектор моделей, переключите переключатель вверху с режима "Текст" на "Изображение и видео", выберите модель для изображений и опишите картинку. Подсказка в поле ввода меняется на "Опишите изображение, которое хотите сгенерировать...", а результат появляется прямо в том же разговоре.
| Модель | Для чего нужна |
|---|---|
| Whizi Image | Создание любого изображения; первая строка в творческом селекторе |
| Nano Banana | Редактирование прикреплённого фото |
| Flux | Чёткое фотореалистичное изображение |
| Stable Diffusion | Модель изображений от Stability AI |
Генерация изображений включена в тариф Pro, 100 изображений за месячный период, и в Powerhouse, 500 изображений. У тарифов Free и Starter лимит на изображения равен нулю. Промпт для изображения может содержать от 1 до 4000 символов, а сгенерированные изображения хранятся 30 дней, у каждого есть элемент управления для скачивания. Если генерация завершается ошибкой вместо результата, текст ошибки указывает причину; см. если не удалось сгенерировать изображение.
Чем генерация в чате отличается от обычной
Обычный процесс работы с изображениями: это отдельный продукт, отдельная подписка и отдельное пустое поле, которое ничего не знает о том, чем вы занимаетесь. Генерация прямо в разговоре меняет две практические вещи.
Во-первых, у модели уже есть контекст. Если вы только что потратили двадцать сообщений на разработку концепции кампании, фраза "сгенерируй для этого главное изображение" уже несёт в себе весь этот контекст. Вам не нужно заново пересказывать бриф другому инструменту.
Во-вторых, вы можете использовать текстовую модель, чтобы написать промпт для изображения. Это тот приём, который упускает большинство людей: попросите Claude или GPT превратить вашу черновую идею в правильно структурированный промпт для изображения, а затем запустите его. Языковые модели значительно лучше людей пишут промпты для изображений, потому что формат хорошо известен и модели видели множество его примеров.
Промпт: пусть текстовая модель напишет промпт для изображения
Напиши промпт для генерации изображения по идее: [черновая идея]. Он будет использован для [цель и место размещения]. Структурируй его так: субъект, действие или состояние, обстановка, освещение, композиция и кадрирование, техника или объектив, цветовое решение, настроение. Добавь негативный список того, чего быть не должно. Дай мне три варианта, которые отличаются композицией, а не прилагательными.
Структура промпта, которая работает
Почти в каждом хорошем промпте для изображения присутствуют одни и те же семь частей примерно в таком порядке. Пропущенные части модель заполняет своими значениями по умолчанию, и именно эти значения по умолчанию делают из общих промптов типичные стоковые изображения. Если вы пишете такой промпт впервые, как создавать изображения с помощью ИИ разбирает эту тему с самого начала.
| Часть | Что указать | Эффект при пропуске |
|---|---|---|
| Субъект | Конкретный объект с важной деталью | Получите самую общую версию существительного |
| Действие или состояние | Что он делает или как расположен | Статично, позирует, безжизненно |
| Обстановка | Где, и сколько видно окружения | Пустой или захламлённый фон по умолчанию |
| Освещение | Направление, качество, время суток | Плоское, равномерное, без характера |
| Композиция | Угол, расстояние, положение субъекта в кадре | Центрированный средний план каждый раз |
| Техника или объектив | Фото и фокусное расстояние, или стиль иллюстрации | По умолчанию гладкая цифровая графика |
| Цвет и настроение | Палитра и ощущение | Перенасыщенно, высокий контраст |
Разобранный пример. Слабо: человек, работающий в офисе. Сильно: Женщина лет пятидесяти рассматривает распечатанные чертежи за столом для работы стоя, послеполуденный свет из окна слева от неё, снято чуть из-за плеча на уровне глаз, 50мм, приглушённые зелёные и тёплые нейтральные тона, спокойно и неспешно. Негатив: стоковая улыбка в камеру, захламлённый стол, видимые логотипы брендов, текст.
Негативный список важнее, чем принято думать. Большую часть того, что выдаёт сгенерированное изображение как сгенерированное, составляет небольшой набор повторяющихся артефактов, и их простое перечисление устраняет их: стоковая улыбка, перенасыщенность, текст, водяной знак, лишние пальцы, симметричная корпоративная композиция.
Выбор модели
- Whizi Image для создания любого изображения. Это собственный генератор Whizi и первая строка в творческом селекторе.
- Nano Banana для редактирования уже имеющегося у вас фото. Прикрепите картинку и опишите изменение; подсказка в поле ввода переключается с генерации на редактирование, как только прикреплено изображение.
- Flux для чёткого фотореалистичного изображения и всего, что должно соседствовать с настоящей фотографией.
- Stable Diffusion, модель от Stability AI, как второе мнение: она хорошо отвечает на конкретные промпты и даёт другой вид при тех же словах.
Вы можете переключаться между ними прямо в одном чате, и это самый быстрый способ ответить на единственный по-настоящему важный вопрос: запустить один и тот же промпт в двух моделях и сравнить результаты рядом. Качество моделей сильно различается в зависимости от сюжета, и лидер в портретах часто не является лидером в интерьерах или в плоской иллюстрации.
Как дорабатывать, не ходя по кругу
Обычная ошибка: раз за разом перегенерировать один и тот же промпт в надежде на удачный результат. Отчасти это неизбежно, но большая часть впустую потраченных попыток возникает из-за изменения нескольких вещей сразу и потери понимания, что именно помогло.
- Меняйте по одной переменной за попытку. Освещение, или кадрирование, или палитру. Не всё три сразу.
- Фиксируйте словами то, что сработало. Когда изображение близко к нужному, опишите в следующем промпте, что именно в нём правильно, а не полагайтесь на то, что модель это помнит.
- Сначала исправляйте композицию, потом детали. Правильно настроить кадрирование и свет сначала гораздо эффективнее, чем доводить до совершенства субъект, который стоит не в той части кадра.
- Генерируйте сразу в нужном соотношении сторон. Обрезка квадрата в широкий баннер разрушает запрошенную вами композицию. Заранее указывайте то соотношение сторон, которое реально нужно.
- Сохраняйте промпты, которые сработали. Восемь надёжных промптов в фирменном стиле, которые можно вставлять снова, ценнее любого отдельного изображения, и именно повторное их использование делает набор материалов похожим на единый набор.
Для редактирования уже имеющегося изображения загрузите его и опишите изменение. Это хорошо работает для правки фона, освещения и палитры, и хуже для точных структурных изменений, которые всё ещё быстрее делать в настоящем редакторе изображений.
С чем модели изображений всё ещё справляются плохо
Текст. Отрисованные слова остаются самым слабым местом во всех моделях. Короткие слова иногда получаются; заголовок, логотип или подпись обычно нет. Генерируйте изображение без текста и добавляйте текст в своём дизайнерском инструменте.
Руки, количество и мелкие повторяющиеся детали. Пальцы, зубы, ножки стульев и окна здания: это всё места, где модели теряют счёт. Приближайте изображение перед тем, как его использовать.
Точные пространственные инструкции. "Ровно три предмета, красный слева" работает ненадёжно. Компонуйте в своём редакторе, если расположение действительно важно.
Согласованность между изображениями. Добиться, чтобы один и тот же персонаж или продукт выглядел одинаково в серии, сложно. Подробные, повторяющиеся описания помогают; идентичный результат не гарантирован.
Об использовании: проверяйте свои права, прежде чем что-либо сгенерированное попадёт в платное размещение, и будьте особенно осторожны со всем, что напоминает реального человека, узнаваемое место или характерный стиль живущего художника. Условия у разных провайдеров различаются, а коммерческая ответственность лежит на том, кто публикует изображение.
- Попросите текстовую модель написать промпт для изображения по вашей черновой идее
- Включите все семь частей: субъект, действие, обстановку, освещение, композицию, технику, настроение
- Добавьте негативный список с названием артефактов, которых быть не должно
- Генерируйте сразу в том соотношении сторон, которое реально будете использовать
- Меняйте одну переменную за одну итерацию
- Запустите один и тот же промпт в двух моделях и сравните
- Добавляйте текст в дизайнерском инструменте, а не в модели изображений
- Сохраняйте сработавшие промпты как многоразовые шаблоны
Частые вопросы
Сколько изображений я могу сгенерировать в месяц?
Тариф Pro включает 100 генераций изображений за месячный период, а Powerhouse включает 500. У тарифов Free и Starter лимит на изображения равен нулю, поэтому Pro является самым доступным тарифом с генерацией изображений. При недельном цикле оплаты лимит равен месячному числу, делённому на четыре, с округлением вверх. Поскольку именно доработка расходует генерации, написание структурированного промпта заранее (в идеале с помощью текстовой модели) заметно сокращает число попыток, нужных для пригодного изображения.
Могу ли я отредактировать уже существующее изображение?
Да. В режиме "Изображение и видео" прикрепите фото и опишите изменение; подсказка в поле ввода переключается с генерации на редактирование, как только прикреплена картинка, а Nano Banana это модель, созданная именно для редактирования фото. Это хорошо работает для правки фона, освещения, палитры и стиля. Хуже работает для точных структурных изменений, таких как перемещение объекта на конкретное расстояние или изменение текста, которые всё ещё быстрее делать в обычном редакторе изображений.
Какую модель изображений использовать?
Whizi Image для создания любого изображения, Nano Banana для редактирования прикреплённого фото, Flux для чёткого фотореалистичного изображения, которое соседствует с настоящей фотографией, и Stable Diffusion для другого вида при том же промпте. Поскольку качество моделей сильно различается в зависимости от сюжета, самый быстрый способ выбрать: запустить один и тот же промпт в двух из них в одном чате и сравнить результаты.
Почему текст на моём изображении выходит неправильно?
Отрисованный текст по-прежнему остаётся самым слабым местом во всех моделях изображений, и никакой промпт не решает это надёжно. Короткие отдельные слова иногда получаются; заголовки, логотипы и подписи обычно нет. Генерируйте изображение без текста и добавляйте типографику в своём дизайнерском инструменте, что также даёт правильный шрифт и полноценный контроль над размещением.
Нужна ли мне отдельная подписка на изображения помимо Whizi?
Для большинства работ над кампаниями, контентом и концепциями, нет. Генерация изображений включена в Pro (100 в месяц) и Powerhouse (500), что покрывает те же задачи, что и отдельная подписка, для типичного маркетингового и социального контента. Отдельный инструмент всё ещё имеет смысл для команд с очень специфичными стилистическими требованиями или большой существующей библиотекой промптов, которую они не хотят пересобирать.