Как генерировать изображения прямо в чате Whizi

Краткий ответ

Чтобы сгенерировать изображение в чате Whizi, откройте селектор моделей, переключите его с режима "Текст" на "Изображение и видео", выберите Whizi Image, Nano Banana, Flux или Stable Diffusion и опишите нужную картинку. Генерация изображений включена в тарифы Pro (100 в месяц) и Powerhouse (500). Дорабатывайте результат в том же чате, затем скачайте готовое изображение.

Короткий ответ

Откройте селектор моделей, переключите переключатель вверху с режима "Текст" на "Изображение и видео", выберите модель для изображений и опишите картинку. Подсказка в поле ввода меняется на "Опишите изображение, которое хотите сгенерировать...", а результат появляется прямо в том же разговоре.

МодельДля чего нужна
Whizi ImageСоздание любого изображения; первая строка в творческом селекторе
Nano BananaРедактирование прикреплённого фото
FluxЧёткое фотореалистичное изображение
Stable DiffusionМодель изображений от Stability AI

Генерация изображений включена в тариф Pro, 100 изображений за месячный период, и в Powerhouse, 500 изображений. У тарифов Free и Starter лимит на изображения равен нулю. Промпт для изображения может содержать от 1 до 4000 символов, а сгенерированные изображения хранятся 30 дней, у каждого есть элемент управления для скачивания. Если генерация завершается ошибкой вместо результата, текст ошибки указывает причину; см. если не удалось сгенерировать изображение.

Чем генерация в чате отличается от обычной

Обычный процесс работы с изображениями: это отдельный продукт, отдельная подписка и отдельное пустое поле, которое ничего не знает о том, чем вы занимаетесь. Генерация прямо в разговоре меняет две практические вещи.

Во-первых, у модели уже есть контекст. Если вы только что потратили двадцать сообщений на разработку концепции кампании, фраза "сгенерируй для этого главное изображение" уже несёт в себе весь этот контекст. Вам не нужно заново пересказывать бриф другому инструменту.

Во-вторых, вы можете использовать текстовую модель, чтобы написать промпт для изображения. Это тот приём, который упускает большинство людей: попросите Claude или GPT превратить вашу черновую идею в правильно структурированный промпт для изображения, а затем запустите его. Языковые модели значительно лучше людей пишут промпты для изображений, потому что формат хорошо известен и модели видели множество его примеров.

Промпт: пусть текстовая модель напишет промпт для изображения

Напиши промпт для генерации изображения по идее: [черновая идея]. Он будет использован для [цель и место размещения]. Структурируй его так: субъект, действие или состояние, обстановка, освещение, композиция и кадрирование, техника или объектив, цветовое решение, настроение. Добавь негативный список того, чего быть не должно. Дай мне три варианта, которые отличаются композицией, а не прилагательными.

Структура промпта, которая работает

Почти в каждом хорошем промпте для изображения присутствуют одни и те же семь частей примерно в таком порядке. Пропущенные части модель заполняет своими значениями по умолчанию, и именно эти значения по умолчанию делают из общих промптов типичные стоковые изображения. Если вы пишете такой промпт впервые, как создавать изображения с помощью ИИ разбирает эту тему с самого начала.

ЧастьЧто указатьЭффект при пропуске
СубъектКонкретный объект с важной детальюПолучите самую общую версию существительного
Действие или состояниеЧто он делает или как расположенСтатично, позирует, безжизненно
ОбстановкаГде, и сколько видно окруженияПустой или захламлённый фон по умолчанию
ОсвещениеНаправление, качество, время сутокПлоское, равномерное, без характера
КомпозицияУгол, расстояние, положение субъекта в кадреЦентрированный средний план каждый раз
Техника или объективФото и фокусное расстояние, или стиль иллюстрацииПо умолчанию гладкая цифровая графика
Цвет и настроениеПалитра и ощущениеПеренасыщенно, высокий контраст

Разобранный пример. Слабо: человек, работающий в офисе. Сильно: Женщина лет пятидесяти рассматривает распечатанные чертежи за столом для работы стоя, послеполуденный свет из окна слева от неё, снято чуть из-за плеча на уровне глаз, 50мм, приглушённые зелёные и тёплые нейтральные тона, спокойно и неспешно. Негатив: стоковая улыбка в камеру, захламлённый стол, видимые логотипы брендов, текст.

Негативный список важнее, чем принято думать. Большую часть того, что выдаёт сгенерированное изображение как сгенерированное, составляет небольшой набор повторяющихся артефактов, и их простое перечисление устраняет их: стоковая улыбка, перенасыщенность, текст, водяной знак, лишние пальцы, симметричная корпоративная композиция.

Выбор модели

  • Whizi Image для создания любого изображения. Это собственный генератор Whizi и первая строка в творческом селекторе.
  • Nano Banana для редактирования уже имеющегося у вас фото. Прикрепите картинку и опишите изменение; подсказка в поле ввода переключается с генерации на редактирование, как только прикреплено изображение.
  • Flux для чёткого фотореалистичного изображения и всего, что должно соседствовать с настоящей фотографией.
  • Stable Diffusion, модель от Stability AI, как второе мнение: она хорошо отвечает на конкретные промпты и даёт другой вид при тех же словах.

Вы можете переключаться между ними прямо в одном чате, и это самый быстрый способ ответить на единственный по-настоящему важный вопрос: запустить один и тот же промпт в двух моделях и сравнить результаты рядом. Качество моделей сильно различается в зависимости от сюжета, и лидер в портретах часто не является лидером в интерьерах или в плоской иллюстрации.

Как дорабатывать, не ходя по кругу

Обычная ошибка: раз за разом перегенерировать один и тот же промпт в надежде на удачный результат. Отчасти это неизбежно, но большая часть впустую потраченных попыток возникает из-за изменения нескольких вещей сразу и потери понимания, что именно помогло.

  • Меняйте по одной переменной за попытку. Освещение, или кадрирование, или палитру. Не всё три сразу.
  • Фиксируйте словами то, что сработало. Когда изображение близко к нужному, опишите в следующем промпте, что именно в нём правильно, а не полагайтесь на то, что модель это помнит.
  • Сначала исправляйте композицию, потом детали. Правильно настроить кадрирование и свет сначала гораздо эффективнее, чем доводить до совершенства субъект, который стоит не в той части кадра.
  • Генерируйте сразу в нужном соотношении сторон. Обрезка квадрата в широкий баннер разрушает запрошенную вами композицию. Заранее указывайте то соотношение сторон, которое реально нужно.
  • Сохраняйте промпты, которые сработали. Восемь надёжных промптов в фирменном стиле, которые можно вставлять снова, ценнее любого отдельного изображения, и именно повторное их использование делает набор материалов похожим на единый набор.

Для редактирования уже имеющегося изображения загрузите его и опишите изменение. Это хорошо работает для правки фона, освещения и палитры, и хуже для точных структурных изменений, которые всё ещё быстрее делать в настоящем редакторе изображений.

С чем модели изображений всё ещё справляются плохо

Текст. Отрисованные слова остаются самым слабым местом во всех моделях. Короткие слова иногда получаются; заголовок, логотип или подпись обычно нет. Генерируйте изображение без текста и добавляйте текст в своём дизайнерском инструменте.

Руки, количество и мелкие повторяющиеся детали. Пальцы, зубы, ножки стульев и окна здания: это всё места, где модели теряют счёт. Приближайте изображение перед тем, как его использовать.

Точные пространственные инструкции. "Ровно три предмета, красный слева" работает ненадёжно. Компонуйте в своём редакторе, если расположение действительно важно.

Согласованность между изображениями. Добиться, чтобы один и тот же персонаж или продукт выглядел одинаково в серии, сложно. Подробные, повторяющиеся описания помогают; идентичный результат не гарантирован.

Об использовании: проверяйте свои права, прежде чем что-либо сгенерированное попадёт в платное размещение, и будьте особенно осторожны со всем, что напоминает реального человека, узнаваемое место или характерный стиль живущего художника. Условия у разных провайдеров различаются, а коммерческая ответственность лежит на том, кто публикует изображение.

Чек-лист
  • Попросите текстовую модель написать промпт для изображения по вашей черновой идее
  • Включите все семь частей: субъект, действие, обстановку, освещение, композицию, технику, настроение
  • Добавьте негативный список с названием артефактов, которых быть не должно
  • Генерируйте сразу в том соотношении сторон, которое реально будете использовать
  • Меняйте одну переменную за одну итерацию
  • Запустите один и тот же промпт в двух моделях и сравните
  • Добавляйте текст в дизайнерском инструменте, а не в модели изображений
  • Сохраняйте сработавшие промпты как многоразовые шаблоны

Частые вопросы

Сколько изображений я могу сгенерировать в месяц?

Тариф Pro включает 100 генераций изображений за месячный период, а Powerhouse включает 500. У тарифов Free и Starter лимит на изображения равен нулю, поэтому Pro является самым доступным тарифом с генерацией изображений. При недельном цикле оплаты лимит равен месячному числу, делённому на четыре, с округлением вверх. Поскольку именно доработка расходует генерации, написание структурированного промпта заранее (в идеале с помощью текстовой модели) заметно сокращает число попыток, нужных для пригодного изображения.

Могу ли я отредактировать уже существующее изображение?

Да. В режиме "Изображение и видео" прикрепите фото и опишите изменение; подсказка в поле ввода переключается с генерации на редактирование, как только прикреплена картинка, а Nano Banana это модель, созданная именно для редактирования фото. Это хорошо работает для правки фона, освещения, палитры и стиля. Хуже работает для точных структурных изменений, таких как перемещение объекта на конкретное расстояние или изменение текста, которые всё ещё быстрее делать в обычном редакторе изображений.

Какую модель изображений использовать?

Whizi Image для создания любого изображения, Nano Banana для редактирования прикреплённого фото, Flux для чёткого фотореалистичного изображения, которое соседствует с настоящей фотографией, и Stable Diffusion для другого вида при том же промпте. Поскольку качество моделей сильно различается в зависимости от сюжета, самый быстрый способ выбрать: запустить один и тот же промпт в двух из них в одном чате и сравнить результаты.

Почему текст на моём изображении выходит неправильно?

Отрисованный текст по-прежнему остаётся самым слабым местом во всех моделях изображений, и никакой промпт не решает это надёжно. Короткие отдельные слова иногда получаются; заголовки, логотипы и подписи обычно нет. Генерируйте изображение без текста и добавляйте типографику в своём дизайнерском инструменте, что также даёт правильный шрифт и полноценный контроль над размещением.

Нужна ли мне отдельная подписка на изображения помимо Whizi?

Для большинства работ над кампаниями, контентом и концепциями, нет. Генерация изображений включена в Pro (100 в месяц) и Powerhouse (500), что покрывает те же задачи, что и отдельная подписка, для типичного маркетингового и социального контента. Отдельный инструмент всё ещё имеет смысл для команд с очень специфичными стилистическими требованиями или большой существующей библиотекой промптов, которую они не хотят пересобирать.