Як генерувати зображення прямо в чаті Whizi

Коротка відповідь

Щоб згенерувати зображення в чаті Whizi, відкрийте вибір моделі, перемкніть його з режиму Text на Image & Video, оберіть Whizi Image, Nano Banana, Flux або Stable Diffusion і опишіть зображення. Генерація зображень входить у плани Pro (100 на місяць) та Powerhouse (500). Робіть ітерації в тому самому чаті, а потім завантажте результат.

Коротка відповідь

Відкрийте вибір моделі, перемкніть перемикач угорі з Text на Image & Video, оберіть модель зображень і опишіть картинку. Підказка в полі вводу змінюється на "Опишіть зображення, яке хочете згенерувати...", а результат надходить у ту саму розмову.

МодельДля чого вона
Whizi ImageСтворення будь-якого зображення; перший рядок у творчому виборі
Nano BananaРедагування прикріпленого фото
FluxЧіткий фотореалістичний арт
Stable DiffusionМодель зображень від Stability AI

Генерація зображень входить у план Pro, з лімітом 100 зображень на місячний період, і в план Powerhouse, з лімітом 500. Плани Free та Starter мають нульову квоту на зображення. Промпт для зображення може містити від 1 до 4000 символів, а згенеровані зображення зберігаються 30 днів, з кнопкою завантаження на кожному. Якщо генерація видає помилку замість результату, у тексті вказано причину: дивіться чому не вдалося згенерувати зображення.

Чому генерація в чаті відрізняється

Звичний робочий процес створення зображень, це окремий продукт, окрема підписка й окреме порожнє поле, яке нічого не знає про вашу поточну роботу. Генерація прямо в розмові змінює дві практичні речі.

По-перше, модель уже має контекст. Якщо ви щойно витратили двадцять повідомлень на розробку концепції кампанії, фраза "згенеруй головне зображення для цього" несе в собі весь цей контекст. Вам не доведеться переказувати бриф іншому інструменту.

По-друге, ви можете використати текстову модель, щоб написати промпт для зображення. Це прийом, який більшість людей упускає: попросіть Claude або GPT перетворити вашу приблизну ідею на правильно структурований промпт для зображення, а потім запустіть його. Мовні моделі значно краще пишуть промпти для зображень, ніж більшість людей, тому що формат добре відомий і вони бачили безліч прикладів.

Промпт: нехай текстова модель напише промпт для зображення

Напиши промпт для генерації зображення за такою ідеєю: [приблизна ідея]. Воно буде використане для [мета й розміщення]. Побудуй його так: суб'єкт, дія або стан, обстановка, освітлення, композиція та кадрування, носій чи об'єктив, кольорова обробка, настрій. Додай негативний список того, що не повинно з'являтися. Дай мені три варіанти, що відрізняються композицією, а не прикметниками.

Структура промпту, яка працює

Майже кожен вдалий промпт для зображення має ці самі сім частин приблизно в такому порядку. Пропущені частини модель заповнює за замовчуванням, і саме тому загальні промпти дають типові стокові зображення. Якщо ви пишете перший такий промпт, як створювати зображення за допомогою ШІ розповідає про це з нуля.

ЧастинаЩо вказатиНаслідок, якщо пропустити
Суб'єктКонкретна річ із важливою деталлюОтримаєте найзагальнішу версію іменника
Дія або станЩо вона робить або як розташованаСтатичність, позування, безжиттєвість
ОбстановкаДе, і скільки з неї видноПорожній або захаращений фон за замовчуванням
ОсвітленняНапрямок, якість, час добиПлоске, рівномірне, безхарактерне освітлення
КомпозиціяКут, відстань, розташування суб'єкта в кадріЩоразу центрований середній план
Носій чи об'єктивФотографія і фокусна відстань, або стиль ілюстраціїСхильність до глянцевого цифрового арту
Колір і настрійПалітра й відчуттяПеренасиченість, високий контраст

Приклад на практиці. Слабко: людина працює в офісі. Сильно: Жінка років п'ятдесяти переглядає друковані креслення за стоячим столом, пізнє пообіднє світло з вікна зліва від неї, знято трохи ззаду через плече на рівні очей, 50мм, приглушені зелені й теплі нейтральні тони, спокійна й неквапна атмосфера. Негативний список: стокова посмішка в камеру, захаращений стіл, видимі логотипи брендів, текст.

Негативний список важить більше, ніж здається. Більшість того, через що згенероване зображення виглядає згенерованим, це невеликий набір повторюваних артефактів, і назвавши їх, ви їх прибираєте: стокова посмішка, перенасиченість, текст, водяний знак, зайві пальці, симетрична корпоративна композиція.

Вибір моделі

  • Whizi Image для створення будь-якого зображення. Це власний генератор компанії і перший рядок у творчому виборі.
  • Nano Banana для редагування вже наявного у вас фото. Прикріпіть картинку й опишіть зміну; підказка в полі вводу перемикається з генерації на редагування, щойно прикріплено зображення.
  • Flux для чіткого фотореалістичного арту й усього, що має розташовуватись поряд зі справжньою фотографією.
  • Stable Diffusion, модель від Stability AI, як друга думка: вона винагороджує конкретну постановку промпту і дає інший вигляд із тих самих слів.

Ви можете перемикатися між ними в тому самому чаті, і це найшвидший спосіб відповісти на єдине важливе питання: запустіть той самий промпт через дві моделі й порівняйте результати поруч. Якість моделі сильно залежить від теми, і переможець у портретах часто не є переможцем в інтер'єрах чи плоскій ілюстрації.

Ітерації без ходіння по колу

Типова помилка, це регенерувати той самий промпт знову і знову, сподіваючись на кращий результат. Частину цього не уникнути, але більшість марних спроб трапляється через зміну кількох речей одразу і втрату розуміння, що саме допомогло.

  • Змінюйте одну змінну за спробу. Освітлення, або кадрування, або палітру. Не всі три одразу.
  • Фіксуйте словами те, що спрацювало. Коли зображення близьке до потрібного, опишіть у наступному промпті, що саме в ньому правильне, а не покладайтесь на те, що модель це пам'ятає.
  • Спершу виправляйте композицію, потім деталі. Правильні кадрування й світло на початку набагато ефективніші, ніж доопрацювання суб'єкта, який стоїть не в тій частині кадру.
  • Генеруйте одразу в потрібному співвідношенні сторін. Обрізання квадрата до широкого банера руйнує композицію, яку ви просили. Одразу вкажіть потрібне співвідношення.
  • Зберігайте промпти, які спрацювали. Вісім надійних промптів у фірмовому стилі, які можна вставити знову, цінніші за будь-яке окреме зображення, і саме їх повторне використання робить набір матеріалів схожим на єдиний набір.

Для редагування наявного зображення завантажте його й опишіть зміну. Це добре працює для коригування фону, освітлення й палітри, і гірше для точних структурних правок, для яких досі швидше скористатися справжнім редактором зображень.

Що моделі зображень усе ще роблять неправильно

Текст. Відтворений текст залишається найслабшою ділянкою в усіх моделей. Короткі слова іноді виходять правильно; заголовок, логотип чи підпис зазвичай ні. Генеруйте зображення без тексту й додавайте його у своєму дизайнерському інструменті.

Руки, кількість і дрібні повторювані деталі. Пальці, зуби, ніжки стільців і вікна будівлі, все це місця, де моделі втрачають лік. Наближайте перед використанням.

Точні просторові інструкції. "Рівно три предмети, червоний зліва" ненадійно. Компонуйте у своєму редакторі, якщо розташування справді важливе.

Узгодженість між зображеннями. Домогтися, щоб той самий персонаж чи продукт виглядав однаково в серії, складно. Детальні повторювані описи допомагають; ідентичні результати не гарантовані.

Щодо використання: перевіряйте свої права, перш ніж будь-що згенероване потрапить у платне розміщення, і будьте особливо обережні з усім, що нагадує реальну людину, впізнавану локацію чи характерний стиль живого митця. Умови постачальників різняться, і комерційна відповідальність лягає на того, хто публікує зображення.

Контрольний список
  • Попросіть текстову модель написати промпт для зображення з вашої приблизної ідеї
  • Включіть усі сім частин: суб'єкт, дія, обстановка, освітлення, композиція, носій, настрій
  • Додайте негативний список із назвами артефактів, яких ви не хочете бачити
  • Генеруйте одразу в тому співвідношенні сторін, яке справді використовуватимете
  • Змінюйте одну змінну за ітерацію
  • Запустіть той самий промпт через дві моделі й порівняйте
  • Додавайте текст у своєму дизайнерському інструменті, а не в моделі зображень
  • Зберігайте промпти, які спрацювали, як шаблони для повторного використання

Поширені запитання

Скільки зображень я можу згенерувати на місяць?

План Pro включає 100 генерацій зображень на місячний період, а Powerhouse, 500. Плани Free та Starter мають нульову квоту на зображення, тож Pro, найдешевший план із генерацією зображень. За тижневим циклом оплати квота дорівнює місячному показнику, поділеному на чотири, з округленням угору. Оскільки саме ітерації витрачають генерації, написання структурованого промпту заздалегідь (бажано за допомогою текстової моделі) помітно скорочує кількість спроб до придатного зображення.

Чи можу я редагувати наявне зображення?

Так. У режимі Image & Video прикріпіть фото й опишіть зміну; підказка в полі вводу перемикається з генерації на редагування, щойно прикріплено картинку, а Nano Banana, це модель, створена саме для редагування фото. Це добре працює для коригування фону, освітлення, палітри й стилю. Гірше працює для точних структурних правок, як-от переміщення об'єкта на певну відстань чи зміна тексту, для яких досі швидше скористатися звичайним редактором зображень.

Яку модель зображень мені варто використовувати?

Whizi Image для створення будь-якого зображення, Nano Banana для редагування прикріпленого фото, Flux для чіткого фотореалістичного арту, що розташовується поряд зі справжньою фотографією, і Stable Diffusion для іншого вигляду з того самого промпту. Оскільки якість моделі сильно залежить від теми, найшвидший спосіб визначитися, це запустити той самий промпт через дві з них у тому самому чаті й порівняти результати.

Чому текст на моєму зображенні виходить неправильним?

Відтворений текст досі найслабша ділянка в усіх моделей зображень, і жоден промпт не виправляє це надійно. Короткі окремі слова іноді виходять правильно; заголовки, логотипи й підписи зазвичай ні. Генеруйте зображення без тексту й додавайте типографіку у своєму дизайнерському інструменті, що також дає вам правильний шрифт і належний контроль над розташуванням.

Чи потрібна мені окрема підписка на зображення поряд із Whizi?

Для більшості роботи з кампаніями, контентом і концепціями, ні. Генерація зображень входить у план Pro (100 на місяць) та Powerhouse (500), що покриває той самий обсяг, який покривала б окрема підписка для типового маркетингового й соціального контенту. Окремий інструмент усе ще має сенс для команд із дуже специфічними стилістичними вимогами або великою наявною бібліотекою промптів, яку вони не хочуть перебудовувати.