Stručná odpověď
Otevřete výběr modelu, přepněte přepínač nahoře z Text na Obrázek a video, zvolte obrazový model a popište obrázek. Nápověda v okně pro psaní se změní na "Popište obrázek, který chcete vygenerovat..." a výsledek se objeví přímo v téže konverzaci.
| Model | K čemu slouží |
|---|---|
| Whizi Image | Vytváření jakéhokoli obrázku; první řádek v tvůrčím výběru |
| Nano Banana | Úprava fotky, kterou přiložíte |
| Flux | Ostré fotorealistické umění |
| Stable Diffusion | Obrazový model společnosti Stability AI |
Generování obrázků je součástí plánu Pro, a to v počtu 100 obrázků za měsíční období, a plánu Powerhouse s počtem 500. Účty Free a Starter mají limit obrázků nulový. Prompt pro obrázek může mít 1 až 4 000 znaků a vygenerované obrázky se uchovávají 30 dní, u každého z nich je tlačítko ke stažení. Pokud generování skončí chybou místo výsledku, text chyby uvádí příčinu; viz selhalo generování obrázku.
Proč je generování v chatu jiné
Běžný postup pro obrázky je samostatný produkt, samostatné předplatné a samostatné prázdné okno, které nic neví o tom, na čem právě pracujete. Generování přímo v konverzaci mění dvě praktické věci.
Za prvé, model už má kontext. Pokud jste právě strávili dvacet zpráv rozvíjením konceptu kampaně, věta "vygeneruj k tomu hlavní obrázek" v sobě nese vše. Nemusíte brief znovu popisovat jinému nástroji.
Za druhé, textový model můžete použít k napsání obrazového promptu. Toto je trik, který většina lidí přehlíží: požádejte Claude nebo GPT, aby váš hrubý nápad přeměnil na řádně strukturovaný obrazový prompt, a poté jej použijte. Jazykové modely píší obrazové prompty výrazně lépe než většina lidí, protože formát je dobře známý a modely viděly velké množství jeho příkladů.
Prompt: nechte textový model napsat obrazový prompt
Napiš prompt pro generování obrázku pro: [hrubý nápad]. Bude použit pro [účel a umístění]. Strukturuj ho jako: předmět, akce nebo stav, prostředí, osvětlení, kompozice a rámování, médium nebo objektiv, barevné ladění, nálada. Přidej negativní seznam toho, co se nesmí objevit. Dej mi tři varianty, které se liší kompozicí, nikoli přídavnými jmény.
Struktura promptu, která funguje
Téměř každý dobrý obrazový prompt má stejných sedm částí, zhruba v tomto pořadí. Chybějící části model doplní svými výchozími hodnotami, a právě proto obecné prompty vytvářejí obecné stock obrázky. Pokud takový prompt píšete poprvé, jak vytvářet AI obrázky probírá totéž od základu.
| Část | Co uvést | Efekt při vynechání |
|---|---|---|
| Předmět | Konkrétní věc s detailem, který je důležitý | Získáte nejobecnější verzi podstatného jména |
| Akce nebo stav | Co dělá nebo jak stojí | Statický, pózovaný, nevýrazný výsledek |
| Prostředí | Kde a jak velká jeho část je vidět | Prázdné nebo přeplněné výchozí pozadí |
| Osvětlení | Směr, kvalita, denní doba | Ploché, rovnoměrně osvětlené, bez charakteru |
| Kompozice | Úhel, vzdálenost, umístění předmětu v záběru | Vždy vystředěný polodetail |
| Médium nebo objektiv | Fotografie a ohnisková vzdálenost, nebo styl ilustrace | Sklon k lesklému digitálnímu umění |
| Barva a nálada | Paleta a pocit | Přesycené barvy, vysoký kontrast |
Ukázkový příklad. Slabé: člověk pracující v kanceláři. Silné: Žena kolem padesáti let prohlíží vytištěné výkresy u stojícího stolu, pozdně odpolední světlo od okna z její levé strany, snímek zpoza jejího ramene v úrovni očí, 50mm, ztlumené zelené a teplé neutrální tóny, klidná a nespěchající atmosféra. Negativní: úsměv jako ze stockové fotky, přeplněný stůl, viditelná loga značek, text.
Negativní seznam je důležitější, než lidé čekají. Většinu toho, díky čemu vygenerované obrázky vypadají vygenerovaně, tvoří malá skupina opakujících se artefaktů, a pojmenováním je odstraníte: úsměv jako ze stockové fotky, přesycené barvy, text, vodoznak, přebývající prsty, symetrická korporátní kompozice.
Výběr modelu
- Whizi Image pro vytváření jakéhokoli obrázku. Je to hlavní generátor a první řádek v tvůrčím výběru.
- Nano Banana pro úpravu fotky, kterou už máte. Přiložte snímek a popište změnu; jakmile je obrázek přiložen, nápověda v okně pro psaní se přepne z generování na úpravu.
- Flux pro ostré fotorealistické umění a vše, co má stát vedle skutečné fotografie.
- Stable Diffusion, model společnosti Stability AI, jako druhý názor: odměňuje konkrétní zadání a ze stejných slov vytvoří jiný vzhled.
Mezi modely můžete přepínat v rámci stejného chatu, což je nejrychlejší způsob, jak odpovědět na jedinou důležitou otázku: pusťte stejný prompt přes dva modely a porovnejte je vedle sebe. Kvalita modelů se podle tématu velmi liší, a vítěz u portrétů často není vítězem u interiérů nebo plošné ilustrace.
Jak upravovat bez zacyklení
Nejčastější chybou je opakované generování stejného promptu v naději na lepší výsledek. Část toho je nevyhnutelná, ale většina promarněných pokusů vzniká tím, že měníte několik věcí najednou a ztratíte přehled o tom, co pomohlo.
- Měňte jednu proměnnou na pokus. Světlo, nebo rámování, nebo paletu. Ne všechny tři najednou.
- To, co fungovalo, popište slovy. Když je obrázek blízko cíli, popište v dalším promptu, co je na něm správně, místo abyste předpokládali, že si to model pamatuje.
- Nejdřív opravte kompozici, pak detail. Správné rámování a světlo hned na začátku je mnohem efektivnější než dolaďovat předmět, který je ve špatné části záběru.
- Generujte hned ve finálním poměru stran. Přiřezáním čtverce na širokou reklamní plochu přijdete o kompozici, o kterou jste žádali. Poměr, který skutečně potřebujete, žádejte hned na začátku.
- Ukládejte prompty, které fungovaly. Osm spolehlivých promptů ve firemním stylu, které lze znovu vložit, má větší hodnotu než jakýkoli jednotlivý obrázek, a jejich opětovné použití je to, díky čemu sada assetů vypadá jako sada.
Pro úpravu obrázku, který už máte, jej nahrajte a popište změnu. To funguje dobře u úprav pozadí, světla a palety, hůře u přesných strukturálních úprav, které jsou stále rychlejší ve skutečném editoru obrázků.
Co obrazovým modelům stále nejde
Text. Vykreslená slova zůstávají nejslabší stránkou u všech modelů. Krátká slova občas vyjdou; nadpis, logo nebo popisek většinou ne. Vygenerujte obrázek bez textu a typografii doplňte ve svém designérském nástroji.
Ruce, počty a malé opakující se detaily. Prsty, zuby, nohy židlí a okna budovy jsou místa, kde modely ztrácejí přehled o počtu. Před použitím si vše zvětšete.
Přesné prostorové instrukce. "Přesně tři předměty, ten červený vlevo" je nespolehlivé. Pokud na uspořádání skutečně záleží, poskládejte jej ve svém editoru.
Konzistence mezi obrázky. Dosáhnout toho, aby stejná postava nebo produkt vypadaly v sérii identicky, je obtížné. Pomáhají podrobné, opakované popisy; identické výsledky ale nejsou zaručené.
K využití: než jakýkoli vygenerovaný obrázek zařadíte do placeného umístění, ověřte si práva, a mimořádnou opatrnost věnujte čemukoli, co připomíná skutečnou osobu, rozpoznatelné místo nebo výrazný styl spojený s žijícím umělcem. Podmínky poskytovatelů se liší a komerční riziko nese ten, kdo obrázek publikuje.
- Požádejte textový model, aby z vašeho hrubého nápadu napsal obrazový prompt
- Zahrňte všech sedm částí: předmět, akci, prostředí, osvětlení, kompozici, médium, náladu
- Přidejte negativní seznam s artefakty, které nikdy nechcete
- Generujte v poměru stran, který skutečně použijete
- Měňte jednu proměnnou na jednu úpravu
- Pusťte stejný prompt přes dva modely a porovnejte je
- Text doplňujte ve svém designérském nástroji, ne v obrazovém modelu
- Ukládejte prompty, které fungovaly, jako opakovaně použitelné šablony
Časté dotazy
Kolik obrázků mohu vygenerovat za měsíc?
Plán Pro zahrnuje 100 generování obrázků za měsíční období a Powerhouse zahrnuje 500. Účty Free a Starter mají limit obrázků nulový, takže Pro je nejnižší plán s generováním obrázků. U týdenní fakturace se limit rovná měsíčnímu číslu vydělenému čtyřmi, zaokrouhlenému nahoru. Protože právě úpravy spotřebovávají generování nejvíc, napsání strukturovaného promptu předem (ideálně pomocí textového modelu) výrazně snižuje počet pokusů potřebných k použitelnému obrázku.
Mohu upravit existující obrázek?
Ano. V režimu Obrázek a video přiložte fotku a popište změnu; jakmile je obrázek přiložen, nápověda v okně pro psaní se přepne z generování na úpravu, a Nano Banana je model postavený přímo pro úpravy fotek. To funguje dobře u úprav pozadí, světla, palety a stylu. Hůře funguje u přesných strukturálních úprav, jako je posunutí objektu o konkrétní vzdálenost nebo změna textu, které jsou stále rychlejší v běžném editoru obrázků.
Který obrazový model mám použít?
Whizi Image pro vytváření jakéhokoli obrázku, Nano Banana pro úpravu fotky, kterou přiložíte, Flux pro ostré fotorealistické umění, které stojí vedle skutečné fotografie, a Stable Diffusion pro jiný vzhled ze stejného promptu. Protože kvalita modelů se podle tématu hodně liší, nejrychlejší způsob rozhodnutí je pustit stejný prompt přes dva z nich ve stejném chatu a porovnat výsledky.
Proč mi v obrázku vychází text špatně?
Vykreslený text je stále nejslabší stránkou u všech obrazových modelů a žádný prompt to spolehlivě nevyřeší. Krátká jednotlivá slova občas fungují; nadpisy, loga a popisky většinou ne. Vygenerujte obrázek bez textu a typografii přidejte ve svém designérském nástroji, což vám navíc dá správné písmo a plnou kontrolu nad umístěním.
Potřebuji vedle Whizi ještě samostatné předplatné na obrázky?
U většiny práce na kampaních, obsahu a konceptech ne. Generování obrázků je součástí plánů Pro (100 měsíčně) a Powerhouse (500), což pokrývá totéž, co by pokrylo samostatné předplatné pro běžný marketingový a sociální výstup. Vyhrazený nástroj má smysl pro týmy s velmi specifickými stylistickými požadavky nebo rozsáhlou existující knihovnou promptů, kterou nechtějí znovu budovat.