Jak vytvářet AI obrázky pro začátečníky (jednoduchý návod)

Krátká odpověď

Chcete-li generovat AI obrázky, napíšete popis a objeví se obrázek. Dobrý výsledek závisí na tom, zda pojmenujete šest věcí: předmět, prostředí, osvětlení, kompozici, styl a náladu nebo barvu. Cokoli vynecháte, se doplní obecnou výchozí variantou, a to, co nechcete, patří do samostatného negativního seznamu.

Jak to funguje, v jednom odstavci

Napíšete popis a objeví se obrázek. Pod kapotou se nástroj naučil, jak slova vypadají, z obrovského množství obrázků s popisky. Začíná s náhodným vizuálním šumem a opakovaně ho posouvá směrem k tomu, co odpovídá vašemu popisu.

Jeden důsledek vysvětluje většinu frustrace začátečníků: model porovnává váš popis se vzory, neřídí se instrukcemi jako člověk. Když řeknete "žádný pes", slovo pes tam pořád je a pes se klidně může objevit. Když něco vynecháte, model se neptá, doplní mezeru nejprůměrnější verzí té věci, kterou kdy viděl.

To je celé umění. Řekněte konkrétně, co chcete, a to, co nechcete, napište na místo k tomu určené.

Šestidílný vzorec

Téměř každý dobrý prompt pro obrázek obsahuje stejných šest věcí. Chybějící se doplní výchozími hodnotami, a právě ty způsobují, že obrázek vypadá obecně.

ČástCo uvéstKdyž to vynecháte
PředmětKonkrétní věc, s podstatnými detailyNejobecnější verze daného podstatného jména
ProstředíKde se to odehrává a kolik toho vidítePrázdné nebo přeplněné pozadí
OsvětleníDenní doba, směr, kvalitaPloché, rovnoměrně osvětlené, bez života
KompoziceZblízka nebo zeširoka, z jakého úhluVždy stejný centrovaný polocelek
StylFotografie, olejomalba, 3D render, ilustraceLesklá digitální grafika
Nálada nebo barvaPocit a paletaPřesycené a s vysokým kontrastem

Slabý prompt: útulný obývací pokoj.

Silný prompt: Malý obývací pokoj s rozsvíceným krbem a mourovatou kočkou spící na obnošeném křesle, pozdně odpolední světlo skrz okno směřující na západ, celkový záběr od dveří, realistická fotografie, 35mm, teplé hnědé a jemné jantarové tóny, klidné a útulné.

Obě zabírají zhruba stejnou dobu na vymyšlení. Druhý je obrázek, první je kategorie.

Pak přidejte část, kterou začátečníci úplně vynechávají: negativní seznam. Negativní: text, vodoznak, extra prsty, přeplněné pozadí, úsměv jako ze stock fotky. Většinu toho, co dělá obrázek rozpoznatelně AI generovaným, tvoří malá množina opakujících se artefaktů, a jejich pojmenování je odstraní.

Trik, který to usnadní

Tyto prompty si nemusíte psát sami. Požádejte textovou AI, aby je napsala za vás.

Napiš prompt pro generování obrázku pro: [váš hrubý nápad]. Je to pro [účel]. Strukturuj ho jako předmět, prostředí, osvětlení, kompozici, styl, barvu a náladu, poté negativní seznam. Dej mi tři verze, které se liší kompozicí, ne přídavnými jmény.

Jazykové modely píší prompty pro obrázky podstatně lépe než většina lidí, protože jde o známý formát a modely viděly obrovské množství příkladů. Proto je generování obrázků přímo v chatu skutečně užitečnější než samostatný nástroj na obrázky: nástroj, který napíše prompt, sedí přímo vedle toho, který ho vykreslí.

Proč váš obrázek vyšel špatně

Stručný diagnostický seznam, který pokrývá téměř každý problém začátečníků.

Nudný a obecný. Neurčili jste osvětlení ani kompozici. Tyto dvě věci odvádí víc práce než jakákoli jiná dvojice.

Správné věci, špatně uspořádané. Vyjádřete kompozici výslovně: celkový záběr zespodu, detail, předmět v levé třetině. Model netuší, kam chcete věci umístit, pokud mu to neřeknete.

Na obrázku je něco, co jste si nepřáli. Pojmenování dané věci v hlavním promptu zvyšuje pravděpodobnost jejího výskytu, ne naopak. Přesuňte ji do negativního seznamu.

Ruce, obličeje nebo malé opakující se detaily jsou špatně. Pořád nejslabší místo napříč všemi nástroji. Zkuste bližší ořez, jiný úhel, nebo aby ruce nebyly vidět. Někdy pomůže prosté vygenerování znovu.

Text je nesmyslný. Očekávané. Viz další část.

Vypadá to jako stock fotografie. Přidejte neformální, popište spíše akci než pózu, a do negativ dejte úsměv jako ze stock fotky do kamery.

Špatný tvar pro to, co potřebujete. Požádejte o poměr stran, který skutečně potřebujete. Oříznutí čtverce na banner zničí kompozici, o kterou jste žádali.

Jak postupovat, aniž byste se točili v kruzích

Začátečníci opakovaně generují stejný prompt v naději na lepší výsledek. Určitá náhodnost je nevyhnutelná, ale většina promarněných pokusů plyne ze změny několika věcí najednou.

  • Měňte jednu věc na pokus. Osvětlení, nebo kompozici, nebo styl. Ne všechny tři najednou, jinak nezjistíte, co pomohlo.
  • Nejdřív opravte kompozici, pak detaily. Vyladit kompozici a světlo napřed je mnohem efektivnější než dolaďovat předmět, který je ve špatné části záběru.
  • Popište, co bylo správně. Když je obrázek blízko cíli, řekněte to slovy v dalším promptu, místo abyste předpokládali, že si to nástroj pamatuje.
  • Ukládejte prompty, které fungovaly. Šest až osm spolehlivých tvarů promptu má větší hodnotu než kterýkoli jednotlivý obrázek, a právě díky nim vypadá sada obrázků, jako by k sobě patřily.

Co to stále neumí

Text. Slova na obrázcích zůstávají nespolehlivá napříč všemi nástroji. Krátké slovo občas vyjde; nadpis nebo logo většinou ne. Vygenerujte obrázek čistý a text přidejte v jakémkoli grafickém nástroji, což vám navíc zajistí správné písmo.

Přesné uspořádání. "Přesně tři předměty, ten červený vlevo" se spolehlivě nedodržuje. Pokud na uspořádání záleží, vygenerujte jednotlivé prvky a poskládejte je sami.

Stejná postava dvakrát. Dosáhnout identické osoby nebo produktu napříč sérií je náročné. Podrobné opakované popisy pomáhají, ale identický výsledek zaručen není.

Přesná úprava skutečné fotografie. Umí dobře upravit pozadí, osvětlení a styl. Nedokáže spolehlivě posunout předmět o pět centimetrů doleva.

A k použití výsledků: než cokoli vygenerovaného použijete komerčně, ověřte pravidla. Zvláštní pozornost věnujte obrázkům připomínajícím skutečnou osobu, rozpoznatelné místo nebo osobitý styl žijícího umělce. Podmínky se mezi nástroji liší a odpovědnost nese ten, kdo obrázek zveřejní.

Kontrolní seznam
  • Zahrňte všech šest částí: předmět, prostředí, osvětlení, kompozici, styl, náladu
  • To, co nechcete, dejte do negativního seznamu, nikdy do hlavního popisu
  • Požádejte textovou AI, aby napsala prompt pro obrázek z vašeho hrubého nápadu
  • Generujte v poměru stran, který skutečně potřebujete
  • Měňte jednu proměnnou na pokus, abyste zjistili, co pomohlo
  • Text přidávejte v grafickém nástroji, ne v modelu na obrázky
  • Ukládejte prompty, které fungovaly, aby vaše obrázky vypadaly konzistentně

Časté dotazy

Potřebuji umělecké schopnosti, abych mohl generovat AI obrázky?

Ne, ale potřebujete popisné schopnosti, a to je část, kterou začátečníci podceňují. Rozdíl mezi zklamáním a dobrým obrázkem tkví téměř výhradně v tom, jak konkrétně popíšete osvětlení, kompozici a styl. Pokud vám podrobný popis scény nejde přirozeně, požádejte textovou AI, aby váš hrubý nápad rozvedla do strukturovaného promptu.

Mohu použít AI, aby mi pomohla vymyslet nápady na obrázky?

Ano, a je to užitečnější, než si většina lidí myslí. Požádejte chatbota o pět popisných konceptů, pak ho nechte váš oblíbený rozpracovat do plného strukturovaného promptu s negativním seznamem. Jazykové modely píší prompty pro obrázky lépe než většina začátečníků, a proto generování obrázků přímo v chatu předčí samostatný nástroj na obrázky.

Proč text na mém obrázku vypadá jako nesmysl?

Protože vykreslený text je skutečně nejslabší místo napříč všemi modely na obrázky a žádný prompt to spolehlivě nevyřeší. Krátká jednotlivá slova občas vyjdou; nadpisy, loga a popisky většinou ne. Vygenerujte obrázek bez textu a typografii přidejte v jakémkoli grafickém nástroji, což vám navíc umožní použít správné písmo a umístit ho přesně.

Který generátor obrázků je nejlepší?

Záleží víc na tématu, než by člověk čekal. Flux vyniká ve fotorealismu a ve všem, co by mělo vypadat jako z fotoaparátu. Stable Diffusion nabízí větší stylovou kontrolu a rozmanitost pro ilustrace. Nejrychlejší způsob, jak se rozhodnout, je pustit stejný prompt oběma a porovnat výsledky vedle sebe, protože vítěz u portrétů často není vítězem u interiérů.

Potřebuji samostatné předplatné pro generování obrázků?

Ne nutně. Generování obrázků je součástí Whizi v plánu Pro a vyšších, spolu s textovými modely, což pokryje běžnou tvůrčí a obsahovou práci bez druhé platby. Samostatný nástroj na obrázky má stále smysl pro lidi, kteří to dělají profesionálně každý den a chtějí velmi jemnou stylovou kontrolu.