Cara Mencipta Imej AI untuk Pemula (Panduan Mudah)

Jawapan Ringkas

Untuk guna penjanaan imej AI, anda menaip penerangan dan gambar muncul. Mendapat yang baik bermaksud menamakan enam perkara: subjek, latar, pencahayaan, rangka, gaya, dan suasana atau warna. Apa-apa yang anda tinggalkan diisi dengan lalai generik, dan apa yang anda tidak mahu pergi ke senarai negatif berasingan.

Cara ia berfungsi, dalam satu perenggan

Anda menaip penerangan dan gambar muncul. Di bawahnya, alat itu mempelajari rupa perkataan daripada jumlah imej berkapsyen yang sangat besar. Ia bermula dengan bunyi visual rawak dan berulang kali menolak bunyi itu ke arah apa sahaja yang sepadan dengan penerangan anda.

Satu akibat menerangkan kebanyakan kekecewaan pemula: model itu memadankan penerangan anda berbanding corak, bukan mengikut arahan seperti seseorang akan lakukan. Jika anda berkata "tiada anjing", perkataan anjing masih ada di dalamnya dan anjing mungkin masih muncul. Jika anda tinggalkan sesuatu, ia tidak bertanya; ia mengisi jurang itu dengan versi paling purata perkara itu yang ia pernah lihat.

Itulah keseluruhan kemahiran itu. Nyatakan apa yang anda mahu secara khusus, dan nyatakan apa yang anda tidak mahu di tempat direka untuknya.

Formula enam bahagian

Hampir setiap prompt imej yang baik mengandungi enam perkara yang sama. Yang hilang diisi dengan lalai, dan lalai itu tepat apa yang menjadikan imej kelihatan generik.

BahagianApa untuk dinyatakanJika anda tinggalkan
SubjekPerkara khusus itu, dengan butiran yang pentingVersi paling generik kata nama itu
LatarDi mana ia berada, dan berapa banyak anda lihatLatar belakang kosong atau bersepah
PencahayaanMasa hari, arah, kualitiRata, dicahaya sekata, tiada nyawa
RangkaDekat atau luas, dari sudut apaTembakan sederhana berpusat, setiap kali
GayaFotograf, lukisan minyak, render 3D, ilustrasiSeni digital berkilat
Suasana atau warnaPerasaan dan paletTerlalu tepu dan kontras tinggi

Prompt lemah: ruang tamu yang selesa.

Prompt kukuh: Ruang tamu kecil dengan perapian menyala dan kucing tabby tidur pada kerusi berlengan lusuh, cahaya lewat petang melalui tingkap menghadap barat, tembakan luas dari pintu, fotograf realistik, 35mm, coklat hangat dan ambar lembut, tenang dan didiami.

Kedua-duanya mengambil usaha yang sama untuk difikirkan. Yang kedua adalah gambar; yang pertama adalah kategori.

Kemudian tambah bahagian yang pemula langkau sepenuhnya: senarai negatif. Negatif: teks, tera air, jari tambahan, latar belakang bersepah, senyuman gaya foto stok. Kebanyakan apa yang menjadikan imej kelihatan dijana AI datang daripada set kecil artifak berulang, dan menamakannya membuang mereka.

Helah yang menjadikan ini mudah

Anda tidak perlu tulis prompt ini sendiri. Minta AI teks menulisnya untuk anda.

Tulis prompt penjanaan imej untuk: [idea kasar anda]. Ia untuk [tujuan]. Strukturkannya sebagai subjek, latar, pencahayaan, rangka, gaya, warna dan suasana, kemudian senarai negatif. Beri saya tiga versi yang berbeza dalam rangka berbanding dalam kata sifat.

Model bahasa jauh lebih baik dalam menulis prompt imej daripada kebanyakan orang, kerana formatnya diketahui dan mereka telah melihat jumlah contoh yang sangat besar. Inilah sebab menjana imej di dalam sembang benar-benar lebih berguna daripada kotak imej berdiri sendiri: alat yang menulis prompt itu duduk tepat bersebelahan yang melukisnya.

Kenapa imej anda keluar salah

Senarai diagnostik pendek meliputi hampir setiap masalah pemula.

Membosankan dan generik. Anda tidak nyatakan pencahayaan atau rangka. Kedua-dua itu melakukan lebih kerja daripada mana-mana pasangan lain.

Perkara betul, disusun salah. Nyatakan rangka secara eksplisit: tembakan luas dari bawah, dekat, subjek pada satu pertiga kiri. Model itu tiada idea di mana anda mahu perkara melainkan anda nyatakan.

Sesuatu yang anda minta jangan lihat ada dalam gambar. Menamakannya dalam prompt utama menjadikannya lebih mungkin, bukan kurang. Alihkan ke senarai negatif.

Tangan, wajah, atau butiran kecil berulang salah. Masih kawasan paling lemah di mana-mana. Cuba potongan lebih dekat, sudut berbeza, atau tangan tidak kelihatan. Kadangkala hanya jana semula.

Teks itu tidak masuk akal. Dijangka. Lihat bahagian seterusnya.

Ia kelihatan seperti fotografi stok. Tambah candid, terangkan tindakan berbanding pose, dan letakkan senyuman gaya foto stok pada kamera dalam negatif.

Bentuk salah untuk tempat anda perlukannya. Minta nisbah aspek yang anda sebenarnya perlukan. Memotong segi empat sama menjadi sepanduk membuang komposisi yang anda minta.

Berulang tanpa berpusing-pusing

Pemula menjana semula prompt yang sama berharap gulingan lebih baik. Sedikit rawak tidak dapat dielakkan, tetapi kebanyakan cubaan terbazir datang daripada mengubah beberapa perkara sekali gus.

  • Ubah satu perkara setiap cubaan. Pencahayaan, atau rangka, atau gaya. Bukan ketiga-tiganya, atau anda tidak akan tahu apa yang membantu.
  • Betulkan komposisi sebelum butiran. Mendapat rangka dan cahaya betul dahulu jauh lebih cekap daripada menyempurnakan subjek yang berada pada bahagian salah bingkai.
  • Terangkan apa yang betul. Apabila imej hampir, nyatakan dalam kata-kata pada prompt seterusnya berbanding menganggap alat itu ingat.
  • Simpan prompt yang berjaya. Enam atau lapan bentuk prompt boleh dipercayai bernilai lebih daripada mana-mana imej tunggal, dan itulah yang menjadikan set gambar kelihatan seolah-olah ia sepadan bersama.

Apa yang ia masih tidak boleh lakukan

Teks. Perkataan dalam imej kekal tidak boleh dipercayai di mana-mana. Perkataan pendek kadangkala berfungsi; tajuk utama atau logo biasanya tidak. Jana gambar itu bersih dan tambah teks dalam mana-mana alat reka bentuk, yang juga memberi anda fon yang betul.

Susunan tepat. "Tepat tiga objek, yang merah di sebelah kiri" tidak diikuti dengan boleh dipercayai. Jika susunan itu penting, jana kepingan itu dan susunkannya sendiri.

Watak yang sama dua kali. Mendapat orang atau produk yang sama merentas siri sukar. Penerangan berulang terperinci membantu dan hasil sama tidak dijamin.

Menyunting foto sebenar dengan tepat. Ia boleh melaraskan latar belakang, pencahayaan, dan gaya dengan baik. Ia tidak boleh dipercayai mengalihkan objek dua inci ke kiri.

Dan tentang menggunakan hasil: semak peraturan sebelum apa-apa yang dijana pergi ke tempat komersial. Ambil perhatian khusus dengan imej yang menyerupai orang sebenar, tempat boleh dikenali, atau gaya tersendiri artis yang masih hidup. Terma berbeza antara alat dan tanggungjawab terletak pada sesiapa yang menerbitkan imej itu.

Senarai Semak
  • Sertakan kesemua enam bahagian: subjek, latar, pencahayaan, rangka, gaya, suasana
  • Letakkan apa yang anda tidak mahu dalam senarai negatif, jangan sekali-kali dalam penerangan utama
  • Minta AI teks menulis prompt imej daripada idea kasar anda
  • Jana pada nisbah aspek yang anda sebenarnya perlukan
  • Ubah satu pemboleh ubah setiap cubaan supaya anda belajar apa yang membantu
  • Tambah teks dalam alat reka bentuk berbanding dalam model imej
  • Simpan prompt yang berjaya supaya imej anda kelihatan konsisten

Soalan Lazim

Perlukah saya kemahiran seni untuk menjana imej AI?

Tidak, tetapi anda perlukan yang deskriptif, dan itu bahagian yang pemula kurang menilai. Jurang antara imej mengecewakan dan yang baik hampir sepenuhnya betapa khusus anda menerangkan pencahayaan, rangka, dan gaya. Jika menerangkan adegan secara terperinci tidak datang secara semula jadi, minta AI teks mengembangkan idea kasar anda menjadi prompt berstruktur.

Bolehkah saya guna AI untuk membantu saya cari idea imej?

Ya, dan ia lebih berguna daripada kebanyakan orang sedar. Minta chatbot untuk lima konsep deskriptif, kemudian minta ia ubah kegemaran anda menjadi prompt imej berstruktur penuh dengan senarai negatif. Model bahasa menulis prompt imej lebih baik daripada kebanyakan pemula, itulah sebab menjana imej di dalam sembang mengatasi kotak imej berdiri sendiri.

Kenapa teks dalam imej saya kelihatan tidak masuk akal?

Kerana teks dirender benar-benar kawasan paling lemah merentas setiap model imej, dan tiada prompt boleh dipercayai membetulkannya. Perkataan tunggal pendek kadangkala keluar; tajuk utama, logo, dan label biasanya tidak. Jana imej tanpa teks dan tambah tipografi dalam mana-mana alat reka bentuk, yang juga membenarkan anda guna fon yang betul dan letakkannya dengan betul.

Penjana imej mana yang terbaik?

Ia bergantung pada subjek lebih daripada jangkaan orang. Flux paling kukuh untuk fotorealisme dan apa sahaja yang patut kelihatan seperti ia datang daripada kamera. Stable Diffusion memberi lebih kawalan gaya dan variasi untuk ilustrasi. Cara paling pantas untuk memutuskan ialah jalankan prompt yang sama melalui dua daripadanya dan lihat hasil bersebelahan, kerana pemenang pada potret selalunya bukan pemenang pada interior.

Perlukah saya langganan berasingan untuk penjanaan imej?

Tidak semestinya. Penjanaan imej termasuk dalam Whizi pada Pro dan ke atas, bersebelahan model teks, yang meliputi kerja kreatif dan kandungan biasa tanpa bil kedua. Alat imej khusus masih masuk akal bagi orang yang melakukan ini secara profesional setiap hari dan mahukan kawalan gaya yang sangat halus.