Cara membuat gambar di dalam chat Whizi

Jawaban singkat

Untuk membuat gambar di chat Whizi, buka pemilih model, alihkan dari Text ke Image & Video, pilih Whizi Image, Nano Banana, Flux, atau Stable Diffusion, lalu deskripsikan gambar yang diinginkan. Pembuatan gambar termasuk dalam paket Pro (100 per bulan) dan Powerhouse (500). Lakukan iterasi di thread yang sama, lalu unduh hasilnya.

Jawaban singkat

Buka pemilih model, alihkan sakelar di bagian atas dari Text ke Image & Video, pilih model gambar, lalu deskripsikan gambar yang diinginkan. Petunjuk pada kolom komposer berubah menjadi "Deskripsikan gambar yang ingin Anda buat...", dan hasilnya muncul langsung di percakapan yang sama.

ModelFungsinya
Whizi ImageMembuat gambar apa saja; baris pertama di pemilih kreatif
Nano BananaMengedit foto yang Anda lampirkan
FluxSeni fotorealistis yang tajam
Stable DiffusionModel gambar dari Stability AI

Pembuatan gambar termasuk dalam paket Pro, sebanyak 100 gambar per periode bulanan, dan Powerhouse, sebanyak 500. Akun Free dan Starter memiliki jatah gambar nol. Satu prompt gambar bisa terdiri dari 1 hingga 4,000 karakter, dan gambar yang dihasilkan disimpan selama 30 hari, dengan kontrol unduh pada masing-masing gambar. Jika sebuah pembuatan gagal alih-alih dirender, pesannya menyebutkan penyebabnya; lihat gambar gagal dibuat.

Mengapa membuat gambar di dalam chat itu berbeda

Alur kerja gambar biasa adalah produk terpisah, langganan terpisah, dan kotak kosong terpisah yang tidak tahu apa pun tentang apa yang sedang Anda kerjakan. Membuat gambar di dalam percakapan mengubah dua hal praktis.

Pertama, model sudah memiliki konteksnya. Jika Anda baru saja menghabiskan dua puluh pesan mengembangkan konsep kampanye, "buatkan gambar utama untuk ini" sudah membawa semua konteks itu. Anda tidak perlu menjelaskan ulang brief ke alat yang berbeda.

Kedua, Anda bisa memakai model teks untuk menulis prompt gambar. Ini trik yang paling sering terlewat: minta Claude atau GPT mengubah ide kasar Anda menjadi prompt gambar yang tersusun rapi, lalu jalankan. Model bahasa jauh lebih pandai menulis prompt gambar dibanding kebanyakan orang, karena formatnya sudah dikenal dan mereka telah melihat sangat banyak contohnya.

Prompt: biarkan model teks yang menulis prompt gambar

Write an image generation prompt for: [rough idea]. It will be used for [purpose and placement]. Structure it as: subject, action or state, setting, lighting, composition and framing, medium or lens, colour treatment, mood. Add a negative list of what must not appear. Give me three variations that differ in composition rather than in adjectives.

Struktur prompt yang berhasil

Hampir setiap prompt gambar yang bagus memiliki tujuh bagian yang sama, kurang lebih dengan urutan ini. Bagian yang terlewat akan diisi oleh model dengan nilai default-nya, dan default inilah yang membuat prompt generik menghasilkan gambar stok yang generik. Jika ini pertama kalinya Anda menulis prompt gambar, cara membuat gambar AI membahas hal yang sama dari awal.

BagianApa yang disebutkanEfek jika dilewatkan
SubjekHal spesifiknya, dengan detail yang pentingAnda mendapatkan versi paling generik dari kata bendanya
Aksi atau kondisiApa yang sedang dilakukan, atau bagaimana posisinyaStatis, berpose, tanpa nyawa
LatarDi mana, dan seberapa banyak yang terlihatLatar belakang default yang kosong atau berantakan
PencahayaanArah, kualitas, waktu hariDatar, tersinari merata, tanpa karakter
KomposisiSudut, jarak, posisi subjek dalam frameSelalu bidikan medium yang terpusat
Medium atau lensaFoto dan panjang fokus, atau gaya ilustrasiCenderung ke arah seni digital yang mengilap
Warna dan suasanaPalet dan perasaanTerlalu jenuh, kontras tinggi

Contoh nyata. Lemah: a person working in an office. Kuat: A woman in her fifties reviewing printed drawings at a standing desk, late afternoon light from a window to her left, shot from slightly behind her shoulder at eye level, 50mm, muted greens and warm neutrals, calm and unhurried. Negative: stock-photo smiling at camera, cluttered desk, visible brand logos, text.

Daftar negatif lebih penting daripada yang dikira orang. Sebagian besar hal yang membuat gambar hasil AI terlihat seperti buatan AI adalah sekumpulan kecil artefak yang berulang, dan menyebutkannya akan menghilangkannya: stock-photo smiling, over-saturated, text, watermark, extra fingers, symmetrical corporate composition.

Memilih model

  • Whizi Image untuk membuat gambar apa saja. Ini adalah generator utama Whizi dan baris pertama di pemilih kreatif.
  • Nano Banana untuk mengedit foto yang sudah Anda miliki. Lampirkan gambarnya dan deskripsikan perubahannya; petunjuk komposer berubah dari membuat menjadi mengedit segera setelah sebuah gambar dilampirkan.
  • Flux untuk seni fotorealistis yang tajam dan apa pun yang harus tampil berdampingan dengan foto asli.
  • Stable Diffusion, model dari Stability AI, sebagai opini kedua: model ini menghargai prompt yang spesifik dan menghasilkan tampilan berbeda dari kata-kata yang sama.

Anda bisa berpindah di antara model-model ini di dalam chat yang sama, yang merupakan cara tercepat untuk menjawab satu-satunya pertanyaan yang penting: jalankan prompt yang sama melalui dua model dan bandingkan hasilnya berdampingan. Kualitas model sangat bervariasi menurut subjeknya, dan pemenang untuk potret sering kali bukan pemenang untuk interior atau ilustrasi datar.

Melakukan iterasi tanpa berputar-putar

Kegagalan yang umum adalah membuat ulang prompt yang sama berkali-kali dengan harapan mendapat hasil yang lebih baik. Sebagian dari itu memang tidak terhindarkan, tetapi kebanyakan percobaan yang terbuang berasal dari mengubah beberapa hal sekaligus dan kehilangan jejak mana yang membantu.

  • Ubah satu variabel per percobaan. Pencahayaan, atau framing, atau palet. Jangan ketiganya sekaligus.
  • Simpan apa yang berhasil dalam kata-kata. Ketika sebuah gambar sudah mendekati, deskripsikan apa yang sudah benar tentangnya di prompt berikutnya alih-alih menganggap modelnya mengingat.
  • Perbaiki komposisi sebelum detail. Membenarkan framing dan cahaya terlebih dahulu jauh lebih efisien daripada menyempurnakan subjek yang berada di bagian frame yang salah.
  • Buat gambar pada rasio aspek final. Memotong gambar persegi menjadi banner lebar membuang komposisi yang Anda minta. Minta rasio yang benar-benar Anda butuhkan sejak awal.
  • Simpan prompt yang berhasil. Delapan prompt gaya rumah yang andal dan bisa Anda tempel ulang lebih berharga daripada satu gambar mana pun, dan memakainya kembali adalah yang membuat sekumpulan aset terlihat seperti satu set.

Untuk mengedit gambar yang sudah Anda miliki, unggah gambarnya dan deskripsikan perubahannya. Ini bekerja dengan baik untuk penyesuaian latar belakang, pencahayaan, dan palet, serta kurang berhasil untuk pengeditan struktural yang presisi, yang masih lebih cepat dilakukan di editor gambar sesungguhnya.

Hal yang masih sering salah pada model gambar

Teks. Kata-kata yang dirender tetap menjadi area terlemah di semua model. Kata pendek terkadang muncul benar; judul, logo, atau label biasanya tidak. Buat gambarnya bersih lalu tambahkan teks di alat desain Anda.

Tangan, jumlah, dan detail kecil yang berulang. Jari, gigi, kaki kursi, dan jendela pada sebuah bangunan semuanya adalah tempat model kehilangan hitungan. Perbesar gambar sebelum Anda memakainya.

Instruksi spasial yang presisi. "Tepat tiga objek, yang merah di sebelah kiri" tidak bisa diandalkan. Susun di editor Anda jika penataannya benar-benar penting.

Konsistensi antar gambar. Membuat karakter atau produk yang sama muncul identik dalam sebuah seri itu sulit. Deskripsi yang detail dan berulang membantu; hasil yang identik tidak dijamin.

Soal penggunaan: periksa hak Anda sebelum apa pun yang dihasilkan masuk ke penempatan berbayar, dan berhati-hatilah khususnya dengan apa pun yang menyerupai orang nyata, lokasi yang bisa dikenali, atau gaya khas yang terkait dengan seniman yang masih hidup. Ketentuan penyedia berbeda-beda, dan risiko komersialnya ada pada siapa pun yang mempublikasikan gambar tersebut.

Daftar Periksa
  • Minta model teks menulis prompt gambar dari ide kasar Anda
  • Sertakan ketujuh bagian: subjek, aksi, latar, pencahayaan, komposisi, medium, suasana
  • Tambahkan daftar negatif yang menyebutkan artefak yang tidak Anda inginkan
  • Buat gambar pada rasio aspek yang benar-benar akan Anda pakai
  • Ubah satu variabel per iterasi
  • Jalankan prompt yang sama melalui dua model dan bandingkan
  • Tambahkan teks di alat desain Anda, bukan di model gambar
  • Simpan prompt yang berhasil sebagai templat yang bisa dipakai ulang

Pertanyaan Umum

Berapa banyak gambar yang bisa saya buat per bulan?

Pro menyertakan 100 pembuatan gambar per periode bulanan dan Powerhouse menyertakan 500. Akun Free dan Starter memiliki jatah gambar nol, jadi Pro adalah paket terendah dengan pembuatan gambar. Pada siklus penagihan mingguan, jatahnya adalah angka bulanan dibagi empat, dibulatkan ke atas. Karena iterasi adalah tempat pembuatan gambar terpakai, menulis prompt yang tersusun terlebih dahulu (idealnya dengan model teks) secara nyata mengurangi jumlah percobaan yang dibutuhkan untuk gambar yang layak pakai.

Bisakah saya mengedit gambar yang sudah ada?

Bisa. Di mode Image & Video, lampirkan foto dan deskripsikan perubahannya; petunjuk komposer berubah dari membuat menjadi mengedit segera setelah sebuah gambar dilampirkan, dan Nano Banana adalah model yang dibuat untuk pengeditan foto. Ini bekerja dengan baik untuk penyesuaian latar belakang, pencahayaan, palet, dan gaya. Ini kurang berhasil untuk pengeditan struktural yang presisi seperti memindahkan sebuah objek sejauh jarak tertentu atau mengubah teks, yang masih lebih cepat dilakukan di editor gambar biasa.

Model gambar mana yang sebaiknya saya pakai?

Whizi Image untuk membuat gambar apa saja, Nano Banana untuk mengedit foto yang Anda lampirkan, Flux untuk seni fotorealistis yang tajam yang tampil berdampingan dengan foto asli, dan Stable Diffusion untuk tampilan berbeda dari prompt yang sama. Karena kualitas model sangat bervariasi menurut subjeknya, cara tercepat untuk memutuskan adalah menjalankan prompt yang sama melalui dua model di chat yang sama dan membandingkan hasilnya.

Mengapa teks di gambar saya keluar salah?

Teks yang dirender masih menjadi area terlemah di semua model gambar, dan tidak ada prompt yang bisa memperbaikinya secara andal. Kata tunggal yang pendek terkadang berhasil; judul, logo, dan label biasanya tidak. Buat gambar tanpa teks dan tambahkan tipografi di alat desain Anda, yang juga memberi Anda font yang benar dan kontrol penempatan yang tepat.

Apakah saya perlu langganan gambar terpisah selain Whizi?

Untuk sebagian besar pekerjaan kampanye, konten, dan konsep, tidak. Pembuatan gambar termasuk dalam paket Pro (100 per bulan) dan Powerhouse (500), yang mencakup hal yang sama seperti langganan mandiri untuk output pemasaran dan sosial pada umumnya. Alat khusus masih masuk akal untuk tim dengan kebutuhan gaya yang sangat spesifik atau pustaka prompt yang sudah ada dan tidak ingin mereka bangun ulang.