Cara membuat gambar dengan AI untuk pemula (panduan sederhana)

Pelajari cara mudah membuat gambar AI dari teks. Temukan tips prompt sederhana untuk menghasilkan karya seni, grafis, dan foto dalam hitungan detik.

Cara kerjanya, dalam satu paragraf

Anda mengetik deskripsi dan sebuah gambar muncul. Di balik layar, alatnya berangkat dari bintik visual acak lalu berulang kali menggesernya ke arah sesuatu yang cocok dengan kata-kata Anda, setelah belajar seperti apa rupa sebuah kata dari jumlah gambar berketerangan yang sangat besar.

Satu akibatnya menjelaskan sebagian besar frustrasi pemula: modelnya mencocokkan deskripsi Anda dengan pola, bukan mengikuti instruksi seperti manusia. Kalau Anda menulis "tanpa anjing", kata anjing tetap ada di sana dan seekor anjing bisa saja muncul. Kalau Anda melewatkan sesuatu, ia tidak bertanya; ia mengisi celahnya dengan versi paling rata-rata dari benda itu yang pernah ia lihat.

Itulah seluruh keterampilannya. Sebutkan apa yang Anda mau dengan spesifik, dan sebutkan apa yang tidak Anda mau di tempat yang memang disediakan untuk itu.

Formula enam bagian

Hampir semua prompt gambar yang bagus memuat enam hal yang sama. Bagian yang hilang akan diisi nilai bawaan, dan nilai bawaan itulah yang membuat gambar terlihat generik.

BagianYang perlu disebutKalau dilewatkan
SubjekBenda spesifiknya, dengan detail yang pentingVersi paling umum dari kata benda itu
LatarDi mana, dan seberapa luas terlihatLatar kosong atau berantakan
CahayaWaktu, arah, kualitasnyaDatar, rata, tanpa nyawa
BingkaiDekat atau lebar, dari sudut apaSelalu bidikan medium di tengah
GayaFoto, lukisan cat minyak, render 3D, ilustrasiSeni digital yang mengkilap
Suasana atau warnaPerasaan dan paletnyaTerlalu jenuh dan kontras tinggi

Prompt yang lemah: ruang keluarga yang nyaman.

Prompt yang kuat: Ruang keluarga kecil dengan perapian menyala dan seekor kucing belang tidur di kursi berlengan yang usang, cahaya sore menjelang senja dari jendela menghadap barat, bidikan lebar dari ambang pintu, foto realistis, 35mm, cokelat hangat dan kuning lembut, tenang dan terasa dihuni.

Keduanya butuh usaha berpikir yang kurang lebih sama. Yang kedua adalah sebuah gambar; yang pertama cuma sebuah kategori.

Lalu tambahkan bagian yang selalu dilewatkan pemula: daftar negatif. Negatif: teks, watermark, jari berlebih, latar berantakan, senyum ala foto stok. Sebagian besar hal yang membuat gambar terlihat buatan AI berasal dari sekumpulan kecil cacat yang berulang, dan menyebutkannya akan menghilangkannya.

Trik yang membuat ini jadi mudah

Anda tidak perlu menulis prompt ini sendiri. Minta AI teks yang menuliskannya untuk Anda.

Tulis prompt pembuatan gambar untuk: [ide kasar Anda]. Ini untuk [tujuan]. Susun dengan urutan subjek, latar, cahaya, bingkai, gaya, warna dan suasana, lalu daftar negatif. Beri saya tiga versi yang bedanya di bingkai, bukan di kata sifatnya.

Model bahasa jauh lebih jago menulis prompt gambar dibanding kebanyakan orang, karena formatnya sudah baku dan mereka sudah melihat contohnya dalam jumlah luar biasa banyak. Inilah alasan membuat gambar di dalam ruang obrolan benar-benar lebih berguna daripada kotak gambar yang berdiri sendiri: alat yang menulis promptnya duduk persis di sebelah alat yang menggambarnya.

Kenapa gambar Anda meleset

Daftar diagnosis singkat yang mencakup hampir semua masalah pemula.

Membosankan dan generik. Anda tidak menyebutkan cahaya atau bingkai. Dua hal itu bekerja lebih keras daripada pasangan unsur mana pun.

Unsurnya benar, tapi tata letaknya salah. Sebutkan bingkainya secara gamblang: bidikan lebar dari bawah, bidikan dekat, subjek di sepertiga kiri. Modelnya sama sekali tidak tahu Anda ingin sesuatu di mana kalau Anda tidak bilang.

Hal yang Anda minta jangan muncul justru ada di gambar. Menyebutnya di prompt utama malah membuatnya lebih mungkin muncul, bukan sebaliknya. Pindahkan ke daftar negatif.

Tangan, wajah, atau detail kecil yang berulang terlihat salah. Ini masih titik terlemah di semua alat. Coba potongan yang lebih dekat, sudut berbeda, atau bikin tangannya tidak terlihat. Kadang cukup dibuat ulang saja.

Teksnya jadi huruf ngawur. Memang begitu. Lihat bagian berikutnya.

Hasilnya terlihat seperti foto stok. Tambahkan candid, gambarkan sebuah aksi alih-alih pose, dan taruh senyum ke kamera ala foto stok di daftar negatif.

Bentuknya tidak sesuai kebutuhan Anda. Minta rasio aspek yang memang Anda butuhkan. Memotong gambar persegi jadi spanduk membuang komposisi yang tadi Anda minta.

Mengulik hasilnya tanpa berputar-putar

Pemula sering membuat ulang prompt yang sama sambil berharap dapat undian yang lebih baik. Sedikit keacakan memang tak terhindarkan, tapi sebagian besar percobaan yang terbuang justru muncul karena mengubah beberapa hal sekaligus.

  • Ubah satu hal per percobaan. Cahayanya, atau bingkainya, atau gayanya. Jangan ketiganya, nanti Anda tidak tahu mana yang berhasil.
  • Benahi komposisi sebelum detail. Membereskan bingkai dan cahaya lebih dulu jauh lebih efisien daripada menyempurnakan subjek yang posisinya salah di dalam bingkai.
  • Sebutkan apa yang sudah benar. Saat sebuah gambar sudah mendekati, tuliskan itu dengan kata-kata di prompt berikutnya, jangan berasumsi alatnya mengingatnya.
  • Simpan prompt yang berhasil. Enam atau delapan pola prompt yang andal lebih berharga daripada satu gambar mana pun, dan itulah yang membuat sekumpulan gambar terlihat satu keluarga.

Yang masih belum bisa dilakukannya

Teks. Kata-kata di dalam gambar masih tidak bisa diandalkan di semua alat. Kata pendek kadang berhasil; judul atau logo biasanya tidak. Buat gambarnya bersih tanpa teks lalu tambahkan teks di aplikasi desain apa pun, yang sekaligus memberi Anda font yang tepat.

Susunan yang presisi. "Tepat tiga benda, yang merah di sebelah kiri" tidak dipatuhi secara konsisten. Kalau susunannya penting, buat tiap bagiannya lalu Anda sendiri yang menyusunnya.

Karakter yang sama dua kali. Mendapatkan orang atau produk yang identik di sebuah rangkaian gambar itu sulit. Deskripsi rinci yang diulang memang membantu, tapi hasil yang identik tidak dijamin.

Menyunting foto asli secara presisi. Ia bisa mengubah latar, cahaya, dan gaya dengan baik. Ia tidak bisa diandalkan untuk menggeser sebuah benda lima sentimeter ke kiri.

Dan soal pemakaian hasilnya: periksa aturannya sebelum apa pun yang dihasilkan AI dipakai untuk keperluan komersial. Berhati-hatilah terutama dengan gambar yang menyerupai orang sungguhan, tempat yang mudah dikenali, atau gaya khas seniman yang masih hidup. Ketentuannya berbeda antaralat dan tanggung jawabnya ada pada siapa pun yang memublikasikan gambar itu.

Daftar Periksa
  • Sertakan keenam bagian: subjek, latar, cahaya, bingkai, gaya, suasana
  • Taruh yang tidak Anda inginkan di daftar negatif, jangan di deskripsi utama
  • Minta AI teks menulis prompt gambarnya dari ide kasar Anda
  • Hasilkan gambar langsung pada rasio aspek yang memang Anda butuhkan
  • Ubah satu variabel per percobaan agar Anda tahu mana yang berhasil
  • Tambahkan teks di aplikasi desain, bukan di model gambarnya
  • Simpan prompt yang berhasil supaya gambar Anda terlihat konsisten

Pertanyaan Umum

Apakah saya perlu bakat seni untuk membuat gambar AI?

Tidak, tapi Anda perlu kemampuan mendeskripsikan, dan bagian itulah yang diremehkan pemula. Jarak antara gambar yang mengecewakan dan gambar yang bagus hampir seluruhnya ditentukan seberapa spesifik Anda menggambarkan cahaya, bingkai, dan gayanya. Kalau menjelaskan sebuah adegan secara rinci bukan hal yang mudah bagi Anda, minta AI teks mengembangkan ide kasar Anda jadi prompt yang terstruktur, dan itu berhasil dengan baik.

Bisakah saya memakai AI untuk mencari ide gambar?

Bisa, dan itu lebih berguna daripada yang disadari kebanyakan orang. Minta chatbot memberi lima konsep deskriptif, lalu minta ia mengubah favorit Anda jadi prompt gambar lengkap yang terstruktur beserta daftar negatifnya. Model bahasa menulis prompt gambar lebih baik daripada kebanyakan pemula, dan itulah sebabnya membuat gambar di dalam obrolan mengalahkan kotak gambar yang berdiri sendiri.

Kenapa teks di gambar saya terlihat seperti huruf ngawur?

Karena teks yang dirender memang titik terlemah di semua model gambar, dan tidak ada prompt yang bisa memperbaikinya secara andal. Kata tunggal yang pendek kadang berhasil; judul, logo, dan label biasanya tidak. Buat gambarnya tanpa teks lalu tambahkan tipografi di aplikasi desain apa pun, yang sekaligus memungkinkan Anda memakai font yang benar dan menempatkannya dengan rapi.

Pembuat gambar AI mana yang terbaik?

Itu lebih bergantung pada subjeknya daripada yang orang kira. Flux paling kuat untuk foto realistis dan apa pun yang harus terlihat seperti hasil kamera. Stable Diffusion memberi kendali gaya dan variasi yang lebih banyak untuk ilustrasi. Cara tercepat memutuskan adalah menjalankan prompt yang sama di dua alat lalu membandingkan hasilnya berdampingan, karena yang menang di potret sering bukan yang menang di interior.

Apakah saya perlu langganan terpisah untuk membuat gambar?

Belum tentu. Pembuatan gambar sudah termasuk di Whizi pada paket Pro ke atas, bersama model teksnya, dan itu sudah menutup kebutuhan kerja kreatif serta konten biasa tanpa tagihan kedua. Alat gambar khusus tetap masuk akal bagi orang yang mengerjakan ini secara profesional setiap hari dan butuh kendali gaya yang sangat halus.