Model vs aplikasi vs API
Kebanyakan perdebatan ChatGPT vs Claude vs Gemini membandingkan lapisan yang keliru. Setiap nama mencakup tiga produk: satu keluarga model, satu aplikasi konsumen, dan satu API untuk pengembang. Pemenangnya berubah tergantung lapisan mana yang Anda beli. Di lapisan aplikasi, harganya nyaris seri tiga arah. Di lapisan model, tidak.
Di lapisan API selisihnya bisa diukur. Harga daftar OpenRouter per 20 Agustus 2026, dilacak dalam Indeks Biaya Whizi: GPT-5.5 seharga $5 per juta token masukan dan $30 per juta keluaran, Claude Sonnet 5 seharga $2 masuk dan $10 keluar, dan Gemini 3.5 Flash $1.50 masuk dan $9 keluar. Untuk satu jawaban standar (1000 token masuk, 500 keluar) itu berarti $0.02 untuk GPT-5.5, $0.007 untuk Sonnet 5, dan $0.006 untuk Gemini 3.5 Flash. Pada panjang jawaban yang sama, GPT-5.5 kira-kira tiga kali lebih mahal daripada dua model unggulan lainnya.
Di lapisan aplikasi, paket unggulan justru berdekatan. ChatGPT Plus $20 per bulan, Claude Pro $20 ($17 per bulan jika dibayar tahunan), dan Gemini Advanced dilebur ke Google AI Pro pada anak tangga $20 yang sama. OpenAI juga menjual ChatGPT Go seharga $8 untuk pemakaian harian yang dibatasi. Karena itu keputusan langganan jarang dimenangkan lewat harga. Ia dimenangkan oleh model mana yang menuntaskan tugas nyata Anda dengan perapian paling sedikit.
Panduan ini membandingkan berdasarkan tugas dan menyebut satu pemenang per kasus pemakaian. Jika Anda masih menyusun daftar pendek di luar tiga besar, mulailah dari alternatif ChatGPT. Jika pilihannya sudah mengerucut ke ketiganya, tabel rute di bawah adalah versi ringkasnya dan protokol prompt setelahnya adalah buktinya.
Perbandingan kemampuan: visi, alat, konteks panjang
Tiga fakta membingkai setiap perdebatan kemampuan pada 2026. Jendela konteks tidak lagi memisahkan para pemimpin: GPT-5.5, Claude Sonnet 5, dan Gemini 3.5 Flash semuanya tercatat 1M token dalam Indeks Biaya Whizi, cukup untuk sekitar 1900 halaman naskah masing-masing. Ketiganya multimodal, jadi gambar dan PDF sudah menjadi standar. Yang masih memisahkan adalah harga, dengan selisih tiga kali lipat di jajaran unggulan. Pertanyaan sesungguhnya pun bergeser dari "bisakah?" menjadi "sebagus apa, dan berapa biayanya?".
| Kemampuan | ChatGPT (GPT-5.5) | Claude (Sonnet 5) | Gemini (3.5 Flash) | Yang perlu diuji |
|---|---|---|---|---|
| Jendela konteks | 1M token | 1M token | 1M token | Sembunyikan satu fakta di halaman 300 sebuah PDF panjang lalu minta kembali dengan rujukan halaman |
| Biaya per jawaban standar | $0.02 | $0.007 | $0.006 | Kalikan dengan volume bulanan Anda yang sebenarnya sebelum berkomitmen |
| Kredit Whizi per pesan | 20 | 10 | 8 | Seberapa jauh satu jatah bertahan pada model bawaan Anda |
| Menulis dan menyunting | Draf terstruktur, kerangka, varian cepat | Pemenang: nada, penyuntingan naskah panjang, sintesis cermat | Paling lemah di antara ketiganya soal suara penulis | Draf berantakan yang sama, pembaca yang sama, lalu hitung suntingan yang Anda buat sesudahnya |
| Kode dan debugging | Pemenang dari reproduksi yang bersih: perbaikan bertahap plus tes | Pemenang untuk tinjauan dan rencana refaktor pada diff besar | Cara termurah membaca seluruh repositori dalam satu prompt | Satu laporan bug, satu tes gagal, satu cuplikan berkas; nilai perubahan aman terkecil |
Daftar fitur tetap tidak memutuskan apa pun sendirian. Gemini 3.5 Flash menerima sejuta token yang sama seperti Sonnet 5, dengan 8 kredit Whizi berbanding 10 milik Sonnet, dan tetap bisa gagal pada penulisan ulang yang peka nada sampai menghabiskan satu jam penyuntingan Anda. Ujilah pada pekerjaan Anda sendiri. Protokol di bawah hanya butuh satu tugas nyata dan tiga tab.
Mengoding
Urusan kode terbelah oleh satu syarat. ChatGPT menang ketika Anda punya reproduksi yang bersih: ia bergerak bertahap dari tes yang gagal menuju perbaikan terkecil dan menulis tes regresi tanpa perlu diminta dua kali. Claude menang ketika pekerjaannya soal pertimbangan, bukan mekanika: meninjau diff besar, menyusun rencana refaktor, atau menjelaskan mengapa sebuah perbaikan berisiko. Claude vs ChatGPT menguraikan keputusan dua model itu lebih dalam.
Pakai prompt mengoding ini: "Anda sedang meninjau sebuah perbaikan bug. Pertama, nyatakan ulang kemungkinan penyebab akarnya berdasarkan reproduksi. Lalu usulkan perubahan teraman terkecil. Lalu sebutkan tes yang akan gagal sebelum perbaikan dan lolos sesudahnya. Jangan menulis ulang kode yang tidak terkait. Berikut laporan bug, kode terkait, dan keluaran tesnya."
Gemini ada di urutan ketiga di sini, dengan satu ceruk yang nyata: dengan $1.50 per juta token masukan, ia cara termurah untuk menaruh satu basis kode utuh di depan jendela 1M token dan bertanya di mana sebuah perubahan akan mendarat. Apa pun yang memenangkan pengujian Anda, aturannya tetap: tidak ada perubahan tulisan AI yang dirilis tanpa tes dan tinjauan manusia. Model yang mengusulkan diff terkecil adalah model yang paling sedikit merugikan Anda pekan berikutnya.
Riset
Dalam riset, ketertelusuran mengalahkan prosa yang terdengar yakin, dan Claude menang untuk sintesis dari paket sumber yang tetap: ia memisahkan apa yang berasal dari sumber dan apa yang ia simpulkan lebih rapi daripada dua lainnya, dan justru itulah pekerjaannya. Gemini menjadi penantang ketika paketnya sangat besar atau bercampur format, sebab jendela 1M token memuat sekitar 1900 halaman dan tarif masukannya paling rendah di antara ketiganya. ChatGPT ketiga dalam disiplin sumber dan pertama dalam mengubah riset yang sudah jadi menjadi keluaran yang terstruktur.
Pakai prompt riset ini: "Jawab pertanyaan ini hanya memakai sumber yang saya berikan. Buat tabel berisi klaim, sumber, tingkat keyakinan, dan catatan. Lalu tulis sintesis sepanjang 250 kata. Akhiri dengan pertanyaan terbuka dan bukti apa yang akan mengubah kesimpulannya."
Diskualifikasi model mana pun yang melanggar instruksi "gunakan hanya sumber yang saya berikan". Model yang diam-diam menyelipkan pengetahuan luar ke dalam ringkasan bersumber tidak bisa dipakai untuk mengambil keputusan, apa pun skor tolok ukurnya. Lewatkan paket yang sama satu kali ke ketiganya. Ketika kegagalan itu terjadi, ia langsung kelihatan.
Dokumen
Gemini menang untuk pekerjaan dokumen, dan alasannya kini harga, bukan kapasitas. Ketiga model unggulan membaca jendela 1M token, kira-kira 1900 halaman naskah, tetapi mengisi jendela itu berbiaya $1.50 per juta token masukan pada Gemini 3.5 Flash, $2 pada Claude Sonnet 5, dan $5 pada GPT-5.5. Berikan kontrak 400 halaman ke tiap model setiap pagi dan bacaan yang sama berbiaya lebih dari tiga kali lipat pada GPT-5.5. Claude jadi penantang ketika hasil akhirnya lebih penting daripada asupannya, karena bahan yang padat keluar darinya sebagai prosa yang enak dibaca. Di bawah jajaran unggulan, ukuran jendela masih beragam (Claude Haiku 4.5 membawa 200K), jadi periksa model spesifiknya, bukan mereknya.
Jangan menulis "ringkas ini" lalu berhenti. Mintalah kerangka, entitas yang disebut, keputusan, risiko, dan kontradiksinya, lengkap dengan rujukan halaman jika alur kerja Anda mendukungnya, lalu minta model menandai bagian yang ia ragukan. Model konteks panjang yang tidak bisa menyebut halaman berarti tidak membaca bagian tengahnya. Perbandingan jendela konteks menjelaskan mengapa bagian tengah dari sejuta token justru tempat daya ingat mulai goyah.
Tabel keputusan
Tabel keputusan lengkap, beserta alasannya. Mulai dari pemenangnya, beri penantang satu percobaan sungguhan dengan masukan yang sama, lalu simpan yang lolos rubrik Anda.
| Jika tugas Anda... | Mulai dengan | Tantang dengan | Alasannya |
|---|---|---|---|
| Draf pertama sebuah rencana atau jawaban terstruktur | ChatGPT | Claude | Tercepat dari halaman kosong menjadi draf yang bisa Anda tanggapi |
| Memoles artikel, memo, atau hasil kerja klien | Claude | ChatGPT | Menang pada nada dan penyuntingan; 10 kredit per pesan di Whizi |
| Analisis atau ekstraksi dokumen besar | Gemini | Claude | Tarif masukan terendah ($1.50 per juta token) pada jendela 1M token |
| Tinjauan kode atau perencanaan refaktor | Claude | ChatGPT | Tinjauan cermat atas diff besar dengan sekitar sepertiga biaya per jawaban GPT-5.5 |
| Debugging dengan log dan tes | ChatGPT | Claude | Penalaran bertahap terkuat dari reproduksi yang bersih |
| Campuran gambar, dokumen, dan teks | Gemini | ChatGPT | Asupan multimodal termurah di antara ketiganya |
| Sintesis riset dari paket sumber | Claude | Gemini | Paling baik memisahkan sumber dari kesimpulan |
| Volume harian dengan anggaran ketat | Gemini 3.5 Flash atau GPT-5.6 Luna | Ketiganya | $0.006 dan $0.0008 per jawaban standar |
Tabel ini hanya menentukan siapa yang mendapat percobaan pertama. Rubrik Anda, pada tugas Anda, yang menentukan siapa yang bertahan.
Protokol uji prompt A/B/C yang bisa dipakai ulang
Cara paling bersih menjawab "ChatGPT vs Claude vs Gemini" adalah berhenti berdebat dan menjalankan prompt yang sama di ketiganya. Pakai protokol ini untuk alur kerja penting mana pun sebelum Anda memilih model bawaan.
- Pilih satu tugas nyata. Jangan pakai prompt mainan. Pilih tugas yang benar-benar perlu Anda selesaikan minggu ini: email penjualan, tinjauan kode, sintesis riset pasar, ekstraksi PDF, atau balasan ke pelanggan.
- Buat paket masukan yang tetap. Sertakan teks sumber, batasan, audiens, format yang diinginkan, dan standar kualitas yang sama untuk setiap model. Jika satu model mendapat konteks lebih banyak daripada yang lain, ujinya tidak adil.
- Siapkan rubrik penilaian sebelum Anda membaca jawabannya. Beri skor tiap keluaran dari 1 sampai 5 pada akurasi, kegunaan, kepatuhan format, waktu penyuntingan, risiko, dan kalibrasi keyakinan.
- Jalankan prompt yang sama di tiap model tanpa mengubah kata-katanya. Jika prompt pertama cacat, revisi sekali lalu jalankan ulang di semuanya.
- Lakukan tantangan babak kedua. Tanyakan ke tiap model: "Apa yang bisa keliru dari jawaban ini? Asumsi apa yang Anda buat? Apa yang harus saya verifikasi?"
- Pilih satu aturan alur kerja. Misalnya: "Pakai Claude untuk prosa final, ChatGPT untuk rencana implementasi, Gemini untuk dokumen panjang, dan Whizi saat tugasnya cukup penting untuk dibandingkan."
Prompt uji siap tempel: "Saya sedang membandingkan model AI untuk alur kerja ini. Selesaikan tugas di bawah hanya memakai konteks yang disediakan. Ikuti format keluaran dengan tepat. Setelah jawaban, sertakan: asumsi, risiko, daftar periksa verifikasi, dan satu saran untuk memperbaiki prompt-nya. Tugas: [tempel tugas]. Konteks: [tempel konteks]. Format keluaran: [tempel format]."
Biaya: satu langganan vs beberapa langganan
Hitungan langganan per Agustus 2026: ChatGPT Plus, Claude Pro, dan Google AI Pro masing-masing berada di kisaran $20 per bulan, jadi berlangganan ketiganya secara langsung mendekati $60. Pasangan yang dihitung di cara termurah memakai ChatGPT dan Claude bersamaan berhenti di sekitar $28 per bulan (ChatGPT Go plus Claude Pro) atau $40 (Plus plus Claude Pro), dan keduanya tidak memuat Gemini.
Argumen konsolidasi Whizi adalah satu paket yang membawa ketiga keluarga model. Starter seharga $15.99 per bulan ($10.99 jika ditagih tahunan) memuat ChatGPT Luna dengan 1 kredit per pesan plus Gemini Flash, dan catatan jujurnya adalah Starter sama sekali tidak membawa model Claude: baris Claude ada di tingkat yang lebih tinggi, tempat Sonnet 5 memakan 10 kredit per pesan dan Opus 5 memakan 20. Kalau Claude satu-satunya model yang Anda pakai sepanjang hari, $20 flat dari Claude Pro memberi Anda lebih banyak Claude daripada yang akan pernah diberikan Whizi Starter. Itulah kasus ketika langganan langsung mengalahkan konsolidasi.
Masukkan tumpukan langganan Anda sendiri ke kalkulator penghematan langganan AI, lalu bandingkan hasilnya dengan harga Whizi. Targetnya satu angka: berapa yang Anda bayar sekarang, berapa biaya satu paket gabungan, dan model apa yang benar-benar hilang saat berpindah.
Coba prompt yang sama di seluruh model
Kesimpulannya, tanpa berputar-putar: Claude untuk menulis dan meninjau kode, ChatGPT untuk debugging dan draf terstruktur, Gemini untuk dokumen panjang dan volume murah. Pilihan bawaan itu berlaku sampai uji A/B/C Anda sendiri berkata lain, dan uji itu lebih berbobot daripada halaman ini.
Di Whizi Anda bisa menjalankan satu prompt pada ketiga keluarga model secara berdampingan dan melihat harga per pesan sebelum mengirim: 1 kredit untuk ChatGPT Luna, 8 untuk Gemini 3.5 Flash, 10 untuk Claude Sonnet 5, 20 untuk GPT-5.5. Tidak ada aplikasi satu penyedia yang menerbitkan perbandingan itu, karena tidak ada penyedia yang memberi harga pada model pesaingnya.
Kalau sudah siap, jalankan perbandingannya di Whizi, mulai dari satu tugas yang paling sering Anda ulang, dan biarkan skornya yang menyusun perutean Anda.
- Tentukan lapisan mana yang Anda beli: aplikasi seharga $20 nyaris seri, sedangkan API berbeda tiga kali lipat dalam harga.
- Pakai tugas, konteks, dan format keluaran yang sama saat menguji ChatGPT, Claude, dan Gemini.
- Nilai hasilnya pada akurasi, kepatuhan format, waktu penyuntingan, dan risiko, dengan rubrik yang ditulis lebih dulu.
- Perlakukan ChatGPT, Claude, dan Gemini sebagai sistem pengarahan alih-alih memaksakan satu pemenang universal.
- Jumlahkan pengeluaran AI Anda saat ini di kalkulator penghematan sebelum memperpanjang paket $20 yang kedua.
Pertanyaan Umum
Mana yang lebih bagus: ChatGPT, Claude, atau Gemini?
Pembagiannya menurut tugas: Claude menang untuk tulisan yang rapi dan tinjauan kode, ChatGPT menang untuk debugging dari reproduksi yang bersih dan draf terstruktur, dan Gemini menang untuk dokumen panjang serta pekerjaan multimodal dengan biaya terendah. Per jawaban standar, Gemini 3.5 Flash $0.006, Claude Sonnet 5 $0.007, dan GPT-5.5 $0.02.
Apa model AI terbaik untuk menulis?
Claude. Ia menjaga nada sepanjang penulisan ulang yang panjang dan menyunting tanpa memudarkan suara penulis, itulah sebabnya ia memegang prosa final dalam rute kami. ChatGPT adalah perhentian pertama yang lebih baik untuk kerangka dan variasi, dan Gemini baru layak diberi tugas menulis ketika naskahnya bersandar pada ratusan halaman bahan sumber.
Apa model AI terbaik untuk mengoding?
ChatGPT ketika Anda punya reproduksi yang bersih, Claude untuk tinjauan dan rencana refaktor. Beri keduanya laporan bug dan tes gagal yang sama, minta perubahan aman terkecil beserta tes regresi, lalu pertahankan yang menyentuh lebih sedikit kode. Ceruk Gemini di ranah kode adalah membaca seluruh basis kode di dalam jendela 1M token dengan murah.
Haruskah saya membayar beberapa langganan AI?
Tidak dengan harga penuh. Tiga langganan langsung mendekati $60 per bulan dan tumpang tindih pada sebagian besar tugas. Pilih satu model yang memenangkan tugas paling sering Anda kerjakan, atau konsolidasikan: Whizi Starter $15.99 per bulan ($10.99 jika ditagih tahunan), dan Claude mulai dari paket Pro.