Prompt yang sama, dijawab ChatGPT dan Claude berdampingan.

Pilih satu dari 3 prompt, lihat kedua model menjawab sekaligus, dan simpan jawaban yang benar-benar akan Anda kirim. Tidak ada yang memanggil model di sini: jawabannya berupa transkrip tetap, jadi halaman ini gratis dijalankan dan selalu sama.

Cara kerjanya

Tiap prompt dinilai dari 100 untuk satu hal yang benar-benar diuji prompt itu, dan pemenangnya tidak selalu model yang sama. Justru itu intinya: ChatGPT lebih baik menyusun pekerjaan, Claude lebih baik menimbang apa yang penting, dan mana yang Anda butuhkan tergantung tugas di depan Anda.

Ini jawaban contoh tetap, ditulis untuk memperlihatkan bagaimana kedua model berbeda jenis, bukan berbeda kualitas. Ini bukan keluaran model secara langsung dan bukan tolok ukur.

Ringkas kontrak 40 halaman ini

Dinilai dari ketepatan dan fokus

ChatGPT (OpenAI), 92/100

Berikut rincian ketentuan utamanya:

  • Para pihak: Meridian Corp (klien) dan Halcyon Ltd (penyedia)
  • Jangka waktu: 24 bulan, diperpanjang otomatis kecuali dibatalkan 60 hari sebelumnya
  • Biaya: USD 12.400 per bulan dengan kenaikan 4% per tahun
  • Tanggung jawab: dibatasi 12 bulan biaya
  • Pengakhiran: oleh pihak mana pun, pemberitahuan tertulis 90 hari

Beri tahu saya kalau Anda mau tabel pasal per pasal.

Claude Sonnet (Anthropic), 96/100

Ini perjanjian jasa 24 bulan antara Meridian Corp dan Halcyon Ltd senilai USD 12.400 per bulan, naik 4% setiap tahun.

Tiga hal layak diperhatikan sebelum tanda tangan: kontrak diperpanjang sendiri kalau Anda tidak membatalkan 60 hari sebelum berakhir, tanggung jawab dibatasi satu tahun biaya, dan pemberitahuan pengakhiran 90 hari lebih lama dari lazimnya.

Sisanya ketentuan baku.

Putusan: Claude menang, 96 berbanding 92. Keduanya menyampaikan faktanya dengan benar, tetapi Claude memberi tahu apa yang perlu dikhawatirkan alih-alih mendaftar semuanya sama rata.

Tolak rapat tanpa memutus hubungan

Dinilai dari nada dan kesiapan kirim

ChatGPT (OpenAI), 88/100

Subjek: Re: Pembicaraan kemitraan

Halo [Nama],

Terima kasih banyak sudah menghubungi! Sayangnya saya tidak bisa menyesuaikannya dengan jadwal saya saat ini. Saya sungguh menghargai Anda memikirkan saya, dan saya senang kalau pintunya tetap terbuka untuk kesempatan berikutnya.

Semoga proyeknya berjalan lancar!

Salam hormat,
[Nama Anda]

Claude Sonnet (Anthropic), 95/100

Halo Dana,

Terima kasih undangannya. Saya lewatkan yang Kamis, minggu ini sudah terlalu padat dan saya lebih baik absen daripada datang setengah siap.

Kalau membantu, saya bisa membaca dek itu sendiri dan mengirim catatan sebelum Jumat. Kalau tidak, sampai jumpa di putaran berikutnya.

Noura

Putusan: Claude menang, 95 berbanding 88. Tanpa bagian yang harus diisi, ada alasan sungguhan, dan ada tawaran alternatif. Bisa dikirim persis seperti itu.

Ubah catatan ini jadi daftar periksa peluncuran

Dinilai dari struktur dan penanggung jawab

ChatGPT (OpenAI), 94/100

Daftar periksa peluncuran, urut berdasarkan tenggat:

  1. Kunci cakupan (Sen), penanggung jawab: manajer produk
  2. QA terakhir untuk pembayaran (Sel), penanggung jawab: teknik
  3. Kit pers dan tangkapan layar (Rab), penanggung jawab: desain
  4. Jadwalkan materi Product Hunt (Kam), penanggung jawab: pemasaran
  5. Ruang komando di hari peluncuran (Jum), semua orang

Mau ini dalam bentuk tabel dengan kolom status?

Claude Sonnet (Anthropic), 90/100

Lima hal memisahkan catatan ini dari hari Jumat: kunci cakupan pada Senin agar QA punya build yang stabil, jalankan regresi pembayaran pada Selasa, ambil kit pers dari desain paling lambat Rabu, jadwalkan materi Product Hunt pada Kamis malam, dan kosongkan Jumat untuk peluncurannya sendiri.

Catatannya juga menyebut harga terlokalisasi. Saya akan mencoretnya dari peluncuran ini, itu bukan bagian penopang.

Putusan: ChatGPT menang, 94 berbanding 90. Ada penanggung jawab, tenggat, dan daftar bernomor yang bisa langsung ditempel ke pelacak tugas.

Pertanyaan

Apakah ini memanggil model sungguhan?

Tidak. Jawabannya transkrip tetap, itulah sebabnya halaman ini terbuka seketika dan tidak memakan biaya. Untuk mengirim prompt Anda sendiri ke kedua model sekaligus, buka Whizi.

Mana yang lebih baik, ChatGPT atau Claude?

Tidak ada yang unggul di semua hal. Pada ketiga prompt ini Claude menang di ringkasan kontrak dan email karena ia menimbang apa yang penting, dan ChatGPT menang di daftar periksa karena ia menyusun pekerjaan. Memilih satu untuk segalanya justru kesalahan yang dibahas halaman ini.

Bisakah saya membagikan perbandingan tertentu?

Bisa. Salin tautan berbaginya dan halaman akan terbuka pada prompt yang sama untuk siapa pun yang Anda kirimi.

Langkah berikutnya

Baca perbandingan ChatGPT dan Claude selengkapnya, atau hitung biaya tugas yang sama di semua model dengan Kalkulator biaya token.