พรอมต์เดียวกัน ตอบโดย ChatGPT และ Claude เคียงข้างกัน

เลือกหนึ่งใน 3 พรอมต์ ดูทั้งสองโมเดลตอบพร้อมกัน แล้วเก็บคำตอบที่คุณจะส่งจริง ๆ ที่นี่ไม่มีอะไรเรียกใช้โมเดลเลย คำตอบเป็นบทถอดความที่ตายตัว หน้านี้จึงฟรีและเหมือนเดิมทุกครั้ง

หลักการทำงาน

แต่ละพรอมต์ได้คะแนนเต็ม 100 จากสิ่งเดียวที่พรอมต์นั้นวัดจริง ๆ และผู้ชนะไม่ได้เป็นโมเดลเดิมเสมอไป นั่นแหละคือประเด็น: ChatGPT จัดโครงงานได้ดีกว่า Claude ตัดสินว่าอะไรสำคัญได้ดีกว่า และคุณต้องการตัวไหนก็ขึ้นอยู่กับงานตรงหน้า

นี่คือคำตอบตัวอย่างที่ตายตัว เขียนขึ้นเพื่อแสดงว่าสองโมเดลต่างกันที่ลักษณะ ไม่ใช่ต่างกันที่คุณภาพ ไม่ใช่ผลลัพธ์ที่โมเดลสร้างสด และไม่ใช่การวัดมาตรฐาน

สรุปสัญญา 40 หน้าฉบับนี้

ตัดสินจากความแม่นยำและการเลือกประเด็น

ChatGPT (OpenAI), 92/100

นี่คือสรุปข้อสัญญาสำคัญ:

  • คู่สัญญา: Meridian Corp (ผู้ว่าจ้าง) และ Halcyon Ltd (ผู้ให้บริการ)
  • ระยะเวลา: 24 เดือน ต่ออายุอัตโนมัติเว้นแต่บอกเลิกล่วงหน้า 60 วัน
  • ค่าบริการ: 12,400 ดอลลาร์ต่อเดือน ปรับขึ้นปีละ 4%
  • ความรับผิด: จำกัดที่ค่าบริการ 12 เดือน
  • การบอกเลิก: ทำได้ทั้งสองฝ่าย แจ้งเป็นลายลักษณ์อักษรล่วงหน้า 90 วัน

บอกได้เลยถ้าอยากได้ตารางแยกทีละข้อ

Claude Sonnet (Anthropic), 96/100

นี่คือสัญญาบริการ 24 เดือนระหว่าง Meridian Corp กับ Halcyon Ltd ที่เดือนละ 12,400 ดอลลาร์ ปรับขึ้นปีละ 4%

สามเรื่องที่ควรดูให้ดีก่อนเซ็น: สัญญาต่ออายุเองถ้าคุณไม่บอกเลิกก่อนครบกำหนด 60 วัน ความรับผิดจำกัดที่ค่าบริการหนึ่งปี และการแจ้งบอกเลิกล่วงหน้า 90 วันนั้นยาวกว่ามาตรฐาน

ที่เหลือเป็นข้อความมาตรฐาน

คำตัดสิน: Claude ชนะ 96 ต่อ 92 ทั้งคู่ให้ข้อเท็จจริงถูกต้อง แต่ Claude บอกว่าควรกังวลเรื่องอะไร แทนที่จะไล่เรียงทุกอย่างเท่ากันหมด

ปฏิเสธนัดประชุมโดยไม่ตัดสัมพันธ์

ตัดสินจากน้ำเสียงและความพร้อมส่ง

ChatGPT (OpenAI), 88/100

เรื่อง: ตอบกลับ: การพูดคุยเรื่องความร่วมมือ

สวัสดีค่ะ คุณ[ชื่อ]

ขอบคุณมากที่ติดต่อมานะคะ! น่าเสียดายที่ตารางงานตอนนี้ไม่เอื้อให้จัดเวลาได้เลย ขอบคุณจริง ๆ ที่นึกถึงดิฉัน และอยากเปิดโอกาสไว้สำหรับครั้งหน้าค่ะ

ขอให้โครงการราบรื่นทุกอย่างนะคะ!

ด้วยความนับถือ
[ชื่อของคุณ]

Claude Sonnet (Anthropic), 95/100

สวัสดีค่ะ ดานา

ขอบคุณที่ชวนนะคะ วันพฤหัสขอผ่านค่ะ สัปดาห์นี้รับงานไว้เยอะเกินไปแล้ว และขอไม่ไปดีกว่าไปแบบเตรียมตัวมาครึ่งเดียว

ถ้าช่วยได้ ดิฉันขอดูสไลด์เองแล้วส่งความเห็นให้ภายในวันศุกร์ ถ้าไม่สะดวก ไว้เจอกันรอบหน้าค่ะ

นูรา

คำตัดสิน: Claude ชนะ 95 ต่อ 88 ไม่มีช่องให้เติม มีเหตุผลจริง และเสนอทางเลือกให้ ส่งได้ทันทีตามที่เขียนไว้เลย

เปลี่ยนโน้ตพวกนี้เป็นเช็กลิสต์ก่อนเปิดตัว

ตัดสินจากโครงสร้างและผู้รับผิดชอบ

ChatGPT (OpenAI), 94/100

เช็กลิสต์ก่อนเปิดตัว เรียงตามกำหนดส่ง:

  1. ปิดขอบเขตงาน (จ.) ผู้รับผิดชอบ: ผู้จัดการผลิตภัณฑ์
  2. ตรวจ QA รอบสุดท้ายเรื่องการชำระเงิน (อ.) ผู้รับผิดชอบ: ทีมวิศวกรรม
  3. ชุดข่าวประชาสัมพันธ์และภาพหน้าจอ (พ.) ผู้รับผิดชอบ: ทีมออกแบบ
  4. ตั้งเวลาสื่อสำหรับ Product Hunt (พฤ.) ผู้รับผิดชอบ: ทีมการตลาด
  5. ห้องบัญชาการวันเปิดตัว (ศ.) ทั้งทีม

อยากได้เป็นตารางที่มีคอลัมน์สถานะไหม

Claude Sonnet (Anthropic), 90/100

มีห้าเรื่องคั่นระหว่างโน้ตพวกนี้กับวันศุกร์: ล็อกขอบเขตงานวันจันทร์เพื่อให้ทีม QA ได้บิลด์ที่นิ่ง รันทดสอบย้อนกลับเรื่องการชำระเงินวันอังคาร เอาชุดข่าวออกจากทีมออกแบบให้ได้ภายในวันพุธ ตั้งเวลาสื่อ Product Hunt คืนวันพฤหัส และเว้นวันศุกร์ไว้ให้การเปิดตัวเอง

ในโน้ตยังพูดถึงราคาแยกตามประเทศด้วย ผมจะตัดออกจากการเปิดตัวรอบนี้ มันไม่ใช่ส่วนที่รับน้ำหนัก

คำตัดสิน: ChatGPT ชนะ 94 ต่อ 90 มีผู้รับผิดชอบ มีกำหนดส่ง และเป็นรายการมีเลขที่วางลงในระบบติดตามงานได้เลย

คำถาม

หน้านี้เรียกใช้โมเดลจริงหรือเปล่า

ไม่ คำตอบเป็นบทถอดความที่ตายตัว หน้านี้จึงโหลดขึ้นทันทีและไม่มีค่าใช้จ่ายในการรัน ถ้าอยากส่งพรอมต์ของคุณเองให้ทั้งสองโมเดลพร้อมกัน ให้เปิด Whizi

โมเดลไหนดีกว่ากัน ChatGPT หรือ Claude

ไม่มีตัวไหนดีกว่าในทุกด้าน ในสามพรอมต์นี้ Claude ชนะเรื่องสรุปสัญญาและอีเมล เพราะมันตัดสินได้ว่าอะไรสำคัญ ส่วน ChatGPT ชนะเรื่องเช็กลิสต์ เพราะมันจัดโครงงานได้ การเลือกตัวเดียวไว้ใช้กับทุกเรื่องคือความผิดพลาดที่หน้านี้พูดถึงพอดี

แชร์การเปรียบเทียบอันใดอันหนึ่งได้ไหม

ได้ คัดลอกลิงก์สำหรับแชร์ แล้วหน้าจะเปิดที่พรอมต์เดียวกันสำหรับคนที่คุณส่งให้

ขั้นถัดไป

อ่านบทเปรียบเทียบ ChatGPT กับ Claudeฉบับเต็ม หรือคำนวณราคางานเดียวกันบนทุกโมเดลด้วยเครื่องคำนวณค่าใช้จ่ายโทเค็น