พรอมต์เดียวกัน ตอบโดย ChatGPT และ Claude เคียงข้างกัน
เลือกหนึ่งใน 3 พรอมต์ ดูทั้งสองโมเดลตอบพร้อมกัน แล้วเก็บคำตอบที่คุณจะส่งจริง ๆ ที่นี่ไม่มีอะไรเรียกใช้โมเดลเลย คำตอบเป็นบทถอดความที่ตายตัว หน้านี้จึงฟรีและเหมือนเดิมทุกครั้ง
หลักการทำงาน
แต่ละพรอมต์ได้คะแนนเต็ม 100 จากสิ่งเดียวที่พรอมต์นั้นวัดจริง ๆ และผู้ชนะไม่ได้เป็นโมเดลเดิมเสมอไป นั่นแหละคือประเด็น: ChatGPT จัดโครงงานได้ดีกว่า Claude ตัดสินว่าอะไรสำคัญได้ดีกว่า และคุณต้องการตัวไหนก็ขึ้นอยู่กับงานตรงหน้า
นี่คือคำตอบตัวอย่างที่ตายตัว เขียนขึ้นเพื่อแสดงว่าสองโมเดลต่างกันที่ลักษณะ ไม่ใช่ต่างกันที่คุณภาพ ไม่ใช่ผลลัพธ์ที่โมเดลสร้างสด และไม่ใช่การวัดมาตรฐาน
สรุปสัญญา 40 หน้าฉบับนี้
ตัดสินจากความแม่นยำและการเลือกประเด็น
ChatGPT (OpenAI), 92/100
นี่คือสรุปข้อสัญญาสำคัญ:
- คู่สัญญา: Meridian Corp (ผู้ว่าจ้าง) และ Halcyon Ltd (ผู้ให้บริการ)
- ระยะเวลา: 24 เดือน ต่ออายุอัตโนมัติเว้นแต่บอกเลิกล่วงหน้า 60 วัน
- ค่าบริการ: 12,400 ดอลลาร์ต่อเดือน ปรับขึ้นปีละ 4%
- ความรับผิด: จำกัดที่ค่าบริการ 12 เดือน
- การบอกเลิก: ทำได้ทั้งสองฝ่าย แจ้งเป็นลายลักษณ์อักษรล่วงหน้า 90 วัน
บอกได้เลยถ้าอยากได้ตารางแยกทีละข้อ
Claude Sonnet (Anthropic), 96/100
นี่คือสัญญาบริการ 24 เดือนระหว่าง Meridian Corp กับ Halcyon Ltd ที่เดือนละ 12,400 ดอลลาร์ ปรับขึ้นปีละ 4%
สามเรื่องที่ควรดูให้ดีก่อนเซ็น: สัญญาต่ออายุเองถ้าคุณไม่บอกเลิกก่อนครบกำหนด 60 วัน ความรับผิดจำกัดที่ค่าบริการหนึ่งปี และการแจ้งบอกเลิกล่วงหน้า 90 วันนั้นยาวกว่ามาตรฐาน
ที่เหลือเป็นข้อความมาตรฐาน
คำตัดสิน: Claude ชนะ 96 ต่อ 92 ทั้งคู่ให้ข้อเท็จจริงถูกต้อง แต่ Claude บอกว่าควรกังวลเรื่องอะไร แทนที่จะไล่เรียงทุกอย่างเท่ากันหมด
ปฏิเสธนัดประชุมโดยไม่ตัดสัมพันธ์
ตัดสินจากน้ำเสียงและความพร้อมส่ง
ChatGPT (OpenAI), 88/100
เรื่อง: ตอบกลับ: การพูดคุยเรื่องความร่วมมือ
สวัสดีค่ะ คุณ[ชื่อ]
ขอบคุณมากที่ติดต่อมานะคะ! น่าเสียดายที่ตารางงานตอนนี้ไม่เอื้อให้จัดเวลาได้เลย ขอบคุณจริง ๆ ที่นึกถึงดิฉัน และอยากเปิดโอกาสไว้สำหรับครั้งหน้าค่ะ
ขอให้โครงการราบรื่นทุกอย่างนะคะ!
ด้วยความนับถือ
[ชื่อของคุณ]
Claude Sonnet (Anthropic), 95/100
สวัสดีค่ะ ดานา
ขอบคุณที่ชวนนะคะ วันพฤหัสขอผ่านค่ะ สัปดาห์นี้รับงานไว้เยอะเกินไปแล้ว และขอไม่ไปดีกว่าไปแบบเตรียมตัวมาครึ่งเดียว
ถ้าช่วยได้ ดิฉันขอดูสไลด์เองแล้วส่งความเห็นให้ภายในวันศุกร์ ถ้าไม่สะดวก ไว้เจอกันรอบหน้าค่ะ
นูรา
คำตัดสิน: Claude ชนะ 95 ต่อ 88 ไม่มีช่องให้เติม มีเหตุผลจริง และเสนอทางเลือกให้ ส่งได้ทันทีตามที่เขียนไว้เลย
เปลี่ยนโน้ตพวกนี้เป็นเช็กลิสต์ก่อนเปิดตัว
ตัดสินจากโครงสร้างและผู้รับผิดชอบ
ChatGPT (OpenAI), 94/100
เช็กลิสต์ก่อนเปิดตัว เรียงตามกำหนดส่ง:
- ปิดขอบเขตงาน (จ.) ผู้รับผิดชอบ: ผู้จัดการผลิตภัณฑ์
- ตรวจ QA รอบสุดท้ายเรื่องการชำระเงิน (อ.) ผู้รับผิดชอบ: ทีมวิศวกรรม
- ชุดข่าวประชาสัมพันธ์และภาพหน้าจอ (พ.) ผู้รับผิดชอบ: ทีมออกแบบ
- ตั้งเวลาสื่อสำหรับ Product Hunt (พฤ.) ผู้รับผิดชอบ: ทีมการตลาด
- ห้องบัญชาการวันเปิดตัว (ศ.) ทั้งทีม
อยากได้เป็นตารางที่มีคอลัมน์สถานะไหม
Claude Sonnet (Anthropic), 90/100
มีห้าเรื่องคั่นระหว่างโน้ตพวกนี้กับวันศุกร์: ล็อกขอบเขตงานวันจันทร์เพื่อให้ทีม QA ได้บิลด์ที่นิ่ง รันทดสอบย้อนกลับเรื่องการชำระเงินวันอังคาร เอาชุดข่าวออกจากทีมออกแบบให้ได้ภายในวันพุธ ตั้งเวลาสื่อ Product Hunt คืนวันพฤหัส และเว้นวันศุกร์ไว้ให้การเปิดตัวเอง
ในโน้ตยังพูดถึงราคาแยกตามประเทศด้วย ผมจะตัดออกจากการเปิดตัวรอบนี้ มันไม่ใช่ส่วนที่รับน้ำหนัก
คำตัดสิน: ChatGPT ชนะ 94 ต่อ 90 มีผู้รับผิดชอบ มีกำหนดส่ง และเป็นรายการมีเลขที่วางลงในระบบติดตามงานได้เลย
คำถาม
หน้านี้เรียกใช้โมเดลจริงหรือเปล่า
ไม่ คำตอบเป็นบทถอดความที่ตายตัว หน้านี้จึงโหลดขึ้นทันทีและไม่มีค่าใช้จ่ายในการรัน ถ้าอยากส่งพรอมต์ของคุณเองให้ทั้งสองโมเดลพร้อมกัน ให้เปิด Whizi
โมเดลไหนดีกว่ากัน ChatGPT หรือ Claude
ไม่มีตัวไหนดีกว่าในทุกด้าน ในสามพรอมต์นี้ Claude ชนะเรื่องสรุปสัญญาและอีเมล เพราะมันตัดสินได้ว่าอะไรสำคัญ ส่วน ChatGPT ชนะเรื่องเช็กลิสต์ เพราะมันจัดโครงงานได้ การเลือกตัวเดียวไว้ใช้กับทุกเรื่องคือความผิดพลาดที่หน้านี้พูดถึงพอดี
แชร์การเปรียบเทียบอันใดอันหนึ่งได้ไหม
ได้ คัดลอกลิงก์สำหรับแชร์ แล้วหน้าจะเปิดที่พรอมต์เดียวกันสำหรับคนที่คุณส่งให้