یک پرامپت یکسان، که ChatGPT و Claude کنار هم به آن پاسخ میدهند.
یکی از 3 پرامپت را انتخاب کنید، ببینید هر دو مدل همزمان پاسخ میدهند، و پاسخی را نگه دارید که واقعاً میفرستادید. اینجا هیچ چیز مدلی را صدا نمیزند: پاسخها متنهای ثابتاند، پس صفحه رایگان است و هر بار یکسان.
این چطور کار میکند
هر پرامپت از ۱۰۰ امتیاز میگیرد، آن هم فقط بابت همان یک چیزی که واقعاً میسنجد، و برنده همیشه یک مدل نیست. نکته دقیقاً همین است: ChatGPT کار را بهتر ساختار میدهد، Claude بهتر تشخیص میدهد چه چیزی مهم است، و اینکه کدام را میخواهید به کاری بستگی دارد که پیش رویتان است.
اینها پاسخهای نمونه ثابتاند که نوشته شدهاند تا نشان دهند دو مدل در جنس با هم فرق دارند نه در کیفیت. خروجی زنده مدل نیستند و معیارسنجی هم نیستند.
این قرارداد ۴۰ صفحهای را خلاصه کن
بر پایه دقت و تمرکز داوری میشود
ChatGPT (OpenAI), 92/100
این هم تفکیک بندهای اصلی:
طرفین: Meridian Corp (کارفرما) و Halcyon Ltd (پیمانکار)
مدت: ۲۴ ماه، تمدید خودکار مگر با فسخ ۶۰ روز پیش از پایان
حقالزحمه: ۱۲٬۴۰۰ دلار در ماه با افزایش سالانه ۴٪
مسئولیت: حداکثر معادل ۱۲ ماه حقالزحمه
فسخ: از سوی هر یک از طرفین، با اطلاع کتبی ۹۰ روزه
اگر جدول بند به بند خواستید بگویید.
Claude Sonnet (Anthropic), 96/100
این یک قرارداد خدمات ۲۴ ماهه میان Meridian Corp و Halcyon Ltd است، ماهی ۱۲٬۴۰۰ دلار که هر سال ۴٪ بالا میرود.
پیش از امضا سه نکته ارزش توجه دارد: قرارداد خودش تمدید میشود مگر ۶۰ روز پیش از پایان مدت فسخش کنید، سقف مسئولیت یک سال حقالزحمه است، و مهلت اطلاع فسخ ۹۰ روزه از حد معمول بلندتر است.
بقیهاش متن استاندارد است.
حکم: Claude برنده است، 96 به 92. هر دو واقعیتها را درست گفتند، اما Claude به جای فهرست کردن همه چیز به یک اندازه، گفت نگران چه باید بود.
یک جلسه را رد کن بدون اینکه پل را خراب کنی
بر پایه لحن و آماده بودن برای ارسال داوری میشود
ChatGPT (OpenAI), 88/100
موضوع: پاسخ: گفتوگو درباره همکاری
سلام [نام]،
خیلی ممنون که تماس گرفتید! متأسفانه با برنامه فعلیام نمیتوانم این را جا بدهم. واقعاً قدردانم که به من فکر کردید و دوست دارم در را برای فرصتهای بعدی باز نگه دارم.
برای پروژه بهترینها را آرزو میکنم!
با احترام، [نام شما]
Claude Sonnet (Anthropic), 95/100
سلام دانا،
ممنون بابت دعوت. پنجشنبه را رد میکنم، هفتهام همین حالا هم بیش از حد پر است و ترجیح میدهم نیایم تا اینکه نیمهآماده حاضر شوم.
اگر به کار میآید، میتوانم فایل ارائه را خودم مرور کنم و تا جمعه یادداشتهایم را بفرستم. وگرنه دور بعد میبینمتان.
نورا
حکم: Claude برنده است، 95 به 88. هیچ جای خالی برای پر کردن ندارد، دلیل واقعی دارد و یک جایگزین پیشنهاد میدهد. میشود دقیقاً همینطور فرستادش.
این یادداشتها را به فهرست کارهای پیش از عرضه تبدیل کن
بر پایه ساختار و تعیین مسئول داوری میشود
ChatGPT (OpenAI), 94/100
فهرست پیش از عرضه، به ترتیب مهلت:
بستن دامنه کار (دوشنبه)، مسئول: مدیر محصول
آخرین دور تست پرداختها (سهشنبه)، مسئول: مهندسی
بسته رسانهای و تصاویر صفحه (چهارشنبه)، مسئول: طراحی
پنج چیز میان این یادداشتها و جمعه ایستاده است: دوشنبه دامنه کار را قفل کنید تا تیم تست نسخه پایداری داشته باشد، سهشنبه تست بازگشتی پرداختها را اجرا کنید، تا چهارشنبه بسته رسانهای را از طراحی بگیرید، پنجشنبه شب محتوای Product Hunt را زمانبندی کنید، و جمعه را برای خود عرضه خالی نگه دارید.
یادداشتها به قیمتگذاری منطقهای هم اشاره دارند. من آن را از این عرضه حذف میکردم، تکیهگاه چیزی نیست.
حکم: ChatGPT برنده است، 94 به 90. مسئول دارد، مهلت دارد، و فهرستی شمارهدار که مستقیم در ابزار پیگیری کارها میچسبانید.
پرسشها
آیا این صفحه مدلهای واقعی را صدا میزند؟
نه. پاسخها متنهای ثابتاند و به همین دلیل صفحه بیدرنگ باز میشود و اجرایش هزینهای ندارد. برای فرستادن پرامپت خودتان به هر دو مدل بهطور همزمان، Whizi را باز کنید.
کدام مدل بهتر است، ChatGPT یا Claude؟
هیچکدام در همه چیز. در این سه پرامپت، Claude خلاصه قرارداد و ایمیل را میبرد چون تشخیص میدهد چه چیزی مهم است، و ChatGPT فهرست کارها را میبرد چون کار را ساختار میدهد. انتخاب یکی برای همه چیز دقیقاً همان اشتباهی است که این صفحه دربارهاش حرف میزند.
میتوانم یک مقایسه مشخص را به اشتراک بگذارم؟
بله. پیوند اشتراکگذاری را کپی کنید تا صفحه برای گیرنده روی همان پرامپت باز شود.