אותו פרומפט, נענה על ידי ChatGPT ו-Claude זה לצד זה.

בחרו אחד מתוך 3 פרומפטים, צפו בשני המודלים עונים בבת אחת, ושמרו את זה שהייתם באמת שולחים. שום דבר כאן לא קורא למודל: התשובות הן תמלולים קבועים, כך שהעמוד חינמי להפעלה וזהה בכל פעם.

איך זה עובד

כל פרומפט מנוקד מתוך 100 על הדבר האחד שהפרומפט הזה באמת בודק, והמנצח לא תמיד אותו מודל. זו הנקודה: ChatGPT מבנה עבודה טוב יותר, Claude מחליט מה חשוב יותר, ואיזה מהם תרצו תלוי במשימה שלפניכם.

אלה תשובות דוגמה קבועות שנכתבו כדי להראות איך שני המודלים שונים באופיים ולא באיכותם. הן אינן פלט חי של מודל, והן אינן מבחן השוואתי.

סכם את החוזה הזה בן 40 העמודים

נשפט לפי דיוק ומיקוד

ChatGPT (OpenAI), 92/100

הנה פירוט של התנאים המרכזיים:

  • צדדים: Meridian Corp (הלקוח) ו-Halcyon Ltd (הספק)
  • תוקף: 24 חודשים, מתחדש אוטומטית אלא אם מבטלים 60 יום מראש
  • עלויות: $12,400 לחודש עם עלייה שנתית של 4%
  • אחריות: מוגבלת ל-12 חודשי תשלומים
  • סיום: כל צד, הודעה בכתב 90 יום מראש

תגידו לי אם תרצו טבלה סעיף אחר סעיף.

Claude Sonnet (Anthropic), 96/100

זהו הסכם שירותים ל-24 חודשים בין Meridian Corp ל-Halcyon Ltd, ב-$12,400 לחודש, עולה ב-4% מדי שנה.

שלושה דברים ראויים לתשומת לבכם לפני החתימה: החוזה מתחדש אוטומטית אלא אם מבטלים 60 יום לפני תום התקופה, האחריות מוגבלת לשנת תשלומים אחת, והודעת הסיום של 90 יום ארוכה יותר מהמקובל.

כל השאר הוא נוסח סטנדרטי.

פסיקה: Claude מנצח, 96 מול 92. שניהם קלעו לעובדות, אבל Claude אמר לכם ממה כדאי לדאוג במקום לפרט הכול באופן שווה.

לדחות פגישה, לשמור על הגשר

נשפט לפי טון ומוכנות לשליחה

ChatGPT (OpenAI), 88/100

נושא: תגובה: דיון על שותפות

היי [שם],

תודה רבה על הפנייה! למרבה הצער, לא אוכל להסתדר עם זה בלוח הזמנים הנוכחי שלי. אני מעריך מאוד שחשבתם עליי, ואשמח להשאיר את הדלת פתוחה להזדמנויות עתידיות.

מאחל לכם הצלחה רבה בפרויקט!

בברכה,
[השם שלכם]

Claude Sonnet (Anthropic), 95/100

היי דנה,

תודה על ההזמנה. אני מוותר על יום חמישי, השבוע שלי כבר עמוס מדי ואני מעדיף לדלג מאשר להגיע לא מספיק מוכן.

אם זה עוזר, אני יכול לעבור על המצגת בנפרד ולשלוח הערות עד יום שישי. אחרת, נתפוס בסבב הבא.

נורה

פסיקה: Claude מנצח, 95 מול 88. בלי מקומות שמורים, סיבה אמיתית, והצעת חלופה. אפשר לשלוח את זה בדיוק כמו שנכתב.

הפכו את ההערות האלה לרשימת בדיקה להשקה

נשפט לפי מבנה ובעלות

ChatGPT (OpenAI), 94/100

רשימת בדיקה להשקה, מסודרת לפי מועד:

  1. הקפאת היקף (יום שני), אחראי: מנהל המוצר
  2. בדיקת QA סופית על תשלומים (יום שלישי), אחראי: הנדסה
  3. ערכת עיתונות וצילומי מסך (יום רביעי), אחראי: עיצוב
  4. תזמון נכסי Product Hunt (יום חמישי), אחראי: שיווק
  5. חדר מלחמה ליום ההשקה (יום שישי), כל הצוות

רוצים את זה כטבלה עם עמודות סטטוס?

Claude Sonnet (Anthropic), 90/100

חמישה דברים עומדים בין ההערות האלה ליום שישי: לנעול את ההיקף ביום שני כדי ש-QA יקבל בילד יציב, להריץ את בדיקת הרגרסיה לתשלומים ביום שלישי, לקבל את ערכת העיתונות מעיצוב עד יום רביעי, לתזמן את נכסי Product Hunt במוצאי יום חמישי, ולשמור את יום שישי פנוי להשקה עצמה.

ההערות מזכירות גם תמחור מותאם לאזור. הייתי מוריד את זה מההשקה הזו, זה לא קריטי.

פסיקה: ChatGPT מנצח, 94 מול 90. בעלים, מועדים, ורשימה ממוספרת שאפשר להדביק ישר לתוך כלי מעקב.

שאלות

זה קורא למודלים האמיתיים?

לא. התשובות הן תמלולים קבועים, ולכן העמוד נטען מיד וחינמי להפעלה. כדי לשלוח פרומפט משלכם לשני המודלים בבת אחת, פתחו את Whizi.

איזה מודל טוב יותר, ChatGPT או Claude?

אף אחד, לא באופן גורף. בשלושת הפרומפטים האלה Claude מנצח בסיכום החוזה ובמייל כי הוא מחליט מה חשוב, ו-ChatGPT מנצח ברשימת הבדיקה כי הוא מבנה עבודה. לבחור אחד לכל דבר היא הטעות שהעמוד הזה מדבר עליה.

אפשר לשתף השוואה מסוימת?

כן. העתיקו את הקישור לשיתוף, והעמוד ייפתח על אותו פרומפט למי ששולחים אליו.

הצעד הבא

קראו את ההשוואת ChatGPT מול Claude המלא, או תמחרו את אותה משימה על פני כל מודל עם המחשבון עלות טוקנים.