Den samme prompten, besvart av ChatGPT og Claude side om side.
Velg en av 3 prompter, se begge modellene svare samtidig, og behold den du faktisk ville sendt. Ingenting her kaller en modell: svarene er faste utskrifter, så siden er gratis å kjøre og identisk hver gang.
Slik fungerer dette
Hver prompt vurderes på en skala til 100 på den ene tingen prompten egentlig tester, og vinneren er ikke alltid den samme modellen. Det er selve poenget: ChatGPT strukturerer arbeid bedre, Claude avgjør hva som betyr mest, og hvilken du vil ha avhenger av oppgaven foran deg.
Dette er faste eksempelsvar skrevet for å vise hvordan de to modellene skiller seg i type snarere enn i kvalitet. De er ikke live modellutdata, og de er ikke en benchmark.
Oppsummer denne 40-siders kontrakten
Vurdert på nøyaktighet og fokus
ChatGPT (OpenAI), 92/100
Her er en oversikt over hovedvilkårene:
Parter: Meridian Corp (kunde) og Halcyon Ltd (leverandør)
Varighet: 24 måneder, fornyes automatisk med mindre den sies opp 60 dager i forveien
Avgifter: $12 400/mnd med en årlig økning på 4 %
Ansvar: begrenset til 12 måneders avgifter
Oppsigelse: begge parter, 90 dagers skriftlig varsel
Si fra hvis du vil ha en klausul-for-klausul-tabell.
Claude Sonnet (Anthropic), 96/100
Dette er en 24 måneders tjenesteavtale mellom Meridian Corp og Halcyon Ltd på $12 400 i måneden, med en økning på 4 % hvert år.
Tre ting fortjener oppmerksomheten din før du signerer: kontrakten fornyes automatisk med mindre du sier opp 60 dager før perioden utløper, ansvaret er begrenset til ett års avgifter, og oppsigelsesvarselet på 90 dager er lengre enn standard.
Alt annet er standardklausuler.
Dom: Claude vinner, 96 mot 92. Begge fikk fakta riktig, men Claude fortalte deg hva du burde bekymre deg for, i stedet for å liste opp alt likt.
Avslå et møte, hold kontakten
Vurdert på tone og ferdighet
ChatGPT (OpenAI), 88/100
Emne: Sv: Samarbeidssamtale
Hei [Navn],
Tusen takk for at du tok kontakt! Dessverre får jeg ikke dette til å passe med timeplanen min akkurat nå. Jeg setter virkelig pris på at du tenkte på meg, og jeg vil gjerne holde døren åpen for fremtidige muligheter.
Lykke til videre med prosjektet!
Med vennlig hilsen, [Ditt navn]
Claude Sonnet (Anthropic), 95/100
Hei Dana,
Takk for invitasjonen. Jeg takker nei til torsdag, uken min er allerede overbooket, og jeg vil heller hoppe over enn å møte opp halvveis forberedt.
Hvis det er nyttig, kan jeg gå gjennom presentasjonen asynkront og sende notater innen fredag. Ellers tar vi det neste runde.
Noura
Dom: Claude vinner, 95 mot 88. Ingen plassholdere, en ekte grunn, og et alternativ tilbudt. Du kunne sendt den akkurat som den er skrevet.
Gjør disse notatene om til en lanseringssjekkliste
Vurdert på struktur og eierskap
ChatGPT (OpenAI), 94/100
Lanseringssjekkliste, sortert etter frist:
Frys omfanget (man), eier: PM
Siste QA-gjennomgang av betalinger (tir), eier: Utvikling
Fem ting står mellom disse notatene og fredag: lås omfanget mandag så QA får et stabilt bygg, kjør betalingsregresjonen tirsdag, få pressemappen ut av Design innen onsdag, planlegg Product Hunt-ressursene torsdag kveld, og hold fredag klar til selve lanseringen.
Notatene nevner også lokalisert prising. Jeg ville kuttet den fra denne lanseringen, den er ikke avgjørende.
Dom: ChatGPT vinner, 94 mot 90. Eiere, frister og en nummerert liste du kan lime rett inn i et sporingssystem.
Spørsmål
Kaller dette de virkelige modellene?
Nei. Svarene er faste utskrifter, som er grunnen til at siden lastes øyeblikkelig og koster ingenting å kjøre. For å sende din egen prompt til begge modellene samtidig, åpne Whizi.
Hvilken modell er best, ChatGPT eller Claude?
Ingen av dem, gjennomgående. På disse tre promptene vinner Claude kontraktsoppsummeringen og e-posten fordi den avgjør hva som betyr noe, og ChatGPT vinner sjekklisten fordi den strukturerer arbeid. Å velge én for alt er feilen denne siden handler om.
Kan jeg dele en spesifikk sammenligning?
Ja. Kopier den delbare lenken, så åpnes siden på samme prompt for den du sender den til.