Den samme prompt, besvaret af ChatGPT og Claude side om side.

Vælg en af 3 prompts, se begge modeller svare på samme tid, og behold den, du faktisk ville sende. Intet her kalder en model: svarene er faste udskrifter, så siden er gratis at køre og identisk hver gang.

Sådan virker det

Hver prompt bedømmes ud af 100 på det ene, prompten reelt tester, og vinderen er ikke altid den samme model. Det er hele pointen: ChatGPT strukturerer arbejde bedre, Claude afgør, hvad der betyder mest, og hvilken du vil have, afhænger af opgaven foran dig.

Dette er faste eksempelsvar skrevet for at vise, hvordan de to modeller adskiller sig i art, ikke i kvalitet. De er ikke live modeloutput, og de er ikke en benchmark.

Opsummer denne 40 sider lange kontrakt

Bedømt på nøjagtighed og fokus

ChatGPT (OpenAI), 92/100

Her er en gennemgang af hovedpunkterne:

  • Parter: Meridian Corp (kunde) og Halcyon Ltd (leverandør)
  • Løbetid: 24 måneder, fornyes automatisk, medmindre den opsiges 60 dage før
  • Gebyrer: $12.400/md. med en årlig stigning på 4 %
  • Ansvar: begrænset til 12 måneders gebyrer
  • Opsigelse: begge parter, 90 dages skriftligt varsel

Sig til, hvis du vil have en tabel med klausul for klausul.

Claude Sonnet (Anthropic), 96/100

Dette er en 24 måneders serviceaftale mellem Meridian Corp og Halcyon Ltd til $12.400 om måneden, stigende 4 % om året.

Tre ting fortjener din opmærksomhed, før du skriver under: kontrakten fornyes automatisk, medmindre du opsiger 60 dage før udløb, ansvaret er begrænset til ét års gebyrer, og de 90 dages opsigelsesvarsel er længere end standard.

Resten er standardklausuler.

Dom: Claude vinder, 96 til 92. Begge fik fakta rigtige, men Claude fortalte dig, hvad du skulle bekymre dig om, i stedet for at liste alt ligeværdigt op.

Afslå et møde, men behold forbindelsen

Bedømt på tone og brugsklarhed

ChatGPT (OpenAI), 88/100

Emne: Re: Partnerskabsdrøftelse

Hej [Navn],

Mange tak, fordi du kontaktede mig! Desværre kan jeg ikke få det til at passe med min nuværende kalender. Jeg sætter stor pris på, at du tænkte på mig, og vil gerne holde døren åben for fremtidige muligheder.

Held og lykke med projektet!

Venlig hilsen,
[Dit navn]

Claude Sonnet (Anthropic), 95/100

Hej Dana,

Tak for invitationen. Jeg må sige nej tak til torsdag, min uge er allerede overbooket, og jeg vil hellere springe over end møde op halvt forberedt.

Hvis det hjælper, kan jeg gennemgå oplægget asynkront og sende noter senest fredag. Ellers ses vi i næste omgang.

Noura

Dom: Claude vinder, 95 til 88. Ingen pladsholdere, en rigtig grund og et alternativ tilbudt. Du kunne sende den præcis, som den er skrevet.

Lav disse noter om til en lanceringsliste

Bedømt på struktur og ejerskab

ChatGPT (OpenAI), 94/100

Lanceringsliste, sorteret efter deadline:

  1. Frys omfang (man), ansvarlig: PM
  2. Sidste QA-gennemgang af betalinger (tir), ansvarlig: Udvikling
  3. Pressekit og skærmbilleder (ons), ansvarlig: Design
  4. Planlæg Product Hunt-materiale (tor), ansvarlig: Marketing
  5. Krigsrum på lanceringsdagen (fre), alle mand

Vil du have dette som en tabel med statuskolonner?

Claude Sonnet (Anthropic), 90/100

Fem ting står mellem disse noter og fredag: lås omfanget mandag, så QA har en stabil build, kør betalingsregressionen tirsdag, få pressekittet ud af Design onsdag, planlæg Product Hunt-materialet torsdag aften, og hold fredag fri til selve lanceringen.

Noterne nævner også lokaliserede priser. Jeg ville skære det fra denne lancering, det er ikke afgørende.

Dom: ChatGPT vinder, 94 til 90. Ansvarlige, deadlines og en nummereret liste, du kan sætte direkte ind i et opgavesystem.

Spørgsmål

Kalder dette de rigtige modeller?

Nej. Svarene er faste udskrifter, hvilket er grunden til, at siden indlæses øjeblikkeligt og koster ingenting at køre. For at sende din egen prompt til begge modeller på én gang, åbn Whizi.

Hvilken model er bedst, ChatGPT eller Claude?

Ingen af dem, samlet set. På disse tre prompts vinder Claude kontraktopsummeringen og mailen, fordi den afgør, hvad der betyder noget, og ChatGPT vinder tjeklisten, fordi den strukturerer arbejde. At vælge én til alt er den fejl, denne side handler om.

Kan jeg dele en bestemt sammenligning?

Ja. Kopiér delelinket, og siden åbner med den samme prompt for den, du sender det til.

Næste skridt

Læs den fulde sammenligning af ChatGPT og Claude, eller prissæt den samme opgave på tværs af alle modeller med Tokenprisberegner.