Lo stesso prompt, risolto da ChatGPT e Claude fianco a fianco.
Scegli uno dei 3 prompt, guarda i due modelli rispondere insieme e tieni la risposta che manderesti davvero. Qui nulla chiama un modello: le risposte sono trascrizioni fisse, quindi la pagina è gratuita e identica ogni volta.
Come funziona
Ogni prompt riceve un punteggio su 100 sull'unica cosa che quel prompt sta davvero misurando, e il vincitore non è sempre lo stesso modello. È proprio questo il punto: ChatGPT struttura meglio, Claude decide meglio cosa conta, e quale ti serve dipende dal lavoro che hai davanti.
Sono risposte di esempio fisse, scritte per mostrare come i due modelli differiscono per tipo e non per qualità. Non sono output dal vivo di un modello e non sono un benchmark.
Riassumi questo contratto di 40 pagine
Valutato su precisione e selezione
ChatGPT (OpenAI), 92/100
Ecco una sintesi delle clausole principali:
Parti: Meridian Corp (cliente) e Halcyon Ltd (fornitore)
Durata: 24 mesi, rinnovo automatico salvo disdetta con 60 giorni di anticipo
Corrispettivo: 12.400 USD al mese con aumento annuo del 4%
Responsabilità: limitata a 12 mensilità
Recesso: da entrambe le parti, preavviso scritto di 90 giorni
Fammi sapere se vuoi una tabella clausola per clausola.
Claude Sonnet (Anthropic), 96/100
È un contratto di servizi di 24 mesi tra Meridian Corp e Halcyon Ltd a 12.400 USD al mese, con un aumento del 4% ogni anno.
Tre punti meritano attenzione prima di firmare: il contratto si rinnova da solo se non disdici 60 giorni prima della scadenza, la responsabilità è limitata a un anno di corrispettivi, e il preavviso di recesso di 90 giorni è più lungo del solito.
Tutto il resto è standard.
Verdetto: Claude vince, 96 a 92. Entrambi hanno i fatti giusti, ma Claude ti dice di cosa preoccuparti invece di elencare tutto allo stesso modo.
Rifiuta un incontro senza chiudere la porta
Valutato su tono e pronta spedibilità
ChatGPT (OpenAI), 88/100
Oggetto: Re: Conversazione sulla collaborazione
Ciao [Nome],
Grazie mille per avermi scritto! Purtroppo non riesco a farlo rientrare nella mia agenda attuale. Apprezzo davvero che tu abbia pensato a me e mi piacerebbe lasciare la porta aperta per occasioni future.
Ti auguro il meglio per il progetto!
Cordiali saluti, [Il tuo nome]
Claude Sonnet (Anthropic), 95/100
Ciao Dana,
Grazie dell'invito. Giovedì lo salto, ho già la settimana troppo piena e preferisco non venire piuttosto che presentarmi mezza impreparata.
Se può servire, posso guardarmi il deck per conto mio e mandarti le note entro venerdì. Altrimenti ci sentiamo al giro dopo.
Noura
Verdetto: Claude vince, 95 a 88. Nessun campo da riempire, un motivo vero e un'alternativa offerta. Potresti inviarla esattamente così.
Trasforma questi appunti in una checklist di lancio
Valutato su struttura e responsabilità
ChatGPT (OpenAI), 94/100
Checklist di lancio, in ordine di scadenza:
Congelare lo scope (lun), responsabile: product manager
Ultimo giro di QA sui pagamenti (mar), responsabile: sviluppo
Cartella stampa e screenshot (mer), responsabile: design
Programmare i materiali per Product Hunt (gio), responsabile: marketing
Sala di regia il giorno del lancio (ven), tutti
La vuoi come tabella con le colonne di stato?
Claude Sonnet (Anthropic), 90/100
Cinque cose separano questi appunti da venerdì: bloccare lo scope lunedì così il QA ha una build stabile, far girare la regressione sui pagamenti martedì, ottenere la cartella stampa dal design entro mercoledì, programmare i materiali per Product Hunt giovedì sera e tenere libero il venerdì per il lancio vero e proprio.
Gli appunti citano anche i prezzi localizzati. Io li toglierei da questo lancio, non sono essenziali.
Verdetto: ChatGPT vince, 94 a 90. Responsabili, scadenze e un elenco numerato da incollare direttamente in un gestionale.
Domande
Questa pagina chiama i modelli veri?
No. Le risposte sono trascrizioni fisse, ed è per questo che la pagina si carica subito e non costa nulla da eseguire. Per mandare il tuo prompt a entrambi i modelli insieme, apri Whizi.
Quale modello è migliore, ChatGPT o Claude?
Nessuno dei due su tutta la linea. Su questi tre prompt Claude vince il riassunto del contratto e l'e-mail perché decide cosa conta, e ChatGPT vince la checklist perché struttura il lavoro. Sceglierne uno solo per tutto è esattamente l'errore di cui parla questa pagina.
Posso condividere un confronto specifico?
Sì. Copia il link da condividere e la pagina si apre sullo stesso prompt per chi lo riceve.