Modelli, app e API non sono la stessa cosa
Quasi tutte le discussioni su ChatGPT vs Claude vs Gemini confrontano il livello sbagliato. Ogni nome copre tre prodotti: una famiglia di modelli, un'app di consumo e un'API per sviluppatori. Il vincitore cambia a seconda del livello che stai comprando. Sul livello delle app il prezzo è quasi un pareggio a tre. Sul livello dei modelli no.
Sul livello delle API la distanza si misura. Listini OpenRouter del 20 agosto 2026, tracciati nell'indice dei costi Whizi: GPT-5.5 costa $5 per milione di token in ingresso e $30 per milione in uscita, Claude Sonnet 5 costa $2 in ingresso e $10 in uscita, e Gemini 3.5 Flash $1.50 in ingresso e $9 in uscita. Su una risposta standard (1000 token in ingresso, 500 in uscita) fanno $0.02 per GPT-5.5, $0.007 per Sonnet 5 e $0.006 per Gemini 3.5 Flash. A parità di lunghezza della risposta, GPT-5.5 costa circa il triplo degli altri due modelli di punta.
Sul livello delle app i piani di punta convergono. ChatGPT Plus costa $20 al mese, Claude Pro costa $20 ($17 al mese pagando a anno), e Gemini Advanced è confluito in Google AI Pro allo stesso scalino da $20. OpenAI vende anche ChatGPT Go a $8 per un uso quotidiano con tetti. Una decisione di abbonamento quindi si vince di rado sul prezzo. Si vince su quale modello sbriga i tuoi compiti veri con meno lavoro di pulizia dopo.
Questa guida confronta per compito e nomina un vincitore per ogni caso d'uso. Se stai ancora costruendo una rosa oltre i tre grandi, parti dalle alternative a ChatGPT. Se la scelta è già ristretta a questi tre, la tabella di instradamento qui sotto è la versione breve e il protocollo di prompt più in basso è la prova.
Confronto delle capacità: visione, strumenti, contesto lungo
Tre fatti inquadrano ogni discorso sulle capacità nel 2026. Le finestre di contesto non separano più i leader: GPT-5.5, Claude Sonnet 5 e Gemini 3.5 Flash hanno tutti 1M token nell'indice dei costi Whizi, abbastanza per circa 1900 pagine di manoscritto ciascuno. Tutti e tre sono multimodali, quindi immagini e PDF sono il minimo sindacale. A separarli resta il prezzo, con un fattore tre tra i modelli di punta. La domanda vera passa così da "ce la fa?" a "quanto bene, e a che costo?".
| Capacità | ChatGPT (GPT-5.5) | Claude (Sonnet 5) | Gemini (3.5 Flash) | Che cosa testare |
|---|---|---|---|---|
| Finestra di contesto | 1M token | 1M token | 1M token | Nascondi un dato a pagina 300 di un PDF lungo e chiedilo con il riferimento di pagina |
| Costo per risposta standard | $0.02 | $0.007 | $0.006 | Moltiplicalo per il tuo volume mensile reale prima di impegnarti |
| Crediti Whizi per messaggio | 20 | 10 | 8 | Quanto dura un'assegnazione sul tuo modello predefinito |
| Scrittura e editing | Bozze strutturate, scalette, varianti rapide | Vincitore: tono, editing di testi lunghi, sintesi accurata | Il più debole dei tre sulla voce | La stessa bozza grezza, lo stesso pubblico, poi conta le correzioni che fai dopo |
| Codice e debug | Vincitore con una riproduzione pulita: correzioni passo passo più test | Vincitore per revisione e piani di refactoring su diff grandi | Il modo più economico di leggere un intero repository in un solo prompt | Un report di errore, un test che fallisce, un estratto di file; giudica la modifica sicura più piccola |
Un elenco di funzioni continua a non decidere nulla da solo. Gemini 3.5 Flash accetta lo stesso milione di token di Sonnet 5, a 8 crediti Whizi contro i 10 di Sonnet, e può comunque sbagliare una riscrittura delicata nel tono al punto da costarti un'ora di editing. Mettilo alla prova sul tuo lavoro. Il protocollo qui sotto richiede un compito vero e tre schede del browser.
Il migliore per ogni caso d'uso
Il miglior modello di IA nel 2026 è una regola di instradamento, non una marca. Fissa un modello predefinito per compito, poi mettilo in discussione quando il compito cambia forma. Questo è l'instradamento che il resto della pagina difende.
| Compito | Vincitore | Sfidante | Il numero che decide |
|---|---|---|---|
| Scrittura ed editing rifiniti | Claude | ChatGPT | Sonnet 5 a $0.007 per risposta standard, 10 crediti in Whizi |
| Debug a partire da una riproduzione pulita | ChatGPT | Claude | GPT-5.5 a $0.02 per risposta, il più caro dei tre |
| Revisione del codice e piani di refactoring | Claude | ChatGPT | La stessa finestra da 1M token di GPT-5.5 a circa un terzo del costo per risposta |
| Documenti lunghi e materiali misti | Gemini | Claude | $1.50 per milione di token in ingresso, la tariffa in ingresso più bassa tra i modelli di punta |
| Sintesi di ricerca da un pacchetto di fonti | Claude | Gemini | Una finestra da 1M token tiene circa 1900 pagine di fonti |
| Volume quotidiano a basso costo | Gemini | ChatGPT | Gemini 3.5 Flash a $0.006 per risposta, Gemini 3.7 Flash a $0.0013 |
Tutte le cifre vengono dall'indice dei costi Whizi, listini rilevati il 20 agosto 2026, calcolati su una risposta standard da 1000 token in ingresso e 500 in uscita.
Scrittura
Claude vince la scrittura. È il modello a cui passare un memo grezzo, una mail delicata per un cliente o una bozza da 3000 parole da ristrutturare senza appiattire la voce. ChatGPT vince il passo precedente: scalette, schemi, venti titoli alternativi e la trasformazione di appunti disordinati in una bozza a cui reagire. Gemini perde questa categoria sulla voce, e smette di perdere quando il testo poggia su un grande pacchetto di fonti, perché dargli 500 pagine di contesto costa meno che darle a uno dei due rivali. Per la versione a due modelli della sfida tra Google e OpenAI, vedi Gemini vs ChatGPT.
Usa questo prompt per confrontare i risultati sulla scrittura: "Riscrivi la bozza qui sotto per un responsabile operativo scettico. Mantieni le affermazioni fattuali, togli le frasi generiche da IA, conserva gli esempi concreti e restituisci: 1) bozza finale, 2) tre modifiche che hai fatto, 3) due affermazioni che dovrei verificare prima di pubblicare".
Valuta i risultati sul tempo di pulizia, non sulla prima impressione. Vince la bozza che puoi pubblicare dopo il minor numero di correzioni continuando a fidarti di ogni suo dato. Nel nostro instradamento è Claude, e il margine è abbastanza ampio da rendere ancora giusto pagare 10 crediti a messaggio contro l'unico credito di ChatGPT Luna quando in gioco c'è la prosa finale.
Programmazione
Il codice si divide su una sola condizione. ChatGPT vince quando hai una riproduzione pulita: procede passo passo dal test che fallisce alla correzione più piccola e scrive i test di regressione senza fartelo chiedere due volte. Claude vince quando il lavoro è di giudizio e non di meccanica: rivedere un diff grande, pianificare un refactoring o spiegare perché una correzione è rischiosa. Claude vs ChatGPT scompone quella scelta a due modelli in modo più approfondito.
Usa questo prompt per il codice: "Stai rivedendo la correzione di un bug. Prima riformula la probabile causa alla radice partendo dalla riproduzione. Poi proponi la modifica più piccola e sicura. Poi elenca i test che fallirebbero prima della correzione e passerebbero dopo. Non riscrivere codice non collegato. Ecco la segnalazione del bug, il codice rilevante e l'output dei test".
Qui Gemini arriva terzo, con una nicchia reale: a $1.50 per milione di token in ingresso è il modo più economico di mettere un'intera codebase davanti a una finestra da 1M token e chiedere dove va a finire una modifica. Qualunque cosa vinca il tuo test, la regola resta: nessuna modifica scritta dall'IA va in produzione senza test e revisione umana. Il modello che propone il diff più piccolo è quello che ti costa meno la settimana dopo.
Ricerca
Nella ricerca la tracciabilità vale più della prosa sicura di sé, e Claude vince la sintesi da un pacchetto di fonti fisso: separa ciò che viene dalla fonte da ciò che ha dedotto in modo più netto degli altri due, ed è esattamente questo il lavoro. Gemini è lo sfidante quando il pacchetto è enorme o mescola formati, perché una finestra da 1M token tiene circa 1900 pagine e la sua tariffa in ingresso è la più bassa dei tre. ChatGPT resta terzo sulla disciplina delle fonti e primo nel trasformare una ricerca finita in un materiale strutturato.
Usa questo prompt di ricerca: "Rispondi alla domanda usando solo le fonti che ti fornisco. Crea una tabella con affermazione, fonte, livello di certezza e note. Poi scrivi una sintesi di 250 parole. Chiudi con le domande aperte e con le prove che cambierebbero la conclusione".
Squalifica qualsiasi modello che violi l'istruzione "usa solo le fonti che ti do". Un modello che infila di nascosto conoscenze esterne in un documento con fonti è inservibile per decidere, qualunque cosa dicano i suoi punteggi nei benchmark. Passa lo stesso pacchetto una volta in tutti e tre. Quando l'errore capita, si vede subito.
Documenti
Gemini vince il lavoro sui documenti, e il motivo ora è il prezzo, non la capienza. Tutti e tre i modelli di punta leggono una finestra da 1M token, circa 1900 pagine di manoscritto, ma riempirla costa $1.50 per milione di token in ingresso su Gemini 3.5 Flash, $2 su Claude Sonnet 5 e $5 su GPT-5.5. Dai a ciascun modello un contratto di 400 pagine ogni mattina e la stessa lettura costa più del triplo su GPT-5.5. Claude è lo sfidante quando conta più il risultato che l'ingestione, perché il materiale denso ne esce come prosa leggibile. Sotto il livello di punta le dimensioni della finestra variano ancora (Claude Haiku 4.5 arriva a 200K), quindi controlla il modello preciso e non la marca.
Non scrivere "riassumi questo" e fermarti lì. Chiedi la scaletta, le entità nominate, le decisioni, i rischi e le contraddizioni, con i riferimenti di pagina se il tuo flusso di lavoro li supporta, poi chiedi al modello di segnalare ciò di cui non è sicuro. Un modello a contesto lungo che non sa citare la pagina non ha letto la parte centrale. Il confronto tra finestre di contesto spiega perché il centro di un milione di token è proprio il punto in cui il recupero cede.
Tabella di scelta
La tabella di decisione completa, con il ragionamento allegato. Parti dal vincitore, concedi allo sfidante un tentativo vero sullo stesso input e tieni quello che sopravvive alla tua griglia.
| Se il compito è... | Parti da | Sfidalo con | Perché |
|---|---|---|---|
| Prima bozza di un piano o di una risposta strutturata | ChatGPT | Claude | Il più rapido dalla pagina bianca a una bozza a cui reagire |
| Rifinire un articolo, un memo o un documento per un cliente | Claude | ChatGPT | Vince su tono ed editing; 10 crediti a messaggio in Whizi |
| Analisi o estrazione da documenti grandi | Gemini | Claude | La tariffa in ingresso più bassa ($1.50 per milione di token) su una finestra da 1M token |
| Revisione del codice o pianificazione di un refactoring | Claude | ChatGPT | Revisione accurata di diff grandi a circa un terzo del costo per risposta di GPT-5.5 |
| Debug con log e test | ChatGPT | Claude | Il ragionamento passo passo più solido a partire da una riproduzione pulita |
| Mix di immagini, documenti e testo | Gemini | ChatGPT | L'ingestione multimodale più economica dei tre |
| Sintesi di ricerca da un pacchetto di fonti | Claude | Gemini | Il migliore a separare la fonte dall'inferenza |
| Volume quotidiano con budget stretto | Gemini 3.5 Flash o GPT-5.6 Luna | Tutti e tre | $0.006 e $0.0008 per risposta standard |
La tabella decide chi fa il primo tentativo, niente di più. È la tua griglia, sul tuo compito, a decidere chi tiene il posto.
Protocollo di test A/B/C riutilizzabile
Il modo più pulito per rispondere alla domanda "ChatGPT vs Claude vs Gemini" è smettere di discutere e passare lo stesso prompt a tutti e tre. Usa questo protocollo per qualsiasi flusso di lavoro importante prima di scegliere un modello predefinito.
- Scegli un compito reale. Niente prompt giocattolo. Prendi qualcosa che devi davvero portare a termine questa settimana: un'email commerciale, una revisione di codice, una sintesi di ricerca di mercato, un'estrazione da PDF o una risposta di assistenza.
- Prepara un pacchetto di input fisso. Dai a ogni modello lo stesso testo di partenza, gli stessi vincoli, lo stesso pubblico, lo stesso formato e la stessa asticella di qualità. Se un modello riceve più contesto degli altri, il test non è equo.
- Definisci i criteri di valutazione prima di leggere le risposte. Dai a ogni risultato un voto da 1 a 5 su precisione, utilità, rispetto del formato, tempo di correzione, rischio e onestà nel dichiarare la propria sicurezza.
- Esegui lo stesso prompt su ogni modello senza cambiare una parola. Se il primo prompt è sbagliato, correggilo una volta sola e rilancialo ovunque.
- Fai un secondo giro di sfida. Chiedi a ogni modello: "Cosa potrebbe esserci di sbagliato in questa risposta? Quali ipotesi hai fatto? Cosa dovrei verificare?".
- Scegli una regola di lavoro. Per esempio: "Claude per la prosa finale, ChatGPT per i piani di implementazione, Gemini per i documenti lunghi e Whizi quando il compito è abbastanza importante da meritare un confronto".
Prompt di prova da copiare e incollare: "Sto confrontando modelli di IA per questo flusso di lavoro. Completa il compito qui sotto usando solo il contesto fornito. Segui esattamente il formato di output. Dopo la risposta, aggiungi: ipotesi, rischi, lista di verifica e un suggerimento per migliorare il prompt. Compito: [incolla il compito]. Contesto: [incolla il contesto]. Formato di output: [incolla il formato]".
Costi: un abbonamento o più di uno
I conti degli abbonamenti, ad agosto 2026: ChatGPT Plus, Claude Pro e Google AI Pro stanno ciascuno intorno a $20 al mese, quindi tenerli tutti e tre in diretta si avvicina a $60. Gli abbinamenti calcolati in il modo più economico di usare ChatGPT e Claude insieme si fermano a circa $28 al mese (ChatGPT Go più Claude Pro) o $40 (Plus più Claude Pro), e nessuno dei due include Gemini.
L'argomento di consolidamento di Whizi è un solo piano che porta tutte e tre le famiglie. Starter, a $15.99 al mese ($10.99 con fatturazione annuale), include ChatGPT Luna a 1 credito per messaggio più Gemini Flash, e il difetto da dire apertamente è che Starter non porta nessun modello Claude: le righe di Claude stanno sui piani superiori, dove Sonnet 5 costa 10 crediti a messaggio e Opus 5 ne costa 20. Se Claude è l'unico modello che usi tutto il giorno, i $20 fissi di Claude Pro ti danno più Claude di quanto Whizi Starter darà mai. È il caso in cui un abbonamento diretto batte il consolidamento.
Fai passare il tuo stack dal calcolatore di risparmio sugli abbonamenti IA, poi confronta il risultato con i prezzi di Whizi. L'obiettivo è un numero: quanto paghi adesso, quanto costa un piano unico e quali modelli perderesti davvero cambiando.
Prova lo stesso prompt su più modelli
Il verdetto, senza giri di parole: Claude per la scrittura e la revisione del codice, ChatGPT per il debug e le bozze strutturate, Gemini per i documenti lunghi e il volume a basso costo. Questi valori predefiniti reggono finché il tuo test A/B/C non dice altro, e il test conta più di questa pagina.
In Whizi puoi far girare lo stesso prompt su tutte e tre le famiglie affiancate e vedere il prezzo per messaggio prima di inviare: 1 credito per ChatGPT Luna, 8 per Gemini 3.5 Flash, 10 per Claude Sonnet 5, 20 per GPT-5.5. Nessuna app di un singolo fornitore pubblica quel confronto, perché nessun fornitore mette un prezzo ai modelli del rivale.
Quando sei pronto, lancia il confronto in Whizi, parti dal compito che ripeti più spesso e lascia che siano i punteggi a fissare il tuo instradamento.
- Decidi quale livello stai comprando: le app da $20 sono quasi pari, le API si differenziano di un fattore tre sul prezzo.
- Usa lo stesso compito, lo stesso contesto e lo stesso formato quando provi ChatGPT, Claude e Gemini.
- Valuta i risultati su accuratezza, rispetto del formato, tempo di correzione e rischio, con la griglia scritta prima di leggere le risposte.
- Usa ChatGPT, Claude e Gemini come sistema di smistamento invece di imporre un vincitore unico.
- Somma la tua spesa attuale in IA nel calcolatore di risparmio prima di rinnovare un secondo piano da $20.
Domande frequenti
Qual è il migliore: ChatGPT, Claude o Gemini?
Si divide per compito: Claude vince nella scrittura rifinita e nella revisione del codice, ChatGPT nel debug a partire da una riproduzione pulita e nelle bozze strutturate, Gemini nei documenti lunghi e nel lavoro multimodale, al costo più basso. Per risposta standard, Gemini 3.5 Flash costa $0.006, Claude Sonnet 5 $0.007 e GPT-5.5 $0.02.
Qual è il miglior modello di IA per scrivere?
Claude. Tiene il tono lungo riscritture estese e corregge senza appiattire la voce, ed è per questo che nel nostro instradamento si prende la prosa finale. ChatGPT resta la prima tappa migliore per scalette e varianti, e Gemini si guadagna il lavoro di scrittura solo quando la bozza poggia su centinaia di pagine di materiale di partenza.
Qual è il miglior modello di IA per programmare?
ChatGPT quando hai una riproduzione pulita, Claude per revisioni e piani di refactoring. Dai a entrambi lo stesso report di errore e lo stesso test che fallisce, pretendi la modifica sicura più piccola insieme ai test di regressione, e tieni quello che tocca meno codice. La nicchia di Gemini nel codice è leggere un'intera codebase dentro la sua finestra da 1M token a poco prezzo.
Conviene pagare più abbonamenti di IA?
Non a prezzo pieno. Tre abbonamenti diretti arrivano vicino a $60 al mese e si sovrappongono sulla maggior parte dei compiti. O scegli l'unico modello che vince il compito che ripeti di più, oppure consolidi: Whizi Starter costa $15.99 al mese ($10.99 con fatturazione annuale), e Claude parte dal piano Pro.