Finestre di contesto a confronto: quanto possono contenere i modelli con prezzo su Whizi

Risposta rapida

Le finestre di contesto nell'indice a pagamento di Whizi vanno da 8,192 a 1,310,720 token, e 47 di quelle 100 righe portano 1,000,000 di token o più. Non è la finestra a decidere il risultato. Ogni modello riceve un budget fisso di 40,000 token in ingresso e 20,000 in uscita per turno, e solo una finestra sotto i 93,000 token riduce quel budget.

La risposta breve

Le finestre nell'indice a pagamento vanno da 8,192 a 1,310,720 token, e 47 di quelle 100 righe con prezzo hanno una finestra di 1,000,000 di token o più. La finestra è il massimo che un modello può considerare in una richiesta, contato in token, ma non è il numero che decide il tuo risultato su Whizi.

Il numero che lo decide è il budget per turno. Ogni modello del catalogo riceve la stessa quota fissa per un turno: 40,000 token in ingresso e 20,000 in uscita. Una finestra più grande non aumenta quel budget. Una finestra più piccola di 93,000 token lo riduce.

DatoValore
Finestra più grande nell'indice a pagamentoDeepSeek V4 Flash 0731, 1,310,720 token
Finestre più piccole nell'indice a pagamentoLe due righe Tencent Hy-MT2, 8,192 token
Righe a 1,000,000 di token o più47 delle 100 righe a pagamento
Input inviato per turno, ogni modello del catalogo40,000 token
Output consentito per turno, ogni modello del catalogo20,000 token
Finestra sotto la quale quel budget si riduce93,000 token

Quindi per un documento reale, i due limiti che contano davvero sono il limite di 100,000 caratteri per un singolo messaggio di chat e quel budget di 40,000 token in ingresso. Nessuno dei due è la colonna della finestra.

Finestre di contesto per modello, con costo e piano

Ogni riga qui sotto viene dal Whizi Cost Index, che valuta il prezzo di 100 righe OpenRouter su 29 provider per una risposta standard di 1,000 token in ingresso più 500 in uscita. Le tariffe dei provider dietro questi numeri sono state rilevate il 2026-08-20. Sul web, la colonna crediti indica quanto costa un messaggio su quel modello rispetto alla tua quota di crediti, e la colonna piano è il piano più basso che può sbloccarlo. Una piattaforma che non è nella lista consentita per i crediti vede invece un fisso 1x, viene addebitata di uno a turno, e mantiene la quota messaggi.

OpenAI.

ModelloFinestra di contestoCosto per rispostaCreditiPiano minimo
GPT-5.6 Luna1M$0.00081Starter
GPT-5.4 Nano400K$0.0008252Powerhouse
GPT-5.4 Mini400K$0.0034Powerhouse
GPT-5.6 Terra1M$0.0084Pro
GPT-5.41M$0.0115Powerhouse
GPT-5.6 Sol1M$0.0120Powerhouse
GPT-5.51M$0.0220Pro
GPT Chat Latest400K$0.0225Powerhouse

Anthropic.

ModelloFinestra di contestoCosto per rispostaCreditiPiano minimo
Claude Haiku 4.5200K$0.00354Pro
Claude Sonnet 51M$0.00710Pro
Claude Sonnet 4.61M$0.010510Pro
Claude Sonnet 4.51M$0.010510Pro
Claude Opus 51M$0.017520Powerhouse
Claude Opus 4.81M$0.017520Powerhouse
Claude Fable 51M$0.03550Powerhouse

Google.

ModelloFinestra di contestoCosto per rispostaCreditiPiano minimo
Gemini 2.5 Flash Lite1M$0.00031Pro
Gemini 3.1 Flash Lite1M$0.0011Powerhouse
Gemini 3.7 Flash1M$0.0013132Pro
Gemini 2.5 Flash1M$0.001552Pro
Gemini 3.5 Flash Lite1M$0.001552Powerhouse
Gemini 3.6 Flash1M$0.0026253Pro
Gemini 3.5 Flash1M$0.0068Pro
Gemini 3.1 Pro Preview1M$0.00810Pro

DeepSeek.

ModelloFinestra di contestoCosto per rispostaCreditiPiano minimo
DeepSeek V4 Flash 07311.31M$0.000281Powerhouse
DeepSeek V3.2164K$0.0004691Pro
DeepSeek V3.1164K$0.0007251Pro
DeepSeek V4 Pro 08131M$0.002972Powerhouse

Qwen.

ModelloFinestra di contestoCosto per rispostaCreditiPiano minimo
Qwen3.7 Flash1M$0.0000951Powerhouse
Qwen3 Coder Next262K$0.000521Powerhouse
Qwen3.6 Flash1M$0.000751Powerhouse
Qwen3.7 Plus1M$0.000961Pro
Qwen3.8 27B1M$0.002053Powerhouse
Qwen3.7 Max1M$0.0036885Powerhouse
Qwen3.8 Max1M$0.0056Powerhouse

xAI.

ModelloFinestra di contestoCosto per rispostaCreditiPiano minimo
Grok Build 0.1256K$0.0023Powerhouse
Grok 4.31M$0.00254Powerhouse
Grok 4.5500K$0.0056Powerhouse
Grok 4.6500K$0.0056Pro

Meta.

ModelloFinestra di contestoCosto per rispostaCreditiPiano minimo
Llama 3.3 70B Instruct131K$0.000261Pro
Llama 4 Maverick1M$0.00061Pro
Muse Glimmer 30B131K$0.00112Powerhouse
Muse Spark 1.21M$0.0033755Powerhouse

Mistral.

ModelloFinestra di contestoCosto per rispostaCreditiPiano minimo
Codestral 2508256K$0.000751Powerhouse
Mistral Large 3 2512262K$0.001252Pro
Mistral Medium 3.1131K$0.00142Pro
Mistral Medium 3.5262K$0.005256Powerhouse

Z.ai e Moonshot.

ModelloFinestra di contestoCosto per rispostaCreditiPiano minimo
GLM 4.6205K$0.00151Powerhouse
GLM 4.7205K$0.0012752Powerhouse
GLM 5205K$0.001562Pro
GLM 5.21M$0.0024843Powerhouse
GLM 5.31M$0.00365Powerhouse
Kimi K2 0711131K$0.0017210Powerhouse
Kimi K2 Thinking262K$0.0018510Powerhouse
Kimi K2.7 Code262K$0.0024610Powerhouse
Kimi K31M$0.010510Pro

Altre quattordici righe.

Questa è una selezione delle righe a pagamento dai laboratori restanti, non tutte.

ModelloFinestra di contestoCosto per rispostaCreditiPiano minimo
MiniMax M2205K$0.0007651Powerhouse
MiniMax M31M$0.00091Powerhouse
Nemotron 3.5 Lightning, NVIDIA262K$0.000181Powerhouse
Nemotron 3 Ultra, NVIDIA512K$0.00243Powerhouse
Nova Pro 1.0, Amazon300K$0.00243Powerhouse
Command A, Cohere256K$0.007510Powerhouse
Solar Pro 4, Upstage524K$0.000091Powerhouse
Ling-3.0-flash, inclusionAI262K$0.0000531Powerhouse
Nex-N2-Mini, Nex Agi262K$0.0000751Powerhouse
Laguna XS 2.1, Poolside262K$0.000121Powerhouse
Granite 4.1 8B, IBM131K$0.00011Powerhouse
Phi 4, Microsoft16K$0.000141Powerhouse
Inkling, Thinkingmachines1M$0.0029754Powerhouse
Fugu Ultra, Sakana1M$0.0225Powerhouse

Il catalogo comprende 280+ modelli, e le righe sopra provengono dal Cost Index, che valuta il prezzo di 100 righe OpenRouter a scopo di confronto, e né le tabelle né l'indice rappresentano l'intero catalogo. La colonna piano è derivata anziché elencata, e l'elenco modelli spiega come funziona quella derivazione.

Starter è l'unico piano che la tabella copre a malapena. Le sue quattro voci sono Auto, il modello proprietario Whizi AI, il modello GPT di base su cui gira Whizi AI, e un modello Gemini veloce. Whizi AI è una persona proprietaria su quel modello GPT di base, non un modello a sé, e costa 1 credito a messaggio. Gli account gratuiti stanno sotto: raggiungono solo Whizi AI e Auto, con 7 messaggi il primo giorno, poi 3 al giorno, e un turno gratuito è inoltre limitato a circa 5,000 token in ingresso e 5,000 in uscita.

Le finestre abbastanza piccole da cambiare il budget

La colonna della finestra non è quella che decide la lunghezza, perché il budget per turno è fisso in tutto il catalogo. Come viene costruito quel budget, e cosa succede quando una conversazione lo supera, è spiegato in quando la conversazione è troppo lunga.

Quello che una finestra decide davvero è se quel budget fisso si applica o no, e la soglia è a 93,000 token. Sei delle 100 righe a pagamento restano sotto quella soglia, e due di loro hanno le finestre più piccole di tutto l'indice a pagamento.

RigaFinestra di contestoPresente nelle tabelle sopra
Tencent Hy-MT2, due righe8,192No
Phi 4, Microsoft16K
Perceptron Mk133KNo
DeepSeek R164KNo
Nano Banana 2 Lite, Google66KNo

Cosa significa una finestra per un documento reale

Il primo limite che un documento incontra non è la finestra di contesto. È il limite di 100,000 caratteri per un singolo messaggio, e il testo estratto da un file allegato conta esattamente come il testo digitato.

Sul web, i file PDF, Word e i fogli di calcolo vengono estratti in testo nel tuo browser prima che qualsiasi cosa venga inviata, quindi ciò che il modello riceve è quel testo estratto. Ogni file è limitato a 10 MB. L'elenco completo dei formati è in tipi di file supportati.

I progetti sono l'unico posto dove un documento consuma davvero il budget, perché un file fissato nel progetto viene ricostruito nel prompt a ogni singolo turno di quel progetto, dentro lo stesso budget fisso in ingresso, qualunque sia la finestra del modello. I limiti del file fissato e del blocco progetto sono in quando la conversazione è troppo lunga.

Finestra confrontata con prezzo e crediti, nelle righe sopra

Ordina le tabelle per finestra e nient'altro segue quell'ordine. La finestra più grande dell'indice a pagamento, a 1,310,720 token, costa $0.00028 per risposta standard, addebita 1 credito a messaggio e sta su Powerhouse. La riga più economica di tutte costa $0.000053 per risposta su una finestra di 262K. La riga mediana sta a $0.00185 per risposta, anche lei su una finestra di 262K. La riga più cara costa $0.105 per risposta standard e non ha alcun gradino di crediti, perché non è una delle righe che Whizi offre.

La dispersione è più facile da leggere sulle righe che condividono la stessa finestra.

RigaFinestra di contestoCosto per rispostaCrediti
DeepSeek V4 Flash 07311.31M$0.000281
Qwen3.7 Flash1M$0.0000951
Inkling, Thinkingmachines1M$0.0029754
Claude Fable 51M$0.03550
Granite 4.1 8B, IBM131K$0.00011
Kimi K2 0711131K$0.0017210

Tre righe lì hanno la stessa finestra da 1,000,000 di token e addebitano 1, 4 e 50 crediti. Due righe hanno la stessa finestra da 131K e addebitano 1 e 10. L'indice a pagamento copre circa 2000x dalla riga più economica alla più cara, e le righe sopra mostrano che quello scarto non segue la colonna della finestra.

Lista di controllo
  • Le finestre nell'indice a pagamento vanno da 8,192 a 1,310,720 token
  • 47 delle 100 righe a pagamento hanno una finestra di 1,000,000 di token o più
  • La finestra più grande dell'indice risponde una volta per $0.00028 e addebita 1 credito
  • La riga più economica dell'indice ha una finestra da 262K, non la più grande
  • La riga mediana a pagamento sta a $0.00185 per risposta standard, anche lei su una finestra da 262K
  • Sul web, la colonna crediti indica quanto spende un messaggio rispetto alla quota crediti
  • Un gradino di crediti è derivato dalle tariffe per token del provider, quindi la dimensione della finestra non è un fattore
  • Whizi AI è una persona proprietaria su un modello GPT di base, a 1 credito a messaggio
  • Gli account gratuiti raggiungono due righe, e un turno gratuito è limitato a 5,000 token in ingresso e in uscita
  • Il Cost Index valuta il prezzo di 100 righe OpenRouter, che non è l'intero catalogo di 280+

Domande frequenti

Ottengo una finestra di contesto più grande con un piano superiore?

No. La finestra appartiene al modello, non al tuo abbonamento. Un piano superiore ti dà accesso a più modelli e a una quota crediti mensile più ampia: 400 crediti su Starter, 2,000 su Pro e 8,000 su Powerhouse.

Un modello con una finestra di contesto più grande costa più crediti?

Non nelle tabelle sopra. La finestra più grande dell'indice a pagamento, a 1,310,720 token, addebita 1 credito a messaggio, mentre una riga con finestra da 131K nelle stesse tabelle addebita 10. Un gradino di crediti è derivato da un turno di riferimento di 3,000 token in ingresso e 800 in uscita rispetto alle tariffe live per token del provider, poi arrotondato per eccesso a un gradino legale, e la dimensione della finestra non è uno dei fattori.

Posso provare un modello con una grande finestra di contesto con un account gratuito?

No, non dal 2026-09-02. Un account gratuito sblocca Whizi AI e Auto, quindi le righe da 1,000,000 di token richiedono un piano. Un turno gratuito è inoltre limitato a circa 5,000 token in ingresso e 5,000 in uscita, un limite più stretto di qualsiasi finestra di contesto in questa pagina, e la quota è di 7 messaggi il primo giorno, poi 3 al giorno.

Whizi pubblica una finestra di contesto per ogni modello del catalogo?

No. Le finestre in questa pagina vengono dal Cost Index, che valuta il prezzo di 100 righe OpenRouter a scopo di confronto, e il catalogo comprende 280+ modelli. Il selettore nell'app è una superficie separata servita in tempo reale dal worker condiviso, quindi elenca il catalogo attuale anziché questo indice.

Da dove vengono i numeri delle finestre di contesto in questa pagina?

Dal Whizi Cost Index, che valuta il prezzo di 100 righe OpenRouter su una risposta standard di 1,000 token in ingresso più 500 in uscita, con i prezzi sorgente rilevati da OpenRouter il 2026-08-20. Il Cost Index registra quell'unica data di rilevamento, quindi considera i valori in dollari come validi a quella data e non come tariffe in tempo reale.