La risposta breve
Le finestre nell'indice a pagamento vanno da 8,192 a 1,310,720 token, e 47 di quelle 100 righe con prezzo hanno una finestra di 1,000,000 di token o più. La finestra è il massimo che un modello può considerare in una richiesta, contato in token, ma non è il numero che decide il tuo risultato su Whizi.
Il numero che lo decide è il budget per turno. Ogni modello del catalogo riceve la stessa quota fissa per un turno: 40,000 token in ingresso e 20,000 in uscita. Una finestra più grande non aumenta quel budget. Una finestra più piccola di 93,000 token lo riduce.
| Dato | Valore |
|---|---|
| Finestra più grande nell'indice a pagamento | DeepSeek V4 Flash 0731, 1,310,720 token |
| Finestre più piccole nell'indice a pagamento | Le due righe Tencent Hy-MT2, 8,192 token |
| Righe a 1,000,000 di token o più | 47 delle 100 righe a pagamento |
| Input inviato per turno, ogni modello del catalogo | 40,000 token |
| Output consentito per turno, ogni modello del catalogo | 20,000 token |
| Finestra sotto la quale quel budget si riduce | 93,000 token |
Quindi per un documento reale, i due limiti che contano davvero sono il limite di 100,000 caratteri per un singolo messaggio di chat e quel budget di 40,000 token in ingresso. Nessuno dei due è la colonna della finestra.
Finestre di contesto per modello, con costo e piano
Ogni riga qui sotto viene dal Whizi Cost Index, che valuta il prezzo di 100 righe OpenRouter su 29 provider per una risposta standard di 1,000 token in ingresso più 500 in uscita. Le tariffe dei provider dietro questi numeri sono state rilevate il 2026-08-20. Sul web, la colonna crediti indica quanto costa un messaggio su quel modello rispetto alla tua quota di crediti, e la colonna piano è il piano più basso che può sbloccarlo. Una piattaforma che non è nella lista consentita per i crediti vede invece un fisso 1x, viene addebitata di uno a turno, e mantiene la quota messaggi.
OpenAI.
| Modello | Finestra di contesto | Costo per risposta | Crediti | Piano minimo |
|---|---|---|---|---|
| GPT-5.6 Luna | 1M | $0.0008 | 1 | Starter |
| GPT-5.4 Nano | 400K | $0.000825 | 2 | Powerhouse |
| GPT-5.4 Mini | 400K | $0.003 | 4 | Powerhouse |
| GPT-5.6 Terra | 1M | $0.008 | 4 | Pro |
| GPT-5.4 | 1M | $0.01 | 15 | Powerhouse |
| GPT-5.6 Sol | 1M | $0.01 | 20 | Powerhouse |
| GPT-5.5 | 1M | $0.02 | 20 | Pro |
| GPT Chat Latest | 400K | $0.02 | 25 | Powerhouse |
Anthropic.
| Modello | Finestra di contesto | Costo per risposta | Crediti | Piano minimo |
|---|---|---|---|---|
| Claude Haiku 4.5 | 200K | $0.0035 | 4 | Pro |
| Claude Sonnet 5 | 1M | $0.007 | 10 | Pro |
| Claude Sonnet 4.6 | 1M | $0.0105 | 10 | Pro |
| Claude Sonnet 4.5 | 1M | $0.0105 | 10 | Pro |
| Claude Opus 5 | 1M | $0.0175 | 20 | Powerhouse |
| Claude Opus 4.8 | 1M | $0.0175 | 20 | Powerhouse |
| Claude Fable 5 | 1M | $0.035 | 50 | Powerhouse |
Google.
| Modello | Finestra di contesto | Costo per risposta | Crediti | Piano minimo |
|---|---|---|---|---|
| Gemini 2.5 Flash Lite | 1M | $0.0003 | 1 | Pro |
| Gemini 3.1 Flash Lite | 1M | $0.001 | 1 | Powerhouse |
| Gemini 3.7 Flash | 1M | $0.001313 | 2 | Pro |
| Gemini 2.5 Flash | 1M | $0.00155 | 2 | Pro |
| Gemini 3.5 Flash Lite | 1M | $0.00155 | 2 | Powerhouse |
| Gemini 3.6 Flash | 1M | $0.002625 | 3 | Pro |
| Gemini 3.5 Flash | 1M | $0.006 | 8 | Pro |
| Gemini 3.1 Pro Preview | 1M | $0.008 | 10 | Pro |
DeepSeek.
| Modello | Finestra di contesto | Costo per risposta | Crediti | Piano minimo |
|---|---|---|---|---|
| DeepSeek V4 Flash 0731 | 1.31M | $0.00028 | 1 | Powerhouse |
| DeepSeek V3.2 | 164K | $0.000469 | 1 | Pro |
| DeepSeek V3.1 | 164K | $0.000725 | 1 | Pro |
| DeepSeek V4 Pro 0813 | 1M | $0.00297 | 2 | Powerhouse |
Qwen.
| Modello | Finestra di contesto | Costo per risposta | Crediti | Piano minimo |
|---|---|---|---|---|
| Qwen3.7 Flash | 1M | $0.000095 | 1 | Powerhouse |
| Qwen3 Coder Next | 262K | $0.00052 | 1 | Powerhouse |
| Qwen3.6 Flash | 1M | $0.00075 | 1 | Powerhouse |
| Qwen3.7 Plus | 1M | $0.00096 | 1 | Pro |
| Qwen3.8 27B | 1M | $0.00205 | 3 | Powerhouse |
| Qwen3.7 Max | 1M | $0.003688 | 5 | Powerhouse |
| Qwen3.8 Max | 1M | $0.005 | 6 | Powerhouse |
xAI.
| Modello | Finestra di contesto | Costo per risposta | Crediti | Piano minimo |
|---|---|---|---|---|
| Grok Build 0.1 | 256K | $0.002 | 3 | Powerhouse |
| Grok 4.3 | 1M | $0.0025 | 4 | Powerhouse |
| Grok 4.5 | 500K | $0.005 | 6 | Powerhouse |
| Grok 4.6 | 500K | $0.005 | 6 | Pro |
Meta.
| Modello | Finestra di contesto | Costo per risposta | Crediti | Piano minimo |
|---|---|---|---|---|
| Llama 3.3 70B Instruct | 131K | $0.00026 | 1 | Pro |
| Llama 4 Maverick | 1M | $0.0006 | 1 | Pro |
| Muse Glimmer 30B | 131K | $0.0011 | 2 | Powerhouse |
| Muse Spark 1.2 | 1M | $0.003375 | 5 | Powerhouse |
Mistral.
| Modello | Finestra di contesto | Costo per risposta | Crediti | Piano minimo |
|---|---|---|---|---|
| Codestral 2508 | 256K | $0.00075 | 1 | Powerhouse |
| Mistral Large 3 2512 | 262K | $0.00125 | 2 | Pro |
| Mistral Medium 3.1 | 131K | $0.0014 | 2 | Pro |
| Mistral Medium 3.5 | 262K | $0.00525 | 6 | Powerhouse |
Z.ai e Moonshot.
| Modello | Finestra di contesto | Costo per risposta | Crediti | Piano minimo |
|---|---|---|---|---|
| GLM 4.6 | 205K | $0.0015 | 1 | Powerhouse |
| GLM 4.7 | 205K | $0.001275 | 2 | Powerhouse |
| GLM 5 | 205K | $0.00156 | 2 | Pro |
| GLM 5.2 | 1M | $0.002484 | 3 | Powerhouse |
| GLM 5.3 | 1M | $0.0036 | 5 | Powerhouse |
| Kimi K2 0711 | 131K | $0.00172 | 10 | Powerhouse |
| Kimi K2 Thinking | 262K | $0.00185 | 10 | Powerhouse |
| Kimi K2.7 Code | 262K | $0.00246 | 10 | Powerhouse |
| Kimi K3 | 1M | $0.0105 | 10 | Pro |
Altre quattordici righe.
Questa è una selezione delle righe a pagamento dai laboratori restanti, non tutte.
| Modello | Finestra di contesto | Costo per risposta | Crediti | Piano minimo |
|---|---|---|---|---|
| MiniMax M2 | 205K | $0.000765 | 1 | Powerhouse |
| MiniMax M3 | 1M | $0.0009 | 1 | Powerhouse |
| Nemotron 3.5 Lightning, NVIDIA | 262K | $0.00018 | 1 | Powerhouse |
| Nemotron 3 Ultra, NVIDIA | 512K | $0.0024 | 3 | Powerhouse |
| Nova Pro 1.0, Amazon | 300K | $0.0024 | 3 | Powerhouse |
| Command A, Cohere | 256K | $0.0075 | 10 | Powerhouse |
| Solar Pro 4, Upstage | 524K | $0.00009 | 1 | Powerhouse |
| Ling-3.0-flash, inclusionAI | 262K | $0.000053 | 1 | Powerhouse |
| Nex-N2-Mini, Nex Agi | 262K | $0.000075 | 1 | Powerhouse |
| Laguna XS 2.1, Poolside | 262K | $0.00012 | 1 | Powerhouse |
| Granite 4.1 8B, IBM | 131K | $0.0001 | 1 | Powerhouse |
| Phi 4, Microsoft | 16K | $0.00014 | 1 | Powerhouse |
| Inkling, Thinkingmachines | 1M | $0.002975 | 4 | Powerhouse |
| Fugu Ultra, Sakana | 1M | $0.02 | 25 | Powerhouse |
Il catalogo comprende 280+ modelli, e le righe sopra provengono dal Cost Index, che valuta il prezzo di 100 righe OpenRouter a scopo di confronto, e né le tabelle né l'indice rappresentano l'intero catalogo. La colonna piano è derivata anziché elencata, e l'elenco modelli spiega come funziona quella derivazione.
Starter è l'unico piano che la tabella copre a malapena. Le sue quattro voci sono Auto, il modello proprietario Whizi AI, il modello GPT di base su cui gira Whizi AI, e un modello Gemini veloce. Whizi AI è una persona proprietaria su quel modello GPT di base, non un modello a sé, e costa 1 credito a messaggio. Gli account gratuiti stanno sotto: raggiungono solo Whizi AI e Auto, con 7 messaggi il primo giorno, poi 3 al giorno, e un turno gratuito è inoltre limitato a circa 5,000 token in ingresso e 5,000 in uscita.
Le finestre abbastanza piccole da cambiare il budget
La colonna della finestra non è quella che decide la lunghezza, perché il budget per turno è fisso in tutto il catalogo. Come viene costruito quel budget, e cosa succede quando una conversazione lo supera, è spiegato in quando la conversazione è troppo lunga.
Quello che una finestra decide davvero è se quel budget fisso si applica o no, e la soglia è a 93,000 token. Sei delle 100 righe a pagamento restano sotto quella soglia, e due di loro hanno le finestre più piccole di tutto l'indice a pagamento.
| Riga | Finestra di contesto | Presente nelle tabelle sopra |
|---|---|---|
| Tencent Hy-MT2, due righe | 8,192 | No |
| Phi 4, Microsoft | 16K | Sì |
| Perceptron Mk1 | 33K | No |
| DeepSeek R1 | 64K | No |
| Nano Banana 2 Lite, Google | 66K | No |
Cosa significa una finestra per un documento reale
Il primo limite che un documento incontra non è la finestra di contesto. È il limite di 100,000 caratteri per un singolo messaggio, e il testo estratto da un file allegato conta esattamente come il testo digitato.
Sul web, i file PDF, Word e i fogli di calcolo vengono estratti in testo nel tuo browser prima che qualsiasi cosa venga inviata, quindi ciò che il modello riceve è quel testo estratto. Ogni file è limitato a 10 MB. L'elenco completo dei formati è in tipi di file supportati.
I progetti sono l'unico posto dove un documento consuma davvero il budget, perché un file fissato nel progetto viene ricostruito nel prompt a ogni singolo turno di quel progetto, dentro lo stesso budget fisso in ingresso, qualunque sia la finestra del modello. I limiti del file fissato e del blocco progetto sono in quando la conversazione è troppo lunga.
Finestra confrontata con prezzo e crediti, nelle righe sopra
Ordina le tabelle per finestra e nient'altro segue quell'ordine. La finestra più grande dell'indice a pagamento, a 1,310,720 token, costa $0.00028 per risposta standard, addebita 1 credito a messaggio e sta su Powerhouse. La riga più economica di tutte costa $0.000053 per risposta su una finestra di 262K. La riga mediana sta a $0.00185 per risposta, anche lei su una finestra di 262K. La riga più cara costa $0.105 per risposta standard e non ha alcun gradino di crediti, perché non è una delle righe che Whizi offre.
La dispersione è più facile da leggere sulle righe che condividono la stessa finestra.
| Riga | Finestra di contesto | Costo per risposta | Crediti |
|---|---|---|---|
| DeepSeek V4 Flash 0731 | 1.31M | $0.00028 | 1 |
| Qwen3.7 Flash | 1M | $0.000095 | 1 |
| Inkling, Thinkingmachines | 1M | $0.002975 | 4 |
| Claude Fable 5 | 1M | $0.035 | 50 |
| Granite 4.1 8B, IBM | 131K | $0.0001 | 1 |
| Kimi K2 0711 | 131K | $0.00172 | 10 |
Tre righe lì hanno la stessa finestra da 1,000,000 di token e addebitano 1, 4 e 50 crediti. Due righe hanno la stessa finestra da 131K e addebitano 1 e 10. L'indice a pagamento copre circa 2000x dalla riga più economica alla più cara, e le righe sopra mostrano che quello scarto non segue la colonna della finestra.
- Le finestre nell'indice a pagamento vanno da 8,192 a 1,310,720 token
- 47 delle 100 righe a pagamento hanno una finestra di 1,000,000 di token o più
- La finestra più grande dell'indice risponde una volta per $0.00028 e addebita 1 credito
- La riga più economica dell'indice ha una finestra da 262K, non la più grande
- La riga mediana a pagamento sta a $0.00185 per risposta standard, anche lei su una finestra da 262K
- Sul web, la colonna crediti indica quanto spende un messaggio rispetto alla quota crediti
- Un gradino di crediti è derivato dalle tariffe per token del provider, quindi la dimensione della finestra non è un fattore
- Whizi AI è una persona proprietaria su un modello GPT di base, a 1 credito a messaggio
- Gli account gratuiti raggiungono due righe, e un turno gratuito è limitato a 5,000 token in ingresso e in uscita
- Il Cost Index valuta il prezzo di 100 righe OpenRouter, che non è l'intero catalogo di 280+
Domande frequenti
Ottengo una finestra di contesto più grande con un piano superiore?
No. La finestra appartiene al modello, non al tuo abbonamento. Un piano superiore ti dà accesso a più modelli e a una quota crediti mensile più ampia: 400 crediti su Starter, 2,000 su Pro e 8,000 su Powerhouse.
Un modello con una finestra di contesto più grande costa più crediti?
Non nelle tabelle sopra. La finestra più grande dell'indice a pagamento, a 1,310,720 token, addebita 1 credito a messaggio, mentre una riga con finestra da 131K nelle stesse tabelle addebita 10. Un gradino di crediti è derivato da un turno di riferimento di 3,000 token in ingresso e 800 in uscita rispetto alle tariffe live per token del provider, poi arrotondato per eccesso a un gradino legale, e la dimensione della finestra non è uno dei fattori.
Posso provare un modello con una grande finestra di contesto con un account gratuito?
No, non dal 2026-09-02. Un account gratuito sblocca Whizi AI e Auto, quindi le righe da 1,000,000 di token richiedono un piano. Un turno gratuito è inoltre limitato a circa 5,000 token in ingresso e 5,000 in uscita, un limite più stretto di qualsiasi finestra di contesto in questa pagina, e la quota è di 7 messaggi il primo giorno, poi 3 al giorno.
Whizi pubblica una finestra di contesto per ogni modello del catalogo?
No. Le finestre in questa pagina vengono dal Cost Index, che valuta il prezzo di 100 righe OpenRouter a scopo di confronto, e il catalogo comprende 280+ modelli. Il selettore nell'app è una superficie separata servita in tempo reale dal worker condiviso, quindi elenca il catalogo attuale anziché questo indice.
Da dove vengono i numeri delle finestre di contesto in questa pagina?
Dal Whizi Cost Index, che valuta il prezzo di 100 righe OpenRouter su una risposta standard di 1,000 token in ingresso più 500 in uscita, con i prezzi sorgente rilevati da OpenRouter il 2026-08-20. Il Cost Index registra quell'unica data di rilevamento, quindi considera i valori in dollari come validi a quella data e non come tariffe in tempo reale.