Confronto delle finestre di contesto: tutti i modelli IA principali in una tabella

Risposta rapida

La finestra di contesto più grande nel catalogo di agosto 2026 è di 1M token, detenuta da DeepSeek V4 Flash 0731 di DeepSeek. Le tabelle qui sotto confrontano tutti i modelli IA principali in token e in normali pagine di testo, sullo stesso snapshot del catalogo dell'Indice dei costi per modello IA. Un token equivale a circa tre quarti di una parola inglese.

Quale modello IA ha la finestra di contesto più grande?

La finestra di contesto più grande nel catalogo di agosto 2026 è di 1M token, detenuta da DeepSeek V4 Flash 0731 di DeepSeek. Come intuizione fisica approssimativa, un token equivale a circa tre quarti di una parola inglese, e una pagina manoscritta è di circa 400 parole, quindi la tabella qui sotto traduce ogni finestra in pagine.

Una riga per ogni fornitore principale, con il suo modello dalla finestra di contesto più grande:

FornitoreModello con contesto più grandeFinestra di contestoCorrisponde a circa
DeepSeekDeepSeek V4 Flash 07311M tokencirca 2,500 pagine
OpenAIGPT-5.41M tokencirca 2,000 pagine
GoogleGemini 2.5 Flash1M tokencirca 2,000 pagine
MetaLlama 4 Maverick1M tokencirca 2,000 pagine
QwenQwen3.8 2.4T A95B1M tokencirca 2,000 pagine
MoonshotKimi K31M tokencirca 2,000 pagine
Z.aiGLM 5.21M tokencirca 2,000 pagine
MiniMaxMiniMax M31M tokencirca 2,000 pagine
AnthropicClaude Fable 51M tokencirca 1,900 pagine
xAIGrok 4.31M tokencirca 1,900 pagine
MistralMistral Large 3 2512262K tokencirca 492 pagine

Se la domanda dietro la tua ricerca è "cos'è una finestra di contesto, prima di tutto", inizia dalla spiegazione semplice in Cos'è una finestra di contesto? e torna qui per i numeri.

Come si classificano tutti i 100 modelli per finestra di contesto?

Il catalogo completo, ordinato per finestra di contesto. I dati provengono dalla stessa fonte dell'Indice dei costi per modello IA e sono stati rilevati il 2026-08-20; è uno snapshot di quella data e non un flusso in tempo reale, quindi controlla la data prima di citare una cifra. La colonna dei crediti mostra quanto costa ogni modello per messaggio dentro Whizi, dove un piano lo include.

ModelloFornitoreFinestra di contestoCorrisponde a circaCrediti in Whizi
DeepSeek V4 Flash 0731DeepSeek1Mcirca 2,500 pagine1
GPT-5.4OpenAI1Mcirca 2,000 pagine15
GPT-5.5OpenAI1Mcirca 2,000 pagine20
GPT-5.6 LunaOpenAI1Mcirca 2,000 pagine1
GPT-5.6 Luna ProOpenAI1Mcirca 2,000 pagineNon a consumo
GPT-5.6 SolOpenAI1Mcirca 2,000 pagine20
GPT-5.6 Sol ProOpenAI1Mcirca 2,000 pagineNon a consumo
GPT-5.6 TerraOpenAI1Mcirca 2,000 pagine4
GPT-5.6 Terra ProOpenAI1Mcirca 2,000 pagineNon a consumo
LongCat 2.0Meituan1Mcirca 2,000 pagine1
DeepSeek V4 Pro 0813DeepSeek1Mcirca 2,000 pagine2
Gemini 2.5 FlashGoogle1Mcirca 2,000 pagine2
Gemini 2.5 Flash LiteGoogle1Mcirca 2,000 pagine1
Gemini 3.1 Flash LiteGoogle1Mcirca 2,000 pagine1
Gemini 3.1 Pro PreviewGoogle1Mcirca 2,000 pagine10
Gemini 3.5 FlashGoogle1Mcirca 2,000 pagine8
Gemini 3.5 Flash LiteGoogle1Mcirca 2,000 pagine2
Gemini 3.6 FlashGoogle1Mcirca 2,000 pagine3
Gemini 3.7 FlashGoogle1Mcirca 2,000 pagine2
GLM 5.2Z.ai1Mcirca 2,000 pagine3
GLM 5.3Z.ai1Mcirca 2,000 pagine5
InklingThinkingmachines1Mcirca 2,000 pagine4
Kimi K3Moonshot1Mcirca 2,000 pagine10
Laguna S 2.1Poolside1Mcirca 2,000 pagine1
Llama 4 MaverickMeta1Mcirca 2,000 pagine1
MiniMax M3MiniMax1Mcirca 2,000 pagine1
Muse Spark 1.1Meta1Mcirca 2,000 pagine5
Muse Spark 1.2Meta1Mcirca 2,000 pagine5
Qwen3.8 2.4T A95BQwen1Mcirca 2,000 pagine8
Claude Fable 5Anthropic1Mcirca 1,900 pagine50
Claude Opus 4.7 (Fast)Anthropic1Mcirca 1,900 pagineNon a consumo
Claude Opus 4.8Anthropic1Mcirca 1,900 pagine20
Claude Opus 4.8 (Fast)Anthropic1Mcirca 1,900 pagineNon a consumo
Claude Opus 5Anthropic1Mcirca 1,900 pagine20
Claude Opus 5 (Fast)Anthropic1Mcirca 1,900 pagineNon a consumo
Claude Sonnet 4.5Anthropic1Mcirca 1,900 pagine10
Claude Sonnet 4.6Anthropic1Mcirca 1,900 pagine10
Claude Sonnet 5Anthropic1Mcirca 1,900 pagine10
Fugu UltraSakana1Mcirca 1,900 pagine25
Grok 4.3xAI1Mcirca 1,900 pagine4
Qwen3.5 Plus 2026-04-20Qwen1Mcirca 1,900 pagine1
Qwen3.6 FlashQwen1Mcirca 1,900 pagine1
Qwen3.7 FlashQwen1Mcirca 1,900 pagine1
Qwen3.7 MaxQwen1Mcirca 1,900 pagine5
Qwen3.7 PlusQwen1Mcirca 1,900 pagine1
Qwen3.8 27BQwen1Mcirca 1,900 pagine3
Qwen3.8 MaxQwen1Mcirca 1,900 pagine6
Inkling SmallThinkingmachines524Kcirca 983 pagine1
Solar Pro 4Upstage524Kcirca 983 pagine1
Nemotron 3 UltraNVIDIA512Kcirca 961 pagine3
Grok 4.5xAI500Kcirca 938 pagine6
Grok 4.6xAI500Kcirca 938 pagine6
GPT Chat LatestOpenAI400Kcirca 750 pagine25
GPT-5.4 MiniOpenAI400Kcirca 750 pagine4
GPT-5.4 NanoOpenAI400Kcirca 750 pagine2
Nova Pro 1.0Amazon300Kcirca 563 pagine3
Hy3Tencent262Kcirca 492 pagine1
Kimi K2 ThinkingMoonshot262Kcirca 492 pagine10
Kimi K2.7 CodeMoonshot262Kcirca 492 pagine10
Laguna XS 2.1Poolside262Kcirca 492 pagine1
Ling-3.0-flashinclusionAI262Kcirca 492 pagine1
Mistral Large 3 2512Mistral262Kcirca 492 pagine2
Mistral Medium 3.5Mistral262Kcirca 492 pagine6
Nemotron 3.5 LightningNVIDIA262Kcirca 492 pagine1
Nex-N2-MiniNex Agi262Kcirca 492 pagine1
Nex-N2-ProNex Agi262Kcirca 492 pagine1
Qwen3 Coder NextQwen262Kcirca 492 pagine1
Qwen3.6 35B A3BQwen262Kcirca 492 pagine1
Ring-2.6-1TinclusionAI262Kcirca 492 pagine1
Sakana NamazuSakana262Kcirca 492 pagine4
Seed 2.1 TurboBytedance Seed262Kcirca 492 pagine2
Seed-2.0-CodeBytedance Seed262Kcirca 492 pagine3
Step 3.7 FlashStepfun262Kcirca 492 pagine1
Codestral 2508Mistral256Kcirca 480 pagine1
Command ACohere256Kcirca 480 pagine10
Grok Build 0.1xAI256Kcirca 480 pagine3
KAT-Coder-Air V2.5Kwaipilot256Kcirca 480 pagine1
KAT-Coder-Pro V2.5Kwaipilot256Kcirca 480 pagine3
GLM 4.6Z.ai205Kcirca 384 pagine1
GLM 4.7Z.ai205Kcirca 384 pagine2
GLM 5Z.ai205Kcirca 384 pagine2
MiniMax M2MiniMax205Kcirca 384 pagine1
Claude Haiku 4.5Anthropic200Kcirca 375 pagine4
DeepSeek V3.1DeepSeek164Kcirca 307 pagine1
DeepSeek V3.2DeepSeek164Kcirca 307 pagine1
Aion-3.0Aion Labs131Kcirca 246 pagine10
Aion-3.0-MiniAion Labs131Kcirca 246 pagine2
Granite 4.1 8BIbm Granite131Kcirca 246 pagine1
Kimi K2 0711Moonshot131Kcirca 246 pagine10
Llama 3.3 70B InstructMeta131Kcirca 246 pagine1
Mistral Medium 3.1Mistral131Kcirca 246 pagine2
Muse Glimmer 30BMeta131Kcirca 246 pagine2
Nano Banana 2 (Gemini 3.1 Flash Image)Google131Kcirca 246 pagineNon a consumo
Nano Banana Pro (Gemini 3 Pro Image)Google131Kcirca 246 pagineNon a consumo
Nano Banana 2 Lite (Gemini 3.1 Flash Lite Image)Google66Kcirca 123 pagineNon a consumo
R1DeepSeek64Kcirca 120 pagine2
Perceptron Mk1Perceptron33Kcirca 61 pagine1
Phi 4Microsoft16Kcirca 31 pagine1
Hy-MT2-1.8BTencent8Kcirca 15 pagineNon a consumo
Hy-MT2-30B-A3BTencent8Kcirca 15 pagineNon a consumo

Come leggere questi numeri onestamente

La finestra è condivisa. Tutto conta contro di essa contemporaneamente: il tuo prompt, ogni messaggio precedente nella conversazione, qualsiasi documento allegato e la risposta che si sta scrivendo. Un modello con una finestra da 128K che ha già letto un contratto da 100K token non ha 128K rimasti per la discussione; ne ha 28K.

Dichiarato non è effettivo. La ricerca sul contesto lungo continua a trovare lo stesso schema: i modelli ricordano l'inizio e la fine di un contesto enorme meglio della parte centrale. Negli esperimenti Lost in the Middle (Liu et al., 2023), spostare il documento chiave dai bordi dell'input al centro è costato ai modelli circa 20 punti di accuratezza, quindi un modello può accettare un milione di token e comunque sorvolare sulla clausola sepolta al token 400,000. Per il lavoro ad alta posta in gioco su documenti lunghi, chiedi specificamente delle sezioni centrali, oppure fornisci il documento in parti etichettate.

Più grande non è automaticamente meglio. Le finestre grandi costano di più da eseguire e possono diluire l'attenzione su testo irrilevante. Se il tuo lavoro è fatto di email e bozze brevi, la dimensione della finestra non sarà mai la cosa che noti. Inizia a contare con contratti interi, basi di codice, trascrizioni e libri.

I token non sono parole. La regola dei tre quarti è una buona media per l'inglese, ma codice, numeri e lingue diverse dall'inglese spesso si tokenizzano in modo meno efficiente, quindi le stime in pagine nella tabella sono deliberatamente approssimative.

Abbina la finestra al compito

La conclusione pratica della tabella è che la finestra di contesto è una scelta per compito, non una scelta per abbonamento. Il modello con la finestra più grande è raramente il miglior scrittore, e il miglior scrittore è raramente il modo più economico di riassumere 800 pagine.

Questo è l'argomento per avere il catalogo in un unico spazio di lavoro. In Whizi puoi affidare il PDF da 200 pagine a un modello con contesto ampio, poi passare a Claude o GPT nella stessa conversazione per scrivere una bozza da ciò che ha trovato, senza che il documento lasci il thread. Il contrappunto onesto: se tutto ciò che dai in pasto a un modello sta comodamente in una finestra da 128K, che copre la maggior parte del lavoro di email, bozze e documenti brevi, questa intera tabella è irrilevante e un abbonamento a un solo fornitore è l'acquisto più semplice. La guida come scegliere un modello tratta la stessa decisione per qualità e costo.

Per citare questa pagina: l'URL senza ancoraggio è stabile, la data dei dati è stampata sopra la tabella completa, e le cifre sui token provengono dal catalogo dei fornitori invece che dalle pagine di marketing.

Lista di controllo
  • Sottrai i tuoi documenti e la cronologia dalla finestra prima di fidarti del numero in evidenza
  • Per i documenti lunghi, testa il richiamo dalla parte centrale, non solo dall'inizio
  • Traduci i token in pagine con la regola dei tre quarti prima di decidere qualsiasi cosa
  • Scegli la finestra per compito invece che per abbonamento
  • Controlla la data dei dati sopra la tabella completa quando citi una cifra

Domande frequenti

Quale modello IA ha la finestra di contesto più grande?

Nel catalogo di agosto 2026 è DeepSeek V4 Flash 0731 di DeepSeek con 1M token. La tabella completa qui sopra elenca tutti i 100 modelli ordinati per dimensione della finestra, con la data dei dati stampata sopra.

Qual è la finestra di contesto Claude più grande?

La finestra di contesto Claude più grande nell'indice è di 1M token (Claude Fable 5), che corrisponde a circa 1,900 pagine di testo. Le varianti Claude più piccole sono elencate nella tabella completa qui sopra.

Qual è la finestra di contesto GPT più grande?

La finestra di contesto GPT più grande nell'indice è di 1M token (GPT-5.4), che corrisponde a circa 2,000 pagine di testo. Le varianti GPT più piccole sono elencate nella tabella completa qui sopra.

Qual è la finestra di contesto Gemini più grande?

La finestra di contesto Gemini più grande nell'indice è di 1M token (Gemini 2.5 Flash), che corrisponde a circa 2,000 pagine di testo. Le varianti Gemini più piccole sono elencate nella tabella completa qui sopra.

Qual è la finestra di contesto Grok più grande?

La finestra di contesto Grok più grande nell'indice è di 1M token (Grok 4.3), che corrisponde a circa 1,900 pagine di testo. Le varianti Grok più piccole sono elencate nella tabella completa qui sopra.

Una finestra di contesto più grande è sempre migliore?

No. Le finestre più grandi costano di più, e il richiamo peggiora verso il centro di un contesto molto grande. Più grande è decisivo per libri interi, basi di codice e trascrizioni lunghe, ed è irrilevante per la chat quotidiana. Abbina la finestra al compito invece di pagare per il numero più grande.

Quante pagine entrano in una finestra di contesto?

Dividi il conteggio dei token per circa 530 per ottenere le pagine manoscritte: un token è circa tre quarti di una parola inglese, e una pagina è di circa 400 parole. Quindi 128K token sono circa 240 pagine, e un milione di token sono circa 1,900 pagine. Codice e testo non in inglese di solito ne fanno entrare di meno.