Comparação de janela de contexto: todos os principais modelos de IA em uma tabela

Resposta rápida

A maior janela de contexto do catálogo de agosto de 2026 é de 1M tokens, do DeepSeek V4 Flash 0731, da DeepSeek. As tabelas abaixo comparam todos os principais modelos de IA em tokens e em páginas simples, no mesmo instantâneo de catálogo do Índice de Custo por Modelo de IA. Um token equivale a cerca de três quartos de uma palavra em inglês.

Qual modelo de IA tem a maior janela de contexto?

A maior janela de contexto do catálogo de agosto de 2026 é de 1M tokens, do DeepSeek V4 Flash 0731, da DeepSeek. Como intuição física aproximada, um token equivale a cerca de três quartos de uma palavra em inglês, e uma página de manuscrito tem cerca de 400 palavras, então a tabela abaixo traduz cada janela em páginas.

Uma linha por provedor principal, mostrando seu modelo de maior contexto:

ProvedorModelo de maior contextoJanela de contextoCabe aproximadamente
DeepSeekDeepSeek V4 Flash 07311M tokenscerca de 2,500 páginas
OpenAIGPT-5.41M tokenscerca de 2,000 páginas
GoogleGemini 2.5 Flash1M tokenscerca de 2,000 páginas
MetaLlama 4 Maverick1M tokenscerca de 2,000 páginas
QwenQwen3.8 2.4T A95B1M tokenscerca de 2,000 páginas
MoonshotKimi K31M tokenscerca de 2,000 páginas
Z.aiGLM 5.21M tokenscerca de 2,000 páginas
MiniMaxMiniMax M31M tokenscerca de 2,000 páginas
AnthropicClaude Fable 51M tokenscerca de 1,900 páginas
xAIGrok 4.31M tokenscerca de 1,900 páginas
MistralMistral Large 3 2512262K tokenscerca de 492 páginas

Se a pergunta por trás da sua busca é "o que é uma janela de contexto, afinal", comece pela explicação simples em O que é uma janela de contexto? e volte aqui para os números.

Como todos os 100 modelos se classificam por janela de contexto?

O catálogo completo, ordenado por janela de contexto. Os dados vêm da mesma fonte do Índice de Custo por Modelo de IA e foram consultados em 2026-08-20; é um instantâneo dessa data, não um feed ao vivo, então confira a data antes de citar um número. A coluna de créditos mostra quanto cada modelo custa por mensagem dentro do Whizi, onde um plano o inclui.

ModeloProvedorJanela de contextoCabe aproximadamenteCréditos no Whizi
DeepSeek V4 Flash 0731DeepSeek1Mcerca de 2,500 páginas1
GPT-5.4OpenAI1Mcerca de 2,000 páginas15
GPT-5.5OpenAI1Mcerca de 2,000 páginas20
GPT-5.6 LunaOpenAI1Mcerca de 2,000 páginas1
GPT-5.6 Luna ProOpenAI1Mcerca de 2,000 páginasNão medido
GPT-5.6 SolOpenAI1Mcerca de 2,000 páginas20
GPT-5.6 Sol ProOpenAI1Mcerca de 2,000 páginasNão medido
GPT-5.6 TerraOpenAI1Mcerca de 2,000 páginas4
GPT-5.6 Terra ProOpenAI1Mcerca de 2,000 páginasNão medido
LongCat 2.0Meituan1Mcerca de 2,000 páginas1
DeepSeek V4 Pro 0813DeepSeek1Mcerca de 2,000 páginas2
Gemini 2.5 FlashGoogle1Mcerca de 2,000 páginas2
Gemini 2.5 Flash LiteGoogle1Mcerca de 2,000 páginas1
Gemini 3.1 Flash LiteGoogle1Mcerca de 2,000 páginas1
Gemini 3.1 Pro PreviewGoogle1Mcerca de 2,000 páginas10
Gemini 3.5 FlashGoogle1Mcerca de 2,000 páginas8
Gemini 3.5 Flash LiteGoogle1Mcerca de 2,000 páginas2
Gemini 3.6 FlashGoogle1Mcerca de 2,000 páginas3
Gemini 3.7 FlashGoogle1Mcerca de 2,000 páginas2
GLM 5.2Z.ai1Mcerca de 2,000 páginas3
GLM 5.3Z.ai1Mcerca de 2,000 páginas5
InklingThinkingmachines1Mcerca de 2,000 páginas4
Kimi K3Moonshot1Mcerca de 2,000 páginas10
Laguna S 2.1Poolside1Mcerca de 2,000 páginas1
Llama 4 MaverickMeta1Mcerca de 2,000 páginas1
MiniMax M3MiniMax1Mcerca de 2,000 páginas1
Muse Spark 1.1Meta1Mcerca de 2,000 páginas5
Muse Spark 1.2Meta1Mcerca de 2,000 páginas5
Qwen3.8 2.4T A95BQwen1Mcerca de 2,000 páginas8
Claude Fable 5Anthropic1Mcerca de 1,900 páginas50
Claude Opus 4.7 (Fast)Anthropic1Mcerca de 1,900 páginasNão medido
Claude Opus 4.8Anthropic1Mcerca de 1,900 páginas20
Claude Opus 4.8 (Fast)Anthropic1Mcerca de 1,900 páginasNão medido
Claude Opus 5Anthropic1Mcerca de 1,900 páginas20
Claude Opus 5 (Fast)Anthropic1Mcerca de 1,900 páginasNão medido
Claude Sonnet 4.5Anthropic1Mcerca de 1,900 páginas10
Claude Sonnet 4.6Anthropic1Mcerca de 1,900 páginas10
Claude Sonnet 5Anthropic1Mcerca de 1,900 páginas10
Fugu UltraSakana1Mcerca de 1,900 páginas25
Grok 4.3xAI1Mcerca de 1,900 páginas4
Qwen3.5 Plus 2026-04-20Qwen1Mcerca de 1,900 páginas1
Qwen3.6 FlashQwen1Mcerca de 1,900 páginas1
Qwen3.7 FlashQwen1Mcerca de 1,900 páginas1
Qwen3.7 MaxQwen1Mcerca de 1,900 páginas5
Qwen3.7 PlusQwen1Mcerca de 1,900 páginas1
Qwen3.8 27BQwen1Mcerca de 1,900 páginas3
Qwen3.8 MaxQwen1Mcerca de 1,900 páginas6
Inkling SmallThinkingmachines524Kcerca de 983 páginas1
Solar Pro 4Upstage524Kcerca de 983 páginas1
Nemotron 3 UltraNVIDIA512Kcerca de 961 páginas3
Grok 4.5xAI500Kcerca de 938 páginas6
Grok 4.6xAI500Kcerca de 938 páginas6
GPT Chat LatestOpenAI400Kcerca de 750 páginas25
GPT-5.4 MiniOpenAI400Kcerca de 750 páginas4
GPT-5.4 NanoOpenAI400Kcerca de 750 páginas2
Nova Pro 1.0Amazon300Kcerca de 563 páginas3
Hy3Tencent262Kcerca de 492 páginas1
Kimi K2 ThinkingMoonshot262Kcerca de 492 páginas10
Kimi K2.7 CodeMoonshot262Kcerca de 492 páginas10
Laguna XS 2.1Poolside262Kcerca de 492 páginas1
Ling-3.0-flashinclusionAI262Kcerca de 492 páginas1
Mistral Large 3 2512Mistral262Kcerca de 492 páginas2
Mistral Medium 3.5Mistral262Kcerca de 492 páginas6
Nemotron 3.5 LightningNVIDIA262Kcerca de 492 páginas1
Nex-N2-MiniNex Agi262Kcerca de 492 páginas1
Nex-N2-ProNex Agi262Kcerca de 492 páginas1
Qwen3 Coder NextQwen262Kcerca de 492 páginas1
Qwen3.6 35B A3BQwen262Kcerca de 492 páginas1
Ring-2.6-1TinclusionAI262Kcerca de 492 páginas1
Sakana NamazuSakana262Kcerca de 492 páginas4
Seed 2.1 TurboBytedance Seed262Kcerca de 492 páginas2
Seed-2.0-CodeBytedance Seed262Kcerca de 492 páginas3
Step 3.7 FlashStepfun262Kcerca de 492 páginas1
Codestral 2508Mistral256Kcerca de 480 páginas1
Command ACohere256Kcerca de 480 páginas10
Grok Build 0.1xAI256Kcerca de 480 páginas3
KAT-Coder-Air V2.5Kwaipilot256Kcerca de 480 páginas1
KAT-Coder-Pro V2.5Kwaipilot256Kcerca de 480 páginas3
GLM 4.6Z.ai205Kcerca de 384 páginas1
GLM 4.7Z.ai205Kcerca de 384 páginas2
GLM 5Z.ai205Kcerca de 384 páginas2
MiniMax M2MiniMax205Kcerca de 384 páginas1
Claude Haiku 4.5Anthropic200Kcerca de 375 páginas4
DeepSeek V3.1DeepSeek164Kcerca de 307 páginas1
DeepSeek V3.2DeepSeek164Kcerca de 307 páginas1
Aion-3.0Aion Labs131Kcerca de 246 páginas10
Aion-3.0-MiniAion Labs131Kcerca de 246 páginas2
Granite 4.1 8BIbm Granite131Kcerca de 246 páginas1
Kimi K2 0711Moonshot131Kcerca de 246 páginas10
Llama 3.3 70B InstructMeta131Kcerca de 246 páginas1
Mistral Medium 3.1Mistral131Kcerca de 246 páginas2
Muse Glimmer 30BMeta131Kcerca de 246 páginas2
Nano Banana 2 (Gemini 3.1 Flash Image)Google131Kcerca de 246 páginasNão medido
Nano Banana Pro (Gemini 3 Pro Image)Google131Kcerca de 246 páginasNão medido
Nano Banana 2 Lite (Gemini 3.1 Flash Lite Image)Google66Kcerca de 123 páginasNão medido
R1DeepSeek64Kcerca de 120 páginas2
Perceptron Mk1Perceptron33Kcerca de 61 páginas1
Phi 4Microsoft16Kcerca de 31 páginas1
Hy-MT2-1.8BTencent8Kcerca de 15 páginasNão medido
Hy-MT2-30B-A3BTencent8Kcerca de 15 páginasNão medido

Como interpretar esses números com honestidade

A janela é compartilhada. Tudo conta contra ela ao mesmo tempo: o seu prompt, cada mensagem anterior da conversa, qualquer documento anexado e a resposta sendo escrita. Um modelo com uma janela de 128K que já leu um contrato de 100K tokens não tem 128K sobrando para a discussão; tem 28K.

O anunciado não é o efetivo. As pesquisas de contexto longo continuam achando o mesmo padrão: os modelos lembram do início e do fim de um contexto enorme melhor do que do meio. Nos experimentos Lost in the Middle (Liu et al., 2023), mover o documento chave das bordas da entrada para o meio custou aos modelos cerca de 20 pontos de precisão, então um modelo pode aceitar um milhão de tokens e ainda assim passar por cima da cláusula enterrada no token 400,000. Para trabalho de alto risco em documentos longos, pergunte especificamente sobre as seções do meio, ou alimente o documento em partes rotuladas.

Maior não é automaticamente melhor. Janelas grandes custam mais para rodar e podem diluir a atenção em texto irrelevante. Se o seu trabalho é e-mails e rascunhos curtos, o tamanho da janela nunca vai ser a coisa que você percebe. Ele começa a importar em contratos inteiros, bases de código, transcrições e livros.

Tokens não são palavras. A regra dos três quartos é uma boa média para o inglês, mas código, números e idiomas fora do inglês costumam tokenizar de forma menos eficiente, então as estimativas de páginas na tabela são deliberadamente aproximadas.

Combine a janela com o trabalho

A conclusão prática da tabela é que a janela de contexto é uma escolha por tarefa, não por assinatura. O modelo com a maior janela raramente é o melhor escritor, e o melhor escritor raramente é o jeito mais barato de resumir 800 páginas.

Esse é o argumento para ter o catálogo inteiro em um só espaço de trabalho. No Whizi você pode entregar o PDF de 200 páginas a um modelo de contexto grande, depois trocar para o Claude ou o GPT na mesma conversa para redigir a partir do que ele encontrou, sem o documento sair do fio de conversa. O contraponto honesto: se tudo o que você alimenta a um modelo cabe confortavelmente em uma janela de 128K, o que cobre a maior parte do trabalho de e-mail, rascunho e documento curto, essa tabela inteira é irrelevante e uma assinatura de um único provedor é a compra mais simples. O guia como escolher um modelo de IA cobre a mesma decisão para qualidade e custo.

Para citar esta página: a URL sem âncora é estável, a data dos dados está impressa acima da tabela completa, e os números de tokens vêm do catálogo do provedor, não de páginas de marketing.

Lista de verificação
  • Subtraia seus documentos e o histórico da janela antes de confiar no número de destaque
  • Para documentos longos, teste a lembrança a partir do meio, não só do início
  • Traduza tokens em páginas com a regra dos três quartos antes de decidir qualquer coisa
  • Escolha a janela por tarefa, não por assinatura
  • Confira a data dos dados acima da tabela completa ao citar um número

Perguntas frequentes

Qual modelo de IA tem a maior janela de contexto?

No catálogo de agosto de 2026 é o DeepSeek V4 Flash 0731, da DeepSeek, com 1M tokens. A tabela completa acima lista todos os 100 modelos ordenados por tamanho de janela, com a data dos dados impressa acima dela.

Qual é a maior janela de contexto do Claude?

A maior janela de contexto do Claude no índice é de 1M tokens (Claude Fable 5), que cabe cerca de 1,900 páginas de texto. Variantes menores do Claude estão listadas na tabela completa acima.

Qual é a maior janela de contexto do GPT?

A maior janela de contexto do GPT no índice é de 1M tokens (GPT-5.4), que cabe cerca de 2,000 páginas de texto. Variantes menores do GPT estão listadas na tabela completa acima.

Qual é a maior janela de contexto do Gemini?

A maior janela de contexto do Gemini no índice é de 1M tokens (Gemini 2.5 Flash), que cabe cerca de 2,000 páginas de texto. Variantes menores do Gemini estão listadas na tabela completa acima.

Qual é a maior janela de contexto do Grok?

A maior janela de contexto do Grok no índice é de 1M tokens (Grok 4.3), que cabe cerca de 1,900 páginas de texto. Variantes menores do Grok estão listadas na tabela completa acima.

Uma janela de contexto maior é sempre melhor?

Não. Janelas maiores custam mais, e a lembrança se degrada em direção ao meio de um contexto muito grande. Maior é decisivo para livros inteiros, bases de código e transcrições longas, e irrelevante para conversas do dia a dia. Combine a janela com a tarefa em vez de pagar pelo maior número.

Quantas páginas cabem em uma janela de contexto?

Divida a contagem de tokens por cerca de 530 para chegar a páginas de manuscrito: um token equivale a cerca de três quartos de uma palavra em inglês, e uma página tem cerca de 400 palavras. Então 128K tokens são cerca de 240 páginas, e um milhão de tokens são cerca de 1,900 páginas. Código e texto fora do inglês geralmente cabem menos.