A resposta curta
As janelas no índice de preços vão de 8.192 tokens a 1.310.720 tokens, e 47 dessas 100 linhas precificadas carregam uma janela de 1.000.000 de tokens ou mais. A janela é o máximo que um modelo consegue considerar em uma requisição, contado em tokens, mas não é o número que decide o seu resultado no Whizi.
O número que decide isso é o orçamento por turno. Todo modelo do catálogo recebe a mesma cota fixa para um turno: 40.000 tokens de entrada e 20.000 tokens de saída. Uma janela maior não aumenta esse orçamento. Uma janela menor que 93.000 tokens o reduz.
| Dado | Valor |
|---|---|
| Maior janela no índice de preços | DeepSeek V4 Flash 0731, 1.310.720 tokens |
| Menores janelas no índice de preços | As duas linhas do Tencent Hy-MT2, 8.192 tokens |
| Linhas com 1.000.000 de tokens ou mais | 47 das 100 linhas precificadas |
| Entrada enviada por turno, todo modelo do catálogo | 40.000 tokens |
| Saída permitida por turno, todo modelo do catálogo | 20.000 tokens |
| Janela abaixo da qual esse orçamento diminui | 93.000 tokens |
Então, para um documento real, os dois limites que realmente pesam são o limite de 100.000 caracteres em uma única mensagem de chat e aquele orçamento de 40.000 tokens de entrada. Nenhum dos dois é a coluna da janela.
Janelas de contexto por modelo, com custo e plano
Toda linha abaixo vem do Whizi Cost Index, que precifica 100 linhas do OpenRouter em 29 provedores sobre uma resposta padrão de 1.000 tokens de entrada mais 500 tokens de saída. As taxas dos provedores por trás desses números foram coletadas em 20/08/2026. No site, a coluna de créditos é o que uma mensagem naquele modelo custa em relação ao seu limite de créditos, e a coluna de plano é o plano mais baixo que consegue abri-lo. Uma plataforma que não está na lista liberada de créditos vê uma taxa fixa de 1x, é cobrada uma por turno e mantém o limite de mensagens.
OpenAI.
| Modelo | Janela de contexto | Custo por resposta | Créditos | Plano mínimo |
|---|---|---|---|---|
| GPT-5.6 Luna | 1M | $0.0008 | 1 | Starter |
| GPT-5.4 Nano | 400K | $0.000825 | 2 | Powerhouse |
| GPT-5.4 Mini | 400K | $0.003 | 4 | Powerhouse |
| GPT-5.6 Terra | 1M | $0.008 | 4 | Pro |
| GPT-5.4 | 1M | $0.01 | 15 | Powerhouse |
| GPT-5.6 Sol | 1M | $0.01 | 20 | Powerhouse |
| GPT-5.5 | 1M | $0.02 | 20 | Pro |
| GPT Chat Latest | 400K | $0.02 | 25 | Powerhouse |
Anthropic.
| Modelo | Janela de contexto | Custo por resposta | Créditos | Plano mínimo |
|---|---|---|---|---|
| Claude Haiku 4.5 | 200K | $0.0035 | 4 | Pro |
| Claude Sonnet 5 | 1M | $0.007 | 10 | Pro |
| Claude Sonnet 4.6 | 1M | $0.0105 | 10 | Pro |
| Claude Sonnet 4.5 | 1M | $0.0105 | 10 | Pro |
| Claude Opus 5 | 1M | $0.0175 | 20 | Powerhouse |
| Claude Opus 4.8 | 1M | $0.0175 | 20 | Powerhouse |
| Claude Fable 5 | 1M | $0.035 | 50 | Powerhouse |
Google.
| Modelo | Janela de contexto | Custo por resposta | Créditos | Plano mínimo |
|---|---|---|---|---|
| Gemini 2.5 Flash Lite | 1M | $0.0003 | 1 | Pro |
| Gemini 3.1 Flash Lite | 1M | $0.001 | 1 | Powerhouse |
| Gemini 3.7 Flash | 1M | $0.001313 | 2 | Pro |
| Gemini 2.5 Flash | 1M | $0.00155 | 2 | Pro |
| Gemini 3.5 Flash Lite | 1M | $0.00155 | 2 | Powerhouse |
| Gemini 3.6 Flash | 1M | $0.002625 | 3 | Pro |
| Gemini 3.5 Flash | 1M | $0.006 | 8 | Pro |
| Gemini 3.1 Pro Preview | 1M | $0.008 | 10 | Pro |
DeepSeek.
| Modelo | Janela de contexto | Custo por resposta | Créditos | Plano mínimo |
|---|---|---|---|---|
| DeepSeek V4 Flash 0731 | 1.31M | $0.00028 | 1 | Powerhouse |
| DeepSeek V3.2 | 164K | $0.000469 | 1 | Pro |
| DeepSeek V3.1 | 164K | $0.000725 | 1 | Pro |
| DeepSeek V4 Pro 0813 | 1M | $0.00297 | 2 | Powerhouse |
Qwen.
| Modelo | Janela de contexto | Custo por resposta | Créditos | Plano mínimo |
|---|---|---|---|---|
| Qwen3.7 Flash | 1M | $0.000095 | 1 | Powerhouse |
| Qwen3 Coder Next | 262K | $0.00052 | 1 | Powerhouse |
| Qwen3.6 Flash | 1M | $0.00075 | 1 | Powerhouse |
| Qwen3.7 Plus | 1M | $0.00096 | 1 | Pro |
| Qwen3.8 27B | 1M | $0.00205 | 3 | Powerhouse |
| Qwen3.7 Max | 1M | $0.003688 | 5 | Powerhouse |
| Qwen3.8 Max | 1M | $0.005 | 6 | Powerhouse |
xAI.
| Modelo | Janela de contexto | Custo por resposta | Créditos | Plano mínimo |
|---|---|---|---|---|
| Grok Build 0.1 | 256K | $0.002 | 3 | Powerhouse |
| Grok 4.3 | 1M | $0.0025 | 4 | Powerhouse |
| Grok 4.5 | 500K | $0.005 | 6 | Powerhouse |
| Grok 4.6 | 500K | $0.005 | 6 | Pro |
Meta.
| Modelo | Janela de contexto | Custo por resposta | Créditos | Plano mínimo |
|---|---|---|---|---|
| Llama 3.3 70B Instruct | 131K | $0.00026 | 1 | Pro |
| Llama 4 Maverick | 1M | $0.0006 | 1 | Pro |
| Muse Glimmer 30B | 131K | $0.0011 | 2 | Powerhouse |
| Muse Spark 1.2 | 1M | $0.003375 | 5 | Powerhouse |
Mistral.
| Modelo | Janela de contexto | Custo por resposta | Créditos | Plano mínimo |
|---|---|---|---|---|
| Codestral 2508 | 256K | $0.00075 | 1 | Powerhouse |
| Mistral Large 3 2512 | 262K | $0.00125 | 2 | Pro |
| Mistral Medium 3.1 | 131K | $0.0014 | 2 | Pro |
| Mistral Medium 3.5 | 262K | $0.00525 | 6 | Powerhouse |
Z.ai e Moonshot.
| Modelo | Janela de contexto | Custo por resposta | Créditos | Plano mínimo |
|---|---|---|---|---|
| GLM 4.6 | 205K | $0.0015 | 1 | Powerhouse |
| GLM 4.7 | 205K | $0.001275 | 2 | Powerhouse |
| GLM 5 | 205K | $0.00156 | 2 | Pro |
| GLM 5.2 | 1M | $0.002484 | 3 | Powerhouse |
| GLM 5.3 | 1M | $0.0036 | 5 | Powerhouse |
| Kimi K2 0711 | 131K | $0.00172 | 10 | Powerhouse |
| Kimi K2 Thinking | 262K | $0.00185 | 10 | Powerhouse |
| Kimi K2.7 Code | 262K | $0.00246 | 10 | Powerhouse |
| Kimi K3 | 1M | $0.0105 | 10 | Pro |
Mais catorze linhas.
Estas são uma seleção das linhas precificadas dos demais laboratórios, não todas elas.
| Modelo | Janela de contexto | Custo por resposta | Créditos | Plano mínimo |
|---|---|---|---|---|
| MiniMax M2 | 205K | $0.000765 | 1 | Powerhouse |
| MiniMax M3 | 1M | $0.0009 | 1 | Powerhouse |
| Nemotron 3.5 Lightning, NVIDIA | 262K | $0.00018 | 1 | Powerhouse |
| Nemotron 3 Ultra, NVIDIA | 512K | $0.0024 | 3 | Powerhouse |
| Nova Pro 1.0, Amazon | 300K | $0.0024 | 3 | Powerhouse |
| Command A, Cohere | 256K | $0.0075 | 10 | Powerhouse |
| Solar Pro 4, Upstage | 524K | $0.00009 | 1 | Powerhouse |
| Ling-3.0-flash, inclusionAI | 262K | $0.000053 | 1 | Powerhouse |
| Nex-N2-Mini, Nex Agi | 262K | $0.000075 | 1 | Powerhouse |
| Laguna XS 2.1, Poolside | 262K | $0.00012 | 1 | Powerhouse |
| Granite 4.1 8B, IBM | 131K | $0.0001 | 1 | Powerhouse |
| Phi 4, Microsoft | 16K | $0.00014 | 1 | Powerhouse |
| Inkling, Thinkingmachines | 1M | $0.002975 | 4 | Powerhouse |
| Fugu Ultra, Sakana | 1M | $0.02 | 25 | Powerhouse |
O catálogo tem mais de 280 modelos, e as linhas acima vêm do Cost Index, que precifica 100 linhas do OpenRouter para comparação, e nem as tabelas nem o índice são o catálogo inteiro. A coluna de plano é derivada, não listada, e a lista de modelos explica como essa derivação funciona.
Starter é o plano que a tabela quase não cobre. Suas quatro entradas são Auto, o modelo da casa Whizi AI, o modelo base do GPT sobre o qual o Whizi AI roda, e um modelo Gemini rápido. O Whizi AI é uma persona da casa sobre esse modelo base do GPT, e não um modelo próprio, e custa 1 crédito por mensagem. As contas gratuitas ficam abaixo dele: alcançam apenas o Whizi AI e o Auto, com 7 mensagens no primeiro dia, depois 3 por dia, e um turno gratuito também é limitado a cerca de 5.000 tokens de entrada e 5.000 de saída.
As janelas pequenas o suficiente para mudar o orçamento
A coluna da janela não é a coluna que decide o tamanho, porque o orçamento por turno é fixo em todo o catálogo. Como esse orçamento é construído, e o que acontece quando uma conversa ultrapassa esse limite, está em quando a conversa fica longa demais.
O que uma janela realmente decide é se esse orçamento fixo se aplica de fato, e o corte fica em 93.000 tokens. Seis das 100 linhas precificadas ficam abaixo disso, e duas delas são as menores janelas de todo o índice de preços.
| Linha | Janela de contexto | Aparece nas tabelas acima |
|---|---|---|
| Tencent Hy-MT2, duas linhas | 8.192 | Não |
| Phi 4, Microsoft | 16K | Sim |
| Perceptron Mk1 | 33K | Não |
| DeepSeek R1 | 64K | Não |
| Nano Banana 2 Lite, Google | 66K | Não |
O que uma janela significa para um documento real
O primeiro limite que um documento encontra não é a janela de contexto. É o limite de 100.000 caracteres em uma única mensagem, e o texto extraído de um arquivo anexado conta para esse limite exatamente como o texto digitado.
No site, arquivos PDF, Word e planilhas são extraídos para texto no seu navegador antes de qualquer envio, então o que o modelo recebe é esse texto extraído. Cada arquivo é limitado a 10 MB. A lista completa de formatos está em tipos de arquivo suportados.
Projetos são o único lugar em que um documento realmente consome o orçamento, porque um arquivo fixado no projeto é reconstruído dentro do prompt a cada turno naquele projeto, dentro do mesmo orçamento fixo de entrada, não importa qual janela o modelo carregue. Os limites do arquivo fixado e do bloco do projeto estão em quando a conversa fica longa demais.
Janela versus preço e créditos, nas linhas acima
Ordene as tabelas pela janela e mais nada acompanha essa ordem. A maior janela do índice de preços, com 1.310.720 tokens, custa $0.00028 por resposta padrão, cobra 1 crédito por mensagem e fica no Powerhouse. A linha mais barata de todas custa $0.000053 por resposta em uma janela de 262K. A linha mediana fica em $0.00185 por resposta, também em uma janela de 262K. A linha mais cara custa $0.105 por resposta padrão e não carrega nenhum degrau de crédito, porque não é uma das linhas que o Whizi oferece.
A dispersão fica mais fácil de ver nas linhas que compartilham a mesma janela.
| Linha | Janela de contexto | Custo por resposta | Créditos |
|---|---|---|---|
| DeepSeek V4 Flash 0731 | 1.31M | $0.00028 | 1 |
| Qwen3.7 Flash | 1M | $0.000095 | 1 |
| Inkling, Thinkingmachines | 1M | $0.002975 | 4 |
| Claude Fable 5 | 1M | $0.035 | 50 |
| Granite 4.1 8B, IBM | 131K | $0.0001 | 1 |
| Kimi K2 0711 | 131K | $0.00172 | 10 |
Três dessas linhas carregam a mesma janela de 1.000.000 de tokens e cobram 1, 4 e 50 créditos. Duas linhas carregam a mesma janela de 131K e cobram 1 e 10. O índice de preços cobre cerca de 2000x da linha mais barata até a mais cara, e as linhas acima mostram que essa variação não segue a coluna da janela.
- As janelas no índice de preços vão de 8.192 tokens a 1.310.720 tokens
- 47 das 100 linhas precificadas carregam uma janela de 1.000.000 de tokens ou mais
- A maior janela do índice responde por $0.00028 e cobra 1 crédito
- A linha mais barata do índice carrega uma janela de 262K, não a maior delas
- A linha mediana precificada fica em $0.00185 por resposta padrão, também em uma janela de 262K
- No site, a coluna de créditos é o que uma mensagem gasta do limite de créditos
- Um degrau de crédito é derivado das taxas por token do provedor, então o tamanho da janela não entra nessa conta
- O Whizi AI é uma persona da casa sobre um modelo base do GPT, a 1 crédito por mensagem
- Contas gratuitas alcançam duas linhas, e um turno gratuito é limitado a 5.000 tokens de entrada e saída
- O Cost Index precifica 100 linhas do OpenRouter, que não é o catálogo inteiro de mais de 280
Perguntas frequentes
Eu ganho uma janela de contexto maior em um plano mais alto?
Não. A janela pertence ao modelo, não à sua assinatura. O que um plano mais alto compra é acesso a mais modelos e um limite mensal de créditos maior: 400 créditos no Starter, 2.000 no Pro e 8.000 no Powerhouse.
Um modelo com janela de contexto maior custa mais créditos?
Não nas tabelas acima. A maior janela do índice de preços, com 1.310.720 tokens, cobra 1 crédito por mensagem, enquanto uma linha com janela de 131K nas mesmas tabelas cobra 10. Um degrau de crédito é derivado de um turno de referência de 3.000 tokens de entrada e 800 tokens de saída contra as taxas por token ao vivo do provedor, depois arredondado para cima até um degrau válido, e o tamanho da janela não é uma das entradas dessa conta.
Posso testar um modelo com janela de contexto grande em uma conta gratuita?
Não, desde 02/09/2026. Uma conta gratuita abre o Whizi AI e o Auto, então as linhas de 1.000.000 de tokens exigem um plano. Um turno gratuito também é limitado a cerca de 5.000 tokens de entrada e 5.000 de saída, um limite mais apertado do que qualquer janela de contexto desta página, e a cota é de 7 mensagens no primeiro dia, depois 3 por dia.
O Whizi publica uma janela de contexto para cada modelo do catálogo?
Não. As janelas desta página vêm do Cost Index, que precifica 100 linhas do OpenRouter para comparação, e o catálogo tem mais de 280 modelos. O seletor no aplicativo é uma superfície separada, servida ao vivo pelo worker compartilhado, então ele lista o catálogo atual, não este índice.
De onde vêm os números de janela de contexto desta página?
Do Whizi Cost Index, que precifica 100 linhas do OpenRouter sobre uma resposta padrão de 1.000 tokens de entrada mais 500 tokens de saída, com preços de origem coletados no OpenRouter em 20/08/2026. O Cost Index registra essa única data de coleta, então trate os valores em dólar como daquele dia, não como taxas ao vivo.