Janelas de contexto comparadas: o que os modelos precificados no Whizi suportam

Resposta rápida

As janelas de contexto no índice de preços do Whizi vão de 8.192 tokens a 1.310.720 tokens, e 47 dessas 100 linhas carregam 1.000.000 de tokens ou mais. A janela não é o que decide o seu resultado. Todo modelo recebe um orçamento fixo de 40.000 tokens de entrada e 20.000 tokens de saída por turno, e só uma janela abaixo de 93.000 tokens reduz isso.

A resposta curta

As janelas no índice de preços vão de 8.192 tokens a 1.310.720 tokens, e 47 dessas 100 linhas precificadas carregam uma janela de 1.000.000 de tokens ou mais. A janela é o máximo que um modelo consegue considerar em uma requisição, contado em tokens, mas não é o número que decide o seu resultado no Whizi.

O número que decide isso é o orçamento por turno. Todo modelo do catálogo recebe a mesma cota fixa para um turno: 40.000 tokens de entrada e 20.000 tokens de saída. Uma janela maior não aumenta esse orçamento. Uma janela menor que 93.000 tokens o reduz.

DadoValor
Maior janela no índice de preçosDeepSeek V4 Flash 0731, 1.310.720 tokens
Menores janelas no índice de preçosAs duas linhas do Tencent Hy-MT2, 8.192 tokens
Linhas com 1.000.000 de tokens ou mais47 das 100 linhas precificadas
Entrada enviada por turno, todo modelo do catálogo40.000 tokens
Saída permitida por turno, todo modelo do catálogo20.000 tokens
Janela abaixo da qual esse orçamento diminui93.000 tokens

Então, para um documento real, os dois limites que realmente pesam são o limite de 100.000 caracteres em uma única mensagem de chat e aquele orçamento de 40.000 tokens de entrada. Nenhum dos dois é a coluna da janela.

Janelas de contexto por modelo, com custo e plano

Toda linha abaixo vem do Whizi Cost Index, que precifica 100 linhas do OpenRouter em 29 provedores sobre uma resposta padrão de 1.000 tokens de entrada mais 500 tokens de saída. As taxas dos provedores por trás desses números foram coletadas em 20/08/2026. No site, a coluna de créditos é o que uma mensagem naquele modelo custa em relação ao seu limite de créditos, e a coluna de plano é o plano mais baixo que consegue abri-lo. Uma plataforma que não está na lista liberada de créditos vê uma taxa fixa de 1x, é cobrada uma por turno e mantém o limite de mensagens.

OpenAI.

ModeloJanela de contextoCusto por respostaCréditosPlano mínimo
GPT-5.6 Luna1M$0.00081Starter
GPT-5.4 Nano400K$0.0008252Powerhouse
GPT-5.4 Mini400K$0.0034Powerhouse
GPT-5.6 Terra1M$0.0084Pro
GPT-5.41M$0.0115Powerhouse
GPT-5.6 Sol1M$0.0120Powerhouse
GPT-5.51M$0.0220Pro
GPT Chat Latest400K$0.0225Powerhouse

Anthropic.

ModeloJanela de contextoCusto por respostaCréditosPlano mínimo
Claude Haiku 4.5200K$0.00354Pro
Claude Sonnet 51M$0.00710Pro
Claude Sonnet 4.61M$0.010510Pro
Claude Sonnet 4.51M$0.010510Pro
Claude Opus 51M$0.017520Powerhouse
Claude Opus 4.81M$0.017520Powerhouse
Claude Fable 51M$0.03550Powerhouse

Google.

ModeloJanela de contextoCusto por respostaCréditosPlano mínimo
Gemini 2.5 Flash Lite1M$0.00031Pro
Gemini 3.1 Flash Lite1M$0.0011Powerhouse
Gemini 3.7 Flash1M$0.0013132Pro
Gemini 2.5 Flash1M$0.001552Pro
Gemini 3.5 Flash Lite1M$0.001552Powerhouse
Gemini 3.6 Flash1M$0.0026253Pro
Gemini 3.5 Flash1M$0.0068Pro
Gemini 3.1 Pro Preview1M$0.00810Pro

DeepSeek.

ModeloJanela de contextoCusto por respostaCréditosPlano mínimo
DeepSeek V4 Flash 07311.31M$0.000281Powerhouse
DeepSeek V3.2164K$0.0004691Pro
DeepSeek V3.1164K$0.0007251Pro
DeepSeek V4 Pro 08131M$0.002972Powerhouse

Qwen.

ModeloJanela de contextoCusto por respostaCréditosPlano mínimo
Qwen3.7 Flash1M$0.0000951Powerhouse
Qwen3 Coder Next262K$0.000521Powerhouse
Qwen3.6 Flash1M$0.000751Powerhouse
Qwen3.7 Plus1M$0.000961Pro
Qwen3.8 27B1M$0.002053Powerhouse
Qwen3.7 Max1M$0.0036885Powerhouse
Qwen3.8 Max1M$0.0056Powerhouse

xAI.

ModeloJanela de contextoCusto por respostaCréditosPlano mínimo
Grok Build 0.1256K$0.0023Powerhouse
Grok 4.31M$0.00254Powerhouse
Grok 4.5500K$0.0056Powerhouse
Grok 4.6500K$0.0056Pro

Meta.

ModeloJanela de contextoCusto por respostaCréditosPlano mínimo
Llama 3.3 70B Instruct131K$0.000261Pro
Llama 4 Maverick1M$0.00061Pro
Muse Glimmer 30B131K$0.00112Powerhouse
Muse Spark 1.21M$0.0033755Powerhouse

Mistral.

ModeloJanela de contextoCusto por respostaCréditosPlano mínimo
Codestral 2508256K$0.000751Powerhouse
Mistral Large 3 2512262K$0.001252Pro
Mistral Medium 3.1131K$0.00142Pro
Mistral Medium 3.5262K$0.005256Powerhouse

Z.ai e Moonshot.

ModeloJanela de contextoCusto por respostaCréditosPlano mínimo
GLM 4.6205K$0.00151Powerhouse
GLM 4.7205K$0.0012752Powerhouse
GLM 5205K$0.001562Pro
GLM 5.21M$0.0024843Powerhouse
GLM 5.31M$0.00365Powerhouse
Kimi K2 0711131K$0.0017210Powerhouse
Kimi K2 Thinking262K$0.0018510Powerhouse
Kimi K2.7 Code262K$0.0024610Powerhouse
Kimi K31M$0.010510Pro

Mais catorze linhas.

Estas são uma seleção das linhas precificadas dos demais laboratórios, não todas elas.

ModeloJanela de contextoCusto por respostaCréditosPlano mínimo
MiniMax M2205K$0.0007651Powerhouse
MiniMax M31M$0.00091Powerhouse
Nemotron 3.5 Lightning, NVIDIA262K$0.000181Powerhouse
Nemotron 3 Ultra, NVIDIA512K$0.00243Powerhouse
Nova Pro 1.0, Amazon300K$0.00243Powerhouse
Command A, Cohere256K$0.007510Powerhouse
Solar Pro 4, Upstage524K$0.000091Powerhouse
Ling-3.0-flash, inclusionAI262K$0.0000531Powerhouse
Nex-N2-Mini, Nex Agi262K$0.0000751Powerhouse
Laguna XS 2.1, Poolside262K$0.000121Powerhouse
Granite 4.1 8B, IBM131K$0.00011Powerhouse
Phi 4, Microsoft16K$0.000141Powerhouse
Inkling, Thinkingmachines1M$0.0029754Powerhouse
Fugu Ultra, Sakana1M$0.0225Powerhouse

O catálogo tem mais de 280 modelos, e as linhas acima vêm do Cost Index, que precifica 100 linhas do OpenRouter para comparação, e nem as tabelas nem o índice são o catálogo inteiro. A coluna de plano é derivada, não listada, e a lista de modelos explica como essa derivação funciona.

Starter é o plano que a tabela quase não cobre. Suas quatro entradas são Auto, o modelo da casa Whizi AI, o modelo base do GPT sobre o qual o Whizi AI roda, e um modelo Gemini rápido. O Whizi AI é uma persona da casa sobre esse modelo base do GPT, e não um modelo próprio, e custa 1 crédito por mensagem. As contas gratuitas ficam abaixo dele: alcançam apenas o Whizi AI e o Auto, com 7 mensagens no primeiro dia, depois 3 por dia, e um turno gratuito também é limitado a cerca de 5.000 tokens de entrada e 5.000 de saída.

As janelas pequenas o suficiente para mudar o orçamento

A coluna da janela não é a coluna que decide o tamanho, porque o orçamento por turno é fixo em todo o catálogo. Como esse orçamento é construído, e o que acontece quando uma conversa ultrapassa esse limite, está em quando a conversa fica longa demais.

O que uma janela realmente decide é se esse orçamento fixo se aplica de fato, e o corte fica em 93.000 tokens. Seis das 100 linhas precificadas ficam abaixo disso, e duas delas são as menores janelas de todo o índice de preços.

LinhaJanela de contextoAparece nas tabelas acima
Tencent Hy-MT2, duas linhas8.192Não
Phi 4, Microsoft16KSim
Perceptron Mk133KNão
DeepSeek R164KNão
Nano Banana 2 Lite, Google66KNão

O que uma janela significa para um documento real

O primeiro limite que um documento encontra não é a janela de contexto. É o limite de 100.000 caracteres em uma única mensagem, e o texto extraído de um arquivo anexado conta para esse limite exatamente como o texto digitado.

No site, arquivos PDF, Word e planilhas são extraídos para texto no seu navegador antes de qualquer envio, então o que o modelo recebe é esse texto extraído. Cada arquivo é limitado a 10 MB. A lista completa de formatos está em tipos de arquivo suportados.

Projetos são o único lugar em que um documento realmente consome o orçamento, porque um arquivo fixado no projeto é reconstruído dentro do prompt a cada turno naquele projeto, dentro do mesmo orçamento fixo de entrada, não importa qual janela o modelo carregue. Os limites do arquivo fixado e do bloco do projeto estão em quando a conversa fica longa demais.

Janela versus preço e créditos, nas linhas acima

Ordene as tabelas pela janela e mais nada acompanha essa ordem. A maior janela do índice de preços, com 1.310.720 tokens, custa $0.00028 por resposta padrão, cobra 1 crédito por mensagem e fica no Powerhouse. A linha mais barata de todas custa $0.000053 por resposta em uma janela de 262K. A linha mediana fica em $0.00185 por resposta, também em uma janela de 262K. A linha mais cara custa $0.105 por resposta padrão e não carrega nenhum degrau de crédito, porque não é uma das linhas que o Whizi oferece.

A dispersão fica mais fácil de ver nas linhas que compartilham a mesma janela.

LinhaJanela de contextoCusto por respostaCréditos
DeepSeek V4 Flash 07311.31M$0.000281
Qwen3.7 Flash1M$0.0000951
Inkling, Thinkingmachines1M$0.0029754
Claude Fable 51M$0.03550
Granite 4.1 8B, IBM131K$0.00011
Kimi K2 0711131K$0.0017210

Três dessas linhas carregam a mesma janela de 1.000.000 de tokens e cobram 1, 4 e 50 créditos. Duas linhas carregam a mesma janela de 131K e cobram 1 e 10. O índice de preços cobre cerca de 2000x da linha mais barata até a mais cara, e as linhas acima mostram que essa variação não segue a coluna da janela.

Lista de verificação
  • As janelas no índice de preços vão de 8.192 tokens a 1.310.720 tokens
  • 47 das 100 linhas precificadas carregam uma janela de 1.000.000 de tokens ou mais
  • A maior janela do índice responde por $0.00028 e cobra 1 crédito
  • A linha mais barata do índice carrega uma janela de 262K, não a maior delas
  • A linha mediana precificada fica em $0.00185 por resposta padrão, também em uma janela de 262K
  • No site, a coluna de créditos é o que uma mensagem gasta do limite de créditos
  • Um degrau de crédito é derivado das taxas por token do provedor, então o tamanho da janela não entra nessa conta
  • O Whizi AI é uma persona da casa sobre um modelo base do GPT, a 1 crédito por mensagem
  • Contas gratuitas alcançam duas linhas, e um turno gratuito é limitado a 5.000 tokens de entrada e saída
  • O Cost Index precifica 100 linhas do OpenRouter, que não é o catálogo inteiro de mais de 280

Perguntas frequentes

Eu ganho uma janela de contexto maior em um plano mais alto?

Não. A janela pertence ao modelo, não à sua assinatura. O que um plano mais alto compra é acesso a mais modelos e um limite mensal de créditos maior: 400 créditos no Starter, 2.000 no Pro e 8.000 no Powerhouse.

Um modelo com janela de contexto maior custa mais créditos?

Não nas tabelas acima. A maior janela do índice de preços, com 1.310.720 tokens, cobra 1 crédito por mensagem, enquanto uma linha com janela de 131K nas mesmas tabelas cobra 10. Um degrau de crédito é derivado de um turno de referência de 3.000 tokens de entrada e 800 tokens de saída contra as taxas por token ao vivo do provedor, depois arredondado para cima até um degrau válido, e o tamanho da janela não é uma das entradas dessa conta.

Posso testar um modelo com janela de contexto grande em uma conta gratuita?

Não, desde 02/09/2026. Uma conta gratuita abre o Whizi AI e o Auto, então as linhas de 1.000.000 de tokens exigem um plano. Um turno gratuito também é limitado a cerca de 5.000 tokens de entrada e 5.000 de saída, um limite mais apertado do que qualquer janela de contexto desta página, e a cota é de 7 mensagens no primeiro dia, depois 3 por dia.

O Whizi publica uma janela de contexto para cada modelo do catálogo?

Não. As janelas desta página vêm do Cost Index, que precifica 100 linhas do OpenRouter para comparação, e o catálogo tem mais de 280 modelos. O seletor no aplicativo é uma superfície separada, servida ao vivo pelo worker compartilhado, então ele lista o catálogo atual, não este índice.

De onde vêm os números de janela de contexto desta página?

Do Whizi Cost Index, que precifica 100 linhas do OpenRouter sobre uma resposta padrão de 1.000 tokens de entrada mais 500 tokens de saída, com preços de origem coletados no OpenRouter em 20/08/2026. O Cost Index registra essa única data de coleta, então trate os valores em dólar como daquele dia, não como taxas ao vivo.