La respuesta corta
Las ventanas en el índice con precio van de 8,192 a 1,310,720 tokens, y 47 de esas 100 filas con precio tienen una ventana de 1,000,000 de tokens o más. La ventana es el máximo que un modelo puede considerar en una solicitud, contado en tokens, pero no es el número que decide tu resultado en Whizi.
El número que lo decide es el presupuesto por turno. Todos los modelos del catálogo reciben la misma asignación fija para un turno: 40,000 tokens de entrada y 20,000 de salida. Una ventana más grande no aumenta ese presupuesto. Una ventana menor de 93,000 tokens lo reduce.
| Cifra | Valor |
|---|---|
| Ventana más grande en el índice con precio | DeepSeek V4 Flash 0731, 1,310,720 tokens |
| Ventanas más pequeñas en el índice con precio | Las dos filas de Tencent Hy-MT2, 8,192 tokens |
| Filas con 1,000,000 de tokens o más | 47 de las 100 filas con precio |
| Entrada enviada por turno, todos los modelos del catálogo | 40,000 tokens |
| Salida permitida por turno, todos los modelos del catálogo | 20,000 tokens |
| Ventana por debajo de la cual se reduce ese presupuesto | 93,000 tokens |
Entonces, para un documento real, los dos límites que realmente importan son el límite de 100,000 caracteres por mensaje de chat y ese presupuesto de 40,000 tokens de entrada. Ninguno de los dos es la columna de la ventana.
Ventanas de contexto por modelo, con costo y plan
Cada fila de abajo proviene del Índice de Costos de Whizi, que pone precio a 100 filas de OpenRouter de 29 proveedores sobre una respuesta estándar de 1,000 tokens de entrada más 500 de salida. Las tarifas de los proveedores detrás de estas cifras se obtuvieron el 2026-08-20. En la web, la columna de créditos es lo que cuesta un mensaje con ese modelo contra tu asignación de créditos, y la columna de plan es el plan más bajo que puede abrirlo. Una plataforma que no está en la lista permitida de créditos ve un 1x fijo en su lugar, se cobra uno por turno, y conserva la asignación de mensajes.
OpenAI.
| Modelo | Ventana de contexto | Costo por respuesta | Créditos | Plan más bajo |
|---|---|---|---|---|
| GPT-5.6 Luna | 1M | $0.0008 | 1 | Starter |
| GPT-5.4 Nano | 400K | $0.000825 | 2 | Powerhouse |
| GPT-5.4 Mini | 400K | $0.003 | 4 | Powerhouse |
| GPT-5.6 Terra | 1M | $0.008 | 4 | Pro |
| GPT-5.4 | 1M | $0.01 | 15 | Powerhouse |
| GPT-5.6 Sol | 1M | $0.01 | 20 | Powerhouse |
| GPT-5.5 | 1M | $0.02 | 20 | Pro |
| GPT Chat Latest | 400K | $0.02 | 25 | Powerhouse |
Anthropic.
| Modelo | Ventana de contexto | Costo por respuesta | Créditos | Plan más bajo |
|---|---|---|---|---|
| Claude Haiku 4.5 | 200K | $0.0035 | 4 | Pro |
| Claude Sonnet 5 | 1M | $0.007 | 10 | Pro |
| Claude Sonnet 4.6 | 1M | $0.0105 | 10 | Pro |
| Claude Sonnet 4.5 | 1M | $0.0105 | 10 | Pro |
| Claude Opus 5 | 1M | $0.0175 | 20 | Powerhouse |
| Claude Opus 4.8 | 1M | $0.0175 | 20 | Powerhouse |
| Claude Fable 5 | 1M | $0.035 | 50 | Powerhouse |
Google.
| Modelo | Ventana de contexto | Costo por respuesta | Créditos | Plan más bajo |
|---|---|---|---|---|
| Gemini 2.5 Flash Lite | 1M | $0.0003 | 1 | Pro |
| Gemini 3.1 Flash Lite | 1M | $0.001 | 1 | Powerhouse |
| Gemini 3.7 Flash | 1M | $0.001313 | 2 | Pro |
| Gemini 2.5 Flash | 1M | $0.00155 | 2 | Pro |
| Gemini 3.5 Flash Lite | 1M | $0.00155 | 2 | Powerhouse |
| Gemini 3.6 Flash | 1M | $0.002625 | 3 | Pro |
| Gemini 3.5 Flash | 1M | $0.006 | 8 | Pro |
| Gemini 3.1 Pro Preview | 1M | $0.008 | 10 | Pro |
DeepSeek.
| Modelo | Ventana de contexto | Costo por respuesta | Créditos | Plan más bajo |
|---|---|---|---|---|
| DeepSeek V4 Flash 0731 | 1.31M | $0.00028 | 1 | Powerhouse |
| DeepSeek V3.2 | 164K | $0.000469 | 1 | Pro |
| DeepSeek V3.1 | 164K | $0.000725 | 1 | Pro |
| DeepSeek V4 Pro 0813 | 1M | $0.00297 | 2 | Powerhouse |
Qwen.
| Modelo | Ventana de contexto | Costo por respuesta | Créditos | Plan más bajo |
|---|---|---|---|---|
| Qwen3.7 Flash | 1M | $0.000095 | 1 | Powerhouse |
| Qwen3 Coder Next | 262K | $0.00052 | 1 | Powerhouse |
| Qwen3.6 Flash | 1M | $0.00075 | 1 | Powerhouse |
| Qwen3.7 Plus | 1M | $0.00096 | 1 | Pro |
| Qwen3.8 27B | 1M | $0.00205 | 3 | Powerhouse |
| Qwen3.7 Max | 1M | $0.003688 | 5 | Powerhouse |
| Qwen3.8 Max | 1M | $0.005 | 6 | Powerhouse |
xAI.
| Modelo | Ventana de contexto | Costo por respuesta | Créditos | Plan más bajo |
|---|---|---|---|---|
| Grok Build 0.1 | 256K | $0.002 | 3 | Powerhouse |
| Grok 4.3 | 1M | $0.0025 | 4 | Powerhouse |
| Grok 4.5 | 500K | $0.005 | 6 | Powerhouse |
| Grok 4.6 | 500K | $0.005 | 6 | Pro |
Meta.
| Modelo | Ventana de contexto | Costo por respuesta | Créditos | Plan más bajo |
|---|---|---|---|---|
| Llama 3.3 70B Instruct | 131K | $0.00026 | 1 | Pro |
| Llama 4 Maverick | 1M | $0.0006 | 1 | Pro |
| Muse Glimmer 30B | 131K | $0.0011 | 2 | Powerhouse |
| Muse Spark 1.2 | 1M | $0.003375 | 5 | Powerhouse |
Mistral.
| Modelo | Ventana de contexto | Costo por respuesta | Créditos | Plan más bajo |
|---|---|---|---|---|
| Codestral 2508 | 256K | $0.00075 | 1 | Powerhouse |
| Mistral Large 3 2512 | 262K | $0.00125 | 2 | Pro |
| Mistral Medium 3.1 | 131K | $0.0014 | 2 | Pro |
| Mistral Medium 3.5 | 262K | $0.00525 | 6 | Powerhouse |
Z.ai y Moonshot.
| Modelo | Ventana de contexto | Costo por respuesta | Créditos | Plan más bajo |
|---|---|---|---|---|
| GLM 4.6 | 205K | $0.0015 | 1 | Powerhouse |
| GLM 4.7 | 205K | $0.001275 | 2 | Powerhouse |
| GLM 5 | 205K | $0.00156 | 2 | Pro |
| GLM 5.2 | 1M | $0.002484 | 3 | Powerhouse |
| GLM 5.3 | 1M | $0.0036 | 5 | Powerhouse |
| Kimi K2 0711 | 131K | $0.00172 | 10 | Powerhouse |
| Kimi K2 Thinking | 262K | $0.00185 | 10 | Powerhouse |
| Kimi K2.7 Code | 262K | $0.00246 | 10 | Powerhouse |
| Kimi K3 | 1M | $0.0105 | 10 | Pro |
Catorce filas más.
Estas son una selección de las filas con precio de los demás laboratorios, no todas.
| Modelo | Ventana de contexto | Costo por respuesta | Créditos | Plan más bajo |
|---|---|---|---|---|
| MiniMax M2 | 205K | $0.000765 | 1 | Powerhouse |
| MiniMax M3 | 1M | $0.0009 | 1 | Powerhouse |
| Nemotron 3.5 Lightning, NVIDIA | 262K | $0.00018 | 1 | Powerhouse |
| Nemotron 3 Ultra, NVIDIA | 512K | $0.0024 | 3 | Powerhouse |
| Nova Pro 1.0, Amazon | 300K | $0.0024 | 3 | Powerhouse |
| Command A, Cohere | 256K | $0.0075 | 10 | Powerhouse |
| Solar Pro 4, Upstage | 524K | $0.00009 | 1 | Powerhouse |
| Ling-3.0-flash, inclusionAI | 262K | $0.000053 | 1 | Powerhouse |
| Nex-N2-Mini, Nex Agi | 262K | $0.000075 | 1 | Powerhouse |
| Laguna XS 2.1, Poolside | 262K | $0.00012 | 1 | Powerhouse |
| Granite 4.1 8B, IBM | 131K | $0.0001 | 1 | Powerhouse |
| Phi 4, Microsoft | 16K | $0.00014 | 1 | Powerhouse |
| Inkling, Thinkingmachines | 1M | $0.002975 | 4 | Powerhouse |
| Fugu Ultra, Sakana | 1M | $0.02 | 25 | Powerhouse |
El catálogo tiene 280+ modelos, y las filas de arriba provienen del Índice de Costos, que pone precio a 100 filas de OpenRouter para comparar, y ni las tablas ni el índice son el catálogo completo. La columna de plan se deriva en lugar de estar listada, y la lista de modelos explica cómo funciona esa derivación.
Starter es el único plan que la tabla apenas cubre. Sus cuatro entradas son Auto, el modelo de la casa Whizi AI, el modelo base de GPT sobre el que corre Whizi AI, y un modelo rápido de Gemini. Whizi AI es una persona de la casa sobre ese modelo base de GPT y no un modelo propio, y cuesta 1 crédito por mensaje. Las cuentas gratuitas quedan por debajo: solo llegan a Whizi AI y Auto, con 7 mensajes el primer día, luego 3 al día, y un turno gratuito además está limitado a unos 5,000 tokens de entrada y 5,000 de salida.
Las ventanas lo bastante pequeñas para cambiar el presupuesto
La columna de la ventana no es la que decide la longitud, porque el presupuesto por turno es fijo en todo el catálogo. Cómo se construye ese presupuesto, y qué pasa cuando una conversación lo supera, se explica en cuando la conversación es demasiado larga.
Lo que sí decide una ventana es si ese presupuesto fijo se aplica siquiera, y el límite está en 93,000 tokens. Seis de las 100 filas con precio caen por debajo, y dos de ellas tienen las ventanas más pequeñas de todo el índice con precio.
| Fila | Ventana de contexto | Impresa en las tablas de arriba |
|---|---|---|
| Tencent Hy-MT2, dos filas | 8,192 | No |
| Phi 4, Microsoft | 16K | Sí |
| Perceptron Mk1 | 33K | No |
| DeepSeek R1 | 64K | No |
| Nano Banana 2 Lite, Google | 66K | No |
Qué significa una ventana para un documento real
El primer límite que golpea un documento no es la ventana de contexto. Es el límite de 100,000 caracteres por mensaje, y el texto extraído de un archivo adjunto cuenta igual que el texto escrito.
En la web, los archivos PDF, Word y de hoja de cálculo se convierten a texto en tu navegador antes de enviarse, así que lo que recibe el modelo es ese texto extraído. Cada archivo tiene un límite de 10 MB. La lista completa de formatos está en tipos de archivo compatibles.
Los proyectos son el único lugar donde un documento realmente consume el presupuesto, porque un archivo fijado en un proyecto se reconstruye dentro del prompt en cada turno de ese proyecto, dentro del mismo presupuesto fijo de entrada sin importar qué ventana tenga el modelo. Los límites de archivos fijados y de bloque de proyecto están en cuando la conversación es demasiado larga.
Ventana frente a precio y créditos, en las filas de arriba
Ordena las tablas por ventana y nada más se ordena con ellas. La ventana más grande del índice con precio, con 1,310,720 tokens, cuesta $0.00028 por respuesta estándar, cobra 1 crédito por mensaje y está en Powerhouse. La fila más barata de todas cuesta $0.000053 por respuesta con una ventana de 262K. La fila mediana está en $0.00185 por respuesta, también con una ventana de 262K. La fila más cara cuesta $0.105 por respuesta estándar y no tiene ningún escalón de créditos, porque no es una de las filas que Whizi ofrece.
La dispersión es más fácil de ver en filas que comparten ventana.
| Fila | Ventana de contexto | Costo por respuesta | Créditos |
|---|---|---|---|
| DeepSeek V4 Flash 0731 | 1.31M | $0.00028 | 1 |
| Qwen3.7 Flash | 1M | $0.000095 | 1 |
| Inkling, Thinkingmachines | 1M | $0.002975 | 4 |
| Claude Fable 5 | 1M | $0.035 | 50 |
| Granite 4.1 8B, IBM | 131K | $0.0001 | 1 |
| Kimi K2 0711 | 131K | $0.00172 | 10 |
Tres de esas filas comparten la misma ventana de 1,000,000 de tokens y cobran 1, 4 y 50 créditos. Dos filas comparten la misma ventana de 131K y cobran 1 y 10. El índice con precio abarca aproximadamente 2000x desde la fila más barata hasta la más cara, y las filas de arriba muestran que esa dispersión no sigue la columna de la ventana.
- Las ventanas en el índice con precio van de 8,192 a 1,310,720 tokens
- 47 de las 100 filas con precio tienen una ventana de 1,000,000 de tokens o más
- La ventana más grande del índice responde una vez por $0.00028 y cobra 1 crédito
- La fila más barata del índice tiene una ventana de 262K, no la más grande
- La fila mediana con precio está en $0.00185 por respuesta estándar, también con una ventana de 262K
- En la web, la columna de créditos es lo que gasta un mensaje contra la asignación de créditos
- Un escalón de créditos se deriva de las tarifas por token de los proveedores, así que el tamaño de la ventana no es un factor
- Whizi AI es una persona de la casa sobre un modelo base de GPT, a 1 crédito por mensaje
- Las cuentas gratuitas llegan a dos filas, y un turno gratuito está limitado a 5,000 tokens de entrada y salida
- El Índice de Costos pone precio a 100 filas de OpenRouter, que no es el catálogo completo de 280+
Preguntas frecuentes
¿Obtengo una ventana de contexto más grande con un plan superior?
No. La ventana pertenece al modelo, no a tu suscripción. Lo que compra un plan superior es acceso a más modelos y una asignación mensual de créditos más grande: 400 créditos en Starter, 2,000 en Pro y 8,000 en Powerhouse.
¿Un modelo con una ventana de contexto más grande cuesta más créditos?
No en las tablas de arriba. La ventana más grande del índice con precio, con 1,310,720 tokens, cobra 1 crédito por mensaje, mientras que una fila con ventana de 131K en las mismas tablas cobra 10. Un escalón de créditos se deriva de un turno de referencia de 3,000 tokens de entrada y 800 de salida contra las tarifas por token en vivo de los proveedores, y luego se redondea hacia arriba al escalón legal, y el tamaño de la ventana no es uno de los factores.
¿Puedo probar un modelo con una ventana de contexto grande en una cuenta gratuita?
No, no desde el 2026-09-02. Una cuenta gratuita abre Whizi AI y Auto, así que las filas de 1,000,000 de tokens necesitan un plan. Un turno gratuito también está limitado a unos 5,000 tokens de entrada y 5,000 de salida, un límite más estricto que cualquier ventana de contexto de esta página, y la asignación es de 7 mensajes el primer día, luego 3 al día.
¿Whizi publica una ventana de contexto para cada modelo del catálogo?
No. Las ventanas de esta página provienen del Índice de Costos, que pone precio a 100 filas de OpenRouter para comparar, y el catálogo tiene 280+ modelos. El selector de la app es una superficie separada, servida en vivo por el shared worker, así que muestra el catálogo actual y no este índice.
¿De dónde vienen las cifras de ventana de contexto de esta página?
Del Índice de Costos de Whizi, que pone precio a 100 filas de OpenRouter sobre una respuesta estándar de 1,000 tokens de entrada más 500 de salida, con precios de origen obtenidos de OpenRouter el 2026-08-20. El Índice de Costos registra esa única fecha de obtención, así que las cifras en dólares deben tratarse como de ese día y no como tarifas en vivo.