简短的答案
定价索引里的窗口从8,192个token到1,310,720个token不等,100行定价模型里有47行的窗口达到或超过1,000,000个token。窗口是模型在一次请求中最多能处理的内容量,以token计算,但在Whizi里,它并不是决定你结果的那个数字。
真正决定结果的数字是每轮预算。目录里的每个模型在一轮对话中都获得相同的固定额度:40,000个输入token和20,000个输出token。更大的窗口不会提高这个预算,而小于93,000个token的窗口会降低它。
| Figure | Value |
|---|---|
| 定价索引里最大的窗口 | DeepSeek V4 Flash 0731,1,310,720个token |
| 定价索引里最小的窗口 | Tencent Hy-MT2的两行,8,192个token |
| 窗口达到或超过1,000,000个token的行数 | 100行定价模型里的47行 |
| 每轮发送的输入量,所有目录模型统一 | 40,000个token |
| 每轮允许的输出量,所有目录模型统一 | 20,000个token |
| 该预算会缩水的窗口下限 | 93,000个token |
所以对于真实文档来说,真正起作用的两个上限是单条消息100,000个字符的限制,以及那40,000个token的输入预算,两者都不是窗口那一栏。
各模型的上下文窗口、成本与套餐
以下每一行都来自Whizi成本指数,它按照1,000个输入token加500个输出token的标准回答,为29家提供商的100行OpenRouter模型定价。这些数字背后的提供商费率抓取于2026-08-20。在网页端,积分栏是该模型每条消息相对于你的积分额度所消耗的数量,套餐栏是能开放它的最低套餐。不在积分白名单上的平台会看到固定的1x,每轮扣1,并保留消息额度。
OpenAI。
| 模型 | 上下文窗口 | 单次回答成本 | 积分 | 最低套餐 |
|---|---|---|---|---|
| GPT-5.6 Luna | 1M | $0.0008 | 1 | Starter |
| GPT-5.4 Nano | 400K | $0.000825 | 2 | Powerhouse |
| GPT-5.4 Mini | 400K | $0.003 | 4 | Powerhouse |
| GPT-5.6 Terra | 1M | $0.008 | 4 | Pro |
| GPT-5.4 | 1M | $0.01 | 15 | Powerhouse |
| GPT-5.6 Sol | 1M | $0.01 | 20 | Powerhouse |
| GPT-5.5 | 1M | $0.02 | 20 | Pro |
| GPT Chat Latest | 400K | $0.02 | 25 | Powerhouse |
Anthropic。
| 模型 | 上下文窗口 | 单次回答成本 | 积分 | 最低套餐 |
|---|---|---|---|---|
| Claude Haiku 4.5 | 200K | $0.0035 | 4 | Pro |
| Claude Sonnet 5 | 1M | $0.007 | 10 | Pro |
| Claude Sonnet 4.6 | 1M | $0.0105 | 10 | Pro |
| Claude Sonnet 4.5 | 1M | $0.0105 | 10 | Pro |
| Claude Opus 5 | 1M | $0.0175 | 20 | Powerhouse |
| Claude Opus 4.8 | 1M | $0.0175 | 20 | Powerhouse |
| Claude Fable 5 | 1M | $0.035 | 50 | Powerhouse |
Google。
| 模型 | 上下文窗口 | 单次回答成本 | 积分 | 最低套餐 |
|---|---|---|---|---|
| Gemini 2.5 Flash Lite | 1M | $0.0003 | 1 | Pro |
| Gemini 3.1 Flash Lite | 1M | $0.001 | 1 | Powerhouse |
| Gemini 3.7 Flash | 1M | $0.001313 | 2 | Pro |
| Gemini 2.5 Flash | 1M | $0.00155 | 2 | Pro |
| Gemini 3.5 Flash Lite | 1M | $0.00155 | 2 | Powerhouse |
| Gemini 3.6 Flash | 1M | $0.002625 | 3 | Pro |
| Gemini 3.5 Flash | 1M | $0.006 | 8 | Pro |
| Gemini 3.1 Pro Preview | 1M | $0.008 | 10 | Pro |
DeepSeek。
| 模型 | 上下文窗口 | 单次回答成本 | 积分 | 最低套餐 |
|---|---|---|---|---|
| DeepSeek V4 Flash 0731 | 1.31M | $0.00028 | 1 | Powerhouse |
| DeepSeek V3.2 | 164K | $0.000469 | 1 | Pro |
| DeepSeek V3.1 | 164K | $0.000725 | 1 | Pro |
| DeepSeek V4 Pro 0813 | 1M | $0.00297 | 2 | Powerhouse |
Qwen。
| 模型 | 上下文窗口 | 单次回答成本 | 积分 | 最低套餐 |
|---|---|---|---|---|
| Qwen3.7 Flash | 1M | $0.000095 | 1 | Powerhouse |
| Qwen3 Coder Next | 262K | $0.00052 | 1 | Powerhouse |
| Qwen3.6 Flash | 1M | $0.00075 | 1 | Powerhouse |
| Qwen3.7 Plus | 1M | $0.00096 | 1 | Pro |
| Qwen3.8 27B | 1M | $0.00205 | 3 | Powerhouse |
| Qwen3.7 Max | 1M | $0.003688 | 5 | Powerhouse |
| Qwen3.8 Max | 1M | $0.005 | 6 | Powerhouse |
xAI。
| 模型 | 上下文窗口 | 单次回答成本 | 积分 | 最低套餐 |
|---|---|---|---|---|
| Grok Build 0.1 | 256K | $0.002 | 3 | Powerhouse |
| Grok 4.3 | 1M | $0.0025 | 4 | Powerhouse |
| Grok 4.5 | 500K | $0.005 | 6 | Powerhouse |
| Grok 4.6 | 500K | $0.005 | 6 | Pro |
Meta。
| 模型 | 上下文窗口 | 单次回答成本 | 积分 | 最低套餐 |
|---|---|---|---|---|
| Llama 3.3 70B Instruct | 131K | $0.00026 | 1 | Pro |
| Llama 4 Maverick | 1M | $0.0006 | 1 | Pro |
| Muse Glimmer 30B | 131K | $0.0011 | 2 | Powerhouse |
| Muse Spark 1.2 | 1M | $0.003375 | 5 | Powerhouse |
Mistral。
| 模型 | 上下文窗口 | 单次回答成本 | 积分 | 最低套餐 |
|---|---|---|---|---|
| Codestral 2508 | 256K | $0.00075 | 1 | Powerhouse |
| Mistral Large 3 2512 | 262K | $0.00125 | 2 | Pro |
| Mistral Medium 3.1 | 131K | $0.0014 | 2 | Pro |
| Mistral Medium 3.5 | 262K | $0.00525 | 6 | Powerhouse |
Z.ai和Moonshot。
| 模型 | 上下文窗口 | 单次回答成本 | 积分 | 最低套餐 |
|---|---|---|---|---|
| GLM 4.6 | 205K | $0.0015 | 1 | Powerhouse |
| GLM 4.7 | 205K | $0.001275 | 2 | Powerhouse |
| GLM 5 | 205K | $0.00156 | 2 | Pro |
| GLM 5.2 | 1M | $0.002484 | 3 | Powerhouse |
| GLM 5.3 | 1M | $0.0036 | 5 | Powerhouse |
| Kimi K2 0711 | 131K | $0.00172 | 10 | Powerhouse |
| Kimi K2 Thinking | 262K | $0.00185 | 10 | Powerhouse |
| Kimi K2.7 Code | 262K | $0.00246 | 10 | Powerhouse |
| Kimi K3 | 1M | $0.0105 | 10 | Pro |
另外十四行。
这些是其余实验室定价行中的一部分,并非全部。
| 模型 | 上下文窗口 | 单次回答成本 | 积分 | 最低套餐 |
|---|---|---|---|---|
| MiniMax M2 | 205K | $0.000765 | 1 | Powerhouse |
| MiniMax M3 | 1M | $0.0009 | 1 | Powerhouse |
| Nemotron 3.5 Lightning, NVIDIA | 262K | $0.00018 | 1 | Powerhouse |
| Nemotron 3 Ultra, NVIDIA | 512K | $0.0024 | 3 | Powerhouse |
| Nova Pro 1.0, Amazon | 300K | $0.0024 | 3 | Powerhouse |
| Command A, Cohere | 256K | $0.0075 | 10 | Powerhouse |
| Solar Pro 4, Upstage | 524K | $0.00009 | 1 | Powerhouse |
| Ling-3.0-flash, inclusionAI | 262K | $0.000053 | 1 | Powerhouse |
| Nex-N2-Mini, Nex Agi | 262K | $0.000075 | 1 | Powerhouse |
| Laguna XS 2.1, Poolside | 262K | $0.00012 | 1 | Powerhouse |
| Granite 4.1 8B, IBM | 131K | $0.0001 | 1 | Powerhouse |
| Phi 4, Microsoft | 16K | $0.00014 | 1 | Powerhouse |
| Inkling, Thinkingmachines | 1M | $0.002975 | 4 | Powerhouse |
| Fugu Ultra, Sakana | 1M | $0.02 | 25 | Powerhouse |
该目录收录了280+个模型,上面这些行都取自成本指数,它为便于比较为100行OpenRouter模型定价,无论是这些表格还是这个指数都不是完整目录。套餐栏是推算出来的,而不是直接列出的,模型列表详细说明了这个推算过程。
Starter是表格里几乎没怎么覆盖到的那个套餐。它的四个条目是Auto、内置模型Whizi AI,Whizi AI所运行的基础GPT模型,以及一个速度较快的Gemini模型。Whizi AI是这个基础GPT模型上的一个内置人设,而不是它自己的模型,每条消息消耗1积分。免费账户还在它之下:只能使用Whizi AI和Auto,第一天7条消息,之后每天3条,而且免费的每轮对话还额外限制在大约5,000个输入token和5,000个输出token以内。
小到足以改变预算的窗口
窗口那一栏并不是决定长度的那一栏,因为每轮预算在整个目录里都是固定的。这个预算是怎么构成的,以及对话超出预算之后会发生什么,当对话太长时一文有详细说明。
窗口真正决定的是这个固定预算是否适用,分界线在93,000个token。100行定价模型里有6行低于这条线,其中两行是整个定价索引里最小的窗口。
| Row | 上下文窗口 | 是否出现在上面的表格中 |
|---|---|---|
| Tencent Hy-MT2,两行 | 8,192 | 否 |
| Phi 4, Microsoft | 16K | 是 |
| Perceptron Mk1 | 33K | 否 |
| DeepSeek R1 | 64K | 否 |
| Nano Banana 2 Lite, Google | 66K | 否 |
上面这些行里,窗口与价格、积分的关系
按窗口给表格排序,其他任何东西都不会跟着一起排好。定价索引里最大的窗口是1,310,720个token,标准回答成本是$0.00028,每条消息扣1积分,属于Powerhouse套餐。全场最便宜的一行在262K窗口下每次回答只要$0.000053。中位数那一行是每次回答$0.00185,同样是262K窗口。最贵的一行标准回答要价$0.105,而且完全没有积分档位,因为它不是Whizi提供的那些行之一。
在窗口相同的行之间,这种散布最容易看出来。
| Row | 上下文窗口 | 单次回答成本 | 积分 |
|---|---|---|---|
| DeepSeek V4 Flash 0731 | 1.31M | $0.00028 | 1 |
| Qwen3.7 Flash | 1M | $0.000095 | 1 |
| Inkling, Thinkingmachines | 1M | $0.002975 | 4 |
| Claude Fable 5 | 1M | $0.035 | 50 |
| Granite 4.1 8B, IBM | 131K | $0.0001 | 1 |
| Kimi K2 0711 | 131K | $0.00172 | 10 |
其中三行拥有相同的1,000,000 token窗口,却分别扣1、4和50积分。另外两行拥有相同的131K窗口,分别扣1和10。整个定价索引从最便宜到最贵大约相差2000倍,而上面这些行说明,这种差距并不跟着窗口那一栏走。
- 定价索引里的窗口从8,192个token到1,310,720个token不等
- 100行定价模型里有47行的窗口达到或超过1,000,000个token
- 索引里最大的窗口,单次回答只要$0.00028,扣1积分
- 索引里最便宜的那一行是262K窗口,而不是最大的那个
- 定价行里的中位数是每次标准回答$0.00185,同样是262K窗口
- 在网页端,积分栏就是每条消息相对于积分额度所消耗的数量
- 积分档位是根据提供商的每token费率推算出来的,窗口大小不是它的输入项
- Whizi AI是基础GPT模型上的内置人设,每条消息1积分
- 免费账户只能使用两行模型,免费的每轮对话被限制在5,000个输入token和5,000个输出token以内
- 成本指数为100行OpenRouter模型定价,并不是完整的280+目录
常见问题
更高的套餐能获得更大的上下文窗口吗?
不能。窗口属于模型,而不属于你的订阅。更高的套餐买到的是更多模型的使用权,以及更大的月度积分额度:Starter是400积分,Pro是2,000积分,Powerhouse是8,000积分。
上下文窗口更大的模型会消耗更多积分吗?
在上面的表格里并不会。定价索引里最大的窗口是1,310,720个token,每条消息只扣1积分,而同一张表里一个131K窗口的行却要扣10积分。积分档位是根据一个参考轮次(3,000个输入token加800个输出token)对照实时的提供商每token费率推算出来的,再向上取整到一个合法档位,窗口大小并不是其中的输入项。
免费账户能试用大上下文窗口的模型吗?
不能,自2026-09-02起就不行了。免费账户只开放Whizi AI和Auto,1,000,000 token的那些行都需要付费套餐。免费的每轮对话还被限制在大约5,000个输入token和5,000个输出token以内,比本页任何一个上下文窗口都更紧,而且额度是第一天7条消息,之后每天3条。
Whizi会公布目录里每个模型的上下文窗口吗?
不会。本页的窗口数据来自成本指数,它为便于比较为100行OpenRouter模型定价,而目录里共有280+个模型。应用里的模型选择器是另一个独立界面,由共享worker实时提供数据,列出的是当前目录,而不是这个指数。
本页的上下文窗口数据来自哪里?
来自Whizi成本指数,它按照1,000个输入token加500个输出token的标准回答,为100行OpenRouter模型定价,原始价格抓取自OpenRouter,时间是2026-08-20。成本指数只记录这一个抓取日期,所以这里的美元数字应当被视为那一天的价格,而不是实时费率。