上下文窗口对比:AI能读取Whizi各定价模型的多少内容

快速解答

Whizi定价索引中的上下文窗口从8,192个token到1,310,720个token不等,这100行里有47行的窗口达到或超过1,000,000个token。真正决定结果的并不是窗口大小。每个模型每轮都获得固定的40,000个输入token和20,000个输出token,只有当窗口小于93,000个token时,这个额度才会降低。

简短的答案

定价索引里的窗口从8,192个token到1,310,720个token不等,100行定价模型里有47行的窗口达到或超过1,000,000个token。窗口是模型在一次请求中最多能处理的内容量,以token计算,但在Whizi里,它并不是决定你结果的那个数字。

真正决定结果的数字是每轮预算。目录里的每个模型在一轮对话中都获得相同的固定额度:40,000个输入token和20,000个输出token。更大的窗口不会提高这个预算,而小于93,000个token的窗口会降低它。

FigureValue
定价索引里最大的窗口DeepSeek V4 Flash 0731,1,310,720个token
定价索引里最小的窗口Tencent Hy-MT2的两行,8,192个token
窗口达到或超过1,000,000个token的行数100行定价模型里的47行
每轮发送的输入量,所有目录模型统一40,000个token
每轮允许的输出量,所有目录模型统一20,000个token
该预算会缩水的窗口下限93,000个token

所以对于真实文档来说,真正起作用的两个上限是单条消息100,000个字符的限制,以及那40,000个token的输入预算,两者都不是窗口那一栏。

各模型的上下文窗口、成本与套餐

以下每一行都来自Whizi成本指数,它按照1,000个输入token加500个输出token的标准回答,为29家提供商的100行OpenRouter模型定价。这些数字背后的提供商费率抓取于2026-08-20。在网页端,积分栏是该模型每条消息相对于你的积分额度所消耗的数量,套餐栏是能开放它的最低套餐。不在积分白名单上的平台会看到固定的1x,每轮扣1,并保留消息额度。

OpenAI。

模型上下文窗口单次回答成本积分最低套餐
GPT-5.6 Luna1M$0.00081Starter
GPT-5.4 Nano400K$0.0008252Powerhouse
GPT-5.4 Mini400K$0.0034Powerhouse
GPT-5.6 Terra1M$0.0084Pro
GPT-5.41M$0.0115Powerhouse
GPT-5.6 Sol1M$0.0120Powerhouse
GPT-5.51M$0.0220Pro
GPT Chat Latest400K$0.0225Powerhouse

Anthropic。

模型上下文窗口单次回答成本积分最低套餐
Claude Haiku 4.5200K$0.00354Pro
Claude Sonnet 51M$0.00710Pro
Claude Sonnet 4.61M$0.010510Pro
Claude Sonnet 4.51M$0.010510Pro
Claude Opus 51M$0.017520Powerhouse
Claude Opus 4.81M$0.017520Powerhouse
Claude Fable 51M$0.03550Powerhouse

Google。

模型上下文窗口单次回答成本积分最低套餐
Gemini 2.5 Flash Lite1M$0.00031Pro
Gemini 3.1 Flash Lite1M$0.0011Powerhouse
Gemini 3.7 Flash1M$0.0013132Pro
Gemini 2.5 Flash1M$0.001552Pro
Gemini 3.5 Flash Lite1M$0.001552Powerhouse
Gemini 3.6 Flash1M$0.0026253Pro
Gemini 3.5 Flash1M$0.0068Pro
Gemini 3.1 Pro Preview1M$0.00810Pro

DeepSeek。

模型上下文窗口单次回答成本积分最低套餐
DeepSeek V4 Flash 07311.31M$0.000281Powerhouse
DeepSeek V3.2164K$0.0004691Pro
DeepSeek V3.1164K$0.0007251Pro
DeepSeek V4 Pro 08131M$0.002972Powerhouse

Qwen。

模型上下文窗口单次回答成本积分最低套餐
Qwen3.7 Flash1M$0.0000951Powerhouse
Qwen3 Coder Next262K$0.000521Powerhouse
Qwen3.6 Flash1M$0.000751Powerhouse
Qwen3.7 Plus1M$0.000961Pro
Qwen3.8 27B1M$0.002053Powerhouse
Qwen3.7 Max1M$0.0036885Powerhouse
Qwen3.8 Max1M$0.0056Powerhouse

xAI。

模型上下文窗口单次回答成本积分最低套餐
Grok Build 0.1256K$0.0023Powerhouse
Grok 4.31M$0.00254Powerhouse
Grok 4.5500K$0.0056Powerhouse
Grok 4.6500K$0.0056Pro

Meta。

模型上下文窗口单次回答成本积分最低套餐
Llama 3.3 70B Instruct131K$0.000261Pro
Llama 4 Maverick1M$0.00061Pro
Muse Glimmer 30B131K$0.00112Powerhouse
Muse Spark 1.21M$0.0033755Powerhouse

Mistral。

模型上下文窗口单次回答成本积分最低套餐
Codestral 2508256K$0.000751Powerhouse
Mistral Large 3 2512262K$0.001252Pro
Mistral Medium 3.1131K$0.00142Pro
Mistral Medium 3.5262K$0.005256Powerhouse

Z.ai和Moonshot。

模型上下文窗口单次回答成本积分最低套餐
GLM 4.6205K$0.00151Powerhouse
GLM 4.7205K$0.0012752Powerhouse
GLM 5205K$0.001562Pro
GLM 5.21M$0.0024843Powerhouse
GLM 5.31M$0.00365Powerhouse
Kimi K2 0711131K$0.0017210Powerhouse
Kimi K2 Thinking262K$0.0018510Powerhouse
Kimi K2.7 Code262K$0.0024610Powerhouse
Kimi K31M$0.010510Pro

另外十四行。

这些是其余实验室定价行中的一部分,并非全部。

模型上下文窗口单次回答成本积分最低套餐
MiniMax M2205K$0.0007651Powerhouse
MiniMax M31M$0.00091Powerhouse
Nemotron 3.5 Lightning, NVIDIA262K$0.000181Powerhouse
Nemotron 3 Ultra, NVIDIA512K$0.00243Powerhouse
Nova Pro 1.0, Amazon300K$0.00243Powerhouse
Command A, Cohere256K$0.007510Powerhouse
Solar Pro 4, Upstage524K$0.000091Powerhouse
Ling-3.0-flash, inclusionAI262K$0.0000531Powerhouse
Nex-N2-Mini, Nex Agi262K$0.0000751Powerhouse
Laguna XS 2.1, Poolside262K$0.000121Powerhouse
Granite 4.1 8B, IBM131K$0.00011Powerhouse
Phi 4, Microsoft16K$0.000141Powerhouse
Inkling, Thinkingmachines1M$0.0029754Powerhouse
Fugu Ultra, Sakana1M$0.0225Powerhouse

该目录收录了280+个模型,上面这些行都取自成本指数,它为便于比较为100行OpenRouter模型定价,无论是这些表格还是这个指数都不是完整目录。套餐栏是推算出来的,而不是直接列出的,模型列表详细说明了这个推算过程。

Starter是表格里几乎没怎么覆盖到的那个套餐。它的四个条目是Auto、内置模型Whizi AI,Whizi AI所运行的基础GPT模型,以及一个速度较快的Gemini模型。Whizi AI是这个基础GPT模型上的一个内置人设,而不是它自己的模型,每条消息消耗1积分。免费账户还在它之下:只能使用Whizi AI和Auto,第一天7条消息,之后每天3条,而且免费的每轮对话还额外限制在大约5,000个输入token和5,000个输出token以内。

小到足以改变预算的窗口

窗口那一栏并不是决定长度的那一栏,因为每轮预算在整个目录里都是固定的。这个预算是怎么构成的,以及对话超出预算之后会发生什么,当对话太长时一文有详细说明。

窗口真正决定的是这个固定预算是否适用,分界线在93,000个token。100行定价模型里有6行低于这条线,其中两行是整个定价索引里最小的窗口。

Row上下文窗口是否出现在上面的表格中
Tencent Hy-MT2,两行8,192
Phi 4, Microsoft16K
Perceptron Mk133K
DeepSeek R164K
Nano Banana 2 Lite, Google66K

窗口对真实文档意味着什么

文档首先碰到的上限并不是上下文窗口,而是单条消息100,000个字符的限制,从附件文件中提取出来的文本和手打的文本一样,都算在这个限制里。

在网页端,PDF、Word和表格文件会先在你的浏览器里被提取成文本,然后才会发送出去,所以模型收到的其实是提取后的文本。每个文件的上限是10 MB。完整的格式列表见支持的文件类型

项目(Projects)是文档真正会消耗预算的地方,因为项目里固定的文件会在每一轮对话中被重新拼进提示词里,无论模型的窗口多大,都要挤进同一个固定的输入预算。固定文件和项目区块的上限见当对话太长时

上面这些行里,窗口与价格、积分的关系

按窗口给表格排序,其他任何东西都不会跟着一起排好。定价索引里最大的窗口是1,310,720个token,标准回答成本是$0.00028,每条消息扣1积分,属于Powerhouse套餐。全场最便宜的一行在262K窗口下每次回答只要$0.000053。中位数那一行是每次回答$0.00185,同样是262K窗口。最贵的一行标准回答要价$0.105,而且完全没有积分档位,因为它不是Whizi提供的那些行之一。

在窗口相同的行之间,这种散布最容易看出来。

Row上下文窗口单次回答成本积分
DeepSeek V4 Flash 07311.31M$0.000281
Qwen3.7 Flash1M$0.0000951
Inkling, Thinkingmachines1M$0.0029754
Claude Fable 51M$0.03550
Granite 4.1 8B, IBM131K$0.00011
Kimi K2 0711131K$0.0017210

其中三行拥有相同的1,000,000 token窗口,却分别扣1、4和50积分。另外两行拥有相同的131K窗口,分别扣1和10。整个定价索引从最便宜到最贵大约相差2000倍,而上面这些行说明,这种差距并不跟着窗口那一栏走。

操作清单
  • 定价索引里的窗口从8,192个token到1,310,720个token不等
  • 100行定价模型里有47行的窗口达到或超过1,000,000个token
  • 索引里最大的窗口,单次回答只要$0.00028,扣1积分
  • 索引里最便宜的那一行是262K窗口,而不是最大的那个
  • 定价行里的中位数是每次标准回答$0.00185,同样是262K窗口
  • 在网页端,积分栏就是每条消息相对于积分额度所消耗的数量
  • 积分档位是根据提供商的每token费率推算出来的,窗口大小不是它的输入项
  • Whizi AI是基础GPT模型上的内置人设,每条消息1积分
  • 免费账户只能使用两行模型,免费的每轮对话被限制在5,000个输入token和5,000个输出token以内
  • 成本指数为100行OpenRouter模型定价,并不是完整的280+目录

常见问题

更高的套餐能获得更大的上下文窗口吗?

不能。窗口属于模型,而不属于你的订阅。更高的套餐买到的是更多模型的使用权,以及更大的月度积分额度:Starter是400积分,Pro是2,000积分,Powerhouse是8,000积分。

上下文窗口更大的模型会消耗更多积分吗?

在上面的表格里并不会。定价索引里最大的窗口是1,310,720个token,每条消息只扣1积分,而同一张表里一个131K窗口的行却要扣10积分。积分档位是根据一个参考轮次(3,000个输入token加800个输出token)对照实时的提供商每token费率推算出来的,再向上取整到一个合法档位,窗口大小并不是其中的输入项。

免费账户能试用大上下文窗口的模型吗?

不能,自2026-09-02起就不行了。免费账户只开放Whizi AI和Auto,1,000,000 token的那些行都需要付费套餐。免费的每轮对话还被限制在大约5,000个输入token和5,000个输出token以内,比本页任何一个上下文窗口都更紧,而且额度是第一天7条消息,之后每天3条。

Whizi会公布目录里每个模型的上下文窗口吗?

不会。本页的窗口数据来自成本指数,它为便于比较为100行OpenRouter模型定价,而目录里共有280+个模型。应用里的模型选择器是另一个独立界面,由共享worker实时提供数据,列出的是当前目录,而不是这个指数。

本页的上下文窗口数据来自哪里?

来自Whizi成本指数,它按照1,000个输入token加500个输出token的标准回答,为100行OpenRouter模型定价,原始价格抓取自OpenRouter,时间是2026-08-20。成本指数只记录这一个抓取日期,所以这里的美元数字应当被视为那一天的价格,而不是实时费率。