Câu trả lời ngắn gọn
Context window trong bảng giá dao động từ 8,192 token đến 1,310,720 token, và 47 trong số 100 dòng được định giá có context window từ 1,000,000 token trở lên. Context window là số token tối đa mà một mô hình có thể xử lý trong một yêu cầu, nhưng đây không phải là con số quyết định kết quả bạn nhận được trên Whizi.
Con số thực sự quyết định là ngân sách mỗi lượt. Mọi mô hình trong danh mục đều nhận cùng một mức cố định cho một lượt: 40,000 token đầu vào và 20,000 token đầu ra. Một context window lớn hơn không làm tăng ngân sách đó. Một context window nhỏ hơn 93,000 token sẽ làm giảm ngân sách đó.
| Chỉ số | Giá trị |
|---|---|
| Context window lớn nhất trong bảng giá | DeepSeek V4 Flash 0731, 1,310,720 token |
| Context window nhỏ nhất trong bảng giá | Hai dòng Tencent Hy-MT2, 8,192 token |
| Số dòng có từ 1,000,000 token trở lên | 47 trong số 100 dòng được định giá |
| Token đầu vào gửi mỗi lượt, mọi mô hình trong danh mục | 40,000 token |
| Token đầu ra cho phép mỗi lượt, mọi mô hình trong danh mục | 20,000 token |
| Context window dưới mức mà ngân sách đó bị giảm | 93,000 token |
Vì vậy với một tài liệu thực tế, hai giới hạn thực sự có tác động là giới hạn 100,000 ký tự cho một tin nhắn chat và ngân sách 40,000 token đầu vào đó. Không giới hạn nào trong hai giới hạn này là cột context window.
Context window theo từng mô hình, kèm chi phí và gói
Mỗi dòng dưới đây đến từ Whizi Cost Index, bảng định giá 100 dòng OpenRouter trên 29 nhà cung cấp dựa trên một câu trả lời chuẩn gồm 1,000 token đầu vào cộng 500 token đầu ra. Mức giá của các nhà cung cấp đằng sau những con số này được lấy vào ngày 2026-08-20. Trên web, cột credit là chi phí một tin nhắn trên mô hình đó tính vào hạn mức credit của bạn, còn cột gói là gói thấp nhất có thể mở mô hình đó. Một nền tảng không nằm trong danh sách được phép dùng credit sẽ thấy mức cố định 1x thay vào đó, bị tính một lượt mỗi lần, và vẫn giữ nguyên hạn mức tin nhắn.
OpenAI.
| Mô hình | Context window | Chi phí mỗi câu trả lời | Credit | Gói thấp nhất |
|---|---|---|---|---|
| GPT-5.6 Luna | 1M | $0.0008 | 1 | Starter |
| GPT-5.4 Nano | 400K | $0.000825 | 2 | Powerhouse |
| GPT-5.4 Mini | 400K | $0.003 | 4 | Powerhouse |
| GPT-5.6 Terra | 1M | $0.008 | 4 | Pro |
| GPT-5.4 | 1M | $0.01 | 15 | Powerhouse |
| GPT-5.6 Sol | 1M | $0.01 | 20 | Powerhouse |
| GPT-5.5 | 1M | $0.02 | 20 | Pro |
| GPT Chat Latest | 400K | $0.02 | 25 | Powerhouse |
Anthropic.
| Mô hình | Context window | Chi phí mỗi câu trả lời | Credit | Gói thấp nhất |
|---|---|---|---|---|
| Claude Haiku 4.5 | 200K | $0.0035 | 4 | Pro |
| Claude Sonnet 5 | 1M | $0.007 | 10 | Pro |
| Claude Sonnet 4.6 | 1M | $0.0105 | 10 | Pro |
| Claude Sonnet 4.5 | 1M | $0.0105 | 10 | Pro |
| Claude Opus 5 | 1M | $0.0175 | 20 | Powerhouse |
| Claude Opus 4.8 | 1M | $0.0175 | 20 | Powerhouse |
| Claude Fable 5 | 1M | $0.035 | 50 | Powerhouse |
Google.
| Mô hình | Context window | Chi phí mỗi câu trả lời | Credit | Gói thấp nhất |
|---|---|---|---|---|
| Gemini 2.5 Flash Lite | 1M | $0.0003 | 1 | Pro |
| Gemini 3.1 Flash Lite | 1M | $0.001 | 1 | Powerhouse |
| Gemini 3.7 Flash | 1M | $0.001313 | 2 | Pro |
| Gemini 2.5 Flash | 1M | $0.00155 | 2 | Pro |
| Gemini 3.5 Flash Lite | 1M | $0.00155 | 2 | Powerhouse |
| Gemini 3.6 Flash | 1M | $0.002625 | 3 | Pro |
| Gemini 3.5 Flash | 1M | $0.006 | 8 | Pro |
| Gemini 3.1 Pro Preview | 1M | $0.008 | 10 | Pro |
DeepSeek.
| Mô hình | Context window | Chi phí mỗi câu trả lời | Credit | Gói thấp nhất |
|---|---|---|---|---|
| DeepSeek V4 Flash 0731 | 1.31M | $0.00028 | 1 | Powerhouse |
| DeepSeek V3.2 | 164K | $0.000469 | 1 | Pro |
| DeepSeek V3.1 | 164K | $0.000725 | 1 | Pro |
| DeepSeek V4 Pro 0813 | 1M | $0.00297 | 2 | Powerhouse |
Qwen.
| Mô hình | Context window | Chi phí mỗi câu trả lời | Credit | Gói thấp nhất |
|---|---|---|---|---|
| Qwen3.7 Flash | 1M | $0.000095 | 1 | Powerhouse |
| Qwen3 Coder Next | 262K | $0.00052 | 1 | Powerhouse |
| Qwen3.6 Flash | 1M | $0.00075 | 1 | Powerhouse |
| Qwen3.7 Plus | 1M | $0.00096 | 1 | Pro |
| Qwen3.8 27B | 1M | $0.00205 | 3 | Powerhouse |
| Qwen3.7 Max | 1M | $0.003688 | 5 | Powerhouse |
| Qwen3.8 Max | 1M | $0.005 | 6 | Powerhouse |
xAI.
| Mô hình | Context window | Chi phí mỗi câu trả lời | Credit | Gói thấp nhất |
|---|---|---|---|---|
| Grok Build 0.1 | 256K | $0.002 | 3 | Powerhouse |
| Grok 4.3 | 1M | $0.0025 | 4 | Powerhouse |
| Grok 4.5 | 500K | $0.005 | 6 | Powerhouse |
| Grok 4.6 | 500K | $0.005 | 6 | Pro |
Meta.
| Mô hình | Context window | Chi phí mỗi câu trả lời | Credit | Gói thấp nhất |
|---|---|---|---|---|
| Llama 3.3 70B Instruct | 131K | $0.00026 | 1 | Pro |
| Llama 4 Maverick | 1M | $0.0006 | 1 | Pro |
| Muse Glimmer 30B | 131K | $0.0011 | 2 | Powerhouse |
| Muse Spark 1.2 | 1M | $0.003375 | 5 | Powerhouse |
Mistral.
| Mô hình | Context window | Chi phí mỗi câu trả lời | Credit | Gói thấp nhất |
|---|---|---|---|---|
| Codestral 2508 | 256K | $0.00075 | 1 | Powerhouse |
| Mistral Large 3 2512 | 262K | $0.00125 | 2 | Pro |
| Mistral Medium 3.1 | 131K | $0.0014 | 2 | Pro |
| Mistral Medium 3.5 | 262K | $0.00525 | 6 | Powerhouse |
Z.ai và Moonshot.
| Mô hình | Context window | Chi phí mỗi câu trả lời | Credit | Gói thấp nhất |
|---|---|---|---|---|
| GLM 4.6 | 205K | $0.0015 | 1 | Powerhouse |
| GLM 4.7 | 205K | $0.001275 | 2 | Powerhouse |
| GLM 5 | 205K | $0.00156 | 2 | Pro |
| GLM 5.2 | 1M | $0.002484 | 3 | Powerhouse |
| GLM 5.3 | 1M | $0.0036 | 5 | Powerhouse |
| Kimi K2 0711 | 131K | $0.00172 | 10 | Powerhouse |
| Kimi K2 Thinking | 262K | $0.00185 | 10 | Powerhouse |
| Kimi K2.7 Code | 262K | $0.00246 | 10 | Powerhouse |
| Kimi K3 | 1M | $0.0105 | 10 | Pro |
Mười bốn dòng khác.
Đây là một số dòng được định giá được chọn từ các phòng thí nghiệm còn lại, không phải toàn bộ.
| Mô hình | Context window | Chi phí mỗi câu trả lời | Credit | Gói thấp nhất |
|---|---|---|---|---|
| MiniMax M2 | 205K | $0.000765 | 1 | Powerhouse |
| MiniMax M3 | 1M | $0.0009 | 1 | Powerhouse |
| Nemotron 3.5 Lightning, NVIDIA | 262K | $0.00018 | 1 | Powerhouse |
| Nemotron 3 Ultra, NVIDIA | 512K | $0.0024 | 3 | Powerhouse |
| Nova Pro 1.0, Amazon | 300K | $0.0024 | 3 | Powerhouse |
| Command A, Cohere | 256K | $0.0075 | 10 | Powerhouse |
| Solar Pro 4, Upstage | 524K | $0.00009 | 1 | Powerhouse |
| Ling-3.0-flash, inclusionAI | 262K | $0.000053 | 1 | Powerhouse |
| Nex-N2-Mini, Nex Agi | 262K | $0.000075 | 1 | Powerhouse |
| Laguna XS 2.1, Poolside | 262K | $0.00012 | 1 | Powerhouse |
| Granite 4.1 8B, IBM | 131K | $0.0001 | 1 | Powerhouse |
| Phi 4, Microsoft | 16K | $0.00014 | 1 | Powerhouse |
| Inkling, Thinkingmachines | 1M | $0.002975 | 4 | Powerhouse |
| Fugu Ultra, Sakana | 1M | $0.02 | 25 | Powerhouse |
Danh mục có hơn 280+ mô hình, và các dòng ở trên được lấy từ Cost Index, bảng định giá 100 dòng OpenRouter để so sánh, và cả các bảng lẫn chỉ số này đều không phải là toàn bộ danh mục. Cột gói là được suy ra chứ không phải liệt kê sẵn, và danh sách mô hình giải thích cách suy ra đó hoạt động như thế nào.
Starter là gói duy nhất mà bảng trên gần như không đề cập đến. Bốn mục của gói này là Auto, mô hình nội bộ Whizi AI, mô hình GPT nền tảng mà Whizi AI chạy trên đó, và một mô hình Gemini nhanh. Whizi AI là một persona nội bộ trên mô hình GPT nền tảng đó chứ không phải một mô hình riêng, và nó tốn 1 credit mỗi tin nhắn. Tài khoản miễn phí nằm dưới mức này: chỉ tiếp cận được Whizi AI và Auto, với 7 tin nhắn vào ngày đầu tiên, sau đó 3 tin nhắn mỗi ngày, và một lượt miễn phí còn bị giới hạn thêm ở khoảng 5,000 token đầu vào và 5,000 token đầu ra.
Những context window đủ nhỏ để thay đổi ngân sách
Cột context window không phải là cột quyết định độ dài, vì ngân sách mỗi lượt là cố định trên toàn bộ danh mục. Cách ngân sách đó được xây dựng, và điều gì xảy ra khi một cuộc trò chuyện vượt quá mức đó, được trình bày trong khi cuộc trò chuyện quá dài.
Điều mà context window thực sự quyết định là liệu ngân sách cố định đó có được áp dụng hay không, và ngưỡng này nằm ở 93,000 token. Sáu trong số 100 dòng được định giá nằm dưới ngưỡng này, và hai trong số đó là những context window nhỏ nhất trong toàn bộ bảng giá.
| Dòng | Context window | Có xuất hiện trong các bảng trên |
|---|---|---|
| Tencent Hy-MT2, hai dòng | 8,192 | Không |
| Phi 4, Microsoft | 16K | Có |
| Perceptron Mk1 | 33K | Không |
| DeepSeek R1 | 64K | Không |
| Nano Banana 2 Lite, Google | 66K | Không |
Context window có ý nghĩa gì với một tài liệu thực tế
Giới hạn đầu tiên mà một tài liệu chạm phải không phải là context window. Đó là giới hạn 100,000 ký tự cho một tin nhắn, và văn bản trích xuất từ tệp đính kèm được tính vào giới hạn đó giống hệt như văn bản gõ tay.
Trên web, các tệp PDF, Word và bảng tính được trích xuất thành văn bản ngay trong trình duyệt của bạn trước khi bất cứ thứ gì được gửi đi, vì vậy thứ mô hình nhận được chính là văn bản đã trích xuất đó. Mỗi tệp bị giới hạn ở 10 MB. Danh sách định dạng đầy đủ có trong các loại tệp được hỗ trợ.
Projects là nơi duy nhất mà một tài liệu thực sự ăn vào ngân sách, vì một tệp được ghim trong project sẽ được dựng lại vào trong prompt ở mỗi lượt trong project đó, nằm trong cùng một ngân sách đầu vào cố định bất kể mô hình mang context window nào. Giới hạn tệp ghim và block của project có trong khi cuộc trò chuyện quá dài.
Context window so với giá và credit, trong các dòng ở trên
Sắp xếp các bảng theo context window và không có gì khác được sắp xếp theo cùng thứ tự đó. Context window lớn nhất trong bảng giá, ở mức 1,310,720 token, tốn $0.00028 cho mỗi câu trả lời chuẩn, tính 1 credit mỗi tin nhắn và nằm ở gói Powerhouse. Dòng rẻ nhất trong tất cả tốn $0.000053 mỗi câu trả lời trên context window 262K. Dòng trung vị nằm ở mức $0.00185 mỗi câu trả lời, cũng trên context window 262K. Dòng đắt nhất tốn $0.105 cho mỗi câu trả lời chuẩn và không có mức credit nào cả, vì đây không phải là một trong các dòng mà Whizi cung cấp.
Sự phân tán này dễ thấy nhất ở các dòng có chung một context window.
| Dòng | Context window | Chi phí mỗi câu trả lời | Credit |
|---|---|---|---|
| DeepSeek V4 Flash 0731 | 1.31M | $0.00028 | 1 |
| Qwen3.7 Flash | 1M | $0.000095 | 1 |
| Inkling, Thinkingmachines | 1M | $0.002975 | 4 |
| Claude Fable 5 | 1M | $0.035 | 50 |
| Granite 4.1 8B, IBM | 131K | $0.0001 | 1 |
| Kimi K2 0711 | 131K | $0.00172 | 10 |
Ba dòng ở đó có cùng context window 1,000,000 token và tính 1, 4 và 50 credit. Hai dòng có cùng context window 131K và tính 1 và 10. Bảng giá trải rộng khoảng 2000 lần từ dòng rẻ nhất đến dòng đắt nhất, và các dòng ở trên cho thấy mức chênh lệch đó không đi theo cột context window.
- Context window trong bảng giá dao động từ 8,192 token đến 1,310,720 token
- 47 trong số 100 dòng được định giá có context window từ 1,000,000 token trở lên
- Context window lớn nhất trong bảng giá trả lời một lần với $0.00028 và tính 1 credit
- Dòng rẻ nhất trong bảng giá có context window 262K, không phải context window lớn nhất
- Dòng trung vị trong bảng giá nằm ở mức $0.00185 cho mỗi câu trả lời chuẩn, cũng trên context window 262K
- Trên web, cột credit là số credit mà một tin nhắn tiêu tốn từ hạn mức credit của bạn
- Mức credit được suy ra từ đơn giá theo token của nhà cung cấp, nên kích thước context window không phải là yếu tố đầu vào của nó
- Whizi AI là một persona nội bộ trên mô hình GPT nền tảng, với 1 credit mỗi tin nhắn
- Tài khoản miễn phí chỉ tiếp cận được hai dòng, và một lượt miễn phí bị giới hạn ở 5,000 token đầu vào và đầu ra
- Cost Index định giá 100 dòng OpenRouter, đây không phải là toàn bộ danh mục 280+ mô hình
Câu hỏi thường gặp
Tôi có được context window lớn hơn khi dùng gói cao hơn không?
Không. Context window thuộc về mô hình, không thuộc về gói đăng ký của bạn. Một gói cao hơn mang lại quyền truy cập vào nhiều mô hình hơn và hạn mức credit hàng tháng lớn hơn: 400 credit ở gói Starter, 2,000 ở gói Pro và 8,000 ở gói Powerhouse.
Một mô hình có context window lớn hơn có tốn nhiều credit hơn không?
Không, theo các bảng ở trên. Context window lớn nhất trong bảng giá, ở mức 1,310,720 token, chỉ tính 1 credit mỗi tin nhắn, trong khi một dòng có context window 131K trong cùng các bảng đó lại tính 10 credit. Mức credit được suy ra từ một lượt tham chiếu gồm 3,000 token đầu vào và 800 token đầu ra đối chiếu với đơn giá theo token thực tế của nhà cung cấp, sau đó làm tròn lên mức hợp lệ, và kích thước context window không phải là một trong các yếu tố đầu vào đó.
Tôi có thể dùng thử một mô hình có context window lớn trên tài khoản miễn phí không?
Không, kể từ ngày 2026-09-02 thì không còn được nữa. Một tài khoản miễn phí chỉ mở được Whizi AI và Auto, nên các dòng có 1,000,000 token cần một gói trả phí. Một lượt miễn phí cũng bị giới hạn ở khoảng 5,000 token đầu vào và 5,000 token đầu ra, đây là giới hạn chặt hơn bất kỳ context window nào trên trang này, và hạn mức là 7 tin nhắn vào ngày đầu tiên, sau đó 3 tin nhắn mỗi ngày.
Whizi có công bố context window cho mọi mô hình trong danh mục không?
Không. Các context window trên trang này đến từ Cost Index, bảng định giá 100 dòng OpenRouter để so sánh, trong khi danh mục có hơn 280+ mô hình. Bộ chọn mô hình trong ứng dụng là một giao diện riêng được phục vụ trực tiếp bởi shared worker, nên nó liệt kê danh mục hiện tại chứ không phải chỉ số này.
Các con số context window trên trang này lấy từ đâu?
Từ Whizi Cost Index, bảng định giá 100 dòng OpenRouter dựa trên một câu trả lời chuẩn gồm 1,000 token đầu vào cộng 500 token đầu ra, với giá gốc được lấy từ OpenRouter vào ngày 2026-08-20. Cost Index chỉ ghi nhận đúng một ngày lấy dữ liệu đó, nên hãy coi các con số đô la là đúng vào ngày đó chứ không phải mức giá theo thời gian thực.