So sánh context window: AI đọc được bao nhiêu tài liệu của bạn trong Whizi

Trả lời nhanh

Context window trong bảng giá của Whizi dao động từ 8,192 token đến 1,310,720 token, và 47 trong số 100 dòng đó có từ 1,000,000 token trở lên. Context window không phải là yếu tố quyết định kết quả bạn nhận được. Mọi mô hình đều nhận mức cố định 40,000 token đầu vào và 20,000 token đầu ra mỗi lượt, và chỉ khi context window dưới 93,000 token thì mức đó mới bị giảm.

Câu trả lời ngắn gọn

Context window trong bảng giá dao động từ 8,192 token đến 1,310,720 token, và 47 trong số 100 dòng được định giá có context window từ 1,000,000 token trở lên. Context window là số token tối đa mà một mô hình có thể xử lý trong một yêu cầu, nhưng đây không phải là con số quyết định kết quả bạn nhận được trên Whizi.

Con số thực sự quyết định là ngân sách mỗi lượt. Mọi mô hình trong danh mục đều nhận cùng một mức cố định cho một lượt: 40,000 token đầu vào và 20,000 token đầu ra. Một context window lớn hơn không làm tăng ngân sách đó. Một context window nhỏ hơn 93,000 token sẽ làm giảm ngân sách đó.

Chỉ sốGiá trị
Context window lớn nhất trong bảng giáDeepSeek V4 Flash 0731, 1,310,720 token
Context window nhỏ nhất trong bảng giáHai dòng Tencent Hy-MT2, 8,192 token
Số dòng có từ 1,000,000 token trở lên47 trong số 100 dòng được định giá
Token đầu vào gửi mỗi lượt, mọi mô hình trong danh mục40,000 token
Token đầu ra cho phép mỗi lượt, mọi mô hình trong danh mục20,000 token
Context window dưới mức mà ngân sách đó bị giảm93,000 token

Vì vậy với một tài liệu thực tế, hai giới hạn thực sự có tác động là giới hạn 100,000 ký tự cho một tin nhắn chat và ngân sách 40,000 token đầu vào đó. Không giới hạn nào trong hai giới hạn này là cột context window.

Context window theo từng mô hình, kèm chi phí và gói

Mỗi dòng dưới đây đến từ Whizi Cost Index, bảng định giá 100 dòng OpenRouter trên 29 nhà cung cấp dựa trên một câu trả lời chuẩn gồm 1,000 token đầu vào cộng 500 token đầu ra. Mức giá của các nhà cung cấp đằng sau những con số này được lấy vào ngày 2026-08-20. Trên web, cột credit là chi phí một tin nhắn trên mô hình đó tính vào hạn mức credit của bạn, còn cột gói là gói thấp nhất có thể mở mô hình đó. Một nền tảng không nằm trong danh sách được phép dùng credit sẽ thấy mức cố định 1x thay vào đó, bị tính một lượt mỗi lần, và vẫn giữ nguyên hạn mức tin nhắn.

OpenAI.

Mô hìnhContext windowChi phí mỗi câu trả lờiCreditGói thấp nhất
GPT-5.6 Luna1M$0.00081Starter
GPT-5.4 Nano400K$0.0008252Powerhouse
GPT-5.4 Mini400K$0.0034Powerhouse
GPT-5.6 Terra1M$0.0084Pro
GPT-5.41M$0.0115Powerhouse
GPT-5.6 Sol1M$0.0120Powerhouse
GPT-5.51M$0.0220Pro
GPT Chat Latest400K$0.0225Powerhouse

Anthropic.

Mô hìnhContext windowChi phí mỗi câu trả lờiCreditGói thấp nhất
Claude Haiku 4.5200K$0.00354Pro
Claude Sonnet 51M$0.00710Pro
Claude Sonnet 4.61M$0.010510Pro
Claude Sonnet 4.51M$0.010510Pro
Claude Opus 51M$0.017520Powerhouse
Claude Opus 4.81M$0.017520Powerhouse
Claude Fable 51M$0.03550Powerhouse

Google.

Mô hìnhContext windowChi phí mỗi câu trả lờiCreditGói thấp nhất
Gemini 2.5 Flash Lite1M$0.00031Pro
Gemini 3.1 Flash Lite1M$0.0011Powerhouse
Gemini 3.7 Flash1M$0.0013132Pro
Gemini 2.5 Flash1M$0.001552Pro
Gemini 3.5 Flash Lite1M$0.001552Powerhouse
Gemini 3.6 Flash1M$0.0026253Pro
Gemini 3.5 Flash1M$0.0068Pro
Gemini 3.1 Pro Preview1M$0.00810Pro

DeepSeek.

Mô hìnhContext windowChi phí mỗi câu trả lờiCreditGói thấp nhất
DeepSeek V4 Flash 07311.31M$0.000281Powerhouse
DeepSeek V3.2164K$0.0004691Pro
DeepSeek V3.1164K$0.0007251Pro
DeepSeek V4 Pro 08131M$0.002972Powerhouse

Qwen.

Mô hìnhContext windowChi phí mỗi câu trả lờiCreditGói thấp nhất
Qwen3.7 Flash1M$0.0000951Powerhouse
Qwen3 Coder Next262K$0.000521Powerhouse
Qwen3.6 Flash1M$0.000751Powerhouse
Qwen3.7 Plus1M$0.000961Pro
Qwen3.8 27B1M$0.002053Powerhouse
Qwen3.7 Max1M$0.0036885Powerhouse
Qwen3.8 Max1M$0.0056Powerhouse

xAI.

Mô hìnhContext windowChi phí mỗi câu trả lờiCreditGói thấp nhất
Grok Build 0.1256K$0.0023Powerhouse
Grok 4.31M$0.00254Powerhouse
Grok 4.5500K$0.0056Powerhouse
Grok 4.6500K$0.0056Pro

Meta.

Mô hìnhContext windowChi phí mỗi câu trả lờiCreditGói thấp nhất
Llama 3.3 70B Instruct131K$0.000261Pro
Llama 4 Maverick1M$0.00061Pro
Muse Glimmer 30B131K$0.00112Powerhouse
Muse Spark 1.21M$0.0033755Powerhouse

Mistral.

Mô hìnhContext windowChi phí mỗi câu trả lờiCreditGói thấp nhất
Codestral 2508256K$0.000751Powerhouse
Mistral Large 3 2512262K$0.001252Pro
Mistral Medium 3.1131K$0.00142Pro
Mistral Medium 3.5262K$0.005256Powerhouse

Z.ai và Moonshot.

Mô hìnhContext windowChi phí mỗi câu trả lờiCreditGói thấp nhất
GLM 4.6205K$0.00151Powerhouse
GLM 4.7205K$0.0012752Powerhouse
GLM 5205K$0.001562Pro
GLM 5.21M$0.0024843Powerhouse
GLM 5.31M$0.00365Powerhouse
Kimi K2 0711131K$0.0017210Powerhouse
Kimi K2 Thinking262K$0.0018510Powerhouse
Kimi K2.7 Code262K$0.0024610Powerhouse
Kimi K31M$0.010510Pro

Mười bốn dòng khác.

Đây là một số dòng được định giá được chọn từ các phòng thí nghiệm còn lại, không phải toàn bộ.

Mô hìnhContext windowChi phí mỗi câu trả lờiCreditGói thấp nhất
MiniMax M2205K$0.0007651Powerhouse
MiniMax M31M$0.00091Powerhouse
Nemotron 3.5 Lightning, NVIDIA262K$0.000181Powerhouse
Nemotron 3 Ultra, NVIDIA512K$0.00243Powerhouse
Nova Pro 1.0, Amazon300K$0.00243Powerhouse
Command A, Cohere256K$0.007510Powerhouse
Solar Pro 4, Upstage524K$0.000091Powerhouse
Ling-3.0-flash, inclusionAI262K$0.0000531Powerhouse
Nex-N2-Mini, Nex Agi262K$0.0000751Powerhouse
Laguna XS 2.1, Poolside262K$0.000121Powerhouse
Granite 4.1 8B, IBM131K$0.00011Powerhouse
Phi 4, Microsoft16K$0.000141Powerhouse
Inkling, Thinkingmachines1M$0.0029754Powerhouse
Fugu Ultra, Sakana1M$0.0225Powerhouse

Danh mục có hơn 280+ mô hình, và các dòng ở trên được lấy từ Cost Index, bảng định giá 100 dòng OpenRouter để so sánh, và cả các bảng lẫn chỉ số này đều không phải là toàn bộ danh mục. Cột gói là được suy ra chứ không phải liệt kê sẵn, và danh sách mô hình giải thích cách suy ra đó hoạt động như thế nào.

Starter là gói duy nhất mà bảng trên gần như không đề cập đến. Bốn mục của gói này là Auto, mô hình nội bộ Whizi AI, mô hình GPT nền tảng mà Whizi AI chạy trên đó, và một mô hình Gemini nhanh. Whizi AI là một persona nội bộ trên mô hình GPT nền tảng đó chứ không phải một mô hình riêng, và nó tốn 1 credit mỗi tin nhắn. Tài khoản miễn phí nằm dưới mức này: chỉ tiếp cận được Whizi AI và Auto, với 7 tin nhắn vào ngày đầu tiên, sau đó 3 tin nhắn mỗi ngày, và một lượt miễn phí còn bị giới hạn thêm ở khoảng 5,000 token đầu vào và 5,000 token đầu ra.

Những context window đủ nhỏ để thay đổi ngân sách

Cột context window không phải là cột quyết định độ dài, vì ngân sách mỗi lượt là cố định trên toàn bộ danh mục. Cách ngân sách đó được xây dựng, và điều gì xảy ra khi một cuộc trò chuyện vượt quá mức đó, được trình bày trong khi cuộc trò chuyện quá dài.

Điều mà context window thực sự quyết định là liệu ngân sách cố định đó có được áp dụng hay không, và ngưỡng này nằm ở 93,000 token. Sáu trong số 100 dòng được định giá nằm dưới ngưỡng này, và hai trong số đó là những context window nhỏ nhất trong toàn bộ bảng giá.

DòngContext windowCó xuất hiện trong các bảng trên
Tencent Hy-MT2, hai dòng8,192Không
Phi 4, Microsoft16K
Perceptron Mk133KKhông
DeepSeek R164KKhông
Nano Banana 2 Lite, Google66KKhông

Context window có ý nghĩa gì với một tài liệu thực tế

Giới hạn đầu tiên mà một tài liệu chạm phải không phải là context window. Đó là giới hạn 100,000 ký tự cho một tin nhắn, và văn bản trích xuất từ tệp đính kèm được tính vào giới hạn đó giống hệt như văn bản gõ tay.

Trên web, các tệp PDF, Word và bảng tính được trích xuất thành văn bản ngay trong trình duyệt của bạn trước khi bất cứ thứ gì được gửi đi, vì vậy thứ mô hình nhận được chính là văn bản đã trích xuất đó. Mỗi tệp bị giới hạn ở 10 MB. Danh sách định dạng đầy đủ có trong các loại tệp được hỗ trợ.

Projects là nơi duy nhất mà một tài liệu thực sự ăn vào ngân sách, vì một tệp được ghim trong project sẽ được dựng lại vào trong prompt ở mỗi lượt trong project đó, nằm trong cùng một ngân sách đầu vào cố định bất kể mô hình mang context window nào. Giới hạn tệp ghim và block của project có trong khi cuộc trò chuyện quá dài.

Context window so với giá và credit, trong các dòng ở trên

Sắp xếp các bảng theo context window và không có gì khác được sắp xếp theo cùng thứ tự đó. Context window lớn nhất trong bảng giá, ở mức 1,310,720 token, tốn $0.00028 cho mỗi câu trả lời chuẩn, tính 1 credit mỗi tin nhắn và nằm ở gói Powerhouse. Dòng rẻ nhất trong tất cả tốn $0.000053 mỗi câu trả lời trên context window 262K. Dòng trung vị nằm ở mức $0.00185 mỗi câu trả lời, cũng trên context window 262K. Dòng đắt nhất tốn $0.105 cho mỗi câu trả lời chuẩn và không có mức credit nào cả, vì đây không phải là một trong các dòng mà Whizi cung cấp.

Sự phân tán này dễ thấy nhất ở các dòng có chung một context window.

DòngContext windowChi phí mỗi câu trả lờiCredit
DeepSeek V4 Flash 07311.31M$0.000281
Qwen3.7 Flash1M$0.0000951
Inkling, Thinkingmachines1M$0.0029754
Claude Fable 51M$0.03550
Granite 4.1 8B, IBM131K$0.00011
Kimi K2 0711131K$0.0017210

Ba dòng ở đó có cùng context window 1,000,000 token và tính 1, 4 và 50 credit. Hai dòng có cùng context window 131K và tính 1 và 10. Bảng giá trải rộng khoảng 2000 lần từ dòng rẻ nhất đến dòng đắt nhất, và các dòng ở trên cho thấy mức chênh lệch đó không đi theo cột context window.

Danh sách kiểm tra
  • Context window trong bảng giá dao động từ 8,192 token đến 1,310,720 token
  • 47 trong số 100 dòng được định giá có context window từ 1,000,000 token trở lên
  • Context window lớn nhất trong bảng giá trả lời một lần với $0.00028 và tính 1 credit
  • Dòng rẻ nhất trong bảng giá có context window 262K, không phải context window lớn nhất
  • Dòng trung vị trong bảng giá nằm ở mức $0.00185 cho mỗi câu trả lời chuẩn, cũng trên context window 262K
  • Trên web, cột credit là số credit mà một tin nhắn tiêu tốn từ hạn mức credit của bạn
  • Mức credit được suy ra từ đơn giá theo token của nhà cung cấp, nên kích thước context window không phải là yếu tố đầu vào của nó
  • Whizi AI là một persona nội bộ trên mô hình GPT nền tảng, với 1 credit mỗi tin nhắn
  • Tài khoản miễn phí chỉ tiếp cận được hai dòng, và một lượt miễn phí bị giới hạn ở 5,000 token đầu vào và đầu ra
  • Cost Index định giá 100 dòng OpenRouter, đây không phải là toàn bộ danh mục 280+ mô hình

Câu hỏi thường gặp

Tôi có được context window lớn hơn khi dùng gói cao hơn không?

Không. Context window thuộc về mô hình, không thuộc về gói đăng ký của bạn. Một gói cao hơn mang lại quyền truy cập vào nhiều mô hình hơn và hạn mức credit hàng tháng lớn hơn: 400 credit ở gói Starter, 2,000 ở gói Pro và 8,000 ở gói Powerhouse.

Một mô hình có context window lớn hơn có tốn nhiều credit hơn không?

Không, theo các bảng ở trên. Context window lớn nhất trong bảng giá, ở mức 1,310,720 token, chỉ tính 1 credit mỗi tin nhắn, trong khi một dòng có context window 131K trong cùng các bảng đó lại tính 10 credit. Mức credit được suy ra từ một lượt tham chiếu gồm 3,000 token đầu vào và 800 token đầu ra đối chiếu với đơn giá theo token thực tế của nhà cung cấp, sau đó làm tròn lên mức hợp lệ, và kích thước context window không phải là một trong các yếu tố đầu vào đó.

Tôi có thể dùng thử một mô hình có context window lớn trên tài khoản miễn phí không?

Không, kể từ ngày 2026-09-02 thì không còn được nữa. Một tài khoản miễn phí chỉ mở được Whizi AI và Auto, nên các dòng có 1,000,000 token cần một gói trả phí. Một lượt miễn phí cũng bị giới hạn ở khoảng 5,000 token đầu vào và 5,000 token đầu ra, đây là giới hạn chặt hơn bất kỳ context window nào trên trang này, và hạn mức là 7 tin nhắn vào ngày đầu tiên, sau đó 3 tin nhắn mỗi ngày.

Whizi có công bố context window cho mọi mô hình trong danh mục không?

Không. Các context window trên trang này đến từ Cost Index, bảng định giá 100 dòng OpenRouter để so sánh, trong khi danh mục có hơn 280+ mô hình. Bộ chọn mô hình trong ứng dụng là một giao diện riêng được phục vụ trực tiếp bởi shared worker, nên nó liệt kê danh mục hiện tại chứ không phải chỉ số này.

Các con số context window trên trang này lấy từ đâu?

Từ Whizi Cost Index, bảng định giá 100 dòng OpenRouter dựa trên một câu trả lời chuẩn gồm 1,000 token đầu vào cộng 500 token đầu ra, với giá gốc được lấy từ OpenRouter vào ngày 2026-08-20. Cost Index chỉ ghi nhận đúng một ngày lấy dữ liệu đó, nên hãy coi các con số đô la là đúng vào ngày đó chứ không phải mức giá theo thời gian thực.