So sánh cửa sổ ngữ cảnh: mọi mô hình AI lớn trong một bảng

Trả lời nhanh

Cửa sổ ngữ cảnh lớn nhất trong danh mục tháng 8 năm 2026 là 1M token, thuộc về DeepSeek V4 Flash 0731 của DeepSeek. Các bảng dưới đây so sánh mọi mô hình AI lớn theo cả token lẫn số trang thực tế, dựa trên cùng ảnh chụp danh mục với Chỉ số chi phí mô hình AI. Một token tương đương khoảng ba phần tư một từ tiếng Anh.

Mô hình AI nào có cửa sổ ngữ cảnh lớn nhất?

Cửa sổ ngữ cảnh lớn nhất trong danh mục tháng 8 năm 2026 là 1M token, thuộc về DeepSeek V4 Flash 0731 của DeepSeek. Để dễ hình dung, một token tương đương khoảng ba phần tư một từ tiếng Anh, và một trang bản thảo có khoảng 400 từ, nên bảng dưới đây quy đổi mọi cửa sổ ngữ cảnh ra số trang.

Mỗi dòng là một nhà cung cấp lớn, hiển thị mô hình có ngữ cảnh lớn nhất của họ:

Nhà cung cấpMô hình có ngữ cảnh lớn nhấtCửa sổ ngữ cảnhSức chứa gần đúng
DeepSeekDeepSeek V4 Flash 07311M tokenkhoảng 2.500 trang
OpenAIGPT-5.41M tokenkhoảng 2.000 trang
GoogleGemini 2.5 Flash1M tokenkhoảng 2.000 trang
MetaLlama 4 Maverick1M tokenkhoảng 2.000 trang
QwenQwen3.8 2.4T A95B1M tokenkhoảng 2.000 trang
MoonshotKimi K31M tokenkhoảng 2.000 trang
Z.aiGLM 5.21M tokenkhoảng 2.000 trang
MiniMaxMiniMax M31M tokenkhoảng 2.000 trang
AnthropicClaude Fable 51M tokenkhoảng 1.900 trang
xAIGrok 4.31M tokenkhoảng 1.900 trang
MistralMistral Large 3 2512262K tokenkhoảng 492 trang

Nếu câu hỏi thật sự đằng sau lượt tìm kiếm của bạn là "cửa sổ ngữ cảnh là gì", hãy bắt đầu với bài giải thích dễ hiểu tại Cửa sổ ngữ cảnh là gì? rồi quay lại đây để xem các con số.

100 mô hình xếp hạng theo cửa sổ ngữ cảnh như thế nào?

Toàn bộ danh mục, sắp xếp theo cửa sổ ngữ cảnh. Dữ liệu lấy từ cùng nguồn với Chỉ số chi phí mô hình AI và được lấy vào ngày 2026-08-20; đây là ảnh chụp của ngày đó chứ không phải nguồn cấp trực tiếp, nên hãy kiểm tra ngày trước khi trích dẫn một con số. Cột tín dụng cho biết mỗi mô hình tốn bao nhiêu cho một tin nhắn trong Whizi, ở những gói có bao gồm mô hình đó.

Mô hìnhNhà cung cấpCửa sổ ngữ cảnhSức chứa gần đúngTín dụng trong Whizi
DeepSeek V4 Flash 0731DeepSeek1Mkhoảng 2.500 trang1
GPT-5.4OpenAI1Mkhoảng 2.000 trang15
GPT-5.5OpenAI1Mkhoảng 2.000 trang20
GPT-5.6 LunaOpenAI1Mkhoảng 2.000 trang1
GPT-5.6 Luna ProOpenAI1Mkhoảng 2.000 trangKhông tính theo tin nhắn
GPT-5.6 SolOpenAI1Mkhoảng 2.000 trang20
GPT-5.6 Sol ProOpenAI1Mkhoảng 2.000 trangKhông tính theo tin nhắn
GPT-5.6 TerraOpenAI1Mkhoảng 2.000 trang4
GPT-5.6 Terra ProOpenAI1Mkhoảng 2.000 trangKhông tính theo tin nhắn
LongCat 2.0Meituan1Mkhoảng 2.000 trang1
DeepSeek V4 Pro 0813DeepSeek1Mkhoảng 2.000 trang2
Gemini 2.5 FlashGoogle1Mkhoảng 2.000 trang2
Gemini 2.5 Flash LiteGoogle1Mkhoảng 2.000 trang1
Gemini 3.1 Flash LiteGoogle1Mkhoảng 2.000 trang1
Gemini 3.1 Pro PreviewGoogle1Mkhoảng 2.000 trang10
Gemini 3.5 FlashGoogle1Mkhoảng 2.000 trang8
Gemini 3.5 Flash LiteGoogle1Mkhoảng 2.000 trang2
Gemini 3.6 FlashGoogle1Mkhoảng 2.000 trang3
Gemini 3.7 FlashGoogle1Mkhoảng 2.000 trang2
GLM 5.2Z.ai1Mkhoảng 2.000 trang3
GLM 5.3Z.ai1Mkhoảng 2.000 trang5
InklingThinkingmachines1Mkhoảng 2.000 trang4
Kimi K3Moonshot1Mkhoảng 2.000 trang10
Laguna S 2.1Poolside1Mkhoảng 2.000 trang1
Llama 4 MaverickMeta1Mkhoảng 2.000 trang1
MiniMax M3MiniMax1Mkhoảng 2.000 trang1
Muse Spark 1.1Meta1Mkhoảng 2.000 trang5
Muse Spark 1.2Meta1Mkhoảng 2.000 trang5
Qwen3.8 2.4T A95BQwen1Mkhoảng 2.000 trang8
Claude Fable 5Anthropic1Mkhoảng 1.900 trang50
Claude Opus 4.7 (Fast)Anthropic1Mkhoảng 1.900 trangKhông tính theo tin nhắn
Claude Opus 4.8Anthropic1Mkhoảng 1.900 trang20
Claude Opus 4.8 (Fast)Anthropic1Mkhoảng 1.900 trangKhông tính theo tin nhắn
Claude Opus 5Anthropic1Mkhoảng 1.900 trang20
Claude Opus 5 (Fast)Anthropic1Mkhoảng 1.900 trangKhông tính theo tin nhắn
Claude Sonnet 4.5Anthropic1Mkhoảng 1.900 trang10
Claude Sonnet 4.6Anthropic1Mkhoảng 1.900 trang10
Claude Sonnet 5Anthropic1Mkhoảng 1.900 trang10
Fugu UltraSakana1Mkhoảng 1.900 trang25
Grok 4.3xAI1Mkhoảng 1.900 trang4
Qwen3.5 Plus 2026-04-20Qwen1Mkhoảng 1.900 trang1
Qwen3.6 FlashQwen1Mkhoảng 1.900 trang1
Qwen3.7 FlashQwen1Mkhoảng 1.900 trang1
Qwen3.7 MaxQwen1Mkhoảng 1.900 trang5
Qwen3.7 PlusQwen1Mkhoảng 1.900 trang1
Qwen3.8 27BQwen1Mkhoảng 1.900 trang3
Qwen3.8 MaxQwen1Mkhoảng 1.900 trang6
Inkling SmallThinkingmachines524Kkhoảng 983 trang1
Solar Pro 4Upstage524Kkhoảng 983 trang1
Nemotron 3 UltraNVIDIA512Kkhoảng 961 trang3
Grok 4.5xAI500Kkhoảng 938 trang6
Grok 4.6xAI500Kkhoảng 938 trang6
GPT Chat LatestOpenAI400Kkhoảng 750 trang25
GPT-5.4 MiniOpenAI400Kkhoảng 750 trang4
GPT-5.4 NanoOpenAI400Kkhoảng 750 trang2
Nova Pro 1.0Amazon300Kkhoảng 563 trang3
Hy3Tencent262Kkhoảng 492 trang1
Kimi K2 ThinkingMoonshot262Kkhoảng 492 trang10
Kimi K2.7 CodeMoonshot262Kkhoảng 492 trang10
Laguna XS 2.1Poolside262Kkhoảng 492 trang1
Ling-3.0-flashinclusionAI262Kkhoảng 492 trang1
Mistral Large 3 2512Mistral262Kkhoảng 492 trang2
Mistral Medium 3.5Mistral262Kkhoảng 492 trang6
Nemotron 3.5 LightningNVIDIA262Kkhoảng 492 trang1
Nex-N2-MiniNex Agi262Kkhoảng 492 trang1
Nex-N2-ProNex Agi262Kkhoảng 492 trang1
Qwen3 Coder NextQwen262Kkhoảng 492 trang1
Qwen3.6 35B A3BQwen262Kkhoảng 492 trang1
Ring-2.6-1TinclusionAI262Kkhoảng 492 trang1
Sakana NamazuSakana262Kkhoảng 492 trang4
Seed 2.1 TurboBytedance Seed262Kkhoảng 492 trang2
Seed-2.0-CodeBytedance Seed262Kkhoảng 492 trang3
Step 3.7 FlashStepfun262Kkhoảng 492 trang1
Codestral 2508Mistral256Kkhoảng 480 trang1
Command ACohere256Kkhoảng 480 trang10
Grok Build 0.1xAI256Kkhoảng 480 trang3
KAT-Coder-Air V2.5Kwaipilot256Kkhoảng 480 trang1
KAT-Coder-Pro V2.5Kwaipilot256Kkhoảng 480 trang3
GLM 4.6Z.ai205Kkhoảng 384 trang1
GLM 4.7Z.ai205Kkhoảng 384 trang2
GLM 5Z.ai205Kkhoảng 384 trang2
MiniMax M2MiniMax205Kkhoảng 384 trang1
Claude Haiku 4.5Anthropic200Kkhoảng 375 trang4
DeepSeek V3.1DeepSeek164Kkhoảng 307 trang1
DeepSeek V3.2DeepSeek164Kkhoảng 307 trang1
Aion-3.0Aion Labs131Kkhoảng 246 trang10
Aion-3.0-MiniAion Labs131Kkhoảng 246 trang2
Granite 4.1 8BIbm Granite131Kkhoảng 246 trang1
Kimi K2 0711Moonshot131Kkhoảng 246 trang10
Llama 3.3 70B InstructMeta131Kkhoảng 246 trang1
Mistral Medium 3.1Mistral131Kkhoảng 246 trang2
Muse Glimmer 30BMeta131Kkhoảng 246 trang2
Nano Banana 2 (Gemini 3.1 Flash Image)Google131Kkhoảng 246 trangKhông tính theo tin nhắn
Nano Banana Pro (Gemini 3 Pro Image)Google131Kkhoảng 246 trangKhông tính theo tin nhắn
Nano Banana 2 Lite (Gemini 3.1 Flash Lite Image)Google66Kkhoảng 123 trangKhông tính theo tin nhắn
R1DeepSeek64Kkhoảng 120 trang2
Perceptron Mk1Perceptron33Kkhoảng 61 trang1
Phi 4Microsoft16Kkhoảng 31 trang1
Hy-MT2-1.8BTencent8Kkhoảng 15 trangKhông tính theo tin nhắn
Hy-MT2-30B-A3BTencent8Kkhoảng 15 trangKhông tính theo tin nhắn

Cách đọc những con số này một cách trung thực

Cửa sổ này là dùng chung. Mọi thứ đều tính vào đó cùng lúc: prompt của bạn, mọi tin nhắn trước đó trong cuộc trò chuyện, bất kỳ tài liệu nào bạn đính kèm, và cả câu trả lời đang được viết ra. Một mô hình có cửa sổ 128K đã đọc một hợp đồng 100K token thì không còn 128K cho phần thảo luận nữa; nó chỉ còn 28K.

Con số quảng cáo không phải là hiệu quả thực tế. Các nghiên cứu về ngữ cảnh dài liên tục tìm thấy cùng một quy luật: mô hình nhớ phần đầu và phần cuối của một ngữ cảnh khổng lồ tốt hơn phần giữa. Trong các thí nghiệm Lost in the Middle (Liu et al., 2023), việc chuyển tài liệu then chốt từ hai đầu vào giữa đầu vào khiến độ chính xác của mô hình giảm khoảng 20 điểm, nên một mô hình có thể nhận cả triệu token mà vẫn lướt qua điều khoản nằm ở token thứ 400.000. Với công việc rủi ro cao trên tài liệu dài, hãy hỏi cụ thể về các phần ở giữa, hoặc đưa tài liệu vào theo từng phần có gắn nhãn rõ.

Lớn hơn không tự động là tốt hơn. Cửa sổ lớn tốn nhiều chi phí vận hành hơn và có thể làm loãng sự chú ý trên cả những đoạn văn bản không liên quan. Nếu công việc của bạn là email và bản nháp ngắn, kích thước cửa sổ sẽ không bao giờ là điều bạn để ý tới. Nó chỉ bắt đầu quan trọng ở quy mô cả hợp đồng, cả mã nguồn, bản ghi lời nói và sách.

Token không phải là từ. Quy tắc ba phần tư là mức trung bình tốt cho tiếng Anh, nhưng mã nguồn, số liệu và các ngôn ngữ không phải tiếng Anh thường được token hóa kém hiệu quả hơn, nên các ước tính số trang trong bảng cố tình chỉ mang tính tương đối.

Chọn cửa sổ ngữ cảnh phù hợp với công việc

Kết luận thực tế rút ra từ bảng trên là cửa sổ ngữ cảnh là một lựa chọn theo từng việc, không phải theo từng gói thuê bao. Mô hình có cửa sổ lớn nhất hiếm khi là người viết giỏi nhất, và người viết giỏi nhất hiếm khi là cách rẻ nhất để tóm tắt 800 trang.

Đó chính là lý lẽ cho việc gom cả danh mục vào một không gian làm việc. Trong Whizi bạn có thể giao tệp PDF 200 trang cho một mô hình ngữ cảnh lớn, rồi chuyển sang Claude hoặc GPT trong cùng cuộc trò chuyện để viết nháp từ những gì nó tìm được, mà tài liệu không cần rời khỏi luồng trò chuyện. Điểm phản biện thành thật: nếu mọi thứ bạn đưa vào mô hình đều vừa thoải mái trong cửa sổ 128K, vốn đã đủ cho phần lớn email, bản nháp và tài liệu ngắn, thì cả bảng này trở nên không cần thiết và một gói thuê bao duy nhất là lựa chọn mua đơn giản hơn. Hướng dẫn cách chọn một mô hình bàn về cùng quyết định đó xét theo chất lượng và chi phí.

Khi trích dẫn trang này: đường dẫn không kèm anchor luôn ổn định, ngày lấy dữ liệu được in ngay phía trên bảng đầy đủ, và các con số token đến từ danh mục của nhà cung cấp chứ không phải từ trang quảng bá.

Danh sách kiểm tra
  • Trừ tài liệu và lịch sử trò chuyện của bạn ra khỏi cửa sổ trước khi tin vào con số quảng cáo
  • Với tài liệu dài, hãy kiểm tra khả năng nhớ từ phần giữa, không chỉ phần đầu
  • Quy đổi token sang trang bằng quy tắc ba phần tư trước khi quyết định bất cứ điều gì
  • Chọn cửa sổ ngữ cảnh theo từng việc thay vì theo từng gói thuê bao
  • Kiểm tra ngày lấy dữ liệu phía trên bảng đầy đủ khi trích dẫn một con số

Câu hỏi thường gặp

Mô hình AI nào có cửa sổ ngữ cảnh lớn nhất?

Theo danh mục tháng 8 năm 2026, đó là DeepSeek V4 Flash 0731 của DeepSeek với 1M token. Bảng đầy đủ ở trên liệt kê cả 100 mô hình, sắp xếp theo kích thước cửa sổ, kèm ngày lấy dữ liệu in ngay phía trên.

Cửa sổ ngữ cảnh Claude lớn nhất là bao nhiêu?

Cửa sổ ngữ cảnh Claude lớn nhất trong danh mục là 1M token (Claude Fable 5), đủ chứa khoảng 1.900 trang văn bản. Các phiên bản Claude nhỏ hơn được liệt kê trong bảng đầy đủ ở trên.

Cửa sổ ngữ cảnh GPT lớn nhất là bao nhiêu?

Cửa sổ ngữ cảnh GPT lớn nhất trong danh mục là 1M token (GPT-5.4), đủ chứa khoảng 2.000 trang văn bản. Các phiên bản GPT nhỏ hơn được liệt kê trong bảng đầy đủ ở trên.

Cửa sổ ngữ cảnh Gemini lớn nhất là bao nhiêu?

Cửa sổ ngữ cảnh Gemini lớn nhất trong danh mục là 1M token (Gemini 2.5 Flash), đủ chứa khoảng 2.000 trang văn bản. Các phiên bản Gemini nhỏ hơn được liệt kê trong bảng đầy đủ ở trên.

Cửa sổ ngữ cảnh Grok lớn nhất là bao nhiêu?

Cửa sổ ngữ cảnh Grok lớn nhất trong danh mục là 1M token (Grok 4.3), đủ chứa khoảng 1.900 trang văn bản. Các phiên bản Grok nhỏ hơn được liệt kê trong bảng đầy đủ ở trên.

Cửa sổ ngữ cảnh lớn hơn có luôn tốt hơn không?

Không. Cửa sổ lớn hơn tốn nhiều chi phí hơn, và khả năng nhớ giảm dần về phía giữa của một ngữ cảnh rất lớn. Kích thước lớn có tính quyết định với cả cuốn sách, cả mã nguồn và bản ghi lời nói dài, nhưng lại không liên quan gì với trò chuyện hằng ngày. Hãy chọn cửa sổ phù hợp với công việc thay vì trả tiền cho con số lớn nhất.

Bao nhiêu trang thì vừa một cửa sổ ngữ cảnh?

Chia số token cho khoảng 530 để ra số trang bản thảo: một token tương đương khoảng ba phần tư một từ tiếng Anh, và một trang có khoảng 400 từ. Vậy 128K token là khoảng 240 trang, và một triệu token là khoảng 1.900 trang. Mã nguồn và văn bản không phải tiếng Anh thường chứa được ít hơn.