Cùng một câu trả lời tốn gấp 2.000 lần trên mô hình này so với mô hình khác.

Các nhà cung cấp công bố giá trên mỗi triệu token, thứ không so sánh được giữa các mô hình. Chỉ số này tính giá cho một câu trả lời chuẩn, 1.000 token đầu vào cộng 500 token đầu ra, trên 100 mô hình từ 29 nhà cung cấp. Cập nhật lần cuối 20 tháng 8, 2026.

Những con số chính

  • Câu trả lời rẻ nhất: $0.000053 trên Ling-3.0-flash (inclusionAI).
  • Câu trả lời trung vị: $0.0019 trên Kimi K2 Thinking.
  • Câu trả lời đắt nhất: $0.105 trên Claude Opus 4.7 (Fast) (Anthropic).
  • Khoảng cách từ rẻ nhất tới đắt nhất: khoảng 2.000 lần.

Cách tính

Một câu trả lời chuẩn là 1.000 token đầu vào, khoảng một prompt với vài đoạn ngữ cảnh, và 500 token đầu ra, khoảng một câu trả lời khá dài. Mọi mô hình đều được tính trên cùng khối lượng đó: (giá đầu vào x 1.000 + giá đầu ra x 500) chia cho 1.000.000.

Đổi tỷ lệ thì thứ tự cũng đổi theo, và đó chính là điều đáng nói: mô hình có đầu vào rẻ và đầu ra đắt sẽ thắng ở prompt ngắn và thua ở câu trả lời dài. Công thức được công bố để bạn tính lại theo tỷ lệ của riêng mình.

Nguồn và giới hạn

  • Giá là mức niêm yết công khai từ danh mục mô hình của OpenRouter, tính bằng đô la Mỹ trên mỗi triệu token, lấy vào ngày 20 tháng 8, 2026.
  • Giá này chưa gồm giảm giá lưu đệm prompt, giá theo lô hay mức giá thương lượng theo khối lượng. Hóa đơn thực tế ở quy mô lớn sẽ thấp hơn.
  • Chi phí không phải chất lượng. Một mô hình rẻ hơn 2.000 lần không có nghĩa là tệ hơn 2.000 lần, và ở nhiều việc hằng ngày khoảng cách đó rất nhỏ.
  • Cột tín dụng là mức Whizi tính cho mỗi tin nhắn trong các gói của mình, hiển thị cho 89 mô hình mà Whizi đo riêng. Đây không phải giá của nhà cung cấp.

Toàn bộ chỉ số

100 mô hình, rẻ nhất trước. Được dùng lại tự do nếu ghi nguồn Whizi AI Model Cost Index và dẫn liên kết tới trang này. Dữ liệu gốc: JSONCSV.

#Mô hìnhNhà cung cấpMỗi câu trả lờiMỗi 1.000 câu trả lời$ / 1 triệu vào$ / 1 triệu raNgữ cảnhTín dụng Whizi
1Ling-3.0-flashinclusionAI$0.000053$0.052$0.021$0.063262K1x
2Nex-N2-MiniNex Agi$0.000075$0.075$0.025$0.1262K1x
3Solar Pro 4Upstage$0.000090$0.090$0.03$0.12524K1x
4Qwen3.7 FlashQwen$0.000095$0.095$0.03$0.131M1x
5Granite 4.1 8BIbm Granite$0.000100$0.100$0.05$0.1131K1x
6Laguna XS 2.1Poolside$0.000120$0.120$0.06$0.12262K1x
7Hy-MT2-1.8BTencent$0.000133$0.133$0.044$0.1778Kkhông tính
8Phi 4Microsoft$0.000140$0.140$0.07$0.1416K1x
9Nemotron 3.5 LightningNVIDIA$0.000180$0.180$0.08$0.2262K1x
10Laguna S 2.1Poolside$0.000180$0.180$0.09$0.181M1x
11Hy-MT2-30B-A3BTencent$0.000222$0.222$0.074$0.2958Kkhông tính
12Llama 3.3 70B InstructMeta$0.000260$0.260$0.1$0.32131K1x
13DeepSeek V4 Flash 0731DeepSeek$0.000280$0.280$0.14$0.281M1x
14Gemini 2.5 Flash LiteGoogle$0.000300$0.300$0.1$0.41M1x
15Ring-2.6-1TinclusionAI$0.000388$0.388$0.075$0.625262K1x
16Hy3Tencent$0.000396$0.396$0.132$0.528262K1x
17KAT-Coder-Air V2.5Kwaipilot$0.000450$0.450$0.15$0.6256K1x
18DeepSeek V3.2DeepSeek$0.000469$0.469$0.269$0.4164K1x
19Qwen3 Coder NextQwen$0.000520$0.520$0.12$0.8262K1x
20Llama 4 MaverickMeta$0.000600$0.600$0.2$0.81M1x
21Qwen3.6 35B A3BQwen$0.000640$0.640$0.14$1262K1x
22DeepSeek V3.1DeepSeek$0.000725$0.725$0.25$0.95164K1x
23Codestral 2508Mistral$0.000750$0.750$0.3$0.9256K1x
24Qwen3.6 FlashQwen$0.000750$0.750$0.1875$1.1251M1x
25Nex-N2-ProNex Agi$0.000750$0.750$0.25$1262K1x
26MiniMax M2MiniMax$0.000765$0.765$0.255$1.02205K1x
27Step 3.7 FlashStepfun$0.000775$0.775$0.2$1.15262K1x
28GPT-5.6 Luna ProOpenAI$0.000800$0.800$0.2$1.21Mkhông tính
29GPT-5.6 LunaOpenAI$0.000800$0.800$0.2$1.21M1x
30GPT-5.4 NanoOpenAI$0.000825$0.825$0.2$1.25400K2x
31MiniMax M3MiniMax$0.000900$0.900$0.3$1.21M1x
32LongCat 2.0Meituan$0.000900$0.900$0.3$1.21M1x
33Perceptron Mk1Perceptron$0.000900$0.900$0.15$1.533K1x
34Qwen3.7 PlusQwen$0.000960$0.960$0.32$1.281M1x
35Nano Banana 2 Lite (Gemini 3.1 Flash Lite Image)Google$0.0010$1.000$0.25$1.566Kkhông tính
36Gemini 3.1 Flash LiteGoogle$0.0010$1.000$0.25$1.51M1x
37Inkling SmallThinkingmachines$0.0010$1.050$0.45$1.2524K1x
38Muse Glimmer 30BMeta$0.0011$1.100$0.35$1.5131K2x
39Qwen3.5 Plus 2026-04-20Qwen$0.0012$1.200$0.3$1.81M1x
40Mistral Large 3 2512Mistral$0.0013$1.250$0.5$1.5262K2x
41GLM 4.7Z.ai$0.0013$1.275$0.4$1.75205K2x
42Gemini 3.7 FlashGoogle$0.0013$1.313$0.375$1.8751M2x
43Mistral Medium 3.1Mistral$0.0014$1.400$0.4$2131K2x
44Aion-3.0-MiniAion Labs$0.0014$1.400$0.7$1.4131K2x
45GLM 4.6Z.ai$0.0015$1.500$0.5$2205K1x
46Gemini 2.5 FlashGoogle$0.0015$1.550$0.3$2.51M2x
47Gemini 3.5 Flash LiteGoogle$0.0015$1.550$0.3$2.51M2x
48GLM 5Z.ai$0.0016$1.560$0.6$1.92205K2x
49Kimi K2 0711Moonshot$0.0017$1.720$0.57$2.3131K10x
50Seed 2.1 TurboBytedance Seed$0.0018$1.750$0.5$2.5262K2x
51Kimi K2 ThinkingMoonshot$0.0019$1.850$0.6$2.5262K10x
52R1DeepSeek$0.0019$1.950$0.7$2.564K2x
53Seed-2.0-CodeBytedance Seed$0.0020$2.000$0.5$3262K3x
54Nano Banana 2 (Gemini 3.1 Flash Image)Google$0.0020$2.000$0.5$3131Kkhông tính
55Grok Build 0.1xAI$0.0020$2.000$1$2256K3x
56Qwen3.8 27BQwen$0.0021$2.050$0.45$3.21M3x
57KAT-Coder-Pro V2.5Kwaipilot$0.0022$2.220$0.74$2.96256K3x
58Nova Pro 1.0Amazon$0.0024$2.400$0.8$3.2300K3x
59Nemotron 3 UltraNVIDIA$0.0024$2.400$0.6$3.6512K3x
60Kimi K2.7 CodeMoonshot$0.0025$2.460$0.71$3.5262K10x
61GLM 5.2Z.ai$0.0025$2.484$0.966$3.0361M3x
62Grok 4.3xAI$0.0025$2.500$1.25$2.51M4x
63Gemini 3.6 FlashGoogle$0.0026$2.625$0.75$3.751M3x
64Sakana NamazuSakana$0.0029$2.950$0.95$4262K4x
65DeepSeek V4 Pro 0813DeepSeek$0.0030$2.970$1.188$3.5641M2x
66InklingThinkingmachines$0.0030$2.975$0.95$4.051M4x
67GPT-5.4 MiniOpenAI$0.0030$3.000$0.75$4.5400K4x
68Muse Spark 1.2Meta$0.0034$3.375$1.25$4.251M5x
69Muse Spark 1.1Meta$0.0034$3.375$1.25$4.251M5x
70Claude Haiku 4.5Anthropic$0.0035$3.500$1$5200K4x
71GLM 5.3Z.ai$0.0036$3.600$1.4$4.41M5x
72Qwen3.7 MaxQwen$0.0037$3.688$1.475$4.4251M5x
73Grok 4.5xAI$0.0050$5.000$2$6500K6x
74Qwen3.8 MaxQwen$0.0050$5.000$2$61M6x
75Qwen3.8 2.4T A95BQwen$0.0050$5.000$2$61M8x
76Grok 4.6xAI$0.0050$5.000$2$6500K6x
77Mistral Medium 3.5Mistral$0.0053$5.250$1.5$7.5262K6x
78Gemini 3.5 FlashGoogle$0.0060$6.000$1.5$91M8x
79Aion-3.0Aion Labs$0.0060$6.000$3$6131K10x
80Claude Sonnet 5Anthropic$0.0070$7.000$2$101M10x
81Command ACohere$0.0075$7.500$2.5$10256K10x
82Gemini 3.1 Pro PreviewGoogle$0.0080$8.000$2$121M10x
83GPT-5.6 Terra ProOpenAI$0.0080$8.000$2$121Mkhông tính
84GPT-5.6 TerraOpenAI$0.0080$8.000$2$121M4x
85Nano Banana Pro (Gemini 3 Pro Image)Google$0.0080$8.000$2$12131Kkhông tính
86GPT-5.4OpenAI$0.010$10.000$2.5$151M15x
87GPT-5.6 Sol ProOpenAI$0.010$10.000$2.5$151Mkhông tính
88GPT-5.6 SolOpenAI$0.010$10.000$2.5$151M20x
89Claude Sonnet 4.6Anthropic$0.011$10.500$3$151M10x
90Claude Sonnet 4.5Anthropic$0.011$10.500$3$151M10x
91Kimi K3Moonshot$0.011$10.500$3$151M10x
92Claude Opus 5Anthropic$0.018$17.500$5$251M20x
93Claude Opus 4.8Anthropic$0.018$17.500$5$251M20x
94GPT-5.5OpenAI$0.020$20.000$5$301M20x
95GPT Chat LatestOpenAI$0.020$20.000$5$30400K25x
96Fugu UltraSakana$0.020$20.000$5$301M25x
97Claude Opus 5 (Fast)Anthropic$0.035$35.000$10$501Mkhông tính
98Claude Fable 5Anthropic$0.035$35.000$10$501M50x
99Claude Opus 4.8 (Fast)Anthropic$0.035$35.000$10$501Mkhông tính
100Claude Opus 4.7 (Fast)Anthropic$0.105$105.000$30$1501Mkhông tính

Câu hỏi

Vì sao tính giá một câu trả lời thay vì một triệu token?

Vì chẳng ai mua một triệu token. Các nhà cung cấp báo giá đầu vào và đầu ra riêng với mức khác nhau, nên hai mô hình có thể trông sát nhau trên mỗi triệu nhưng chênh nhiều ở cùng một việc thật. Tính giá trên một khối lượng cố định làm cho các con số so sánh được.

Mô hình nào đáng tiền nhất?

Còn tùy công việc. Điều đáng chú ý là phần giữa bảng này chỉ chênh nhau vài phần trăm của một xu cho mỗi câu trả lời, nên với phần lớn công việc hằng ngày, khác biệt giá giữa các mô hình tốt là không đáng kể và nên chọn theo chất lượng câu trả lời.

Bao lâu thì cập nhật một lần?

Giá được làm mới từ danh mục của nhà cung cấp và trang có ghi ngày lấy dữ liệu, hiện là 20 tháng 8, 2026. Giá trên thị trường này thay đổi thường xuyên, nên hãy xem ngày trước khi trích một con số.

Tín dụng Whizi là gì?

Whizi trừ mỗi tin nhắn vào hạn mức hằng tháng, và mô hình đắt tốn nhiều tín dụng hơn mô hình rẻ, từ 1x đến 20x. Cột này cho thấy hệ số đó để bạn thấy giá niêm yết của nhà cung cấp quy đổi thành gói thuê bao cố định ra sao.

Cách trích dẫn

Một bộ dữ liệu chỉ được dùng lại nhiều khi nó dễ ghi nguồn, nên đây là dòng để sao chép:

Whizi AI Model Cost Index, prices as of 2026-08-20. https://whizi.io/vi/tools/model-cost-index/

Phát hành theo CC BY 4.0, cho phép dùng lại vì mục đích thương mại miễn là nêu tên chỉ số và dẫn liên kết tới trang này. Người viết cần kiểm chứng một con số trước khi đăng có thể liên hệ nhóm phụ trách tại [email protected].

Bước tiếp theo

Tính giá văn bản của bạn bằng Công cụ tính chi phí token, hoặc so sánh các gói tại bảng giá Whizi.