Các mô hình AI rẻ nhất theo câu trả lời trong Whizi, và một credit mua được gì

Trả lời nhanh

Dòng có giá rẻ nhất trong bảng chỉ số chi phí của Whizi là Ling từ inclusionAI, với $0.000053 cho một lần trả lời. Nó tính phí một credit mỗi tin nhắn, giống như mọi dòng khác ở đáy bậc thang, và không tin nhắn nào bị tính phí ít hơn một credit. Một câu trả lời chuẩn gồm 1,000 token đầu vào cộng 500 token đầu ra.

Câu trả lời ngắn gọn

Dòng có giá rẻ nhất trong bảng chỉ số chi phí của Whizi là Ling từ inclusionAI, với $0.000053 cho một lần trả lời. Nó tính phí một credit mỗi tin nhắn, giống như mọi dòng khác ở đáy bậc thang, và mức sàn cho mỗi lượt đảm bảo không gì bị tính phí ít hơn một.

Một dòng giá rẻ cho mỗi gói, mở đầu cho các bảng đầy đủ bên dưới:

Mô hìnhNhà cung cấpChi phí mỗi câu trả lờiNgữ cảnhCreditGói
Ling-3.0-flashinclusionAI$0.000053262K1Powerhouse
Llama 3.3 70B InstructMeta$0.00026131K1Pro
GPT-5.6 LunaOpenAI$0.00081M1Starter

Một câu trả lời chuẩn trong bảng chỉ số là 1,000 token đầu vào cộng 500 token đầu ra, để giá niêm yết từ các nhà cung cấp khác nhau có thể so sánh được. Giá gốc được lấy từ OpenRouter vào ngày 2026-08-20. Bảng chỉ số định giá 100 dòng trên 29 nhà cung cấp, và 89 trong số đó tính phí credit của Whizi. Toàn bộ dữ liệu được công bố dưới dạng chỉ số chi phí mô hình AI.

Trang này là phần rẻ của bảng chỉ số đó. Để xem danh mục theo gói, xem danh sách mô hình, và để xem bậc thang credit, xem tài liệu tham khảo credit.

Các dòng dưới một phần mười xu cho mỗi câu trả lời

Một số dòng trả lời một lần với giá dưới $0.001 ở kích thước câu trả lời chuẩn. Tất cả các dòng liệt kê ở đây, trừ một, đều tính phí một credit duy nhất.

Mô hìnhNhà cung cấpChi phí mỗi câu trả lờiNgữ cảnhCreditGói
Ling-3.0-flashinclusionAI$0.000053262K1Powerhouse
Nex-N2-MiniNex Agi$0.000075262K1Powerhouse
Solar Pro 4Upstage$0.00009524K1Powerhouse
Qwen3.7 FlashQwen$0.0000951M1Powerhouse
Granite 4.1 8BIBM$0.0001131K1Powerhouse
Laguna XS 2.1Poolside$0.00012262K1Powerhouse
Phi 4Microsoft$0.0001416K1Powerhouse
Nemotron 3.5 LightningNVIDIA$0.00018262K1Powerhouse
Llama 3.3 70B InstructMeta$0.00026131K1Pro
DeepSeek V4 Flash 0731DeepSeek$0.000281.31M1Powerhouse
Gemini 2.5 Flash LiteGoogle$0.00031M1Pro
DeepSeek V3.2DeepSeek$0.000469164K1Pro
Qwen3 Coder NextQwen$0.00052262K1Powerhouse
Llama 4 MaverickMeta$0.00061M1Pro
DeepSeek V3.1DeepSeek$0.000725164K1Pro
Codestral 2508Mistral$0.00075256K1Powerhouse
Qwen3.6 FlashQwen$0.000751M1Powerhouse
MiniMax M2MiniMax$0.000765205K1Powerhouse
GPT-5.6 LunaOpenAI$0.00081M1Starter
GPT-5.4 NanoOpenAI$0.000825400K2Powerhouse
MiniMax M3MiniMax$0.00091M1Powerhouse
Qwen3.7 PlusQwen$0.000961M1Pro

Một số dòng rẻ nhất mang theo một triệu token trở lên, và cửa sổ ngữ cảnh lớn nhất trong toàn bộ bảng giá thuộc về một dòng gần cuối danh sách chi phí. Rẻ và nhỏ không phải là cùng một trục ở đây. Cửa sổ nhỏ nhất được liệt kê ở trên là 16K.

Hầu hết các dòng này nằm trên gói đắt nhất, vì lý do được trình bày bên dưới.

Dải tiếp theo, đến mức trung vị của bảng chỉ số

Dòng có giá trung vị là một dòng suy luận Kimi với $0.00185 cho mỗi câu trả lời chuẩn. Một số dòng mẫu nằm giữa một phần mười xu và mức trung vị đó:

Mô hìnhNhà cung cấpChi phí mỗi câu trả lờiNgữ cảnhCreditGói
Gemini 3.1 Flash LiteGoogle$0.0011M1Powerhouse
Muse Glimmer 30BMeta$0.0011131K2Powerhouse
Mistral Large 3 2512Mistral$0.00125262K2Pro
GLM 4.7Z.ai$0.001275205K2Powerhouse
Gemini 3.7 FlashGoogle$0.0013131M2Pro
Mistral Medium 3.1Mistral$0.0014131K2Pro
GLM 4.6Z.ai$0.0015205K1Powerhouse
Gemini 2.5 FlashGoogle$0.001551M2Pro
Gemini 3.5 Flash LiteGoogle$0.001551M2Powerhouse
GLM 5Z.ai$0.00156205K2Pro
Kimi K2 0711Moonshot$0.00172131K10Powerhouse
Kimi K2 ThinkingMoonshot$0.00185262K10Powerhouse

Cột credit và cột đô la không bao phủ cùng một tập hợp dòng. Mười một trong số 100 dòng được định giá không tính phí credit nào cả: chúng được định giá để so sánh nhưng không được cung cấp như một dòng tính phí riêng trong sản phẩm. Vì vậy, một con số đô la trong bảng chỉ số tự nó không có nghĩa là dòng đó có thể mở được trong bộ chọn.

Vì sao hầu hết các dòng rẻ nhất đều là Powerhouse

Cột gói ở trên không phải là quyết định về giá, mà là một cơ chế dự phòng. Quyền truy cập mô hình được xác định theo mã định danh: bốn mã định danh Starter trước tiên, sau đó đến các persona agent, rồi đến một danh sách rõ ràng gồm 37 mã định danh khác cho Pro, và bất cứ thứ gì còn lại sẽ trả về Powerhouse. Một dòng giá rẻ mà chưa ai từng đưa vào danh sách Pro do đó mặc định nằm trên bậc cao nhất, đó là lý do vì sao đáy danh sách chi phí đọc lên như một cột Powerhouse. Cơ chế dự phòng này được ghi lại trong danh sách mô hình.

GóiNhững gì gói đó chạm tới ở đầu rẻ
FreeKhông có hạn mức credit. Chỉ Whizi AI và Auto, 7 tin nhắn ngày đầu tiên sau đó 3 tin mỗi ngày
StarterTổng cộng bốn mã định danh: Auto, Whizi AI, GPT-5.6 Luna, Gemini 3 Flash. Tất cả đều tốn 1 credit
ProStarter cộng thêm 37 mã nữa, gồm các dòng DeepSeek, Llama, Gemini Flash, Mistral và Qwen được đánh dấu Pro ở trên
PowerhouseMọi thứ còn lại trong danh mục, đây là nơi các dòng từ những phòng lab nhỏ hơn ở tận đáy danh sách chi phí nằm

Gói miễn phí hoàn toàn không nằm trong so sánh này: kể từ ngày 2026-09-02, gói này chỉ chạm tới Whizi AI và Auto và không gì khác, nên cả dòng rẻ nhất lẫn dòng đắt nhất trong bảng chỉ số đều không thể truy cập được trên đó. Những gì gói này mang lại là 7 tin nhắn trong ngày đầu tiên, sau đó 3 tin mỗi ngày, dùng cho hai dòng đó.

Starter là gói hẹp nhất. Gói này chạm tới bốn mã định danh, mỗi mã đều tính phí một credit duy nhất, nên hạn mức 400 credit của gói này tương đương 400 tin nhắn. Không có mô hình Anthropic nào trên Starter, và cũng không có quyền truy cập vào các dòng giá rẻ từ những phòng lab nhỏ hơn trong các bảng ở trên.

Một credit mua được gì

Một credit được định nghĩa là một tin nhắn trên mô hình chủ nhà, mô hình này chạy trên mô hình OpenAI cơ bản được cố định ở mức một credit. Một bài kiểm tra build sẽ thất bại nếu một trong hai mô hình này rời khỏi bậc đó, vì việc dịch chuyển một trong hai sẽ định giá lại toàn bộ bậc thang.

Mức phí là một số nguyên cố định cho mỗi id mô hình. Ở đầu này của danh mục, điều đó có nghĩa là một dòng 1 credit tốn một credit bất kể độ dài đầu vào hay đầu ra: dán một tài liệu dài vào đó, để câu trả lời chạy dài, thì lượt đó vẫn chỉ bị tính một.

DòngChi phí mỗi câu trả lờiChi phí mỗi 1,000 câu trả lờiCredit
Nemotron 3.5 Lightning$0.00018$0.181
Llama 3.3 70B Instruct$0.00026$0.261
DeepSeek V4 Flash 0731$0.00028$0.281
Gemini 2.5 Flash Lite$0.0003$0.301
DeepSeek V3.2$0.000469$0.4691
Llama 4 Maverick$0.0006$0.601
GPT-5.6 Luna$0.0008$0.801
Qwen3.7 Plus$0.00096$0.961

Khi chuyển thành hạn mức, bậc thấp nhất là nơi duy nhất mà con số credit và con số tin nhắn trùng nhau: mỗi lượt tốn một, nên hạn mức N credit của một gói chính là N tin nhắn miễn là bạn còn ở các dòng 1 credit. Hạn mức theo từng gói, quy tắc đặt lại và chuyển tiếp đều nằm trong tài liệu tham khảo credit.

Còn một cơ chế nữa quan trọng ở đầu rẻ: một lượt không vừa với số dư còn lại sẽ bị từ chối hoàn toàn thay vì bị tính phí một phần. Hai mươi credit trên ba credit còn lại sẽ bị từ chối, không phải giảm giá. Trên một mô hình 1 credit thì điều này gần như không bao giờ xảy ra.

Bậc credit đến từ đâu, và khi nào chính sách của chủ sở hữu ghi đè lên nó

Bảng chỉ số chi phí đo một câu trả lời chuẩn gồm 1,000 token đầu vào cộng 500 token đầu ra so với giá niêm yết của nhà cung cấp. Bậc thang credit được suy ra từ một lượt tham chiếu khác, 3,000 token đầu vào và 800 token đầu ra, chia cho chi phí của cùng lượt đó trên mô hình neo, tức $0.00156 chi tiêu cho nhà cung cấp. Kết quả sau đó được làm tròn lên đến bậc hợp lệ. Bậc thang có mười tám mức: 1, 2, 3, 4, 5, 6, 8, 10, 12, 15, 20, 25, 30, 40, 50, 60, 80, 100. Mười bốn mức hiện mang ít nhất một mô hình, và bốn mức trống được giữ lại có chủ ý, vì thiếu một bậc sẽ khiến mô hình đắt tiếp theo bị làm tròn lên bậc phía trên. Việc làm tròn luôn hướng lên khi một mô hình rơi giữa hai bậc.

Bên cạnh đó, một số dòng được cố định theo chính sách của chủ sở hữu thay vì theo tính toán. Ba ví dụ có thể thấy trong các bảng ở trên và trong danh mục rộng hơn:

  • Dòng họ Kimi bị tính 10 credit so với mức đúng theo chi phí là 2, 3, 4 và 12 tùy dòng. Đó là lý do vì sao hai dòng Moonshot có giá đô la sát nhau, ở mức $0.00172 và $0.00185, nhưng cả hai đều tính 10 credit.
  • Dòng Gemini trên Starter bị tính 1 credit so với mức đúng theo chi phí là 2, đây chính là điều giữ cho Starter luôn ở mức một credit cố định mỗi tin nhắn.
  • Dòng GPT Terra bị tính 4 credit so với mức đúng theo chi phí là 10.

Các dòng có tìm kiếm làm nền được định giá theo cách khác hẳn, vì nhà cung cấp tính một khoản phí cố định cho mỗi lần tìm kiếm, không tỷ lệ theo mức giá trên token. Một lần tìm kiếm với giá $0.005 tương đương 3.2 credit, nên một lần tìm kiếm duy nhất có thể tốn hơn cả một tin nhắn trọn vẹn trên hầu hết danh mục. Những bậc đó là mức sàn giả định một lần tìm kiếm cho mỗi câu trả lời.

Một mã định danh mô hình không có bậc nào cả sẽ bị tính ở đỉnh bậc thang, 100 credit, một cách có chủ ý: một mô hình chưa được định giá nên xuất hiện thành một yêu cầu hỗ trợ thay vì âm thầm ăn vào biên lợi nhuận. Một bài kiểm tra build sẽ thất bại nếu bất kỳ mô hình danh mục hay mã định danh agent nào lên production mà không có bậc.

Cuối cùng, việc tính giá credit được bật theo từng nền tảng. Một nền tảng trong danh sách cho phép sẽ thấy hệ số nhân thực trong bộ chọn và bị tính phí theo hạn mức credit. Một nền tảng không nằm trong danh sách sẽ thấy mức một credit cố định cho mỗi lượt và giữ hạn mức tin nhắn cũ thay thế, tức 400 tin nhắn mỗi tháng trên Starter, 800 trên Pro và 5,000 trên Powerhouse. Ứng dụng web hiện đang dùng hệ thống credit.

Danh sách kiểm tra
  • Dòng có giá rẻ nhất trong bảng chỉ số trả lời một lần với giá $0.000053
  • Một câu trả lời chuẩn là 1,000 token đầu vào cộng 500 token đầu ra, được định giá theo bảng giá niêm yết của OpenRouter vào ngày 2026-08-20
  • Mọi khoản phí đều có mức sàn là một credit, nên không tin nhắn nào tốn ít hơn một
  • Hầu hết các dòng rẻ nhất nằm trên Powerhouse, vì bất cứ thứ gì không nằm trong danh sách Starter hay Pro đều rơi xuống bậc cao nhất
  • Starter chạm tới bốn mã định danh và tất cả đều tốn 1 credit, nên 400 credit chính là 400 tin nhắn
  • Tài khoản miễn phí không có hạn mức credit và chỉ chạm tới hai dòng: Whizi AI và Auto
  • Bậc credit được suy ra từ một lượt tham chiếu khác với con số trong bảng chỉ số, và một số bậc được cố định theo chính sách

Câu hỏi thường gặp

Mô hình AI rẻ nhất trên Whizi là gì?

Xét theo chi phí mỗi câu trả lời chuẩn, dòng có giá rẻ nhất trong bảng chỉ số chi phí của Whizi là Ling từ inclusionAI với $0.000053, tiếp theo là Nex từ Nex Agi, Solar Pro từ Upstage và bậc nhanh của Qwen. Tất cả đều tính phí một credit mỗi tin nhắn. Xét theo số tiền bạn thực sự trả, chúng ngang bằng với mọi dòng 1 credit khác, kể cả mô hình chủ nhà của Whizi, mô hình GPT cơ bản trên Starter và một số dòng DeepSeek, Llama và Gemini.

Tôi cần gói nào để dùng được các mô hình rẻ nhất?

Tùy thuộc vào dòng. Một số dòng rẻ nhất đòi hỏi Powerhouse, vì quyền truy cập mô hình rơi xuống bậc cao nhất đối với bất kỳ mã định danh nào không nằm trong danh sách bốn mục của Starter hay danh sách 37 mục của Pro. Các dòng giá rẻ có thể truy cập trên Pro gồm các mục DeepSeek, Llama, Mistral, Qwen và Gemini Flash được đánh dấu Pro trong các bảng trên trang này.

Một mô hình rẻ hơn có luôn tốn ít credit hơn không?

Không. Hai con số này được đo theo hai cách khác nhau. Bảng chỉ số định giá một câu trả lời chuẩn 1,000 vào, 500 ra so với giá niêm yết của nhà cung cấp, trong khi bậc credit đến từ một lượt tham chiếu 3,000 vào, 800 ra, được làm tròn lên bậc hợp lệ trên một bậc thang cố định, với một số dòng được cố định theo chính sách cao hơn hoặc thấp hơn mức tính toán. Đó là lý do vì sao một dòng ở mức $0.0015 mỗi câu trả lời có thể chỉ tốn một credit trong khi một dòng ở mức $0.000825 lại tốn hai.

Điều gì xảy ra với credit nếu câu trả lời thất bại giữa chừng?

Nó sẽ được hoàn lại. Một lượt tạo bị lỗi hoặc bị hủy sẽ được hoàn lại bằng cách xóa dòng sử dụng của nó, nên số dư trở về đúng như trước. Việc hoàn tiền được gắn với một request id do server tạo ra chứ không phải bất cứ thứ gì client cung cấp, nên áp dụng cùng một khoản hoàn hai lần chỉ khôi phục đúng một lượt chứ không phải hai. Một điều không được hoàn lại: một lượt bị từ chối vì hết hạn mức vẫn tiêu tốn token giới hạn tần suất của nó, nếu không một client hết credit có thể thử lại vô hạn.

Tôi có thể dùng thử các mô hình rẻ mà không cần đăng ký gói không?

Không thể trên tài khoản miễn phí, vì tài khoản này chỉ chạm tới Whizi AI và Auto. Hạn mức của nó là 7 tin nhắn trong ngày đầu tiên, sau đó 3 tin mỗi ngày, dùng cho hai dòng đó, và việc nhận một tài khoản khách sẽ mang lượng sử dụng của nó sang tài khoản đã đăng ký, nên bắt đầu như khách rồi đăng ký sau đó không trả lại một ngày mới.