Dùng GLM trong Whizi: một dòng thuộc Pro, phần còn lại thuộc Powerhouse

Trả lời nhanh

GLM có trong danh mục của Whizi, với các dòng Z.ai được định giá xuyên suốt các thế hệ GLM 4 và GLM 5. Một dòng, GLM 5, mở trên gói Pro với 2 credit mỗi tin nhắn, và mọi dòng GLM khác đều cần gói Powerhouse. Gói Starter không bao gồm mô hình GLM nào. Một tin nhắn GLM tốn từ 1 đến 5 credit.

Câu trả lời ngắn gọn

Có, GLM có trong danh mục của Whizi. Các dòng Z.ai được định giá xuyên suốt các thế hệ GLM 4 và GLM 5, một dòng mở trên gói Pro với 2 credit mỗi tin nhắn, và mọi dòng GLM khác đều cần gói Powerhouse.

Mô hìnhCửa sổ ngữ cảnhCredit mỗi tin nhắnGói yêu cầu
GLM 4.6205K1Powerhouse
GLM 4.7205K2Powerhouse
GLM 5205K2Pro
GLM 5.1không có trong chỉ số giá3Powerhouse
GLM 5.21M3Powerhouse
GLM 5.31M5Powerhouse
GLM 5 Turbokhông có trong chỉ số giá5Powerhouse
GLM 5V Turbokhông có trong chỉ số giá5Powerhouse

Một mã định danh GLM không được liệt kê ở đây vẫn bị tính một mức credit và vẫn yêu cầu gói Powerhouse.

Tài khoản miễn phí bị giới hạn mô hình ở hai dòng, Whizi AI và Auto, nên không có dòng GLM nào khả dụng trên gói miễn phí. Hạn mức miễn phí là 7 tin nhắn trong ngày đầu tiên và 3 tin nhắn mỗi ngày sau đó, dùng cho hai dòng đó. Điều này đã thay đổi vào ngày 2026-09-02: trước đây luồng chat trả về cho gói miễn phí trước khi cổng chặn mô hình chạy, còn giờ cổng chặn chạy trước.

Dòng duy nhất trên Pro không phải dòng rẻ nhất

Pro chỉ mở đúng một mã định danh Z.ai, GLM 5, với 2 credit mỗi tin nhắn. Quy tắc tuyển chọn mà danh sách Pro dựa vào được nêu trong tài liệu tham khảo mô hình, và với dòng này nó chỉ dừng ở một dòng duy nhất, đó là toàn bộ lý do phần còn lại của thế hệ nằm ở bậc cao hơn.

Dòng duy nhất đó không phải dòng rẻ. Dòng GLM rẻ nhất tính theo credit chỉ tốn 1 credit mỗi tin nhắn và yêu cầu gói Powerhouse, trong khi dòng của Pro tốn gấp đôi. Chi phí credit và bậc gói là hai quyết định tách biệt trong Whizi, và không cái nào dự đoán được cái kia.

Starter không bao gồm bất kỳ mô hình GLM nào. Starter chỉ đạt đúng bốn mục trong bộ chọn: Auto, mô hình của nhà, một mô hình OpenAI và một mô hình Google. Mỗi mô hình trong số đó đều là dòng 1x hoặc 2x, đó là lý do hạn mức credit của Starter và hạn mức tin nhắn của Starter là cùng một con số.

Powerhouse bao trùm phần còn lại, một trường hợp được nêu tên và mọi trường hợp khác theo mặc định. Dòng suy luận đỉnh cao trong thế hệ GLM 5 được nêu tên rõ ràng trong số các mô hình bị giữ lại cho Powerhouse, cùng với một dòng Grok, dòng suy nghĩ của Qwen, dòng suy nghĩ của Kimi và những dòng khác. Mọi dòng GLM còn lại rơi vào bậc cao nhất vì bất kỳ mã định danh nào không nằm trong tập Starter và không nằm trong danh sách Pro rõ ràng đều rơi vào đó.

Việc chặn được thực thi ở máy chủ, không phải trên giao diện. Chọn một mô hình cao hơn bậc của bạn sẽ trả về HTTP 403 với mã tier_upgrade_required và thông báo "Upgrade your plan to use this model." Nếu bạn gặp điều này trên một dòng GLM, xem vì sao một mô hình hiển thị là không khả dụng.

Cặp GLM 4, nơi mức credit và chi phí vận hành trái ngược nhau

Trong cặp GLM 4, hai cột trái ngược nhau. Dòng rẻ hơn trên mỗi câu trả lời chuẩn lại mang mức credit cao hơn, còn dòng anh em của nó mang mức thấp hơn. Một mức được đo trên một lượt tham chiếu gồm 3,000 token đầu vào và 800 token đầu ra, con số chỉ số trên một câu trả lời chuẩn 1,000 cộng 500, và hai dòng có tỷ lệ đầu vào và đầu ra được tính trọng số khác nhau có thể đổi chỗ giữa hai cách tính đó. Phương pháp tính mức có trong tài liệu tham khảo credit.

Mô hìnhChi phí mỗi câu trả lời chuẩnChi phí mỗi nghìn câu trả lờiCredit mỗi tin nhắn
GLM 4.7$0.001275$1.2752
GLM 4.6$0.0015$1.501
GLM 5$0.00156$1.562
GLM 5.2$0.002484$2.4843
GLM 5.3$0.0036$3.605

Chỉ số chi phí của Whizi định giá 100 dòng OpenRouter trên cùng một đơn vị đồng nhất để có thể so sánh các nhà cung cấp: một câu trả lời chuẩn gồm 1,000 token đầu vào cộng 500 token đầu ra. Giá nguồn được lấy từ OpenRouter vào ngày 2026-08-20, trên 29 nhà cung cấp.

Để so sánh quy mô: dòng có giá trung vị trong chỉ số là $0.00185 mỗi câu trả lời chuẩn, dòng rẻ nhất là $0.000053 và dòng đắt nhất là $0.105, một khoảng chênh lệch khoảng 2000 lần. Ba trong số năm dòng GLM được định giá nằm dưới mức trung vị đó, và hai dòng nằm trên.

Các dòng được đánh dấu "không có trong chỉ số giá" trong bảng ở đầu trang vẫn bị tính phí credit trong sản phẩm nhưng không nằm trong số 100 dòng mà chỉ số chi phí định giá, nên không có con số trên mỗi câu trả lời để công bố cho chúng.

Một tin nhắn GLM tốn bao nhiêu từ hạn mức của bạn

Một credit là một tin nhắn trên mô hình của nhà, và chi phí credit được cố định theo tin nhắn dựa trên dòng bạn chọn chứ không theo độ dài. Phương pháp có trong tài liệu tham khảo credit. Điều này có nghĩa gì với dòng này: các dòng GLM được liệt kê ở đầu trang này nằm trong một dải duy nhất từ 1 đến 5 credit, nên dòng đắt nhất trong số đó tốn đúng bằng năm lần dòng rẻ nhất, và toàn bộ dòng này nằm trong năm bậc thấp nhất của một thang mười tám bậc.

GóiGiáCredit mỗi thángTin nhắn trên dòng GLM của Pro (2 credit)Tin nhắn trên dòng GLM đắt nhất (5 credit)
Starter$15.99/tháng, hoặc $10.99/tháng khi thanh toán theo năm với $131.88400không có dòng GLM nào trên gói nàykhông có dòng GLM nào trên gói này
Pro$29.99/tháng, hoặc $19.99/tháng khi thanh toán theo năm với $239.882,0001,000không có trên gói này
Powerhouse$49.99/tháng, hoặc $34.99/tháng khi thanh toán theo năm với $419.888,0004,0001,600

Trên Powerhouse, dòng GLM 1 credit mua được 8,000 tin nhắn từ hạn mức 8,000 credit, còn các dòng 3 credit mua được 2,666. Credit không được chuyển sang kỳ sau: mức sử dụng được cộng dồn theo một khóa kỳ hạn, nên sự xuất hiện của một kỳ mới chính là lúc đặt lại.

Một lượt GLM không vừa với số dư còn lại sẽ bị từ chối hoàn toàn thay vì bị tính phí một phần. Đây là chủ đích, vì tính 3 credit cho một dòng 5 credit sẽ khiến một mô hình tốn số tiền khác nhau tùy thời điểm gửi.

Việc định giá credit được chặn theo từng nền tảng bởi một danh sách cho phép mà giá trị sản xuất hiện tại là trình duyệt web. Ngoài danh sách cho phép đó, bộ chọn không hiển thị bất kỳ huy hiệu credit nào, và mỗi lượt sẽ tốn một đơn vị theo hạn mức tin nhắn cũ thay vì một mức theo hạn mức credit.

Vì sao các dòng 205K và các dòng 1M có cùng kích thước

Một dòng GLM với cửa sổ 1M và một dòng GLM với cửa sổ 205K có không gian giống hệt nhau trong Whizi. Cả hai đều nằm trên ngưỡng 93,000 token, và mọi mô hình trong danh mục trên ngưỡng đó đều nhận một ngân sách cố định là 40,000 token đầu vào và 20,000 token đầu ra mỗi lượt, điều này đúng với mọi dòng GLM mà chỉ số chi phí định giá. Các mô hình dưới ngưỡng đó nhận một ngân sách tỷ lệ nhỏ hơn thay vào đó, được mô tả trong khi nào một cuộc trò chuyện quá dài.

Vì vậy chuyển sang cửa sổ lớn hơn không mua được một lời nhắc dài hơn. Thứ nó mua được là dư địa ở phía nhà cung cấp, vì OpenRouter tính đầu vào cộng với đầu ra tối đa được yêu cầu vào cửa sổ chứ không chỉ tính đầu vào.

Chuyển một luồng trò chuyện sang GLM và quay lại

Auto sẽ không đưa bạn vào GLM. Auto không có mức riêng của nó, và thang của nó là sáu tuyến cố định trên năm dòng mô hình: mô hình của nhà cho các câu hỏi ngắn, một dòng nhanh của Google cho việc viết lại và cho tệp đính kèm, một dòng OpenAI cho nội dung dài, một dòng Anthropic cho mã, và một dòng suy luận OpenAI cho suy luận nhiều bước. Không có dòng GLM nào trên thang đó, nên một lượt chỉ rơi vào GLM khi bạn tự chọn nó.

Mọi dòng mô hình phục vụ cho trình duyệt web đều mang tín hiệu chi phí của nó, nên giá credit của một dòng GLM hiển thị trước khi bạn gửi chứ không phải sau đó.

Một luồng GLM bạn mở nhiều tháng trước vẫn mở được hôm nay, vì một cuộc trò chuyện giữ nguyên mã định danh mà nó được tạo ra ngay cả sau khi bộ chọn đã chuyển sang các dòng mới hơn.

Dù bạn chuyển theo hướng nào, khoản phí sẽ theo mô hình thực sự trả lời lượt đó, không phải mô hình mà cuộc trò chuyện bắt đầu.

Nơi GLM không xuất hiện

Tạo nội dung media không dùng GLM. Mục tạo hình ảnh là bốn dòng cố định, tạo video là một dòng duy nhất, và tạo âm thanh là một dòng duy nhất, tất cả đều là bộ tạo của nhà hoặc đối tác, nên không có dòng GLM nào tham gia vào việc tạo một hình ảnh, một video hay âm nhạc.

Không có cờ thị giác theo từng mô hình để trích dẫn. Whizi không theo dõi mô hình nào có thể đọc hình ảnh. Tệp đính kèm được xử lý theo từng yêu cầu chứ không theo từng mô hình, và trên trình duyệt web, văn bản của một tệp PDF, Word hay bảng tính được trích xuất ngay trên trình duyệt trước khi bất cứ thứ gì được gửi đi. Xem các loại tệp được hỗ trợ để biết ý nghĩa thực tế của điều này.

Tìm kiếm web là một công tắc theo từng yêu cầu, không phải khả năng của mô hình. Tìm kiếm chạy ở một trong ba chế độ, và việc bật nó ảnh hưởng đến yêu cầu chứ không phải chọn một mô hình khác, nên không có danh sách công khai nào về các dòng GLM có thể hoặc không thể duyệt web.

Các nhân vật đại diện (agent persona) không phải là GLM. Bốn nhân vật đại diện là một tính năng của Pro chứ không phải một bậc mô hình, và mỗi nhân vật đều chạy trên cùng một mô hình nền, nên việc chọn một nhân vật không bao giờ định tuyến một lượt tới Z.ai.

Danh sách kiểm tra
  • Whizi định giá các mô hình GLM từ Z.ai xuyên suốt các thế hệ GLM 4 và GLM 5
  • GLM 5 là dòng GLM duy nhất khả dụng trên Pro, với 2 credit mỗi tin nhắn
  • Mọi dòng GLM khác đều yêu cầu Powerhouse
  • Starter không bao gồm bất kỳ mô hình GLM nào
  • Tài khoản miễn phí không tiếp cận được dòng GLM nào: gói miễn phí chỉ chạy Whizi AI và Auto
  • Chi phí credit được cố định theo tin nhắn và không thay đổi theo độ dài
  • Mọi dòng GLM mà chỉ số chi phí định giá đều chạy trên ngân sách cố định 40,000 token đầu vào và 20,000 token đầu ra
  • Auto không bao giờ định tuyến một lượt tới dòng GLM

Câu hỏi thường gặp

GLM có được tích hợp trong Whizi không?

Có. Các dòng GLM nằm trong mục Tất cả mô hình của bộ chọn, dưới logo nhà cung cấp Z.ai thay vì biểu tượng dự phòng chung mà hầu hết các phòng lab nhỏ hơn nhận được. Chúng không nằm trong mục Đề xuất, vốn chỉ gồm năm dòng cố định và không có mục GLM nào, nên hãy duyệt Tất cả mô hình thay vì đầu bộ chọn để tìm chúng.

Tôi cần gói Whizi nào để dùng GLM?

Pro tiếp cận được một dòng GLM, GLM 5. Mọi thứ khác trong dòng này thuộc Powerhouse. Nếu bạn gửi trên một dòng mà bậc của bạn không bao gồm, worker sẽ trả về HTTP 403 với một nội dung JSON có dạng {"error": {"code": "tier_upgrade_required", "message": "Upgrade your plan to use this model."}}, và trang web bọc lại nó thành cặp mã và thông báo cũ hơn trước khi trang chat đọc nó, nên câu bạn thấy trên màn hình chính là chuỗi gốc từ backend chứ không phải bản viết lại của client.

Một tin nhắn GLM tốn bao nhiêu credit?

Từ 1 đến 5 credit tùy dòng. Thế hệ GLM 4 là 1 hoặc 2 credit, GLM 5 là 2, hai dòng khác trong thế hệ GLM 5 nằm ở mức 3 credit, và các dòng GLM đắt nhất là 5.

Tôi có thể dùng GLM trên gói miễn phí không?

Không, không phải từ ngày 2026-09-02. Tài khoản miễn phí có 0 credit và chỉ được phép dùng Whizi AI và Auto, nên một dòng GLM sẽ trả lời "This model needs a plan. Start one to use it, or keep chatting with Whizi AI." với mã tier_upgrade_required. Điều gói miễn phí mang lại là 7 tin nhắn trong ngày đầu tiên và 3 tin nhắn mỗi ngày sau đó trên hai dòng đó; dùng hết trong ngày sẽ trả về free_limit_reached và "Today's free messages are used up. More arrive tomorrow, or start a plan to keep going now." GLM cần Powerhouse, nơi bậc suy luận đỉnh cao nằm.

Cửa sổ ngữ cảnh của GLM trong Whizi là bao nhiêu?

Trước khi bất kỳ ngân sách nào được kiểm tra, đầu vào đo được sẽ được nhân với 1.8 lần, vì bộ ước tính token có thể đếm thiếu tới 1.66 lần so với một bộ tách token thực trên nội dung như JSON. Vì vậy một lời nhắc GLM nặng dữ liệu có cấu trúc sẽ được tính lớn hơn so với con số đo được theo nghĩa đen. Các dòng GLM được định giá mang cửa sổ 205K hoặc 1M token tùy dòng, và không con số nào là thứ một lượt thực sự gửi: ngân sách mỗi lượt nằm trong phần giải thích vì sao hai kích thước cửa sổ lại ra cùng một kết quả.