Het korte antwoord
Ja, GLM zit in de Whizi-catalogus. Z.ai-modellen zijn geprijsd over de GLM 4- en GLM 5-generaties, één model is beschikbaar op het Pro-abonnement voor 2 credits per bericht, en elk ander GLM-model vereist Powerhouse.
| Model | Contextvenster | Credits per bericht | Vereist abonnement |
|---|---|---|---|
| GLM 4.6 | 205K | 1 | Powerhouse |
| GLM 4.7 | 205K | 2 | Powerhouse |
| GLM 5 | 205K | 2 | Pro |
| GLM 5.1 | niet in de prijsindex | 3 | Powerhouse |
| GLM 5.2 | 1M | 3 | Powerhouse |
| GLM 5.3 | 1M | 5 | Powerhouse |
| GLM 5 Turbo | niet in de prijsindex | 5 | Powerhouse |
| GLM 5V Turbo | niet in de prijsindex | 5 | Powerhouse |
Een GLM-identifier die hier niet staat vermeld, wordt nog steeds op een credittrede geplaatst en vereist nog steeds Powerhouse.
Gratis accounts zijn modelgebonden aan twee modellen, Whizi AI en Auto, dus geen enkel GLM-model is bereikbaar op een gratis account. De gratis toelage zelf is 7 berichten op de eerste dag en daarna 3 per dag, te besteden aan die twee modellen. Dit veranderde op 2026-09-02: het chatpad gaf vroeger al antwoord voor de gratis laag voordat de modelcontrole liep, en nu voert het eerst die controle uit.
Het model op Pro is niet het goedkoopste model
Pro geeft toegang tot precies één Z.ai-identifier, GLM 5, voor 2 credits per bericht. De curatieregel waarop de Pro-lijst is gebaseerd, staat beschreven in de modelreferentie, en voor deze familie komt dat neer op één model, wat precies de reden is waarom de rest van de generatie een tier hoger zit.
Dat ene model is niet het goedkope. Het GLM-model dat in credits het goedkoopst is, kost 1 credit per bericht en vereist Powerhouse, terwijl het Pro-model het dubbele kost. Creditkosten en abonnementstier zijn twee aparte beslissingen in Whizi, en de ene voorspelt de andere niet.
Starter bevat geen enkel GLM-model. Starter komt tot precies vier keuzemenu-items: Auto, het huismodel, één OpenAI-model en één Google-model. Elk daarvan is een 1x- of 2x-model, en dat is waarom de creditlimiet van Starter en de berichtenlimiet van Starter hetzelfde getal zijn.
Powerhouse dekt de rest, in één geval met naam genoemd en in alle andere gevallen als terugvaloptie. Het frontier-redeneermodel in de GLM 5-generatie wordt expliciet genoemd tussen de modellen die zijn gereserveerd voor Powerhouse, samen met een Grok-model, het Qwen-denkmodel, het Kimi-denkmodel en andere. Elk overig GLM-model komt op de hoogste tier terecht, omdat elke identifier die niet in de Starter-set zit en niet op de expliciete Pro-lijst staat, daar terechtkomt.
Toegangscontrole wordt afgedwongen op de server, niet in de interface. Het selecteren van een model boven je tier levert HTTP 403 op met de code tier_upgrade_required en het bericht "Upgrade your plan to use this model." Kom je dat tegen bij een GLM-model, bekijk dan waarom een model als niet beschikbaar wordt getoond.
Het GLM 4-paar, waar de trede en de daadwerkelijke kosten niet overeenkomen
In het GLM 4-paar komen de twee kolommen niet overeen. Het model dat per standaardantwoord goedkoper is, draagt de hogere credittrede, en het zustermodel draagt de lagere. Een credittrede wordt gemeten op een referentiebeurt van 3.000 input- en 800 outputtokens, terwijl het indexcijfer is gebaseerd op een standaardantwoord van 1.000 plus 500 tokens, en twee modellen waarvan de input- en outputtarieven verschillend zijn gewogen, kunnen van plaats wisselen tussen die twee verhoudingen. De methode achter de credittrede staat in de creditsreferentie.
| Model | Kosten per standaardantwoord | Kosten per duizend antwoorden | Credits per bericht |
|---|---|---|---|
| GLM 4.7 | $0.001275 | $1.275 | 2 |
| GLM 4.6 | $0.0015 | $1.50 | 1 |
| GLM 5 | $0.00156 | $1.56 | 2 |
| GLM 5.2 | $0.002484 | $2.484 | 3 |
| GLM 5.3 | $0.0036 | $3.60 | 5 |
De Whizi-kostenindex prijst 100 OpenRouter-modellen op één identieke eenheid zodat providers vergelijkbaar zijn: een standaardantwoord van 1.000 inputtokens plus 500 outputtokens. De brondata zijn op 2026-08-20 opgehaald bij OpenRouter, over 29 providers.
Ter vergelijking: het mediane geprijsde model in de index kost $0.00185 per standaardantwoord, het goedkoopste $0.000053 en het duurste $0.105, een spreiding van ruwweg 2000x. Drie van de vijf geprijsde GLM-modellen zitten onder die mediaan, en twee erboven.
Modellen die in de tabel bovenaan zijn gemarkeerd met "niet in de prijsindex" hebben wel creditkosten in het product, maar horen niet bij de 100 modellen die de kostenindex prijst, dus is er voor hen geen cijfer per antwoord te publiceren.
Wat een GLM-bericht kost van je toelage
Eén credit staat gelijk aan één bericht op het huismodel, en de creditkosten liggen per bericht vast op basis van het gekozen model, niet op basis van lengte. De methode staat in de creditsreferentie. Wat dit betekent voor deze familie: de GLM-modellen bovenaan deze pagina vallen binnen één band van 1 tot 5 credits, dus het duurste kost precies vijf keer het goedkoopste, en de hele familie zit binnen de onderste vijf tredes van een ladder van achttien tredes.
| Abonnement | Prijs | Credits per maand | Berichten op het Pro GLM-model (2 credits) | Berichten op het duurste GLM-model (5 credits) |
|---|---|---|---|---|
| Starter | $15.99/maand, of $10.99/maand bij jaarlijkse facturering van $131.88 | 400 | geen GLM-model op dit abonnement | geen GLM-model op dit abonnement |
| Pro | $29.99/maand, of $19.99/maand bij jaarlijkse facturering van $239.88 | 2,000 | 1,000 | niet op dit abonnement |
| Powerhouse | $49.99/maand, of $34.99/maand bij jaarlijkse facturering van $419.88 | 8,000 | 4,000 | 1,600 |
Op Powerhouse koopt het GLM-model van 1 credit 8,000 berichten uit een toelage van 8,000 credits, en de modellen van 3 credits kopen er 2,666. Credits worden niet meegenomen naar de volgende periode: het verbruik wordt opgeteld tegen een periodesleutel, dus de start van een nieuwe periode is zelf de reset.
Een GLM-beurt die niet past binnen het resterende saldo wordt volledig geweigerd in plaats van gedeeltelijk in rekening gebracht. Dat is bewust zo, want 3 credits in rekening brengen voor een model van 5 credits zou betekenen dat één model verschillende bedragen kost, afhankelijk van wanneer het werd verstuurd.
Creditprijzen worden per platform beperkt door een allowlist waarvan de productiewaarde vandaag de webclient is. Buiten die allowlist toont het keuzemenu helemaal geen creditbadges, en kost elke beurt één tegen de oudere berichtentoelage in plaats van een trede tegen de credittoelage.
Waarom de 205K-modellen en de 1M-modellen dezelfde ruimte krijgen
Een GLM-model met een venster van 1M en een GLM-model met een venster van 205K krijgen binnen Whizi identieke ruimte. Beide zitten boven de drempel van 93,000 tokens, en elk catalogusmodel boven die drempel krijgt één vast budget van 40,000 inputtokens en 20,000 outputtokens per beurt, wat geldt voor elk GLM-model dat de kostenindex prijst. Modellen onder de drempel krijgen in plaats daarvan een kleiner, proportioneel budget, beschreven in wanneer een gesprek te lang is.
Overstappen naar het grotere venster levert dus geen langere prompt op. Wat het wel oplevert is speelruimte aan de kant van de provider, omdat OpenRouter input plus de gevraagde maximale output tegen het venster telt, niet alleen de input.
Een gesprek naar GLM verplaatsen en weer terug
Auto brengt je niet naar GLM. Auto heeft geen eigen credittrede, en de ladder bestaat uit zes vaste routes over vijf modellen: het huismodel voor korte vragen, een snel Google-model voor herschrijvingen en bijlagen, een OpenAI-model voor lange tekst, een Anthropic-model voor code, en een OpenAI-redeneermodel voor meerstaps redeneren. Geen enkel GLM-model staat op die ladder, dus een beurt komt alleen op GLM terecht als je het zelf kiest.
Elk model dat naar de webclient wordt gestuurd, draagt zijn eigen kostensignaal mee, dus de creditprijs van een GLM-model is zichtbaar voordat je verstuurt, niet erna.
Een GLM-gesprek dat je maanden geleden hebt geopend, opent vandaag nog steeds, omdat een gesprek de identifier behoudt waarmee het is aangemaakt, ook nadat het keuzemenu is doorgeschoven naar nieuwere modellen.
Hoe je ook wisselt, de kosten volgen het model dat de beurt daadwerkelijk heeft beantwoord, niet het model waarmee het gesprek begon.
Waar GLM niet voorkomt
Mediageneratie gebruikt geen GLM. De sectie voor afbeeldingengeneratie bestaat uit vier vaste modellen, videogeneratie is één enkel model, en audiogeneratie is één enkel model, allemaal huis- of partnergeneratoren, dus geen enkel GLM-model is betrokken bij het genereren van een afbeelding, video of muziek.
Er is geen visievlag per model om te noemen. Whizi houdt niet bij welke modellen afbeeldingen kunnen lezen. Bijlagen worden per verzoek afgehandeld, niet per model, en op de webclient wordt de tekst van een PDF-, Word- of spreadsheetbestand al in de browser geëxtraheerd voordat er iets wordt verzonden. Zie ondersteunde bestandstypen voor wat dat in de praktijk betekent.
Websearch is een schakelaar op verzoekniveau, geen modelfunctie. Zoeken draait in één van drie modi, en het inschakelen ervan beïnvloedt het verzoek in plaats van een ander model te kiezen, dus er is geen gepubliceerde lijst van GLM-modellen die wel of niet kunnen browsen.
Agentpersona's zijn geen GLM. De vier agentpersona's zijn een Pro-functie, geen modeltier, en elk daarvan draait op hetzelfde basismodel, dus het kiezen van een persona stuurt een beurt nooit naar Z.ai.
- Whizi prijst GLM-modellen van Z.ai over de GLM 4- en GLM 5-generaties
- GLM 5 is het enige GLM-model dat bereikbaar is op Pro, voor 2 credits per bericht
- Elk ander GLM-model vereist Powerhouse
- Starter bevat helemaal geen GLM-model
- Gratis accounts bereiken geen enkel GLM-model: de gratis laag draait alleen op Whizi AI en Auto
- Creditkosten liggen vast per bericht en variëren niet met de lengte
- Elk GLM-model dat de kostenindex prijst, draait op het vaste budget van 40,000 inputtokens en 20,000 outputtokens
- Auto stuurt een beurt nooit naar een GLM-model
Veelgestelde vragen
Zit GLM in Whizi?
Ja. GLM-modellen staan in de sectie Alle modellen van het keuzemenu, onder het Z.ai-leverancierslogo in plaats van het generieke standaardicoon dat de meeste kleinere labs krijgen. Ze staan niet in de sectie Aanbevolen, die uit vijf vaste modellen bestaat en geen GLM-item bevat, dus blader door Alle modellen in plaats van de bovenkant van het keuzemenu om ze te vinden.
Welk Whizi-abonnement heb ik nodig om GLM te gebruiken?
Pro geeft toegang tot één GLM-model, GLM 5. Al het andere in de familie vereist Powerhouse. Als je verstuurt op een model dat je tier niet omvat, antwoordt de worker met HTTP 403 en een JSON-body in de vorm {"error": {"code": "tier_upgrade_required", "message": "Upgrade your plan to use this model."}}, en de website verpakt dat opnieuw in zijn oudere code- en berichtparen voordat de chatpagina het leest, dus de zin die je op het scherm ziet is de backend-string woordelijk, niet een herschrijving door de client.
Hoeveel credits kost een GLM-bericht?
Tussen de 1 en 5 credits, afhankelijk van het model. De GLM 4-generatie kost 1 of 2 credits, GLM 5 kost 2, nog twee modellen in de GLM 5-generatie zitten op 3 credits, en de duurste GLM-modellen kosten 5.
Kan ik GLM gebruiken op de gratis laag?
Nee, niet meer sinds 2026-09-02. Gratis accounts hebben 0 credits en zijn beperkt tot Whizi AI en Auto, dus een GLM-model antwoordt "This model needs a plan. Start one to use it, or keep chatting with Whizi AI." met de code tier_upgrade_required. Wat gratis wel oplevert is 7 berichten op de eerste dag en daarna 3 per dag op die twee modellen; een dag opmaken geeft free_limit_reached en "Today's free messages are used up. More arrive tomorrow, or start a plan to keep going now." GLM vereist Powerhouse, waar de frontier-redeneertier zit.
Wat is het contextvenster van GLM in Whizi?
Voordat een budget wordt gecontroleerd, wordt de gemeten input met 1.8x vermenigvuldigd, omdat de tokenschatter een echte tokenizer tot wel 1.66x kan onderschatten bij content zoals JSON. Een GLM-prompt vol gestructureerde data wordt daardoor groter ingeschat dan letterlijk gemeten. De geprijsde GLM-modellen hebben een venster van 205K of 1M tokens, afhankelijk van het model, en geen van beide getallen is wat één beurt daadwerkelijk verstuurt: het budget per beurt staat in de sectie over waarom de twee vensterformaten op hetzelfde uitkomen.