Utiliser GLM dans Whizi : une seule ligne sur Pro, le reste sur Powerhouse

Réponse rapide

GLM figure dans le catalogue Whizi, avec des lignes Z.ai tarifées sur les générations GLM 4 et GLM 5. Une seule ligne, GLM 5, s'ouvre sur Pro à 2 crédits par message, et toute autre ligne GLM nécessite Powerhouse. Starter n'inclut aucun modèle GLM. Un message GLM coûte entre 1 et 5 crédits.

La réponse courte

Oui, GLM figure dans le catalogue Whizi. Les lignes Z.ai sont tarifées sur les générations GLM 4 et GLM 5, une ligne s'ouvre sur le forfait Pro à 2 crédits par message, et toute autre ligne GLM nécessite Powerhouse.

ModèleFenêtre de contexteCrédits par messageForfait requis
GLM 4.6205K1Powerhouse
GLM 4.7205K2Powerhouse
GLM 5205K2Pro
GLM 5.1absent de l'index tarifaire3Powerhouse
GLM 5.21M3Powerhouse
GLM 5.31M5Powerhouse
GLM 5 Turboabsent de l'index tarifaire5Powerhouse
GLM 5V Turboabsent de l'index tarifaire5Powerhouse

Un identifiant GLM non répertorié ici est quand même facturé un palier et nécessite quand même Powerhouse.

Les comptes gratuits sont limités à deux lignes de modèles, Whizi AI et Auto, donc aucune ligne GLM n'est accessible avec un tel compte. L'allocation gratuite elle-même est de 7 messages le premier jour puis 3 par jour ensuite, dépensés sur ces deux lignes. Cela a changé le 2026-09-02 : le parcours de chat renvoyait auparavant une réponse pour le niveau gratuit avant que le contrôle du modèle ne s'exécute, et il exécute désormais ce contrôle en premier.

La ligne disponible sur Pro n'est pas la moins chère

Pro se résout en exactement un identifiant Z.ai, GLM 5, à 2 crédits par message. La règle de sélection sur laquelle repose la liste Pro est exposée dans la référence des modèles, et sur cette famille elle aboutit à une seule ligne, ce qui explique entièrement pourquoi le reste de la génération se trouve un palier plus haut.

Cette ligne unique n'est pas la moins chère. La ligne GLM la moins chère en crédits facture 1 crédit par message et nécessite Powerhouse, alors que la ligne Pro en facture le double. Le coût en crédits et le palier de forfait sont deux décisions distinctes chez Whizi, et l'un ne permet pas de prédire l'autre.

Starter n'inclut aucun modèle GLM. Starter atteint exactement quatre entrées dans le sélecteur : Auto, le modèle maison, un modèle OpenAI et un modèle Google. Chacune d'elles est une ligne à 1x ou 2x, ce qui explique pourquoi l'allocation de crédits Starter et l'allocation de messages Starter sont le même nombre.

Powerhouse couvre le reste, nommément dans un cas et par défaut dans tous les autres. La ligne de raisonnement de pointe de la génération GLM 5 est nommée explicitement parmi les modèles réservés à Powerhouse, aux côtés d'une ligne Grok, de la ligne de réflexion Qwen, de la ligne de réflexion Kimi et d'autres. Chaque ligne GLM restante aboutit au palier le plus élevé, car tout identifiant qui n'est ni dans l'ensemble Starter ni dans la liste Pro explicite se résout à cet endroit.

Le contrôle d'accès est appliqué côté serveur, pas dans l'interface. Sélectionner un modèle au-dessus de votre palier renvoie un HTTP 403 avec le code tier_upgrade_required et le message "Upgrade your plan to use this model." Si cela vous arrive sur une ligne GLM, consultez pourquoi un modèle apparaît comme indisponible.

La paire GLM 4, où le palier et le coût d'exécution divergent

Dans la paire GLM 4, les deux colonnes divergent. La ligne la moins chère par réponse standard porte le palier le plus élevé, et sa jumelle porte le palier le plus bas. Un palier est mesuré sur un tour de référence de 3,000 tokens en entrée et 800 en sortie, le chiffre de l'index reposant sur une réponse standard de 1,000 plus 500, et deux lignes dont les tarifs d'entrée et de sortie sont pondérés différemment peuvent inverser leur position entre ces deux répartitions. La méthode de calcul du palier est expliquée dans la référence des crédits.

ModèleCoût par réponse standardCoût pour mille réponsesCrédits par message
GLM 4.7$0.001275$1.2752
GLM 4.6$0.0015$1.501
GLM 5$0.00156$1.562
GLM 5.2$0.002484$2.4843
GLM 5.3$0.0036$3.605

L'index de coûts Whizi tarife 100 lignes OpenRouter sur une unité identique afin de pouvoir comparer les fournisseurs : une réponse standard de 1,000 tokens en entrée plus 500 en sortie. Les prix source ont été récupérés sur OpenRouter le 2026-08-20, auprès de 29 fournisseurs.

Pour donner un ordre de grandeur : la ligne médiane tarifée dans l'index est à $0.00185 par réponse standard, la moins chère est à $0.000053 et la plus chère est à $0.105, soit un écart d'environ 2000x. Trois des cinq lignes GLM tarifées se situent en dessous de cette médiane, et deux au-dessus.

Les lignes marquées « absent de l'index tarifaire » dans le tableau ci-dessus sont bien facturées en crédits dans le produit, mais ne font pas partie des 100 lignes tarifées par l'index de coûts, il n'existe donc pas de chiffre par réponse à publier pour elles.

Ce qu'un message GLM consomme sur votre allocation

Un crédit correspond à un message sur le modèle maison, et le coût en crédits est fixé par message selon la ligne choisie plutôt que selon la longueur. La méthode est expliquée dans la référence des crédits. Ce que cela signifie pour cette famille : les lignes GLM listées en haut de cette page s'étendent sur une seule fourchette allant de 1 à 5 crédits, si bien que la plus chère d'entre elles coûte exactement cinq fois la moins chère, et toute la famille se situe dans les cinq paliers les plus bas d'une échelle qui en compte dix-huit.

ForfaitPrixCrédits par moisMessages sur la ligne GLM Pro (2 crédits)Messages sur la ligne GLM la plus chère (5 crédits)
Starter$15.99/mois, ou $10.99/mois facturé annuellement à $131.88400aucune ligne GLM sur ce forfaitaucune ligne GLM sur ce forfait
Pro$29.99/mois, ou $19.99/mois facturé annuellement à $239.882,0001,000pas sur ce forfait
Powerhouse$49.99/mois, ou $34.99/mois facturé annuellement à $419.888,0004,0001,600

Sur Powerhouse, la ligne GLM à 1 crédit permet 8,000 messages à partir d'une allocation de 8,000 crédits, et les lignes à 3 crédits en permettent 2,666. Les crédits ne se reportent pas : l'usage est cumulé sur une clé de période, si bien que l'arrivée d'une nouvelle période constitue elle-même la remise à zéro.

Un tour GLM qui ne rentre pas dans le solde restant est rejeté purement et simplement plutôt que facturé partiellement. C'est délibéré, car facturer 3 crédits pour une ligne à 5 crédits ferait qu'un même modèle coûterait des montants différents selon le moment de l'envoi.

La tarification en crédits est contrôlée par plateforme via une liste d'autorisation dont la valeur en production aujourd'hui est le client web. En dehors de cette liste, le sélecteur n'affiche aucun badge de crédits, et chaque tour coûte un point sur l'ancienne allocation de messages plutôt qu'un palier sur l'allocation de crédits.

Pourquoi les lignes à 205K et les lignes à 1M ont la même taille

Une ligne GLM avec une fenêtre de 1M et une ligne GLM avec une fenêtre de 205K disposent d'un espace identique dans Whizi. Les deux se situent au-dessus du seuil de 93,000 tokens, et tout modèle du catalogue au-dessus de ce seuil reçoit un budget fixe unique de 40,000 tokens en entrée et 20,000 en sortie par tour, ce qui est vrai pour chaque ligne GLM tarifée par l'index de coûts. Les modèles en dessous du seuil reçoivent à la place un budget proportionnel plus petit, décrit dans quand une conversation est trop longue.

Passer à la fenêtre la plus grande n'achète donc pas une invite plus longue. Ce que cela achète, c'est de la marge côté fournisseur, puisque OpenRouter compte l'entrée plus la sortie maximale demandée par rapport à la fenêtre, et non l'entrée seule.

Faire basculer un fil vers GLM, puis ailleurs

Auto ne vous emmènera pas vers GLM. Auto n'a pas de palier propre, et son échelle comprend six itinéraires fixes répartis sur cinq lignes de modèles : le modèle maison pour les questions courtes, une ligne Google rapide pour les réécritures et les pièces jointes, une ligne OpenAI pour les formats longs, une ligne Anthropic pour le code, et une ligne de raisonnement OpenAI pour le raisonnement en plusieurs étapes. Aucune ligne GLM ne figure sur cette échelle, si bien qu'un tour n'atterrit sur GLM que si vous le choisissez vous-même.

Chaque ligne de modèle servie au client web porte son signal de coût, si bien que le prix en crédits d'une ligne GLM est visible avant l'envoi plutôt qu'après.

Un fil GLM ouvert il y a des mois s'ouvre encore aujourd'hui, car une conversation conserve l'identifiant avec lequel elle a été créée, même après que le sélecteur est passé à des lignes plus récentes.

Quel que soit le sens du basculement, la facturation suit le modèle qui a réellement répondu au tour, et non le modèle sur lequel la conversation a commencé.

Où GLM n'apparaît pas

La génération de médias n'utilise pas GLM. La section de génération d'images compte quatre lignes fixes, la génération de vidéo est une ligne unique, et la génération audio est une ligne unique, toutes étant des générateurs maison ou partenaires, si bien qu'aucune ligne GLM n'intervient dans la génération d'une image, d'une vidéo ou d'une musique.

Il n'existe pas d'indicateur de vision par modèle à citer. Whizi ne suit pas quels modèles peuvent lire des images. Les pièces jointes sont traitées par requête plutôt que par modèle, et sur le client web, le texte d'un fichier PDF, Word ou tableur est extrait dans le navigateur avant tout envoi. Consultez types de fichiers pris en charge pour ce que cela signifie en pratique.

La recherche web est un interrupteur au niveau de la requête, pas une capacité du modèle. La recherche fonctionne selon l'un de trois modes, et l'activer modifie la requête plutôt que de sélectionner un autre modèle, il n'existe donc pas de liste publiée des lignes GLM qui peuvent ou non naviguer sur le web.

Les personas d'agent ne sont pas GLM. Les quatre personas d'agent sont une fonctionnalité Pro plutôt qu'un palier de modèle, et chacune d'elles fonctionne sur le même modèle de base, si bien que choisir un persona n'achemine jamais un tour vers Z.ai.

Liste de vérification
  • Whizi tarife des modèles GLM de Z.ai sur les générations GLM 4 et GLM 5
  • GLM 5 est la seule ligne GLM accessible sur Pro, à 2 crédits par message
  • Toute autre ligne GLM nécessite Powerhouse
  • Starter n'inclut aucun modèle GLM
  • Les comptes gratuits n'atteignent aucune ligne GLM : le niveau gratuit fonctionne uniquement avec Whizi AI et Auto
  • Le coût en crédits est fixe par message et ne varie pas avec la longueur
  • Chaque ligne GLM tarifée par l'index de coûts fonctionne avec le budget fixe de 40,000 tokens en entrée et 20,000 en sortie
  • Auto n'achemine jamais un tour vers une ligne GLM

Questions fréquentes

GLM est-il inclus dans Whizi ?

Oui. Les lignes GLM se trouvent dans la section Tous les modèles (All models) du sélecteur, sous le logo du fournisseur Z.ai plutôt que l'icône générique de repli que reçoivent la plupart des laboratoires plus petits. Elles ne figurent pas dans la section Recommandés, qui compte cinq lignes fixes et ne comporte aucune entrée GLM, il faut donc parcourir Tous les modèles plutôt que le haut du sélecteur pour les trouver.

De quel forfait Whizi ai-je besoin pour utiliser GLM ?

Pro donne accès à une ligne GLM, GLM 5. Tout le reste de la famille nécessite Powerhouse. Si vous envoyez un message sur une ligne que votre palier n'inclut pas, le worker répond avec un HTTP 403 accompagné d'un corps JSON de la forme {"error": {"code": "tier_upgrade_required", "message": "Upgrade your plan to use this model."}}, et le site web réemballe cela dans son ancienne paire code/message avant que la page de chat ne la lise, si bien que la phrase que vous voyez à l'écran est la chaîne backend verbatim plutôt qu'une reformulation côté client.

Combien de crédits coûte un message GLM ?

Entre 1 et 5 crédits selon la ligne. La génération GLM 4 coûte 1 ou 2 crédits, GLM 5 en coûte 2, deux autres lignes de la génération GLM 5 se situent à 3 crédits, et les lignes GLM les plus chères en coûtent 5.

Puis-je utiliser GLM sur le niveau gratuit ?

Non, plus depuis le 2026-09-02. Les comptes gratuits disposent de 0 crédit et sont limités à Whizi AI et Auto, donc une ligne GLM répond "This model needs a plan. Start one to use it, or keep chatting with Whizi AI." avec le code tier_upgrade_required. Ce que le niveau gratuit permet, c'est 7 messages le premier jour puis 3 par jour ensuite sur ces deux lignes ; épuiser une journée renvoie free_limit_reached et "Today's free messages are used up. More arrive tomorrow, or start a plan to keep going now." GLM nécessite Powerhouse, là où se trouve le palier de raisonnement de pointe.

Quelle est la fenêtre de contexte de GLM sur Whizi ?

Avant toute vérification de budget, l'entrée mesurée est multipliée par 1.8x, car l'estimateur de tokens peut sous-compter par rapport à un tokenizer réel jusqu'à 1.66x sur un contenu comme le JSON. Une invite GLM chargée en données structurées est donc dimensionnée plus grande que ce qu'elle mesure littéralement. Les lignes GLM tarifées portent des fenêtres de 205K ou 1M tokens selon la ligne, et aucun de ces deux chiffres n'est ce qu'un tour envoie réellement : le budget par tour figure dans la section expliquant pourquoi les deux tailles de fenêtre reviennent au même.