Usare GLM in Whizi: una sola riga su Pro, il resto su Powerhouse

Risposta rapida

GLM è nel catalogo Whizi, con righe Z.ai listate tra le generazioni GLM 4 e GLM 5. Una sola riga, GLM 5, si sblocca su Pro a 2 crediti per messaggio, e ogni altra riga GLM richiede Powerhouse. Starter non include alcun modello GLM. Un messaggio GLM costa tra 1 e 5 crediti.

La risposta breve

Sì, GLM è nel catalogo Whizi. Le righe Z.ai sono listate tra le generazioni GLM 4 e GLM 5, una riga si sblocca sul piano Pro a 2 crediti per messaggio, e ogni altra riga GLM richiede Powerhouse.

ModelloFinestra di contestoCrediti per messaggioPiano richiesto
GLM 4.6205K1Powerhouse
GLM 4.7205K2Powerhouse
GLM 5205K2Pro
GLM 5.1non nell'indice prezzi3Powerhouse
GLM 5.21M3Powerhouse
GLM 5.31M5Powerhouse
GLM 5 Turbonon nell'indice prezzi5Powerhouse
GLM 5V Turbonon nell'indice prezzi5Powerhouse

Un identificativo GLM non elencato qui viene comunque addebitato a un gradino ed esige comunque Powerhouse.

Gli account gratuiti sono limitati a due righe di modello, Whizi AI e Auto, quindi nessuna riga GLM è raggiungibile su un account gratuito. L'allowance gratuita è di 7 messaggi il primo giorno e 3 al giorno da lì in poi, spesi su quelle due righe. Questo è cambiato il 2026-09-02: il percorso della chat per il livello gratuito tornava prima che il controllo del modello venisse eseguito, e ora esegue prima il controllo.

La sola riga su Pro non è la riga più economica

Pro si risolve in esattamente un identificativo Z.ai, GLM 5, a 2 crediti per messaggio. La regola di curatela su cui si basa l'elenco Pro è descritta nel riferimento sui modelli, e su questa famiglia porta a una singola riga, che è l'intero motivo per cui il resto della generazione si colloca un livello più in alto.

Quella singola riga non è quella economica. La riga GLM più economica in crediti costa 1 credito per messaggio e richiede Powerhouse, mentre la riga Pro costa il doppio. Costo in crediti e livello di piano sono due decisioni separate in Whizi, e nessuna delle due prevede l'altra.

Starter non include alcun modello GLM. Starter raggiunge esattamente quattro voci del selettore: Auto, il modello di casa, un modello OpenAI e un modello Google. Ognuno di essi è una riga 1x o 2x, motivo per cui l'allowance di crediti Starter e l'allowance di messaggi Starter sono lo stesso numero.

Powerhouse copre il resto, per nome in un caso e per fallback in ogni altro. La riga di ragionamento di frontiera nella generazione GLM 5 è nominata esplicitamente tra i modelli riservati a Powerhouse, insieme a una riga Grok, la riga di ragionamento Qwen, la riga di ragionamento Kimi e altre. Ogni riga GLM restante finisce nel livello più alto perché qualsiasi identificativo che non è nel set Starter e non è nell'elenco esplicito Pro finisce lì.

Il controllo degli accessi è applicato sul server, non nell'interfaccia. Selezionare un modello sopra il proprio livello restituisce HTTP 403 con il codice tier_upgrade_required e il messaggio "Upgrade your plan to use this model." Se ti capita su una riga GLM, vedi perché un modello risulta non disponibile.

La coppia GLM 4, dove il gradino e il costo di esecuzione non concordano

Nella coppia GLM 4 le due colonne non concordano. La riga più economica per risposta standard porta il gradino più alto, e la sua gemella porta quello più basso. Un gradino è misurato su un turno di riferimento di 3.000 token in input e 800 in output, la cifra indice su una risposta standard di 1.000 più 500, e due righe le cui tariffe di input e output sono ponderate diversamente possono scambiarsi di posto tra questi due mix. Il metodo del gradino è nel riferimento sui crediti.

ModelloCosto per risposta standardCosto per mille risposteCrediti per messaggio
GLM 4.7$0.001275$1.2752
GLM 4.6$0.0015$1.501
GLM 5$0.00156$1.562
GLM 5.2$0.002484$2.4843
GLM 5.3$0.0036$3.605

L'indice di costo Whizi mette a prezzo 100 righe OpenRouter su un'unità identica, così i fornitori possono essere confrontati: una risposta standard di 1.000 token in input più 500 in output. I prezzi di origine sono stati rilevati da OpenRouter il 2026-08-20, su 29 fornitori.

Per dare una scala: la riga mediana listata nell'indice è $0.00185 per risposta standard, la più economica è $0.000053 e la più cara è $0.105, uno scarto di circa 2000x. Tre delle cinque righe GLM listate si collocano sotto quella mediana, e due sopra.

Le righe indicate come "non nell'indice prezzi" nella tabella in alto portano un addebito di crediti nel prodotto ma non sono tra le 100 righe che l'indice di costo prezza, quindi non c'è una cifra per risposta da pubblicare per esse.

Cosa spende un messaggio GLM dalla tua allowance

Un credito è un messaggio sul modello di casa, e il costo in crediti è fisso per messaggio in base alla riga scelta, non alla lunghezza. Il metodo è nel riferimento sui crediti. Cosa significa su questa famiglia: le righe GLM elencate in cima a questa pagina occupano una singola fascia da 1 credito a 5, quindi la più cara di esse costa esattamente cinque volte la più economica, e l'intera famiglia si colloca dentro i cinque gradini più bassi di una scala a diciotto gradini.

PianoPrezzoCrediti al meseMessaggi sulla riga GLM Pro (2 crediti)Messaggi sulla riga GLM più cara (5 crediti)
Starter$15.99/mese, oppure $10.99/mese fatturato annualmente a $131.88400nessuna riga GLM su questo pianonessuna riga GLM su questo piano
Pro$29.99/mese, oppure $19.99/mese fatturato annualmente a $239.882.0001.000non su questo piano
Powerhouse$49.99/mese, oppure $34.99/mese fatturato annualmente a $419.888.0004.0001.600

Su Powerhouse la riga GLM da 1 credito acquista 8.000 messaggi da un'allowance di 8.000 crediti, e le righe da 3 crediti ne acquistano 2.666. I crediti non si accumulano da un periodo all'altro: l'utilizzo è sommato rispetto a una chiave di periodo, quindi l'arrivo di un nuovo periodo è di per sé il reset.

Un turno GLM che non rientra nel saldo residuo viene rifiutato del tutto invece di essere addebitato in parte. Questo è deliberato, perché addebitare 3 crediti per una riga da 5 crediti farebbe costare un modello importi diversi a seconda di quando è stato inviato.

Il prezzo in crediti è vincolato per piattaforma da una lista di autorizzazione il cui valore in produzione oggi è il client web. Fuori da quella lista il selettore non mostra alcun badge di crediti, e ogni turno costa uno contro la vecchia allowance di messaggi invece di un gradino contro l'allowance di crediti.

Perché le righe da 205K e le righe da 1M hanno la stessa dimensione

Una riga GLM con finestra da 1M e una riga GLM con finestra da 205K ottengono uno spazio identico dentro Whizi. Entrambe si collocano sopra la soglia di 93.000 token, e ogni modello del catalogo sopra quella soglia riceve un budget fisso di 40.000 token in input e 20.000 in output per turno, il che è vero per ogni riga GLM che l'indice di costo prezza. I modelli sotto la soglia ricevono invece un budget proporzionale più piccolo, descritto in quando una conversazione è troppo lunga.

Quindi passare alla finestra più grande non compra un prompt più lungo. Ciò che compra è margine sul lato del fornitore, poiché OpenRouter conta input più output massimo richiesto contro la finestra, non solo l'input.

Spostare un thread su GLM e di nuovo fuori

Auto non ti porterà su GLM. Auto non ha un gradino proprio, e la sua scala è di sei percorsi fissi su cinque righe di modello: il modello di casa per domande brevi, una riga Google veloce per riscritture e allegati, una riga OpenAI per contenuti lunghi, una riga Anthropic per il codice, e una riga di ragionamento OpenAI per ragionamento multi passo. Nessuna riga GLM è su quella scala, quindi un turno finisce su GLM solo se la scegli tu stesso.

Ogni riga di modello servita al client web porta il proprio segnale di costo, quindi il prezzo in crediti di una riga GLM è visibile prima di inviare, non dopo.

Un thread GLM aperto mesi fa si apre ancora oggi, perché una conversazione mantiene l'identificativo con cui è stata creata anche dopo che il selettore è passato a righe più recenti.

In qualunque direzione ti muova, l'addebito segue il modello che ha effettivamente risposto al turno, non il modello con cui la conversazione è iniziata.

Dove GLM non compare

La generazione di contenuti multimediali non usa GLM. La sezione di generazione immagini è di quattro righe fisse, la generazione video è una singola riga, e la generazione audio è una singola riga, tutte di generatori di casa o partner, quindi nessuna riga GLM è coinvolta nel generare un'immagine, un video o musica.

Non c'è un flag di visione per modello da citare. Whizi non tiene traccia di quali modelli possono leggere immagini. Gli allegati sono gestiti per richiesta, non per modello, e sul client web il testo di un file PDF, Word o foglio di calcolo viene estratto nel browser prima che qualcosa venga inviato. Vedi tipi di file supportati per cosa questo significa in pratica.

La ricerca web è un interruttore a livello di richiesta, non una capacità del modello. La ricerca funziona in una di tre modalità, e attivarla influisce sulla richiesta invece di selezionare un modello diverso, quindi non esiste un elenco pubblicato di righe GLM che possono o non possono navigare.

Le persone agente non sono GLM. Le quattro persone agente sono una funzione Pro piuttosto che un livello di modello, ed ognuna di esse gira sullo stesso modello di base, quindi scegliere una persona non instrada mai un turno verso Z.ai.

Lista di controllo
  • Whizi mette a listino modelli GLM di Z.ai tra le generazioni GLM 4 e GLM 5
  • GLM 5 è l'unica riga GLM raggiungibile su Pro, a 2 crediti per messaggio
  • Ogni altra riga GLM richiede Powerhouse
  • Starter non include alcun modello GLM
  • Gli account gratuiti non raggiungono alcuna riga GLM: il livello gratuito esegue solo Whizi AI e Auto
  • Il costo in crediti è fisso per messaggio e non varia con la lunghezza
  • Ogni riga GLM che l'indice di costo prezza gira sul budget fisso di 40.000 token in input e 20.000 in output
  • Auto non instrada mai un turno verso una riga GLM

Domande frequenti

GLM è incluso in Whizi?

Sì. Le righe GLM si trovano nella sezione Tutti i modelli del selettore, sotto il logo del fornitore Z.ai invece della icona generica di fallback che ricevono la maggior parte dei laboratori più piccoli. Non sono nella sezione Consigliati, che è di cinque righe fisse e non porta alcuna voce GLM, quindi sfoglia Tutti i modelli invece della cima del selettore per trovarle.

Di quale piano Whizi ho bisogno per usare GLM?

Pro raggiunge una riga GLM, GLM 5. Tutto il resto della famiglia è Powerhouse. Se invii su una riga che il tuo livello non include, il worker risponde HTTP 403 con un corpo JSON nella forma {"error": {"code": "tier_upgrade_required", "message": "Upgrade your plan to use this model."}}, e il sito riavvolge quel messaggio nella sua vecchia coppia di codice e messaggio prima che la pagina di chat lo legga, quindi la frase che vedi sullo schermo è la stringa del backend testuale, non una riscrittura del client.

Quanti crediti costa un messaggio GLM?

Tra 1 e 5 crediti a seconda della riga. La generazione GLM 4 è a 1 o 2 crediti, GLM 5 è a 2, altre due righe nella generazione GLM 5 si collocano a 3 crediti, e le righe GLM più care sono a 5.

Posso usare GLM sul livello gratuito?

No, non dal 2026-09-02. Gli account gratuiti portano 0 crediti e sono limitati a Whizi AI e Auto, quindi una riga GLM risponde "This model needs a plan. Start one to use it, or keep chatting with Whizi AI." con il codice tier_upgrade_required. Ciò che il livello gratuito offre invece sono 7 messaggi il primo giorno e 3 al giorno da lì in poi su quelle due righe; esaurire una giornata restituisce free_limit_reached e "Today's free messages are used up. More arrive tomorrow, or start a plan to keep going now." GLM richiede Powerhouse, dove si colloca il livello di ragionamento di frontiera.

Qual è la finestra di contesto su GLM in Whizi?

Prima che qualsiasi budget venga controllato, l'input misurato viene scalato di 1,8x, perché lo stimatore di token può sottostimare un vero tokenizzatore fino a 1,66x su contenuti come il JSON. Un prompt GLM ricco di dati strutturati viene quindi dimensionato più grande di quanto misuri letteralmente. Le righe GLM listate portano finestre da 205K o 1M token a seconda della riga, e nessuno dei due numeri è ciò che un singolo turno invia: il budget per turno è nella sezione sul perché le due dimensioni di finestra risultano uguali.