A resposta curta
Sim, o GLM está no catálogo da Whizi. As linhas da Z.ai são precificadas nas gerações GLM 4 e GLM 5, uma linha é liberada no plano Pro por 2 créditos por mensagem, e todas as outras linhas GLM exigem o Powerhouse.
| Modelo | Janela de contexto | Créditos por mensagem | Plano necessário |
|---|---|---|---|
| GLM 4.6 | 205K | 1 | Powerhouse |
| GLM 4.7 | 205K | 2 | Powerhouse |
| GLM 5 | 205K | 2 | Pro |
| GLM 5.1 | fora do índice de preços | 3 | Powerhouse |
| GLM 5.2 | 1M | 3 | Powerhouse |
| GLM 5.3 | 1M | 5 | Powerhouse |
| GLM 5 Turbo | fora do índice de preços | 5 | Powerhouse |
| GLM 5V Turbo | fora do índice de preços | 5 | Powerhouse |
Um identificador GLM que não apareça nesta lista ainda assim cobra um patamar de créditos e ainda exige o Powerhouse.
Contas gratuitas ficam restritas a duas linhas por bloqueio de modelo, Whizi AI e Auto, então nenhuma linha GLM é alcançável numa conta gratuita. A própria franquia gratuita é de 7 mensagens no primeiro dia e 3 por dia depois disso, gastas nessas duas linhas. Isso mudou em 2026-09-02: o caminho do chat costumava retornar para o nível gratuito antes de o bloqueio de modelo rodar, e agora ele roda o bloqueio primeiro.
A única linha do Pro não é a mais barata
O Pro resolve para exatamente um identificador da Z.ai, o GLM 5, a 2 créditos por mensagem. A regra de curadoria sobre a qual a lista do Pro é construída está descrita na referência de modelos, e nesta família ela resulta em uma única linha, que é todo o motivo pelo qual o resto da geração fica um nível acima.
Essa única linha não é a mais barata. A linha GLM mais barata em créditos cobra 1 crédito por mensagem e exige o Powerhouse, enquanto a linha do Pro cobra o dobro disso. Custo em créditos e nível de plano são duas decisões separadas na Whizi, e nenhuma delas prevê a outra.
O Starter não inclui nenhum modelo GLM. O Starter alcança exatamente quatro entradas no seletor: Auto, o modelo da casa, um modelo da OpenAI e um modelo do Google. Todos eles são linhas de 1x ou 2x, motivo pelo qual a franquia de créditos do Starter e a franquia de mensagens do Starter são o mesmo número.
O Powerhouse cobre o restante, por nome em um caso e por regra padrão em todos os outros. A linha de raciocínio de fronteira da geração GLM 5 é citada explicitamente entre os modelos reservados para o Powerhouse, ao lado de uma linha da Grok, da linha de raciocínio da Qwen, da linha de raciocínio da Kimi e outras. Toda linha GLM restante cai no nível superior porque qualquer identificador que não esteja no conjunto do Starter nem na lista explícita do Pro é resolvido ali.
O bloqueio é aplicado no servidor, não na interface. Selecionar um modelo acima do seu nível retorna HTTP 403 com o código tier_upgrade_required e a mensagem "Upgrade your plan to use this model." Se isso acontecer numa linha GLM, veja por que um modelo aparece como indisponível.
O par GLM 4, onde o patamar e o custo real discordam
No par GLM 4 as duas colunas discordam. A linha mais barata por resposta padrão carrega o patamar mais alto, e sua parceira carrega o mais baixo. Um patamar é medido num turno de referência de 3,000 tokens de entrada e 800 de saída, o valor índice numa resposta padrão de 1,000 mais 500, e duas linhas cujas taxas de entrada e saída têm pesos diferentes podem trocar de posição entre essas duas composições. O método do patamar está na referência de créditos.
| Modelo | Custo por resposta padrão | Custo por mil respostas | Créditos por mensagem |
|---|---|---|---|
| GLM 4.7 | $0.001275 | $1.275 | 2 |
| GLM 4.6 | $0.0015 | $1.50 | 1 |
| GLM 5 | $0.00156 | $1.56 | 2 |
| GLM 5.2 | $0.002484 | $2.484 | 3 |
| GLM 5.3 | $0.0036 | $3.60 | 5 |
O índice de custo da Whizi precifica 100 linhas da OpenRouter numa mesma unidade idêntica para que os provedores possam ser comparados: uma resposta padrão de 1,000 tokens de entrada mais 500 tokens de saída. Os preços de origem foram coletados na OpenRouter em 2026-08-20, entre 29 provedores.
Para efeito de escala: a linha com preço mediano no índice é $0.00185 por resposta padrão, a mais barata é $0.000053 e a mais cara é $0.105, uma amplitude de aproximadamente 2000x. Três das cinco linhas GLM precificadas ficam abaixo dessa mediana, e duas ficam acima.
Linhas marcadas como "fora do índice de preços" na tabela do topo carregam uma cobrança em créditos no produto, mas não estão entre as 100 linhas que o índice de custo precifica, então não há uma cifra por resposta para publicar sobre elas.
O que uma mensagem GLM gasta da sua franquia
Um crédito equivale a uma mensagem no modelo da casa, e o custo em créditos é fixo por mensagem, de acordo com a linha escolhida, e não com o comprimento. O método está na referência de créditos. O que isso significa nesta família: as linhas GLM listadas no topo desta página ocupam uma única faixa, de 1 crédito a 5, então a mais cara delas custa exatamente cinco vezes a mais barata, e toda a família fica dentro dos cinco patamares mais baixos de uma escada de dezoito patamares.
| Plano | Preço | Créditos por mês | Mensagens na linha GLM do Pro (2 créditos) | Mensagens na linha GLM mais cara (5 créditos) |
|---|---|---|---|---|
| Starter | $15.99/mês, ou $10.99/mês na cobrança anual, totalizando $131.88 | 400 | nenhuma linha GLM neste plano | nenhuma linha GLM neste plano |
| Pro | $29.99/mês, ou $19.99/mês na cobrança anual, totalizando $239.88 | 2,000 | 1,000 | não disponível neste plano |
| Powerhouse | $49.99/mês, ou $34.99/mês na cobrança anual, totalizando $419.88 | 8,000 | 4,000 | 1,600 |
No Powerhouse, a linha GLM de 1 crédito compra 8,000 mensagens de uma franquia de 8,000 créditos, e as linhas de 3 créditos compram 2,666. Créditos não acumulam de um período para o outro: o uso é somado contra uma chave de período, então a chegada de um novo período é, ela mesma, o reset.
Um turno GLM que não caiba no saldo restante é recusado por completo, em vez de ser cobrado parcialmente. Isso é deliberado, porque cobrar 3 créditos por uma linha de 5 créditos faria com que um mesmo modelo custasse valores diferentes dependendo de quando foi enviado.
A precificação em créditos é controlada por plataforma, por meio de uma lista de permissão cujo valor de produção hoje é o cliente web. Fora dessa lista, o seletor não exibe nenhum selo de créditos, e cada turno custa um contra a franquia antiga de mensagens, em vez de um patamar contra a franquia de créditos.
Por que as linhas de 205K e as de 1M têm o mesmo tamanho
Uma linha GLM com janela de 1M e uma linha GLM com janela de 205K recebem exatamente o mesmo espaço dentro da Whizi. Ambas ficam acima do limiar de 93,000 tokens, e todo modelo do catálogo acima desse limiar recebe um orçamento fixo de 40,000 tokens de entrada e 20,000 de saída por turno, o que vale para toda linha GLM que o índice de custo precifica. Modelos abaixo do limiar recebem, em vez disso, um orçamento proporcional menor, descrito em quando uma conversa fica longa demais.
Então subir para a janela maior não compra um prompt mais longo. O que isso compra é folga do lado do provedor, já que a OpenRouter conta a entrada mais o máximo de saída solicitado contra a janela, em vez de contar apenas a entrada.
Movendo uma conversa para o GLM e de volta
O Auto não vai te levar para o GLM. O Auto não tem patamar próprio, e sua escada é de seis rotas fixas entre cinco linhas de modelo: o modelo da casa para perguntas curtas, uma linha rápida do Google para reescritas e para anexos, uma linha da OpenAI para textos longos, uma linha da Anthropic para código, e uma linha de raciocínio da OpenAI para raciocínio em várias etapas. Nenhuma linha GLM está nessa escada, então um turno só cai no GLM quando você escolhe manualmente.
Toda linha de modelo servida ao cliente web carrega seu sinal de custo, então o preço em créditos de uma linha GLM fica visível antes de você enviar, e não depois.
Uma conversa em GLM que você abriu meses atrás ainda abre hoje, porque uma conversa mantém o identificador com o qual foi criada mesmo depois de o seletor já ter avançado para linhas mais novas.
Seja qual for o caminho, a cobrança segue o modelo que de fato respondeu o turno, e não o modelo com o qual a conversa começou.
Onde o GLM não aparece
A geração de mídia não usa o GLM. A seção de geração de imagem tem quatro linhas fixas, a geração de vídeo é uma única linha, e a geração de áudio é uma única linha, todas elas geradoras da casa ou parceiras, então nenhuma linha GLM está envolvida em gerar uma imagem, um vídeo ou uma música.
Não há uma sinalização de visão por modelo para citar. A Whizi não rastreia quais modelos conseguem ler imagens. Anexos são tratados por solicitação, e não por modelo, e no cliente web o texto de um arquivo PDF, Word ou planilha é extraído no navegador antes de qualquer envio. Veja tipos de arquivo suportados para entender o que isso significa na prática.
A busca na web é um alternador no nível da solicitação, não uma capacidade do modelo. A busca roda em um de três modos, e ativá-la afeta a solicitação, em vez de selecionar um modelo diferente, então não existe uma lista publicada de linhas GLM que podem ou não navegar.
Personas de agente não são GLM. As quatro personas de agente são um recurso do Pro, e não um nível de modelo, e todas elas rodam no mesmo modelo base, então escolher uma persona nunca roteia um turno para a Z.ai.
- A Whizi precifica modelos GLM da Z.ai nas gerações GLM 4 e GLM 5
- O GLM 5 é a única linha GLM alcançável no Pro, a 2 créditos por mensagem
- Toda outra linha GLM exige o Powerhouse
- O Starter não inclui nenhum modelo GLM
- Contas gratuitas não alcançam nenhuma linha GLM: o nível gratuito roda apenas Whizi AI e Auto
- O custo em créditos é fixo por mensagem e não varia com o comprimento
- Toda linha GLM que o índice de custo precifica roda no orçamento fixo de 40,000 tokens de entrada e 20,000 de saída
- O Auto nunca roteia um turno para uma linha GLM
Perguntas frequentes
O GLM está incluído na Whizi?
Sim. As linhas GLM ficam na seção Todos os modelos do seletor, sob o logo do fornecedor Z.ai, em vez do ícone genérico que a maioria dos labs menores recebe. Elas não estão na seção Recomendados, que tem cinco linhas fixas e nenhuma entrada GLM, então navegue por Todos os modelos, e não pelo topo do seletor, para encontrá-las.
De qual plano da Whizi eu preciso para usar o GLM?
O Pro alcança uma linha GLM, o GLM 5. Todo o restante da família é Powerhouse. Se você enviar numa linha que seu nível não inclui, o worker responde HTTP 403 com um corpo JSON no formato {"error": {"code": "tier_upgrade_required", "message": "Upgrade your plan to use this model."}}, e o site reembrulha isso no par antigo de código e mensagem antes de a página de chat lê-lo, então a frase que você vê na tela é a string do backend, palavra por palavra, e não uma reescrita do cliente.
Quantos créditos custa uma mensagem GLM?
Entre 1 e 5 créditos, dependendo da linha. A geração GLM 4 custa 1 ou 2 créditos, o GLM 5 custa 2, mais duas linhas da geração GLM 5 ficam em 3 créditos, e as linhas GLM mais caras custam 5.
Posso usar o GLM no nível gratuito?
Não, não desde 2026-09-02. Contas gratuitas têm 0 créditos e ficam restritas a Whizi AI e Auto, então uma linha GLM responde "This model needs a plan. Start one to use it, or keep chatting with Whizi AI." com o código tier_upgrade_required. O que o nível gratuito compra é 7 mensagens no primeiro dia e 3 por dia depois disso, nessas duas linhas; esgotar um dia retorna free_limit_reached e "Today's free messages are used up. More arrive tomorrow, or start a plan to keep going now." O GLM exige o Powerhouse, que é onde fica o nível de raciocínio de fronteira.
Qual é a janela de contexto do GLM na Whizi?
Antes de qualquer orçamento ser verificado, a entrada medida é multiplicada por 1.8x, porque o estimador de tokens pode subcontar um tokenizador real em até 1.66x em conteúdos como JSON. Por isso, um prompt GLM repleto de dados estruturados é dimensionado maior do que ele literalmente mede. As linhas GLM precificadas carregam janelas de 205K ou 1M tokens, dependendo da linha, e nenhum desses números é o que um turno realmente envia: o orçamento por turno está na seção sobre por que os dois tamanhos de janela chegam ao mesmo resultado.