Usar GLM en Whizi: una fila en Pro, el resto en Powerhouse

Respuesta rápida

GLM está en el catálogo de Whizi, con filas de Z.ai con precio en las generaciones GLM 4 y GLM 5. Una fila, GLM 5, se desbloquea en Pro por 2 créditos por mensaje, y todas las demás filas de GLM requieren Powerhouse. Starter no incluye ningún modelo GLM. Un mensaje de GLM cuesta entre 1 y 5 créditos.

La respuesta corta

Sí, GLM está en el catálogo de Whizi. Las filas de Z.ai tienen precio en las generaciones GLM 4 y GLM 5, una fila se desbloquea en el plan Pro por 2 créditos por mensaje, y todas las demás filas de GLM requieren Powerhouse.

ModeloVentana de contextoCréditos por mensajePlan requerido
GLM 4.6205K1Powerhouse
GLM 4.7205K2Powerhouse
GLM 5205K2Pro
GLM 5.1no está en el índice de precios3Powerhouse
GLM 5.21M3Powerhouse
GLM 5.31M5Powerhouse
GLM 5 Turbono está en el índice de precios5Powerhouse
GLM 5V Turbono está en el índice de precios5Powerhouse

Un identificador de GLM que no aparece aquí sigue teniendo un nivel de créditos y sigue requiriendo Powerhouse.

Las cuentas gratuitas están limitadas a dos modelos, Whizi AI y Auto, así que ninguna fila de GLM es accesible en una cuenta gratuita. La asignación gratuita en sí es de 7 mensajes el primer día y 3 al día después de eso, gastados en esos dos modelos. Esto cambió el 2026-09-02: antes, la ruta de chat para el nivel gratuito se resolvía antes de que se ejecutara el bloqueo por modelo, y ahora el bloqueo se ejecuta primero.

La única fila en Pro no es la más barata

Pro se resuelve exactamente en un identificador de Z.ai, GLM 5, a 2 créditos por mensaje. La regla de curación sobre la que se construye la lista de Pro está descrita en la referencia de modelos, y en esta familia recae en una sola fila, que es la razón por la que el resto de la generación queda un nivel más arriba.

Esa única fila no es la barata. La fila de GLM más barata en créditos cuesta 1 crédito por mensaje y requiere Powerhouse, mientras que la fila de Pro cuesta el doble. El costo en créditos y el nivel de plan son dos decisiones separadas en Whizi, y ninguna predice a la otra.

Starter no incluye ningún modelo GLM. Starter alcanza exactamente cuatro entradas del selector: Auto, el modelo de la casa, un modelo de OpenAI y un modelo de Google. Cada uno de ellos es una fila de 1x o 2x, que es la razón por la que la asignación de créditos de Starter y la asignación de mensajes de Starter son el mismo número.

Powerhouse cubre el resto, por nombre en un caso y por defecto en todos los demás. La fila de razonamiento de frontera en la generación GLM 5 se menciona explícitamente entre los modelos reservados para Powerhouse, junto con una fila de Grok, la fila de pensamiento de Qwen, la fila de pensamiento de Kimi y otras. Cada fila de GLM restante recae en el nivel superior porque cualquier identificador que no esté en el conjunto de Starter ni en la lista explícita de Pro se resuelve ahí.

El bloqueo se aplica en el servidor, no en la interfaz. Elegir un modelo por encima de tu nivel devuelve HTTP 403 con el código tier_upgrade_required y el mensaje "Upgrade your plan to use this model." Si te encuentras con esto en una fila de GLM, consulta por qué un modelo aparece como no disponible.

El par GLM 4, donde el nivel y el costo de ejecución no coinciden

En el par GLM 4 las dos columnas no coinciden. La fila que es más barata por respuesta estándar carga el nivel más alto, y su par carga el más bajo. Un nivel se mide en un turno de referencia de 3,000 tokens de entrada y 800 de salida, la cifra índice sobre una respuesta estándar de 1,000 más 500, y dos filas cuyas tarifas de entrada y salida tienen pesos distintos pueden intercambiar posiciones entre esas dos combinaciones. El método de nivel está en la referencia de créditos.

ModeloCosto por respuesta estándarCosto por mil respuestasCréditos por mensaje
GLM 4.7$0.001275$1.2752
GLM 4.6$0.0015$1.501
GLM 5$0.00156$1.562
GLM 5.2$0.002484$2.4843
GLM 5.3$0.0036$3.605

El índice de costos de Whizi pone precio a 100 filas de OpenRouter en una unidad idéntica para poder comparar proveedores: una respuesta estándar de 1,000 tokens de entrada más 500 de salida. Los precios de origen se obtuvieron de OpenRouter el 2026-08-20, entre 29 proveedores.

Para tener escala: la fila con precio mediano en el índice es $0.00185 por respuesta estándar, la más barata es $0.000053 y la más cara es $0.105, una diferencia de aproximadamente 2000x. Tres de las cinco filas de GLM con precio quedan por debajo de esa mediana, y dos quedan por encima.

Las filas marcadas "no está en el índice de precios" en la tabla de arriba tienen un cargo en créditos en el producto, pero no están entre las 100 filas que el índice de costos evalúa, así que no hay una cifra por respuesta que publicar para ellas.

Qué gasta un mensaje de GLM de tu asignación

Un crédito equivale a un mensaje en el modelo de la casa, y el costo en créditos es fijo por mensaje según la fila que elijas, no según la longitud. El método está en la referencia de créditos. Lo que esto significa para esta familia: las filas de GLM listadas al principio de esta página abarcan una sola banda de 1 crédito a 5, así que la más cara de ellas cuesta exactamente cinco veces la más barata, y toda la familia queda dentro de los cinco niveles más bajos de una escalera de dieciocho niveles.

PlanPrecioCréditos al mesMensajes en la fila de GLM de Pro (2 créditos)Mensajes en la fila de GLM más cara (5 créditos)
Starter$15.99/mes, o $10.99/mes facturado anualmente a $131.88400sin fila de GLM en este plansin fila de GLM en este plan
Pro$29.99/mes, o $19.99/mes facturado anualmente a $239.882,0001,000no disponible en este plan
Powerhouse$49.99/mes, o $34.99/mes facturado anualmente a $419.888,0004,0001,600

En Powerhouse, la fila de GLM de 1 crédito compra 8,000 mensajes de una asignación de 8,000 créditos, y las filas de 3 créditos compran 2,666. Los créditos no se acumulan de un período a otro: el uso se suma contra una clave de período, así que la llegada de un nuevo período es en sí el reinicio.

Un turno de GLM que no cabe en el saldo restante se rechaza por completo en lugar de cobrarse en parte. Esto es deliberado, porque cobrar 3 créditos por una fila de 5 créditos haría que un mismo modelo costara distintas cantidades según cuándo se envió.

El precio en créditos se controla por plataforma mediante una lista de permitidos cuyo valor en producción hoy es el cliente web. Fuera de esa lista, el selector no muestra ninguna insignia de créditos, y cada turno cuesta uno contra la asignación de mensajes anterior en lugar de un nivel contra la asignación de créditos.

Por qué las filas de 205K y las de 1M tienen el mismo tamaño

Una fila de GLM con una ventana de 1M y una fila de GLM con una ventana de 205K obtienen el mismo espacio dentro de Whizi. Ambas están por encima del umbral de 93,000 tokens, y todo modelo del catálogo por encima de ese umbral obtiene un presupuesto fijo de 40,000 tokens de entrada y 20,000 de salida por turno, lo cual es cierto para toda fila de GLM que el índice de costos evalúa. Los modelos por debajo del umbral obtienen en cambio un presupuesto proporcional más pequeño, descrito en cuándo una conversación es demasiado larga.

Así que pasar a la ventana más grande no compra un prompt más largo. Lo que compra es margen del lado del proveedor, ya que OpenRouter cuenta la entrada más la salida máxima solicitada contra la ventana, en lugar de solo la entrada.

Mover un hilo a GLM y de regreso

Auto no te lleva a GLM. Auto no tiene un nivel propio, y su escalera son seis rutas fijas entre cinco modelos: el modelo de la casa para preguntas cortas, una fila rápida de Google para reescrituras y adjuntos, una fila de OpenAI para textos largos, una fila de Anthropic para código, y una fila de razonamiento de OpenAI para razonamiento en varios pasos. Ninguna fila de GLM está en esa escalera, así que un turno solo llega a GLM cuando tú lo eliges.

Cada fila de modelo que se sirve al cliente web lleva su señal de costo, así que el precio en créditos de una fila de GLM es visible antes de enviar, no después.

Un hilo de GLM que abriste hace meses todavía se abre hoy, porque una conversación conserva el identificador con el que se creó incluso después de que el selector haya pasado a filas más nuevas.

Sea cual sea la dirección en la que te muevas, el cargo sigue al modelo que realmente respondió el turno, no al modelo con el que empezó la conversación.

Dónde no aparece GLM

La generación de medios no usa GLM. La sección de generación de imágenes son cuatro filas fijas, la generación de video es una sola fila, y la generación de audio es una sola fila, todas ellas generadores de la casa o de socios, así que ninguna fila de GLM interviene al generar una imagen, un video o música.

No hay una marca de visión por modelo que citar. Whizi no lleva registro de qué modelos pueden leer imágenes. Los adjuntos se manejan por solicitud, no por modelo, y en el cliente web el texto de un archivo PDF, Word o de hoja de cálculo se extrae en el navegador antes de enviar nada. Consulta tipos de archivo compatibles para ver qué significa esto en la práctica.

La búsqueda web es un interruptor a nivel de solicitud, no una capacidad del modelo. La búsqueda funciona en uno de tres modos, y activarla afecta la solicitud en lugar de seleccionar un modelo distinto, así que no existe una lista publicada de qué filas de GLM pueden o no navegar.

Los personajes de agente no son GLM. Los cuatro personajes de agente son una función de Pro, no un nivel de modelo, y todos ellos funcionan sobre el mismo modelo base, así que elegir un personaje nunca dirige un turno a Z.ai.

Lista de comprobación
  • Whizi pone precio a los modelos GLM de Z.ai en las generaciones GLM 4 y GLM 5
  • GLM 5 es la única fila de GLM accesible en Pro, a 2 créditos por mensaje
  • Cada otra fila de GLM requiere Powerhouse
  • Starter no incluye ningún modelo GLM
  • Las cuentas gratuitas no alcanzan ninguna fila de GLM: el nivel gratuito solo ejecuta Whizi AI y Auto
  • El costo en créditos es fijo por mensaje y no varía con la longitud
  • Cada fila de GLM que el índice de costos evalúa funciona con el presupuesto fijo de 40,000 tokens de entrada y 20,000 de salida
  • Auto nunca dirige un turno a una fila de GLM

Preguntas frecuentes

¿GLM está incluido en Whizi?

Sí. Las filas de GLM están en la sección Todos los modelos del selector, bajo el logotipo del proveedor Z.ai en lugar del ícono genérico que reciben la mayoría de los laboratorios más pequeños. No están en la sección Recomendados, que son cinco filas fijas y no incluye ninguna entrada de GLM, así que explora Todos los modelos en vez de la parte superior del selector para encontrarlas.

¿Qué plan de Whizi necesito para usar GLM?

Pro alcanza una fila de GLM, GLM 5. Todo lo demás en la familia es Powerhouse. Si envías en una fila que tu nivel no incluye, el servidor responde HTTP 403 con un cuerpo JSON con la forma {"error": {"code": "tier_upgrade_required", "message": "Upgrade your plan to use this model."}}, y el sitio web vuelve a envolver eso en su par de código y mensaje anteriores antes de que la página de chat lo lea, así que la frase que ves en pantalla es la cadena del backend tal cual, no una reescritura del cliente.

¿Cuántos créditos cuesta un mensaje de GLM?

Entre 1 y 5 créditos según la fila. La generación GLM 4 cuesta 1 o 2 créditos, GLM 5 cuesta 2, dos filas más en la generación GLM 5 quedan en 3 créditos, y las filas de GLM más caras cuestan 5.

¿Puedo usar GLM en el nivel gratuito?

No, no desde el 2026-09-02. Las cuentas gratuitas llevan 0 créditos y están limitadas a Whizi AI y Auto, así que una fila de GLM responde "This model needs a plan. Start one to use it, or keep chatting with Whizi AI." con el código tier_upgrade_required. Lo que el nivel gratuito sí compra es 7 mensajes el primer día y 3 al día después de eso en esos dos modelos; agotar un día devuelve free_limit_reached y "Today's free messages are used up. More arrive tomorrow, or start a plan to keep going now." GLM necesita Powerhouse, que es donde se ubica el nivel de razonamiento de frontera.

¿Cuál es la ventana de contexto de GLM en Whizi?

Antes de que se revise cualquier presupuesto, la entrada medida se escala por 1.8x, porque el estimador de tokens puede subcontar un tokenizador real hasta por 1.66x en contenido como JSON. Un prompt de GLM cargado de datos estructurados se dimensiona por lo tanto más grande de lo que mide literalmente. Las filas de GLM con precio llevan ventanas de 205K o 1M tokens según la fila, y ninguna de esas cifras es lo que envía un solo turno: el presupuesto por turno está en la sección sobre por qué los dos tamaños de ventana resultan iguales.