Usar Llama en Whizi: modelos, coste en créditos y plan

Respuesta rápida

Whizi incluye la familia Llama de Meta en su catálogo, y las tres filas de Llama del conjunto Pro cuestan 1 crédito por mensaje. Pro es el plan que desbloquea el conjunto Llama, y Powerhouse lo incluye. Starter no incluye ningún modelo Llama. Cualquier identificador Llama que el conjunto Pro no nombre pasa a Powerhouse.

La respuesta corta

Sí, Whizi incluye la familia Llama de Meta dentro de su catálogo de más de 280 modelos, y las tres filas de Llama del conjunto Pro se sitúan en el peldaño más barato que Whizi mide: 1 crédito por mensaje. Llama está en el plan Pro, que cuesta $29.99/mes, o $19.99/mes facturado anualmente a $239.88. Starter no incluye ningún modelo Llama.

Las filas de Llama que Whizi tarifica, con el coste en créditos cobrado por mensaje:

ModeloVentana de contextoCoste por respuesta estándarCréditos por mensajePlan mínimo
Llama 4 Maverick1M$0.00061Pro
Llama 3.3 70B Instruct131K$0.000261Pro
Llama 4 ScoutNo incluido en el Índice de CosteNo incluido en el Índice de Coste1Pro

Una respuesta estándar equivale a 1.000 tokens de entrada más 500 de salida, con precios leídos el 2026-08-20, de modo que las cifras se comparan en igualdad de condiciones entre proveedores.

Esos tres identificadores son las filas de Llama nombradas en el conjunto de modelos Pro. Cualquier otro identificador Llama que el catálogo incluya cae en el respaldo de Powerhouse descrito más abajo, así que conviene leer la tabla como la lista de Pro y no como una enumeración completa del catálogo.

Lo que cuesta en créditos un mensaje de Llama

Las tres filas de Llama del conjunto Pro se sitúan en el peldaño más bajo de la escala de créditos, así que un turno de Llama cuesta 1 crédito sea lo que sea lo que envíes. El tercer identificador, Llama 4 Scout, no está incluido en el Índice de Coste, así que la tabla no publica ventana ni precio por respuesta para él, pero la tabla de créditos le cobra 1 crédito igual que a los otros dos.

A 1 crédito por mensaje, la asignación de créditos equivale al número de mensajes de Llama: en la web, Pro compra 2.000 turnos de Llama al mes y Powerhouse compra 8.000. Starter no alcanza ninguna fila de Llama.

PlanCréditos al mes (web)Mensajes al mes fuera de la lista de créditos
Starter400400
Pro2.000800
Powerhouse8.0005.000

La facturación semanal solo se ofrece en móvil, y no en todos los niveles. Donde se vende, las asignaciones semanales de créditos son 100 en Starter y 500 en Pro, y las asignaciones semanales de mensajes son 100 y 400.

Un turno se cobra al peldaño del modelo que lo respondió, así que una conversación que se mueve entre familias se factura por turno según la tarifa de cada modelo que responde. Los créditos no se acumulan: el saldo suma el uso dentro del periodo actual, así que la llegada de un nuevo periodo es en sí misma el reinicio. No hay recarga posible.

Los multiplicadores de crédito solo se cobran en plataformas incluidas en la lista de créditos, que hoy es la app web. Una plataforma fuera de esa lista ve un 1x plano, se cobra uno por turno y conserva la asignación de mensajes anterior en su lugar. En Starter las dos asignaciones son el mismo número, 400. En Pro y Powerhouse no lo son, lo que corresponde a la segunda y tercera columnas de la tabla anterior.

La escala completa, los catorce peldaños ocupados, está en la referencia de créditos.

El límite de plan, con exactitud

El acceso se resuelve en el servidor por identificador (ver la referencia de modelos).

Starter alcanza exactamente cuatro entradas en el selector: Auto, Whizi AI, un modelo de OpenAI y un modelo de Google. Ninguna fila de Llama está entre ellas.

Pro añade el conjunto Llama por encima de Starter. Leído como la regla de curaduría aplicada a una familia, ese conjunto son las filas actuales de Llama 4 más el veterano Llama 3, tres identificadores en total.

Powerhouse incluye todo lo que alcanza Pro, porque la comparación de niveles usa una prueba de mayor o igual, así que un nivel superior siempre satisface un requisito inferior. Powerhouse es también donde cae cualquier identificador del catálogo que no esté nombrado en los conjuntos de Starter o Pro, por lo que un identificador Llama no listado es Powerhouse hasta que se promueva deliberadamente.

Seleccionar un modelo por encima de tu nivel devuelve HTTP 403 con el código tier_upgrade_required y el mensaje "Upgrade your plan to use this model." Ese síntoma está cubierto en cuando un modelo no está disponible.

Las cuentas gratuitas no alcanzan ninguna fila de Llama: desde el 2026-09-02 el nivel gratuito abre Whizi AI y Auto y nada más. La asignación de créditos gratuita es 0, y la asignación de mensajes es 7 mensajes el primer día, luego 3 al día, gastados en esas dos filas.

Ventana de contexto frente a lo que realmente recibe un turno

La ventana de contexto de la tabla anterior es la ventana publicada del modelo. No es el presupuesto con el que corre un solo turno de Whizi.

Cada modelo del catálogo recibe un presupuesto fijo de 40.000 tokens de entrada y 20.000 de salida por turno. Un modelo cuya ventana esté por debajo de 93.000 tokens recibe en su lugar un presupuesto proporcional menor, con la salida limitada al 40 por ciento de la ventana y un margen de seguridad de 1.000 tokens reservado.

Como ambas filas de Llama con precio están por encima del umbral de 93.000 tokens, las dos corren con el mismo presupuesto fijo de 40.000 de entrada y 20.000 de salida. La ventana publicada más grande no aumenta lo que envía un solo turno de Whizi, y el proveedor cuenta el máximo de salida solicitado contra la ventana igual que la entrada, así que la fila de 1M y la de 131K quedan igualadas aquí. Si una conversación supera el presupuesto, consulta cuando una conversación es demasiado larga.

Dónde se sitúan estas filas en el Índice de Coste

El Índice de Coste tarifica 100 filas de 29 proveedores para una respuesta estándar cada una. Ese número es el tamaño del índice de precios, no el tamaño del catálogo de Whizi.

Punto de referenciaCoste por respuesta estándar
Fila más barata con precio en el índice$0.000053
Fila mediana con precio$0.00185
Llama 3.3 70B Instruct$0.00026
Llama 4 Maverick$0.0006
Fila más cara con precio en el índice$0.105

Ambas filas de Llama con precio quedan por debajo de la mediana del índice, y la diferencia entre la fila más barata y la más cara es de aproximadamente 2000x. 89 de las 100 filas con precio llevan un cobro en créditos de Whizi; el resto tiene precio a modo de comparación pero no se ofrece como fila medida propia.

Para qué no se usa Llama en Whizi

Ninguna fila de Llama está en la escala de Auto. Auto tiene seis peldaños, y los modelos en ellos son el modelo de la casa para preguntas cortas, una fila de Gemini Flash para reescrituras y otra vez para adjuntos, una fila de GPT para textos largos, una fila de Claude Sonnet para código y una segunda fila de GPT para razonamiento en varios pasos. Ningún identificador Llama aparece en ninguno de los seis, así que Auto nunca llega a Llama en ningún nivel y una respuesta de Llama siempre es una elección manual en el selector de modelos.

Los adjuntos en Auto van a otro sitio. Auto dirige cualquier turno que lleve un adjunto a Gemini Flash, con el razonamiento de que una imagen necesita visión más que una ventana grande. Si eliges tú mismo una fila de Llama, el adjunto se gestiona por solicitud en lugar de por modelo. En la app, se reenvía al modelo en el que esté el turno, y solo se reenvía el mensaje de usuario más reciente que lleve adjuntos. En la web, un archivo PDF, Word u hoja de cálculo tiene su texto extraído en el navegador, y ese texto es lo que llega al modelo.

La voz y la generación de medios no son elecciones por modelo. Los generadores de medios se saltan por completo el límite por modelo y se organizan por nivel según la sección del selector, y el modo de voz corre sobre su propia ruta en tiempo real, así que elegir una fila de Llama no cambia ninguna de las dos cosas.

Whizi no publica el soporte de visión por modelo. No existe ningún indicador de capacidad de visión o multimodal en ningún sitio del catálogo ni del índice de coste, así que Whizi no puede decirte qué fila de Llama lee una imagen. Las partes de imagen se reenvían al modelo en el que esté el turno, y el resultado depende de ti y del modelo.

Lista de comprobación
  • Llama está en el catálogo y las tres filas del conjunto Pro cuestan 1 crédito por mensaje
  • Pro es el plan que desbloquea el conjunto Llama, y Powerhouse lo incluye
  • Starter no incluye ningún modelo Llama
  • Una cuenta gratuita no alcanza ninguna fila de Llama: Pro es el plan más bajo que sí lo hace
  • Un turno de Llama corre con el presupuesto fijo de 40.000 tokens de entrada y 20.000 de salida, porque ambas filas con precio están por encima del umbral de 93.000 tokens
  • Ninguna fila de Llama está en ninguno de los seis peldaños de Auto, así que Llama siempre es una elección manual
  • Whizi no publica un indicador de visión por modelo, así que no puede decirte qué fila de Llama lee una imagen

Preguntas frecuentes

¿Qué modelos Llama incluye Whizi?

El conjunto de modelos Pro nombra tres identificadores Llama: las dos variantes de Llama 4 más el veterano Llama 3, y las tres cuestan 1 crédito por mensaje. Dos de ellas tienen precio en el Índice de Coste de Whizi, con ventanas de contexto publicadas de 1M y 131K. El catálogo puede incluir más identificadores Llama, y cualquiera no nombrado en los conjuntos de Starter o Pro requiere Powerhouse.

¿Cuántos créditos cuesta un mensaje de Llama?

Un crédito, que es el peldaño más bajo de la escala y lo mismo que un mensaje en el modelo de la casa de Whizi. Ni Starter ni el nivel gratuito abren ninguna fila de Llama, así que Pro es el primer plan donde ese 1 crédito compra algo aquí.

¿Necesito el plan más alto para usar Llama?

No. Pro es el plan más barato que abre una fila de Llama, a $29.99/mes. Starter no llega a ninguna, Powerhouse solo hace falta para un identificador Llama que el conjunto Pro no nombre, y una cuenta gratuita no alcanza ninguna de ellas: funciona con Whizi AI y Auto.

¿Puedo cambiar una conversación de Llama a otro modelo?

Sí. Cada turno se cobra al peldaño del modelo que lo respondió, así que una conversación que se mueve entre familias se factura por turno a la tarifa de cada una, no al nivel de la conversación completa. Un modelo nunca desaparece del catálogo una vez ofrecido, porque una conversación conserva el modelo con el que se creó, así que un hilo antiguo de Llama sigue abriéndose después. Los detalles están en cambiar de modelo a mitad de conversación.

¿Qué puedo adjuntar a un turno de Llama?

Los adjuntos se gestionan por solicitud en lugar de por modelo, y no cuestan créditos propios. Los límites son 10 MB por archivo, 4 adjuntos por mensaje y 20 MB en total por mensaje. Los tipos aceptados son JPEG, PNG, WebP, GIF, PDF, texto plano, Markdown, CSV y JSON.

¿Funciona la búsqueda web con Llama?

Whizi no publica una lista de búsqueda web por modelo. La búsqueda es un ajuste por solicitud con tres modos, desactivada, sondeo y nativa, en lugar de un indicador de capacidad por modelo, y la matriz por modelo nunca se ha enumerado, así que no hay una respuesta específica para Llama que dar. El propio ajuste está cubierto en búsqueda web.