La respuesta corta
La fila con el precio más bajo del índice de costos de Whizi es Ling, de inclusionAI, con $0.000053 por responder una vez. Cobra un crédito por mensaje, como el resto de las filas en la parte baja de la escala, y el mínimo por turno garantiza que nunca se cobre menos de uno.
Una fila barata por plan, como entrada a las tablas completas más abajo:
| Modelo | Proveedor | Costo por respuesta | Contexto | Créditos | Plan |
|---|---|---|---|---|---|
| Ling-3.0-flash | inclusionAI | $0.000053 | 262K | 1 | Powerhouse |
| Llama 3.3 70B Instruct | Meta | $0.00026 | 131K | 1 | Pro |
| GPT-5.6 Luna | OpenAI | $0.0008 | 1M | 1 | Starter |
Una respuesta estándar en el índice equivale a 1,000 tokens de entrada más 500 de salida, de modo que las tarifas de lista de distintos proveedores se vuelven comparables. Los precios de origen se obtuvieron de OpenRouter el 2026-08-20. El índice fija el precio de 100 filas en 29 proveedores, y 89 de esas filas tienen un cobro en créditos de Whizi. El conjunto de datos completo se publica como el índice de costos de modelos de IA.
Esta página es la franja económica de ese índice. Para el catálogo por plan, consulta la lista de modelos, y para la escala de créditos en sí, consulta la referencia de créditos.
Filas por debajo de una décima de centavo por respuesta
Una selección de las filas que responden una vez por menos de $0.001 al tamaño de respuesta estándar. Todas las filas mostradas aquí, salvo una, cobran un solo crédito.
| Modelo | Proveedor | Costo por respuesta | Contexto | Créditos | Plan |
|---|---|---|---|---|---|
| Ling-3.0-flash | inclusionAI | $0.000053 | 262K | 1 | Powerhouse |
| Nex-N2-Mini | Nex Agi | $0.000075 | 262K | 1 | Powerhouse |
| Solar Pro 4 | Upstage | $0.00009 | 524K | 1 | Powerhouse |
| Qwen3.7 Flash | Qwen | $0.000095 | 1M | 1 | Powerhouse |
| Granite 4.1 8B | IBM | $0.0001 | 131K | 1 | Powerhouse |
| Laguna XS 2.1 | Poolside | $0.00012 | 262K | 1 | Powerhouse |
| Phi 4 | Microsoft | $0.00014 | 16K | 1 | Powerhouse |
| Nemotron 3.5 Lightning | NVIDIA | $0.00018 | 262K | 1 | Powerhouse |
| Llama 3.3 70B Instruct | Meta | $0.00026 | 131K | 1 | Pro |
| DeepSeek V4 Flash 0731 | DeepSeek | $0.00028 | 1.31M | 1 | Powerhouse |
| Gemini 2.5 Flash Lite | $0.0003 | 1M | 1 | Pro | |
| DeepSeek V3.2 | DeepSeek | $0.000469 | 164K | 1 | Pro |
| Qwen3 Coder Next | Qwen | $0.00052 | 262K | 1 | Powerhouse |
| Llama 4 Maverick | Meta | $0.0006 | 1M | 1 | Pro |
| DeepSeek V3.1 | DeepSeek | $0.000725 | 164K | 1 | Pro |
| Codestral 2508 | Mistral | $0.00075 | 256K | 1 | Powerhouse |
| Qwen3.6 Flash | Qwen | $0.00075 | 1M | 1 | Powerhouse |
| MiniMax M2 | MiniMax | $0.000765 | 205K | 1 | Powerhouse |
| GPT-5.6 Luna | OpenAI | $0.0008 | 1M | 1 | Starter |
| GPT-5.4 Nano | OpenAI | $0.000825 | 400K | 2 | Powerhouse |
| MiniMax M3 | MiniMax | $0.0009 | 1M | 1 | Powerhouse |
| Qwen3.7 Plus | Qwen | $0.00096 | 1M | 1 | Pro |
Varias de las filas más baratas tienen un millón de tokens o más, y la ventana más grande de todo el índice de precios pertenece a una fila cerca del final de la lista de costos. Barato y pequeño no son el mismo eje aquí. La ventana más pequeña mostrada arriba es de 16K.
La mayoría de estas filas están en el plan más caro, por la razón que se explica más abajo.
El siguiente tramo, hasta la mediana del índice
La fila con el precio mediano es una fila de razonamiento de Kimi a $0.00185 por respuesta estándar. Una muestra de las filas entre una décima de centavo y esa mediana:
| Modelo | Proveedor | Costo por respuesta | Contexto | Créditos | Plan |
|---|---|---|---|---|---|
| Gemini 3.1 Flash Lite | $0.001 | 1M | 1 | Powerhouse | |
| Muse Glimmer 30B | Meta | $0.0011 | 131K | 2 | Powerhouse |
| Mistral Large 3 2512 | Mistral | $0.00125 | 262K | 2 | Pro |
| GLM 4.7 | Z.ai | $0.001275 | 205K | 2 | Powerhouse |
| Gemini 3.7 Flash | $0.001313 | 1M | 2 | Pro | |
| Mistral Medium 3.1 | Mistral | $0.0014 | 131K | 2 | Pro |
| GLM 4.6 | Z.ai | $0.0015 | 205K | 1 | Powerhouse |
| Gemini 2.5 Flash | $0.00155 | 1M | 2 | Pro | |
| Gemini 3.5 Flash Lite | $0.00155 | 1M | 2 | Powerhouse | |
| GLM 5 | Z.ai | $0.00156 | 205K | 2 | Pro |
| Kimi K2 0711 | Moonshot | $0.00172 | 131K | 10 | Powerhouse |
| Kimi K2 Thinking | Moonshot | $0.00185 | 262K | 10 | Powerhouse |
La columna de créditos y la columna de dólares no cubren el mismo conjunto de filas. Once de las 100 filas con precio no tienen ningún cobro en créditos: tienen precio solo para comparar, pero no se ofrecen como una fila medida propia dentro del producto. Por eso, una cifra en dólares del índice no significa por sí sola que esa fila se pueda abrir en el selector.
Por qué la mayoría de las filas más baratas están en Powerhouse
La columna de plan de arriba no es una decisión de precios, es un valor por defecto. El acceso a los modelos se resuelve por identificador: primero los cuatro identificadores de Starter, luego las personas de agente, después una lista explícita de otros 37 identificadores para Pro, y todo lo demás cae en Powerhouse. Una fila barata que nadie promovió nunca a la lista de Pro queda entonces en el nivel superior por defecto, y por eso la parte baja de la lista de costos se lee como una columna de Powerhouse. Ese valor por defecto está documentado en la lista de modelos.
| Plan | A qué llega en la franja económica |
|---|---|
| Free | Sin asignación de créditos. Solo Whizi AI y Auto, 7 mensajes el primer día y luego 3 al día |
| Starter | Cuatro identificadores en total: Auto, Whizi AI, GPT-5.6 Luna, Gemini 3 Flash. Todos cuestan 1 crédito |
| Pro | Starter más 37 más, incluidas las filas de DeepSeek, Llama, Gemini Flash, Mistral y Qwen marcadas como Pro arriba |
| Powerhouse | Todo lo demás del catálogo, donde se ubican las filas de laboratorios más pequeños al final de la lista de costos |
El nivel gratuito no forma parte de esta comparación en absoluto: desde el 2026-09-02 solo llega a Whizi AI y Auto y nada más, así que ni la fila más barata del índice ni la más cara son accesibles en él. Lo que compra son 7 mensajes el primer día, y luego 3 al día, repartidos entre esas dos filas.
Starter es el plan reducido. Llega a cuatro identificadores, cada uno cobra un solo crédito, así que su asignación de 400 créditos equivale a 400 mensajes. No hay ningún modelo de Anthropic en Starter, ni acceso a las filas baratas de laboratorios más pequeños de las tablas anteriores.
Qué compra un crédito
Un crédito se define como un mensaje en el modelo de la casa, que funciona sobre el modelo base de OpenAI fijado en un crédito. Una prueba de compilación falla si alguno de los dos se sale alguna vez de ese escalón, porque mover cualquiera de los dos redenomina toda la escala.
El cobro es un número entero fijo por id de modelo. En esta franja del catálogo eso significa que una fila de 1 crédito cuesta un crédito sin importar la longitud de entrada o salida: pega un documento largo, deja que la respuesta se extienda, y el turno sigue costando uno.
| Fila | Costo por respuesta | Costo por 1,000 respuestas | Créditos |
|---|---|---|---|
| Nemotron 3.5 Lightning | $0.00018 | $0.18 | 1 |
| Llama 3.3 70B Instruct | $0.00026 | $0.26 | 1 |
| DeepSeek V4 Flash 0731 | $0.00028 | $0.28 | 1 |
| Gemini 2.5 Flash Lite | $0.0003 | $0.30 | 1 |
| DeepSeek V3.2 | $0.000469 | $0.469 | 1 |
| Llama 4 Maverick | $0.0006 | $0.60 | 1 |
| GPT-5.6 Luna | $0.0008 | $0.80 | 1 |
| Qwen3.7 Plus | $0.00096 | $0.96 | 1 |
Convertido en una asignación, el escalón más bajo es el único lugar donde la cifra de créditos y la cifra de mensajes coinciden: cada turno cuesta uno, así que una asignación de plan de N créditos equivale a N mensajes mientras te mantengas en filas de 1 crédito. La asignación por plan, el reinicio y la regla de acumulación están todos en la referencia de créditos.
Otro mecanismo que importa en la franja económica: un turno que no cabe en el saldo restante se rechaza por completo, en lugar de cobrarse parcialmente. Veinte créditos con tres créditos restantes se rechazan, no se descuentan. En un modelo de 1 crédito eso casi nunca ocurre.
De dónde sale un escalón de crédito, y cuándo la política del propietario lo anula
El índice de costos mide una respuesta estándar de 1,000 tokens de entrada más 500 de salida frente a las tarifas de lista de los proveedores. La escala de créditos se deriva de un turno de referencia distinto, 3,000 tokens de entrada y 800 de salida, dividido entre lo que ese mismo turno cuesta en el modelo ancla, que es $0.00156 de gasto de proveedor. El resultado se redondea luego hacia arriba hasta un escalón válido. La escala tiene dieciocho: 1, 2, 3, 4, 5, 6, 8, 10, 12, 15, 20, 25, 30, 40, 50, 60, 80, 100. Catorce tienen hoy al menos un modelo, y los cuatro vacíos se mantienen a propósito, porque un escalón faltante haría que el siguiente modelo más caro se redondeara hasta el escalón de arriba. El redondeo sube cuando un modelo cae entre dos escalones.
Además de eso, algunas filas están fijadas por política del propietario en lugar de por aritmética. Tres ejemplos visibles en las tablas anteriores y en el catálogo más amplio:
- La familia Kimi cobra 10 créditos frente a tarifas reales de 2, 3, 4 y 12 según la fila. Por eso dos filas de Moonshot quedan casi pegadas en dólares, a $0.00172 y $0.00185, y aun así ambas cobran 10 créditos.
- La fila de Gemini en Starter cobra 1 crédito frente a un valor real de 2, lo que mantiene a Starter en un crédito plano por mensaje.
- La fila de GPT Terra cobra 4 créditos frente a un valor real de 10.
Las filas basadas en búsqueda tienen un precio distinto otra vez, porque el proveedor cobra una tarifa fija por búsqueda que no escala con la tarifa por token. Una búsqueda a $0.005 vale 3.2 créditos, así que una sola búsqueda cuesta más que un mensaje completo en la mayor parte del catálogo. Esos escalones son pisos que asumen una búsqueda por respuesta.
Un identificador de modelo sin ningún escalón se cobra deliberadamente en la cima de la escala, 100 créditos: un modelo sin precio debe salir a la luz como un ticket de soporte en lugar de comerse el margen en silencio. Una prueba de compilación falla si algún modelo del catálogo o identificador de agente llega a producción sin un escalón.
Por último, el cobro en créditos se activa por plataforma. Una plataforma en la lista permitida ve multiplicadores reales en el selector y se le cobran contra la asignación de créditos. Una plataforma que no está en esa lista ve un crédito plano por turno y conserva en su lugar la asignación de mensajes anterior, que es de 400 mensajes al mes en Starter, 800 en Pro y 5,000 en Powerhouse. El cliente web usa hoy el sistema de créditos.
- La fila con el precio más bajo del índice responde una vez por $0.000053
- Una respuesta estándar es 1,000 tokens de entrada más 500 de salida, con precios de las tarifas de lista de OpenRouter del 2026-08-20
- Todo cobro tiene un piso de un crédito, así que ningún mensaje cuesta menos de uno
- La mayoría de las filas más baratas están en Powerhouse, porque todo lo que no está en la lista de Starter o Pro cae en el nivel superior
- Starter llega a cuatro identificadores y todos cuestan 1 crédito, así que 400 créditos son 400 mensajes
- Las cuentas gratuitas no tienen asignación de créditos y llegan a dos filas: Whizi AI y Auto
- El escalón de crédito se deriva de un turno de referencia distinto al de la cifra del índice, y algunos escalones están fijados por política
Preguntas frecuentes
¿Cuál es el modelo de IA más barato en Whizi?
Por costo por respuesta estándar, la fila con el precio más bajo del índice de costos de Whizi es Ling, de inclusionAI, a $0.000053, seguida de Nex, de Nex Agi, Solar Pro, de Upstage, y el nivel rápido de Qwen. Todas cobran un crédito por mensaje. Por lo que realmente pagas, están empatadas con cualquier otra fila de un crédito, incluido el modelo de la casa de Whizi, el modelo base de GPT en Starter y varias filas de DeepSeek, Llama y Gemini.
¿Qué plan necesito para llegar a los modelos más baratos?
Depende de la fila. Varias de las filas más baratas requieren Powerhouse, porque el acceso a los modelos cae al nivel superior para cualquier identificador que no esté en la lista de cuatro elementos de Starter ni en la lista de 37 elementos de Pro. Las filas baratas accesibles en Pro incluyen las entradas de DeepSeek, Llama, Mistral, Qwen y Gemini Flash marcadas como Pro en las tablas de esta página.
¿Un modelo más barato siempre cuesta menos créditos?
No. Las dos cifras se miden de forma distinta. El índice fija el precio de una respuesta estándar de 1,000 de entrada y 500 de salida frente a las tarifas de lista de los proveedores, mientras que el escalón de crédito sale de un turno de referencia de 3,000 de entrada y 800 de salida, redondeado hacia arriba hasta un escalón válido en una escala fija, con algunas filas fijadas por política por encima o por debajo de su aritmética. Por eso una fila a $0.0015 por respuesta puede cobrar un crédito mientras que una fila a $0.000825 cobra dos.
¿Qué pasa con el crédito si una respuesta falla a mitad de camino?
Se devuelve. Una generación que falla o se aborta se reembolsa eliminando su fila de uso, así que el saldo vuelve a donde estaba. El reembolso se identifica con un id de solicitud generado por el servidor, no con nada que aporte el cliente, así que aplicar el mismo reembolso dos veces restaura exactamente un turno y no dos. Una cosa que no se reembolsa: un turno rechazado por falta de cuota igual gasta sus tokens de límite de tasa, porque de lo contrario un cliente sin créditos podría reintentar sin límite.
¿Puedo probar los modelos baratos sin suscripción?
No en una cuenta gratuita, que solo llega a Whizi AI y Auto. Su asignación es de 7 mensajes el primer día, y luego 3 al día, repartidos entre esas dos filas, y reclamar una cuenta de invitado traslada su uso a la cuenta registrada, así que empezar como invitado y registrarse después no te da un día nuevo.