Los modelos de IA más baratos por respuesta en Whizi, y qué compra un crédito

Respuesta rápida

La fila con el precio más bajo del índice de costos de Whizi es Ling, de inclusionAI, con $0.000053 por responder una vez. Cobra un crédito por mensaje, como el resto de las filas en la parte baja de la escala, y ningún mensaje se cobra nunca menos de un crédito. Una respuesta estándar equivale a 1,000 tokens de entrada más 500 de salida.

La respuesta corta

La fila con el precio más bajo del índice de costos de Whizi es Ling, de inclusionAI, con $0.000053 por responder una vez. Cobra un crédito por mensaje, como el resto de las filas en la parte baja de la escala, y el mínimo por turno garantiza que nunca se cobre menos de uno.

Una fila barata por plan, como entrada a las tablas completas más abajo:

ModeloProveedorCosto por respuestaContextoCréditosPlan
Ling-3.0-flashinclusionAI$0.000053262K1Powerhouse
Llama 3.3 70B InstructMeta$0.00026131K1Pro
GPT-5.6 LunaOpenAI$0.00081M1Starter

Una respuesta estándar en el índice equivale a 1,000 tokens de entrada más 500 de salida, de modo que las tarifas de lista de distintos proveedores se vuelven comparables. Los precios de origen se obtuvieron de OpenRouter el 2026-08-20. El índice fija el precio de 100 filas en 29 proveedores, y 89 de esas filas tienen un cobro en créditos de Whizi. El conjunto de datos completo se publica como el índice de costos de modelos de IA.

Esta página es la franja económica de ese índice. Para el catálogo por plan, consulta la lista de modelos, y para la escala de créditos en sí, consulta la referencia de créditos.

Filas por debajo de una décima de centavo por respuesta

Una selección de las filas que responden una vez por menos de $0.001 al tamaño de respuesta estándar. Todas las filas mostradas aquí, salvo una, cobran un solo crédito.

ModeloProveedorCosto por respuestaContextoCréditosPlan
Ling-3.0-flashinclusionAI$0.000053262K1Powerhouse
Nex-N2-MiniNex Agi$0.000075262K1Powerhouse
Solar Pro 4Upstage$0.00009524K1Powerhouse
Qwen3.7 FlashQwen$0.0000951M1Powerhouse
Granite 4.1 8BIBM$0.0001131K1Powerhouse
Laguna XS 2.1Poolside$0.00012262K1Powerhouse
Phi 4Microsoft$0.0001416K1Powerhouse
Nemotron 3.5 LightningNVIDIA$0.00018262K1Powerhouse
Llama 3.3 70B InstructMeta$0.00026131K1Pro
DeepSeek V4 Flash 0731DeepSeek$0.000281.31M1Powerhouse
Gemini 2.5 Flash LiteGoogle$0.00031M1Pro
DeepSeek V3.2DeepSeek$0.000469164K1Pro
Qwen3 Coder NextQwen$0.00052262K1Powerhouse
Llama 4 MaverickMeta$0.00061M1Pro
DeepSeek V3.1DeepSeek$0.000725164K1Pro
Codestral 2508Mistral$0.00075256K1Powerhouse
Qwen3.6 FlashQwen$0.000751M1Powerhouse
MiniMax M2MiniMax$0.000765205K1Powerhouse
GPT-5.6 LunaOpenAI$0.00081M1Starter
GPT-5.4 NanoOpenAI$0.000825400K2Powerhouse
MiniMax M3MiniMax$0.00091M1Powerhouse
Qwen3.7 PlusQwen$0.000961M1Pro

Varias de las filas más baratas tienen un millón de tokens o más, y la ventana más grande de todo el índice de precios pertenece a una fila cerca del final de la lista de costos. Barato y pequeño no son el mismo eje aquí. La ventana más pequeña mostrada arriba es de 16K.

La mayoría de estas filas están en el plan más caro, por la razón que se explica más abajo.

El siguiente tramo, hasta la mediana del índice

La fila con el precio mediano es una fila de razonamiento de Kimi a $0.00185 por respuesta estándar. Una muestra de las filas entre una décima de centavo y esa mediana:

ModeloProveedorCosto por respuestaContextoCréditosPlan
Gemini 3.1 Flash LiteGoogle$0.0011M1Powerhouse
Muse Glimmer 30BMeta$0.0011131K2Powerhouse
Mistral Large 3 2512Mistral$0.00125262K2Pro
GLM 4.7Z.ai$0.001275205K2Powerhouse
Gemini 3.7 FlashGoogle$0.0013131M2Pro
Mistral Medium 3.1Mistral$0.0014131K2Pro
GLM 4.6Z.ai$0.0015205K1Powerhouse
Gemini 2.5 FlashGoogle$0.001551M2Pro
Gemini 3.5 Flash LiteGoogle$0.001551M2Powerhouse
GLM 5Z.ai$0.00156205K2Pro
Kimi K2 0711Moonshot$0.00172131K10Powerhouse
Kimi K2 ThinkingMoonshot$0.00185262K10Powerhouse

La columna de créditos y la columna de dólares no cubren el mismo conjunto de filas. Once de las 100 filas con precio no tienen ningún cobro en créditos: tienen precio solo para comparar, pero no se ofrecen como una fila medida propia dentro del producto. Por eso, una cifra en dólares del índice no significa por sí sola que esa fila se pueda abrir en el selector.

Por qué la mayoría de las filas más baratas están en Powerhouse

La columna de plan de arriba no es una decisión de precios, es un valor por defecto. El acceso a los modelos se resuelve por identificador: primero los cuatro identificadores de Starter, luego las personas de agente, después una lista explícita de otros 37 identificadores para Pro, y todo lo demás cae en Powerhouse. Una fila barata que nadie promovió nunca a la lista de Pro queda entonces en el nivel superior por defecto, y por eso la parte baja de la lista de costos se lee como una columna de Powerhouse. Ese valor por defecto está documentado en la lista de modelos.

PlanA qué llega en la franja económica
FreeSin asignación de créditos. Solo Whizi AI y Auto, 7 mensajes el primer día y luego 3 al día
StarterCuatro identificadores en total: Auto, Whizi AI, GPT-5.6 Luna, Gemini 3 Flash. Todos cuestan 1 crédito
ProStarter más 37 más, incluidas las filas de DeepSeek, Llama, Gemini Flash, Mistral y Qwen marcadas como Pro arriba
PowerhouseTodo lo demás del catálogo, donde se ubican las filas de laboratorios más pequeños al final de la lista de costos

El nivel gratuito no forma parte de esta comparación en absoluto: desde el 2026-09-02 solo llega a Whizi AI y Auto y nada más, así que ni la fila más barata del índice ni la más cara son accesibles en él. Lo que compra son 7 mensajes el primer día, y luego 3 al día, repartidos entre esas dos filas.

Starter es el plan reducido. Llega a cuatro identificadores, cada uno cobra un solo crédito, así que su asignación de 400 créditos equivale a 400 mensajes. No hay ningún modelo de Anthropic en Starter, ni acceso a las filas baratas de laboratorios más pequeños de las tablas anteriores.

Qué compra un crédito

Un crédito se define como un mensaje en el modelo de la casa, que funciona sobre el modelo base de OpenAI fijado en un crédito. Una prueba de compilación falla si alguno de los dos se sale alguna vez de ese escalón, porque mover cualquiera de los dos redenomina toda la escala.

El cobro es un número entero fijo por id de modelo. En esta franja del catálogo eso significa que una fila de 1 crédito cuesta un crédito sin importar la longitud de entrada o salida: pega un documento largo, deja que la respuesta se extienda, y el turno sigue costando uno.

FilaCosto por respuestaCosto por 1,000 respuestasCréditos
Nemotron 3.5 Lightning$0.00018$0.181
Llama 3.3 70B Instruct$0.00026$0.261
DeepSeek V4 Flash 0731$0.00028$0.281
Gemini 2.5 Flash Lite$0.0003$0.301
DeepSeek V3.2$0.000469$0.4691
Llama 4 Maverick$0.0006$0.601
GPT-5.6 Luna$0.0008$0.801
Qwen3.7 Plus$0.00096$0.961

Convertido en una asignación, el escalón más bajo es el único lugar donde la cifra de créditos y la cifra de mensajes coinciden: cada turno cuesta uno, así que una asignación de plan de N créditos equivale a N mensajes mientras te mantengas en filas de 1 crédito. La asignación por plan, el reinicio y la regla de acumulación están todos en la referencia de créditos.

Otro mecanismo que importa en la franja económica: un turno que no cabe en el saldo restante se rechaza por completo, en lugar de cobrarse parcialmente. Veinte créditos con tres créditos restantes se rechazan, no se descuentan. En un modelo de 1 crédito eso casi nunca ocurre.

De dónde sale un escalón de crédito, y cuándo la política del propietario lo anula

El índice de costos mide una respuesta estándar de 1,000 tokens de entrada más 500 de salida frente a las tarifas de lista de los proveedores. La escala de créditos se deriva de un turno de referencia distinto, 3,000 tokens de entrada y 800 de salida, dividido entre lo que ese mismo turno cuesta en el modelo ancla, que es $0.00156 de gasto de proveedor. El resultado se redondea luego hacia arriba hasta un escalón válido. La escala tiene dieciocho: 1, 2, 3, 4, 5, 6, 8, 10, 12, 15, 20, 25, 30, 40, 50, 60, 80, 100. Catorce tienen hoy al menos un modelo, y los cuatro vacíos se mantienen a propósito, porque un escalón faltante haría que el siguiente modelo más caro se redondeara hasta el escalón de arriba. El redondeo sube cuando un modelo cae entre dos escalones.

Además de eso, algunas filas están fijadas por política del propietario en lugar de por aritmética. Tres ejemplos visibles en las tablas anteriores y en el catálogo más amplio:

  • La familia Kimi cobra 10 créditos frente a tarifas reales de 2, 3, 4 y 12 según la fila. Por eso dos filas de Moonshot quedan casi pegadas en dólares, a $0.00172 y $0.00185, y aun así ambas cobran 10 créditos.
  • La fila de Gemini en Starter cobra 1 crédito frente a un valor real de 2, lo que mantiene a Starter en un crédito plano por mensaje.
  • La fila de GPT Terra cobra 4 créditos frente a un valor real de 10.

Las filas basadas en búsqueda tienen un precio distinto otra vez, porque el proveedor cobra una tarifa fija por búsqueda que no escala con la tarifa por token. Una búsqueda a $0.005 vale 3.2 créditos, así que una sola búsqueda cuesta más que un mensaje completo en la mayor parte del catálogo. Esos escalones son pisos que asumen una búsqueda por respuesta.

Un identificador de modelo sin ningún escalón se cobra deliberadamente en la cima de la escala, 100 créditos: un modelo sin precio debe salir a la luz como un ticket de soporte en lugar de comerse el margen en silencio. Una prueba de compilación falla si algún modelo del catálogo o identificador de agente llega a producción sin un escalón.

Por último, el cobro en créditos se activa por plataforma. Una plataforma en la lista permitida ve multiplicadores reales en el selector y se le cobran contra la asignación de créditos. Una plataforma que no está en esa lista ve un crédito plano por turno y conserva en su lugar la asignación de mensajes anterior, que es de 400 mensajes al mes en Starter, 800 en Pro y 5,000 en Powerhouse. El cliente web usa hoy el sistema de créditos.

Lista de comprobación
  • La fila con el precio más bajo del índice responde una vez por $0.000053
  • Una respuesta estándar es 1,000 tokens de entrada más 500 de salida, con precios de las tarifas de lista de OpenRouter del 2026-08-20
  • Todo cobro tiene un piso de un crédito, así que ningún mensaje cuesta menos de uno
  • La mayoría de las filas más baratas están en Powerhouse, porque todo lo que no está en la lista de Starter o Pro cae en el nivel superior
  • Starter llega a cuatro identificadores y todos cuestan 1 crédito, así que 400 créditos son 400 mensajes
  • Las cuentas gratuitas no tienen asignación de créditos y llegan a dos filas: Whizi AI y Auto
  • El escalón de crédito se deriva de un turno de referencia distinto al de la cifra del índice, y algunos escalones están fijados por política

Preguntas frecuentes

¿Cuál es el modelo de IA más barato en Whizi?

Por costo por respuesta estándar, la fila con el precio más bajo del índice de costos de Whizi es Ling, de inclusionAI, a $0.000053, seguida de Nex, de Nex Agi, Solar Pro, de Upstage, y el nivel rápido de Qwen. Todas cobran un crédito por mensaje. Por lo que realmente pagas, están empatadas con cualquier otra fila de un crédito, incluido el modelo de la casa de Whizi, el modelo base de GPT en Starter y varias filas de DeepSeek, Llama y Gemini.

¿Qué plan necesito para llegar a los modelos más baratos?

Depende de la fila. Varias de las filas más baratas requieren Powerhouse, porque el acceso a los modelos cae al nivel superior para cualquier identificador que no esté en la lista de cuatro elementos de Starter ni en la lista de 37 elementos de Pro. Las filas baratas accesibles en Pro incluyen las entradas de DeepSeek, Llama, Mistral, Qwen y Gemini Flash marcadas como Pro en las tablas de esta página.

¿Un modelo más barato siempre cuesta menos créditos?

No. Las dos cifras se miden de forma distinta. El índice fija el precio de una respuesta estándar de 1,000 de entrada y 500 de salida frente a las tarifas de lista de los proveedores, mientras que el escalón de crédito sale de un turno de referencia de 3,000 de entrada y 800 de salida, redondeado hacia arriba hasta un escalón válido en una escala fija, con algunas filas fijadas por política por encima o por debajo de su aritmética. Por eso una fila a $0.0015 por respuesta puede cobrar un crédito mientras que una fila a $0.000825 cobra dos.

¿Qué pasa con el crédito si una respuesta falla a mitad de camino?

Se devuelve. Una generación que falla o se aborta se reembolsa eliminando su fila de uso, así que el saldo vuelve a donde estaba. El reembolso se identifica con un id de solicitud generado por el servidor, no con nada que aporte el cliente, así que aplicar el mismo reembolso dos veces restaura exactamente un turno y no dos. Una cosa que no se reembolsa: un turno rechazado por falta de cuota igual gasta sus tokens de límite de tasa, porque de lo contrario un cliente sin créditos podría reintentar sin límite.

¿Puedo probar los modelos baratos sin suscripción?

No en una cuenta gratuita, que solo llega a Whizi AI y Auto. Su asignación es de 7 mensajes el primer día, y luego 3 al día, repartidos entre esas dos filas, y reclamar una cuenta de invitado traslada su uso a la cuenta registrada, así que empezar como invitado y registrarse después no te da un día nuevo.