La misma respuesta cuesta 2000 veces más en un modelo que en otro.

Los proveedores publican el precio por millón de tokens, algo que no se puede comparar entre modelos. Este índice calcula el precio de una respuesta estándar, 1000 tokens de entrada más 500 tokens de salida, en 100 modelos de 29 proveedores. Actualizado el 20 de agosto de 2026.

Cifras principales

  • Respuesta más barata: $0.000053 en Ling-3.0-flash (inclusionAI).
  • Respuesta mediana: $0.0019 en Kimi K2 Thinking.
  • Respuesta más cara: $0.105 en Claude Opus 4.7 (Fast) (Anthropic).
  • Diferencia de la más barata a la más cara: unas 2000 veces.

Cómo se calcula

Una respuesta estándar son 1000 tokens de entrada, más o menos un prompt con un par de párrafos de contexto, y 500 tokens de salida, más o menos una respuesta sustancial. Todos los modelos se calculan sobre esa misma carga de trabajo: (tarifa de entrada x 1000 + tarifa de salida x 500) dividido entre 1.000.000.

Cambia la proporción y el orden cambia con ella, que es justo la idea: un modelo con entrada barata y salida cara gana en prompts cortos y pierde en respuestas largas. La fórmula es pública para que puedas recalcularla con tu propia proporción.

Fuentes y límites

  • Los precios son tarifas públicas de lista del catálogo de modelos de OpenRouter, en dólares por millón de tokens, obtenidas el 20 de agosto de 2026.
  • No incluyen descuentos por caché de prompt, precios por lotes ni tarifas negociadas por volumen. Las facturas reales a escala salen más bajas.
  • El coste no es la calidad. Un modelo 2000 veces más barato no es 2000 veces peor, y en muchas tareas del día a día la diferencia es pequeña.
  • La columna de créditos es lo que Whizi cobra por mensaje en sus propios planes, mostrada para los 89 modelos que mide de forma individual. No es una tarifa del proveedor.

El índice completo

100 modelos, del más barato al más caro. Libre para reutilizar con atribución al Whizi AI Model Cost Index y un enlace a esta página. Datos en bruto: JSON y CSV.

#ModeloProveedorPor respuestaPor 1.000 respuestas$ / 1M entrada$ / 1M salidaContextoCréditos de Whizi
1Ling-3.0-flashinclusionAI$0.000053$0.052$0.021$0.063262K1x
2Nex-N2-MiniNex Agi$0.000075$0.075$0.025$0.1262K1x
3Solar Pro 4Upstage$0.000090$0.090$0.03$0.12524K1x
4Qwen3.7 FlashQwen$0.000095$0.095$0.03$0.131M1x
5Granite 4.1 8BIbm Granite$0.000100$0.100$0.05$0.1131K1x
6Laguna XS 2.1Poolside$0.000120$0.120$0.06$0.12262K1x
7Hy-MT2-1.8BTencent$0.000133$0.133$0.044$0.1778Ksin medición
8Phi 4Microsoft$0.000140$0.140$0.07$0.1416K1x
9Nemotron 3.5 LightningNVIDIA$0.000180$0.180$0.08$0.2262K1x
10Laguna S 2.1Poolside$0.000180$0.180$0.09$0.181M1x
11Hy-MT2-30B-A3BTencent$0.000222$0.222$0.074$0.2958Ksin medición
12Llama 3.3 70B InstructMeta$0.000260$0.260$0.1$0.32131K1x
13DeepSeek V4 Flash 0731DeepSeek$0.000280$0.280$0.14$0.281M1x
14Gemini 2.5 Flash LiteGoogle$0.000300$0.300$0.1$0.41M1x
15Ring-2.6-1TinclusionAI$0.000388$0.388$0.075$0.625262K1x
16Hy3Tencent$0.000396$0.396$0.132$0.528262K1x
17KAT-Coder-Air V2.5Kwaipilot$0.000450$0.450$0.15$0.6256K1x
18DeepSeek V3.2DeepSeek$0.000469$0.469$0.269$0.4164K1x
19Qwen3 Coder NextQwen$0.000520$0.520$0.12$0.8262K1x
20Llama 4 MaverickMeta$0.000600$0.600$0.2$0.81M1x
21Qwen3.6 35B A3BQwen$0.000640$0.640$0.14$1262K1x
22DeepSeek V3.1DeepSeek$0.000725$0.725$0.25$0.95164K1x
23Codestral 2508Mistral$0.000750$0.750$0.3$0.9256K1x
24Qwen3.6 FlashQwen$0.000750$0.750$0.1875$1.1251M1x
25Nex-N2-ProNex Agi$0.000750$0.750$0.25$1262K1x
26MiniMax M2MiniMax$0.000765$0.765$0.255$1.02205K1x
27Step 3.7 FlashStepfun$0.000775$0.775$0.2$1.15262K1x
28GPT-5.6 Luna ProOpenAI$0.000800$0.800$0.2$1.21Msin medición
29GPT-5.6 LunaOpenAI$0.000800$0.800$0.2$1.21M1x
30GPT-5.4 NanoOpenAI$0.000825$0.825$0.2$1.25400K2x
31MiniMax M3MiniMax$0.000900$0.900$0.3$1.21M1x
32LongCat 2.0Meituan$0.000900$0.900$0.3$1.21M1x
33Perceptron Mk1Perceptron$0.000900$0.900$0.15$1.533K1x
34Qwen3.7 PlusQwen$0.000960$0.960$0.32$1.281M1x
35Nano Banana 2 Lite (Gemini 3.1 Flash Lite Image)Google$0.0010$1.000$0.25$1.566Ksin medición
36Gemini 3.1 Flash LiteGoogle$0.0010$1.000$0.25$1.51M1x
37Inkling SmallThinkingmachines$0.0010$1.050$0.45$1.2524K1x
38Muse Glimmer 30BMeta$0.0011$1.100$0.35$1.5131K2x
39Qwen3.5 Plus 2026-04-20Qwen$0.0012$1.200$0.3$1.81M1x
40Mistral Large 3 2512Mistral$0.0013$1.250$0.5$1.5262K2x
41GLM 4.7Z.ai$0.0013$1.275$0.4$1.75205K2x
42Gemini 3.7 FlashGoogle$0.0013$1.313$0.375$1.8751M2x
43Mistral Medium 3.1Mistral$0.0014$1.400$0.4$2131K2x
44Aion-3.0-MiniAion Labs$0.0014$1.400$0.7$1.4131K2x
45GLM 4.6Z.ai$0.0015$1.500$0.5$2205K1x
46Gemini 2.5 FlashGoogle$0.0015$1.550$0.3$2.51M2x
47Gemini 3.5 Flash LiteGoogle$0.0015$1.550$0.3$2.51M2x
48GLM 5Z.ai$0.0016$1.560$0.6$1.92205K2x
49Kimi K2 0711Moonshot$0.0017$1.720$0.57$2.3131K10x
50Seed 2.1 TurboBytedance Seed$0.0018$1.750$0.5$2.5262K2x
51Kimi K2 ThinkingMoonshot$0.0019$1.850$0.6$2.5262K10x
52R1DeepSeek$0.0019$1.950$0.7$2.564K2x
53Seed-2.0-CodeBytedance Seed$0.0020$2.000$0.5$3262K3x
54Nano Banana 2 (Gemini 3.1 Flash Image)Google$0.0020$2.000$0.5$3131Ksin medición
55Grok Build 0.1xAI$0.0020$2.000$1$2256K3x
56Qwen3.8 27BQwen$0.0021$2.050$0.45$3.21M3x
57KAT-Coder-Pro V2.5Kwaipilot$0.0022$2.220$0.74$2.96256K3x
58Nova Pro 1.0Amazon$0.0024$2.400$0.8$3.2300K3x
59Nemotron 3 UltraNVIDIA$0.0024$2.400$0.6$3.6512K3x
60Kimi K2.7 CodeMoonshot$0.0025$2.460$0.71$3.5262K10x
61GLM 5.2Z.ai$0.0025$2.484$0.966$3.0361M3x
62Grok 4.3xAI$0.0025$2.500$1.25$2.51M4x
63Gemini 3.6 FlashGoogle$0.0026$2.625$0.75$3.751M3x
64Sakana NamazuSakana$0.0029$2.950$0.95$4262K4x
65DeepSeek V4 Pro 0813DeepSeek$0.0030$2.970$1.188$3.5641M2x
66InklingThinkingmachines$0.0030$2.975$0.95$4.051M4x
67GPT-5.4 MiniOpenAI$0.0030$3.000$0.75$4.5400K4x
68Muse Spark 1.2Meta$0.0034$3.375$1.25$4.251M5x
69Muse Spark 1.1Meta$0.0034$3.375$1.25$4.251M5x
70Claude Haiku 4.5Anthropic$0.0035$3.500$1$5200K4x
71GLM 5.3Z.ai$0.0036$3.600$1.4$4.41M5x
72Qwen3.7 MaxQwen$0.0037$3.688$1.475$4.4251M5x
73Grok 4.5xAI$0.0050$5.000$2$6500K6x
74Qwen3.8 MaxQwen$0.0050$5.000$2$61M6x
75Qwen3.8 2.4T A95BQwen$0.0050$5.000$2$61M8x
76Grok 4.6xAI$0.0050$5.000$2$6500K6x
77Mistral Medium 3.5Mistral$0.0053$5.250$1.5$7.5262K6x
78Gemini 3.5 FlashGoogle$0.0060$6.000$1.5$91M8x
79Aion-3.0Aion Labs$0.0060$6.000$3$6131K10x
80Claude Sonnet 5Anthropic$0.0070$7.000$2$101M10x
81Command ACohere$0.0075$7.500$2.5$10256K10x
82Gemini 3.1 Pro PreviewGoogle$0.0080$8.000$2$121M10x
83GPT-5.6 Terra ProOpenAI$0.0080$8.000$2$121Msin medición
84GPT-5.6 TerraOpenAI$0.0080$8.000$2$121M4x
85Nano Banana Pro (Gemini 3 Pro Image)Google$0.0080$8.000$2$12131Ksin medición
86GPT-5.4OpenAI$0.010$10.000$2.5$151M15x
87GPT-5.6 Sol ProOpenAI$0.010$10.000$2.5$151Msin medición
88GPT-5.6 SolOpenAI$0.010$10.000$2.5$151M20x
89Claude Sonnet 4.6Anthropic$0.011$10.500$3$151M10x
90Claude Sonnet 4.5Anthropic$0.011$10.500$3$151M10x
91Kimi K3Moonshot$0.011$10.500$3$151M10x
92Claude Opus 5Anthropic$0.018$17.500$5$251M20x
93Claude Opus 4.8Anthropic$0.018$17.500$5$251M20x
94GPT-5.5OpenAI$0.020$20.000$5$301M20x
95GPT Chat LatestOpenAI$0.020$20.000$5$30400K25x
96Fugu UltraSakana$0.020$20.000$5$301M25x
97Claude Opus 5 (Fast)Anthropic$0.035$35.000$10$501Msin medición
98Claude Fable 5Anthropic$0.035$35.000$10$501M50x
99Claude Opus 4.8 (Fast)Anthropic$0.035$35.000$10$501Msin medición
100Claude Opus 4.7 (Fast)Anthropic$0.105$105.000$30$1501Msin medición

Preguntas

¿Por qué poner precio a una respuesta y no a un millón de tokens?

Porque nadie compra un millón de tokens. Los proveedores cobran entrada y salida por separado con tarifas distintas, así que dos modelos pueden parecer cercanos por millón y separarse mucho en la misma tarea real. Poner precio a una carga de trabajo fija hace que los números sean comparables.

¿Qué modelo da mejor relación calidad-precio?

Depende de la tarea. La lectura útil es que el centro de esta tabla se mueve en unas centésimas de céntimo por respuesta, así que para la mayor parte del trabajo diario la diferencia de precio entre buenos modelos es insignificante y la elección debería hacerse por la calidad de la respuesta.

¿Cada cuánto se actualiza?

Los precios se refrescan desde el catálogo del proveedor y la página lleva la fecha de obtención, ahora mismo 20 de agosto de 2026. Las tarifas de este mercado se mueven a menudo, así que mira la fecha antes de citar una cifra.

¿Qué son los créditos de Whizi?

Whizi descuenta cada mensaje de una cuota mensual, y los modelos caros cuestan más créditos que los baratos, de 1x hasta 20x. La columna muestra ese multiplicador para que veas cómo la tarifa de lista de un proveedor se traduce en una suscripción fija.

Cómo citar esto

Un conjunto de datos solo se reutiliza si es fácil de acreditar, así que esta es la línea para copiar:

Whizi AI Model Cost Index, prices as of 2026-08-20. https://whizi.io/es/tools/model-cost-index/

Publicado bajo CC BY 4.0, que permite el uso comercial siempre que se nombre el índice y se enlace esta página. Quien necesite comprobar una cifra antes de publicar puede escribir a los responsables a [email protected].

Siguiente paso

Calcula el precio de tu propio texto con la Calculadora de coste de tokens o compara los planes en precios de Whizi.