A mesma resposta custa 2.000 vezes mais em um modelo do que em outro.

Os provedores publicam o preço por milhão de tokens, o que não dá para comparar entre modelos. Este índice calcula o preço de uma resposta padrão, 1.000 tokens de entrada mais 500 tokens de saída, em 100 modelos de 29 provedores. Atualizado em 20 de agosto de 2026.

Números principais

  • Resposta mais barata: $0.000053 no Ling-3.0-flash (inclusionAI).
  • Resposta mediana: $0.0019 no Kimi K2 Thinking.
  • Resposta mais cara: $0.105 no Claude Opus 4.7 (Fast) (Anthropic).
  • Diferença da mais barata para a mais cara: cerca de 2.000 vezes.

Como isto é calculado

Uma resposta padrão são 1.000 tokens de entrada, mais ou menos um prompt com uns dois parágrafos de contexto, e 500 tokens de saída, mais ou menos uma resposta substancial. Todos os modelos são precificados sobre essa mesma carga de trabalho: (tarifa de entrada x 1.000 + tarifa de saída x 500) dividido por 1.000.000.

Mude a proporção e a ordem muda junto, e é justamente esse o ponto: um modelo com entrada barata e saída cara ganha em prompts curtos e perde em respostas longas. A fórmula é pública para você recalcular tudo com a sua própria proporção.

Fontes e limites

  • Os preços são tarifas públicas de tabela do catálogo de modelos da OpenRouter, em dólares por milhão de tokens, coletadas em 20 de agosto de 2026.
  • Eles não incluem descontos de cache de prompt, preços de lote nem valores negociados por volume. Contas reais em escala saem mais baratas.
  • Custo não é qualidade. Um modelo 2.000 vezes mais barato não é 2.000 vezes pior, e em muitas tarefas do dia a dia a diferença é pequena.
  • A coluna de créditos é o que o Whizi cobra por mensagem nos seus próprios planos, mostrada para os 89 modelos que ele mede individualmente. Não é uma tarifa do provedor.

O índice completo

100 modelos, do mais barato ao mais caro. Livre para reutilizar com atribuição ao Whizi AI Model Cost Index e um link para esta página. Dados brutos: JSON e CSV.

#ModeloProvedorPor respostaPor 1.000 respostas$ / 1M entrada$ / 1M saídaContextoCréditos Whizi
1Ling-3.0-flashinclusionAI$0.000053$0.052$0.021$0.063262K1x
2Nex-N2-MiniNex Agi$0.000075$0.075$0.025$0.1262K1x
3Solar Pro 4Upstage$0.000090$0.090$0.03$0.12524K1x
4Qwen3.7 FlashQwen$0.000095$0.095$0.03$0.131M1x
5Granite 4.1 8BIbm Granite$0.000100$0.100$0.05$0.1131K1x
6Laguna XS 2.1Poolside$0.000120$0.120$0.06$0.12262K1x
7Hy-MT2-1.8BTencent$0.000133$0.133$0.044$0.1778Knão medido
8Phi 4Microsoft$0.000140$0.140$0.07$0.1416K1x
9Nemotron 3.5 LightningNVIDIA$0.000180$0.180$0.08$0.2262K1x
10Laguna S 2.1Poolside$0.000180$0.180$0.09$0.181M1x
11Hy-MT2-30B-A3BTencent$0.000222$0.222$0.074$0.2958Knão medido
12Llama 3.3 70B InstructMeta$0.000260$0.260$0.1$0.32131K1x
13DeepSeek V4 Flash 0731DeepSeek$0.000280$0.280$0.14$0.281M1x
14Gemini 2.5 Flash LiteGoogle$0.000300$0.300$0.1$0.41M1x
15Ring-2.6-1TinclusionAI$0.000388$0.388$0.075$0.625262K1x
16Hy3Tencent$0.000396$0.396$0.132$0.528262K1x
17KAT-Coder-Air V2.5Kwaipilot$0.000450$0.450$0.15$0.6256K1x
18DeepSeek V3.2DeepSeek$0.000469$0.469$0.269$0.4164K1x
19Qwen3 Coder NextQwen$0.000520$0.520$0.12$0.8262K1x
20Llama 4 MaverickMeta$0.000600$0.600$0.2$0.81M1x
21Qwen3.6 35B A3BQwen$0.000640$0.640$0.14$1262K1x
22DeepSeek V3.1DeepSeek$0.000725$0.725$0.25$0.95164K1x
23Codestral 2508Mistral$0.000750$0.750$0.3$0.9256K1x
24Qwen3.6 FlashQwen$0.000750$0.750$0.1875$1.1251M1x
25Nex-N2-ProNex Agi$0.000750$0.750$0.25$1262K1x
26MiniMax M2MiniMax$0.000765$0.765$0.255$1.02205K1x
27Step 3.7 FlashStepfun$0.000775$0.775$0.2$1.15262K1x
28GPT-5.6 Luna ProOpenAI$0.000800$0.800$0.2$1.21Mnão medido
29GPT-5.6 LunaOpenAI$0.000800$0.800$0.2$1.21M1x
30GPT-5.4 NanoOpenAI$0.000825$0.825$0.2$1.25400K2x
31MiniMax M3MiniMax$0.000900$0.900$0.3$1.21M1x
32LongCat 2.0Meituan$0.000900$0.900$0.3$1.21M1x
33Perceptron Mk1Perceptron$0.000900$0.900$0.15$1.533K1x
34Qwen3.7 PlusQwen$0.000960$0.960$0.32$1.281M1x
35Nano Banana 2 Lite (Gemini 3.1 Flash Lite Image)Google$0.0010$1.000$0.25$1.566Knão medido
36Gemini 3.1 Flash LiteGoogle$0.0010$1.000$0.25$1.51M1x
37Inkling SmallThinkingmachines$0.0010$1.050$0.45$1.2524K1x
38Muse Glimmer 30BMeta$0.0011$1.100$0.35$1.5131K2x
39Qwen3.5 Plus 2026-04-20Qwen$0.0012$1.200$0.3$1.81M1x
40Mistral Large 3 2512Mistral$0.0013$1.250$0.5$1.5262K2x
41GLM 4.7Z.ai$0.0013$1.275$0.4$1.75205K2x
42Gemini 3.7 FlashGoogle$0.0013$1.313$0.375$1.8751M2x
43Mistral Medium 3.1Mistral$0.0014$1.400$0.4$2131K2x
44Aion-3.0-MiniAion Labs$0.0014$1.400$0.7$1.4131K2x
45GLM 4.6Z.ai$0.0015$1.500$0.5$2205K1x
46Gemini 2.5 FlashGoogle$0.0015$1.550$0.3$2.51M2x
47Gemini 3.5 Flash LiteGoogle$0.0015$1.550$0.3$2.51M2x
48GLM 5Z.ai$0.0016$1.560$0.6$1.92205K2x
49Kimi K2 0711Moonshot$0.0017$1.720$0.57$2.3131K10x
50Seed 2.1 TurboBytedance Seed$0.0018$1.750$0.5$2.5262K2x
51Kimi K2 ThinkingMoonshot$0.0019$1.850$0.6$2.5262K10x
52R1DeepSeek$0.0019$1.950$0.7$2.564K2x
53Seed-2.0-CodeBytedance Seed$0.0020$2.000$0.5$3262K3x
54Nano Banana 2 (Gemini 3.1 Flash Image)Google$0.0020$2.000$0.5$3131Knão medido
55Grok Build 0.1xAI$0.0020$2.000$1$2256K3x
56Qwen3.8 27BQwen$0.0021$2.050$0.45$3.21M3x
57KAT-Coder-Pro V2.5Kwaipilot$0.0022$2.220$0.74$2.96256K3x
58Nova Pro 1.0Amazon$0.0024$2.400$0.8$3.2300K3x
59Nemotron 3 UltraNVIDIA$0.0024$2.400$0.6$3.6512K3x
60Kimi K2.7 CodeMoonshot$0.0025$2.460$0.71$3.5262K10x
61GLM 5.2Z.ai$0.0025$2.484$0.966$3.0361M3x
62Grok 4.3xAI$0.0025$2.500$1.25$2.51M4x
63Gemini 3.6 FlashGoogle$0.0026$2.625$0.75$3.751M3x
64Sakana NamazuSakana$0.0029$2.950$0.95$4262K4x
65DeepSeek V4 Pro 0813DeepSeek$0.0030$2.970$1.188$3.5641M2x
66InklingThinkingmachines$0.0030$2.975$0.95$4.051M4x
67GPT-5.4 MiniOpenAI$0.0030$3.000$0.75$4.5400K4x
68Muse Spark 1.2Meta$0.0034$3.375$1.25$4.251M5x
69Muse Spark 1.1Meta$0.0034$3.375$1.25$4.251M5x
70Claude Haiku 4.5Anthropic$0.0035$3.500$1$5200K4x
71GLM 5.3Z.ai$0.0036$3.600$1.4$4.41M5x
72Qwen3.7 MaxQwen$0.0037$3.688$1.475$4.4251M5x
73Grok 4.5xAI$0.0050$5.000$2$6500K6x
74Qwen3.8 MaxQwen$0.0050$5.000$2$61M6x
75Qwen3.8 2.4T A95BQwen$0.0050$5.000$2$61M8x
76Grok 4.6xAI$0.0050$5.000$2$6500K6x
77Mistral Medium 3.5Mistral$0.0053$5.250$1.5$7.5262K6x
78Gemini 3.5 FlashGoogle$0.0060$6.000$1.5$91M8x
79Aion-3.0Aion Labs$0.0060$6.000$3$6131K10x
80Claude Sonnet 5Anthropic$0.0070$7.000$2$101M10x
81Command ACohere$0.0075$7.500$2.5$10256K10x
82Gemini 3.1 Pro PreviewGoogle$0.0080$8.000$2$121M10x
83GPT-5.6 Terra ProOpenAI$0.0080$8.000$2$121Mnão medido
84GPT-5.6 TerraOpenAI$0.0080$8.000$2$121M4x
85Nano Banana Pro (Gemini 3 Pro Image)Google$0.0080$8.000$2$12131Knão medido
86GPT-5.4OpenAI$0.010$10.000$2.5$151M15x
87GPT-5.6 Sol ProOpenAI$0.010$10.000$2.5$151Mnão medido
88GPT-5.6 SolOpenAI$0.010$10.000$2.5$151M20x
89Claude Sonnet 4.6Anthropic$0.011$10.500$3$151M10x
90Claude Sonnet 4.5Anthropic$0.011$10.500$3$151M10x
91Kimi K3Moonshot$0.011$10.500$3$151M10x
92Claude Opus 5Anthropic$0.018$17.500$5$251M20x
93Claude Opus 4.8Anthropic$0.018$17.500$5$251M20x
94GPT-5.5OpenAI$0.020$20.000$5$301M20x
95GPT Chat LatestOpenAI$0.020$20.000$5$30400K25x
96Fugu UltraSakana$0.020$20.000$5$301M25x
97Claude Opus 5 (Fast)Anthropic$0.035$35.000$10$501Mnão medido
98Claude Fable 5Anthropic$0.035$35.000$10$501M50x
99Claude Opus 4.8 (Fast)Anthropic$0.035$35.000$10$501Mnão medido
100Claude Opus 4.7 (Fast)Anthropic$0.105$105.000$30$1501Mnão medido

Perguntas

Por que precificar uma resposta em vez de um milhão de tokens?

Porque ninguém compra um milhão de tokens. Os provedores cobram entrada e saída separadamente com tarifas diferentes, então dois modelos podem parecer próximos por milhão e ficar bem distantes na mesma tarefa real. Precificar uma carga de trabalho fixa deixa os números comparáveis.

Qual modelo tem o melhor custo-benefício?

Depende da tarefa. A leitura útil é que o meio desta tabela fica dentro de alguns centésimos de centavo por resposta, então para a maior parte do trabalho do dia a dia a diferença de preço entre bons modelos é irrelevante e a escolha deve ser feita pela qualidade da resposta.

Com que frequência é atualizado?

Os preços são atualizados a partir do catálogo do provedor e a página traz a data da coleta, no momento 20 de agosto de 2026. As tarifas deste mercado mudam bastante, então confira a data antes de citar um número.

O que são créditos Whizi?

O Whizi desconta cada mensagem de uma cota mensal, e modelos caros custam mais créditos do que os baratos, de 1x até 20x. A coluna mostra esse multiplicador para você ver como a tarifa de tabela de um provedor se traduz em uma assinatura fixa.

Como citar

Um conjunto de dados só é reutilizado se for fácil de creditar, então aqui está a linha para copiar:

Whizi AI Model Cost Index, prices as of 2026-08-20. https://whizi.io/pt-br/tools/model-cost-index/

Publicado sob CC BY 4.0, que permite reuso comercial desde que o índice seja nomeado e esta página seja vinculada. Quem precisar conferir um número antes de publicar pode falar com os mantenedores em [email protected].

Próximo passo

Calcule o preço do seu próprio texto com a Calculadora de custo de tokens ou compare os planos em preços do Whizi.