Os modelos de IA mais baratos por resposta na Whizi, e o que um crédito compra

Resposta rápida

A linha mais barata do índice de custos da Whizi é a Ling, da inclusionAI, a $0.000053 por resposta. Ela cobra um crédito por mensagem, como todas as outras linhas na base da escada, e nenhuma mensagem é cobrada por menos de um crédito. Uma resposta padrão equivale a 1.000 tokens de entrada mais 500 de saída.

A resposta curta

A linha mais barata do índice de custos da Whizi é a Ling, da inclusionAI, a $0.000053 por resposta. Ela cobra um crédito por mensagem, como todas as outras linhas na base da escada, e o piso de cada rodada garante que nada é cobrado por menos de um crédito.

Uma linha barata por plano, como introdução às tabelas completas abaixo:

ModeloProvedorCusto por respostaContextoCréditosPlano
Ling-3.0-flashinclusionAI$0.000053262K1Powerhouse
Llama 3.3 70B InstructMeta$0.00026131K1Pro
GPT-5.6 LunaOpenAI$0.00081M1Starter

Uma resposta padrão no índice equivale a 1.000 tokens de entrada mais 500 de saída, o que torna comparáveis as tabelas de preço de provedores diferentes. Os preços de origem foram obtidos no OpenRouter em 20/08/2026. O índice precifica 100 linhas em 29 provedores, e 89 dessas linhas têm cobrança em créditos da Whizi. O conjunto completo de dados é publicado como o índice de custo de modelos de IA.

Esta página é a ponta barata desse índice. Para o catálogo por plano, veja a lista de modelos, e para a própria escada de créditos, veja a referência de créditos.

Linhas com menos de um décimo de centavo por resposta

Uma seleção das linhas que respondem uma vez por menos de $0.001 no tamanho de resposta padrão. Todas as linhas listadas aqui cobram um único crédito, exceto uma.

ModeloProvedorCusto por respostaContextoCréditosPlano
Ling-3.0-flashinclusionAI$0.000053262K1Powerhouse
Nex-N2-MiniNex Agi$0.000075262K1Powerhouse
Solar Pro 4Upstage$0.00009524K1Powerhouse
Qwen3.7 FlashQwen$0.0000951M1Powerhouse
Granite 4.1 8BIBM$0.0001131K1Powerhouse
Laguna XS 2.1Poolside$0.00012262K1Powerhouse
Phi 4Microsoft$0.0001416K1Powerhouse
Nemotron 3.5 LightningNVIDIA$0.00018262K1Powerhouse
Llama 3.3 70B InstructMeta$0.00026131K1Pro
DeepSeek V4 Flash 0731DeepSeek$0.000281.31M1Powerhouse
Gemini 2.5 Flash LiteGoogle$0.00031M1Pro
DeepSeek V3.2DeepSeek$0.000469164K1Pro
Qwen3 Coder NextQwen$0.00052262K1Powerhouse
Llama 4 MaverickMeta$0.00061M1Pro
DeepSeek V3.1DeepSeek$0.000725164K1Pro
Codestral 2508Mistral$0.00075256K1Powerhouse
Qwen3.6 FlashQwen$0.000751M1Powerhouse
MiniMax M2MiniMax$0.000765205K1Powerhouse
GPT-5.6 LunaOpenAI$0.00081M1Starter
GPT-5.4 NanoOpenAI$0.000825400K2Powerhouse
MiniMax M3MiniMax$0.00091M1Powerhouse
Qwen3.7 PlusQwen$0.000961M1Pro

Várias das linhas mais baratas trazem um milhão de tokens ou mais, e a maior janela de todo o índice de preços pertence a uma linha perto do fim da lista de custos. Barato e pequeno não são o mesmo eixo aqui. A menor janela listada acima é de 16K.

A maioria dessas linhas fica no plano mais caro, pelo motivo explicado a seguir.

A próxima faixa, até a mediana do índice

A linha de preço mediano é uma linha de raciocínio da Kimi, a $0.00185 por resposta padrão. Uma amostra das linhas entre um décimo de centavo e essa mediana:

ModeloProvedorCusto por respostaContextoCréditosPlano
Gemini 3.1 Flash LiteGoogle$0.0011M1Powerhouse
Muse Glimmer 30BMeta$0.0011131K2Powerhouse
Mistral Large 3 2512Mistral$0.00125262K2Pro
GLM 4.7Z.ai$0.001275205K2Powerhouse
Gemini 3.7 FlashGoogle$0.0013131M2Pro
Mistral Medium 3.1Mistral$0.0014131K2Pro
GLM 4.6Z.ai$0.0015205K1Powerhouse
Gemini 2.5 FlashGoogle$0.001551M2Pro
Gemini 3.5 Flash LiteGoogle$0.001551M2Powerhouse
GLM 5Z.ai$0.00156205K2Pro
Kimi K2 0711Moonshot$0.00172131K10Powerhouse
Kimi K2 ThinkingMoonshot$0.00185262K10Powerhouse

A coluna de créditos e a coluna de dólares não cobrem o mesmo conjunto de linhas. Onze das 100 linhas precificadas não têm nenhuma cobrança em créditos: elas são precificadas para comparação, mas não são oferecidas como uma linha medida própria no produto. Por isso, um valor em dólares no índice não significa, por si só, que a linha pode ser aberta no seletor.

Por que a maioria das linhas mais baratas está no Powerhouse

A coluna de plano acima não é uma decisão de preço, é um comportamento padrão. O acesso a modelos é resolvido por identificador: primeiro os quatro identificadores do Starter, depois as personas de agente, depois uma lista explícita de mais 37 identificadores para o Pro, e qualquer outra coisa retorna Powerhouse. Uma linha barata que nunca foi promovida para a lista do Pro, portanto, fica no nível mais alto por padrão, e é por isso que a base da lista de custos aparece como uma coluna Powerhouse. Esse comportamento padrão está documentado na lista de modelos.

PlanoO que alcança na ponta barata
FreeSem cota de créditos. Apenas Whizi AI e Auto, 7 mensagens no primeiro dia e depois 3 por dia
StarterQuatro identificadores no total: Auto, Whizi AI, GPT-5.6 Luna, Gemini 3 Flash. Todos custam 1 crédito
ProStarter mais 37 outros, incluindo as linhas DeepSeek, Llama, Gemini Flash, Mistral e Qwen marcadas como Pro acima
PowerhouseTudo o mais no catálogo, onde ficam as linhas de laboratórios menores na base da lista de custos

O plano gratuito nem entra nessa comparação: desde 02/09/2026 ele alcança apenas Whizi AI e Auto, então nem a linha mais barata do índice nem a mais cara ficam acessíveis nele. O que ele oferece são 7 mensagens no primeiro dia, depois 3 por dia, gastas nessas duas linhas.

O Starter é o plano restrito. Ele alcança quatro identificadores, todos cobram um único crédito, e por isso sua cota de 400 créditos equivale a 400 mensagens. Não há modelo da Anthropic no Starter, nem acesso às linhas baratas de laboratórios menores nas tabelas acima.

O que um crédito compra

Um crédito é definido como uma mensagem no modelo da casa, que roda sobre o modelo base da OpenAI fixado em um crédito. Um teste de build falha se qualquer um dos dois sair desse degrau, porque mover um deles redenomina a escada inteira.

A cobrança é um número inteiro fixo por id de modelo. Nesta ponta do catálogo, isso significa que uma linha de 1 crédito custa um crédito independentemente do tamanho de entrada ou saída: cole um documento longo nela, deixe a resposta se estender, e a rodada ainda é cobrada em um.

LinhaCusto por respostaCusto por 1.000 respostasCréditos
Nemotron 3.5 Lightning$0.00018$0.181
Llama 3.3 70B Instruct$0.00026$0.261
DeepSeek V4 Flash 0731$0.00028$0.281
Gemini 2.5 Flash Lite$0.0003$0.301
DeepSeek V3.2$0.000469$0.4691
Llama 4 Maverick$0.0006$0.601
GPT-5.6 Luna$0.0008$0.801
Qwen3.7 Plus$0.00096$0.961

Transformado em cota, o degrau mais baixo é o único lugar onde o número de créditos e o número de mensagens coincidem: toda rodada custa um, então uma cota de N créditos em um plano equivale a N mensagens enquanto você ficar em linhas de 1 crédito. A cota por plano, a reinicialização e a regra de acúmulo estão todas na referência de créditos.

Mais um mecanismo importante na ponta barata: uma rodada que não cabe no saldo restante é recusada por completo, em vez de cobrada parcialmente. Vinte créditos sobre um saldo de três é rejeitado, não descontado. Em um modelo de 1 crédito, isso quase nunca acontece.

De onde vem um degrau de crédito, e quando a política interna o substitui

O índice de custos mede uma resposta padrão de 1.000 tokens de entrada mais 500 de saída contra as tarifas de tabela dos provedores. A escada de créditos vem de uma rodada de referência diferente, 3.000 tokens de entrada e 800 de saída, dividida pelo que essa mesma rodada custa no modelo âncora, que é $0.00156 de gasto com provedor. O resultado então é arredondado para cima até um degrau válido. A escada tem dezoito degraus: 1, 2, 3, 4, 5, 6, 8, 10, 12, 15, 20, 25, 30, 40, 50, 60, 80, 100. Quatorze têm pelo menos um modelo hoje, e os quatro vazios são mantidos de propósito, porque um degrau faltando arredondaria o próximo modelo mais caro para o degrau acima. O arredondamento vai para cima quando um modelo cai entre dois degraus.

Além disso, algumas linhas são fixadas por política interna em vez de aritmética. Três exemplos visíveis nas tabelas acima e no catálogo mais amplo:

  • A família Kimi é cobrada em 10 créditos contra taxas reais de custo de 2, 3, 4 e 12, dependendo da linha. É por isso que duas linhas da Moonshot ficam bem próximas em dólares, a $0.00172 e $0.00185, mas ambas cobram 10 créditos.
  • A linha Gemini no Starter é cobrada em 1 crédito contra um custo real de 2, o que mantém o Starter em um crédito fixo por mensagem.
  • A linha GPT Terra é cobrada em 4 créditos contra um custo real de 10.

As linhas com busca embutida são precificadas de outra forma, porque o provedor cobra uma taxa fixa por busca que não escala com a tarifa por token. Uma busca a $0.005 vale 3,2 créditos, então uma única busca custa mais do que uma mensagem inteira na maior parte do catálogo. Esses degraus são pisos que assumem uma busca por resposta.

Um identificador de modelo sem nenhum degrau é cobrado no topo da escada, 100 créditos, de propósito: um modelo sem preço definido deve virar um chamado de suporte, em vez de corroer a margem silenciosamente. Um teste de build falha se qualquer modelo do catálogo ou identificador de agente chegar à produção sem um degrau.

Por fim, o sistema de créditos é ativado por plataforma. Uma plataforma na lista permitida vê multiplicadores reais no seletor e é cobrada por eles contra a cota de créditos. Uma plataforma que não está na lista vê um crédito fixo por rodada e mantém a antiga cota de mensagens, que é de 400 mensagens por mês no Starter, 800 no Pro e 5.000 no Powerhouse. O cliente web está no sistema de créditos hoje.

Lista de verificação
  • A linha mais barata do índice responde uma vez por $0.000053
  • Uma resposta padrão é 1.000 tokens de entrada mais 500 de saída, precificada pelas tarifas de tabela do OpenRouter em 20/08/2026
  • Toda cobrança tem um piso de um crédito, então nenhuma mensagem custa menos que isso
  • A maioria das linhas mais baratas fica no Powerhouse, porque tudo o que não está na lista do Starter ou do Pro cai para o nível mais alto
  • O Starter alcança quatro identificadores e todos custam 1 crédito, então 400 créditos equivalem a 400 mensagens
  • Contas gratuitas não têm cota de créditos e alcançam duas linhas: Whizi AI e Auto
  • O degrau de crédito vem de uma rodada de referência diferente do valor do índice, e alguns degraus são fixados por política

Perguntas frequentes

Qual é o modelo de IA mais barato na Whizi?

Por custo por resposta padrão, a linha mais barata do índice de custos da Whizi é a Ling, da inclusionAI, a $0.000053, seguida pela Nex, da Nex Agi, a Solar Pro, da Upstage, e o nível rápido do Qwen. Todas cobram um crédito por mensagem. Pelo que você realmente paga, elas empatam com todas as outras linhas de 1 crédito, incluindo o modelo da casa da Whizi, o modelo GPT base no Starter e várias linhas da DeepSeek, Llama e Gemini.

Qual plano eu preciso para alcançar os modelos mais baratos?

Depende da linha. Várias das linhas mais baratas exigem Powerhouse, porque o acesso a modelos cai para o nível mais alto para qualquer identificador que não esteja na lista de quatro itens do Starter ou na lista de 37 itens do Pro. As linhas baratas acessíveis no Pro incluem as entradas DeepSeek, Llama, Mistral, Qwen e Gemini Flash marcadas como Pro nas tabelas desta página.

Um modelo mais barato sempre custa menos créditos?

Não. Os dois valores são medidos de formas diferentes. O índice precifica uma resposta padrão de 1.000 tokens de entrada e 500 de saída contra as tarifas de tabela dos provedores, enquanto o degrau de crédito vem de uma rodada de referência de 3.000 de entrada e 800 de saída, arredondada para cima até um degrau válido numa escada fixa, com algumas linhas fixadas por política acima ou abaixo da sua aritmética. É por isso que uma linha a $0.0015 por resposta pode cobrar um crédito, enquanto uma linha a $0.000825 cobra dois.

O que acontece com o crédito se uma resposta falha no meio do caminho?

Ele volta. Uma geração que falha ou é interrompida é reembolsada apagando sua linha de uso, então o saldo volta ao que era antes. O reembolso é vinculado a um id de solicitação gerado pelo servidor, e não a algo fornecido pelo cliente, então aplicar o mesmo reembolso duas vezes restaura exatamente uma rodada, e não duas. Uma coisa que não é reembolsada: uma rodada rejeitada por falta de cota ainda gasta seus tokens de limite de taxa, senão um cliente sem créditos poderia tentar de novo sem limite.

Posso experimentar os modelos baratos sem assinatura?

Não em uma conta gratuita, que alcança apenas Whizi AI e Auto. Sua cota é de 7 mensagens no primeiro dia, depois 3 por dia, gastas nessas duas linhas, e reivindicar uma conta de convidado carrega o uso para a conta registrada, então começar como convidado e se cadastrar depois não devolve um dia novo.