Usando o GPT no Whizi: modelos, custo em créditos e planos

Resposta rápida

Os modelos GPT fazem parte do catálogo do Whizi e são acessados com uma assinatura do Whizi, não do ChatGPT. A linha GPT mais barata custa 1 crédito por mensagem e está incluída no Starter. O Pro adiciona nove entradas da OpenAI, e tudo fora dessas listas, incluindo as linhas Codex e a série o, exige o Powerhouse.

A resposta rápida

Os modelos GPT fazem parte do catálogo do Whizi e são acessados com uma assinatura do Whizi, não do ChatGPT. A linha GPT mais barata custa 1 crédito por mensagem e está incluída no Starter. O restante fica no Pro ou no Powerhouse, e a linha GPT mais cara do catálogo custa 25 créditos por mensagem.

O assistente padrão, o Whizi AI, é uma persona da casa que roda sobre o modelo GPT base, então todo plano pago alcança o GPT desde a primeira mensagem. Um crédito é definido como uma mensagem no Whizi AI, o que significa que um crédito também é uma mensagem naquele modelo GPT base.

PlanoPreçoCréditos mensaisModelos GPT alcançáveis
Freesem assinatura0 créditos, 7 mensagens no primeiro dia e depois 3 por dianenhum: o free roda apenas Whizi AI e Auto
Starter$15.99/mês, ou $10.99/mês cobrado anualmente a $131.88400GPT-5.6 Luna, além do Whizi AI, que roda sobre ele
Pro$29.99/mês, ou $19.99/mês cobrado anualmente a $239.882,000GPT-5.6 Terra, GPT-5.5, GPT-5.2, GPT-5 Mini, GPT-4.1, GPT-4.1 Mini, GPT-4o, GPT-4o Mini, GPT-OSS-120B
Powerhouse$49.99/mês, ou $34.99/mês cobrado anualmente a $419.888,000tudo acima, mais todas as outras linhas GPT do catálogo

O que cada modelo GPT custa

Um custo em créditos é um número inteiro fixo por modelo, e a mecânica dessa escala está em como os créditos funcionam. As linhas da OpenAI no catálogo vão de 1 crédito a 25, então a resposta GPT mais barata e a mais cara diferem por um fator de vinte e cinco na mesma conta.

A coluna em dólar é o que uma resposta custa nas tarifas de tabela do provedor, medida em uma resposta padrão de 1.000 tokens de entrada mais 500 tokens de saída, usando taxas lidas em 2026-08-20. Ela existe para que a coluna de créditos possa ser conferida contra algo real, não porque você é cobrado em dólares por mensagem.

ModeloJanela de contextoCréditos por mensagemUma resposta padrãoPlano
GPT-5.6 Luna1M1$0.0008Starter
GPT-5.4 Nano400K2$0.000825Powerhouse
GPT-5.4 Mini400K4$0.003Powerhouse
GPT-5.6 Terra1M4$0.008Pro
GPT-5.41M15$0.01Powerhouse
GPT-5.6 Sol1M20$0.01Powerhouse
GPT-5.51M20$0.02Pro
GPT Chat Latest400K25$0.02Powerhouse

Outras linhas GPT têm um custo em créditos, mas não estão nesse conjunto de preços:

ModeloCréditos por mensagemPlano
GPT-4o1Pro
GPT-4.1 Mini2Pro
GPT-5 Mini2Pro
GPT-4.18Pro
GPT-58Powerhouse
GPT-5.18Powerhouse
GPT-5.1 Codex8Powerhouse
GPT-5.1 Codex Max8Powerhouse
GPT-5.210Pro
GPT-5.2 Chat10Powerhouse
GPT-5.2 Codex10Powerhouse
GPT-5.3 Codex12Powerhouse

A série de raciocínio da OpenAI fica no Powerhouse:

ModeloCréditos por mensagemPlano
o3-mini4Powerhouse
o4-mini4Powerhouse
o3-mini-high5Powerhouse
o4-mini-high5Powerhouse
o38Powerhouse

Três linhas da OpenAI são cobradas abaixo do que a fórmula de custo retorna, por decisão do dono e não por aritmética. A própria escala de degraus, e a regra para um modelo que cai entre dois degraus, estão em como os créditos funcionam.

ModeloCobradoO que a fórmula dá
GPT-5.6 Terra4 créditos10
GPT-5.520 créditos25
GPT-5.6 Sol20 créditos25

Qual plano libera qual modelo GPT

O acesso é resolvido no servidor por identificador de modelo. No Starter, a trava recai sobre toda linha GPT acima do modelo base de 1 crédito. No Pro, ela recai sobre os identificadores da OpenAI fora das nove do Pro, que é onde ficam as linhas de código Codex, a série o e a linha GPT mais alta. Em ambos os casos, a recusa é HTTP 403 com o código tier_upgrade_required e a mensagem "Upgrade your plan to use this model."

Starter alcança exatamente quatro entradas no seletor: Auto, Whizi AI, o modelo GPT base e um modelo Gemini rápido. Essa é a lista inteira, então no Starter toda mensagem GPT custa 1 crédito e nada acima da linha base está disponível.

Pro adiciona nove entradas da OpenAI, as mesmas nomeadas na tabela da resposta rápida acima. O conjunto vai do GPT-4o de 1 crédito até o GPT-5.5 de 20 créditos, e inclui a linha de peso aberto GPT-OSS. O Pro para por aí: a linha GPT troféu do Powerhouse, as linhas de código Codex e a série o não estão no conjunto. O Pro é um superconjunto estrito do Starter, então a linha GPT do Starter também está incluída.

Powerhouse é o nível de reserva, não o Pro. Qualquer identificador de modelo que não esteja no conjunto do Starter nem na lista do Pro é resolvido para o Powerhouse, e é por isso que as linhas GPT especialistas em código e a série o ficam ali. Isso também significa que uma linha GPT que o catálogo ganha chega no Powerhouse e ali permanece até ser deliberadamente promovida, então os nove nomes na coluna do Pro são tudo o que o Pro alcança no lado da OpenAI, não uma amostra disso.

Uma linha é deliberadamente retida no Powerhouse em vez de pela regra de reserva: o GPT-5.6 Sol é o modelo troféu no cartão do plano Powerhouse, ao lado do Claude Opus. O seletor mostra a consequência. Sua seção Recomendado se limita a modelos que um assinante Pro já pode alcançar, então a vaga da OpenAI ali é a linha GPT de nível Pro em vez disso.

O que uma cota compra em mensagens GPT

Um turno GPT ou cabe no saldo restante ou é recusado por completo: um turno GPT de 25 créditos com um saldo de 20 créditos é rejeitado, não descontado até o que sobra.

PlanoCréditos mensaisA 1 créditoA 4 créditosA 20 créditos
Starter400400 mensagens GPTnão incluídonão incluído
Pro2,0002,000500100
Powerhouse8,0008,0002,000400

A cobrança semanal é oferecida só no celular, e o celular não está na lista liberada para créditos, então um comprador semanal é medido em mensagens em vez de créditos: 100 por semana no Starter, 400 no Pro, 2,000 no Powerhouse.

Todo modelo que uma conta Starter pode alcançar custa 1 crédito, então nesse nível 400 créditos são 400 mensagens.

A precificação em créditos é ativada por plataforma. O app web está na lista liberada hoje e é cobrado pelos multiplicadores reais contra a cota de créditos. Um cliente que não está na lista liberada é cobrado um por turno contra a cota antiga de mensagens, que é 400 mensal no Starter, 800 no Pro e 5,000 no Powerhouse. Um cliente fora da lista liberada também não exibe selos de crédito no seletor, porque o campo de custo está ausente em vez de fixado em 1.

Ficar sem saldo retorna HTTP 429 com o código message_limit_reached e a mensagem "Your monthly message limit has been reached." Planos semanais dizem semanal. O que fazer a respeito está em ficar sem créditos.

Usando o GPT sem uma assinatura do ChatGPT

Uma conta gratuita do Whizi recebe 7 mensagens no primeiro dia e mais 3 a cada meia-noite UTC depois disso, e desde 2026-09-02 o nível gratuito tem restrição por modelo: essas mensagens vão para o Whizi AI ou o Auto, não para uma linha GPT. O Starter a $15.99/mês é o primeiro plano que alcança uma.

Escolher uma linha GPT em uma conta gratuita retorna HTTP 403 com o código tier_upgrade_required e a mensagem "This model needs a plan. Start one to use it, or keep chatting with Whizi AI." Gastar o dia nas duas linhas gratuitas disponíveis pode abrir HTTP 402 com o código free_limit_reached e a mensagem "Today's free messages are used up. More arrive tomorrow, or start a plan to keep going now."

Depois disso, um plano pago é o que libera a cota contínua. Contas novas começam com um teste de 7 dias cobrado na tarifa introdutória de $0.99, após o qual o plano escolhido é renovado a menos que seja cancelado.

O histórico existente do ChatGPT pode ir com você. O Whizi importa exportações do ChatGPT e do Claude, e o próprio arquivo de exportação nunca chega ao servidor: o navegador o interpreta e envia conversas normalizadas. Uma requisição carrega até 25 conversas e 400 mensagens por conversa, e qualquer coisa maior é dividida automaticamente em fatias seguintes. Uma exportação .json crua é aceita até 300 MB, acima disso a exportação .zip é o caminho. As importações são idempotentes, então clicar em Importar duas vezes ou retomar após uma conexão caída entrega os mesmos chats uma única vez.

Duas coisas não sobrevivem a uma importação do ChatGPT: apenas o ramo que estava na tela é importado, então respostas regeneradas e rascunhos descartados não são reproduzidos, e conteúdo que não é transcrição é ignorado, o que cobre raciocínio oculto, código e saída de ferramentas de análise, rascunhos de navegação, blocos de instruções personalizadas e chamadas de função. Se uma importação travar ou reportar conversas ignoradas, veja erros de importação de chat.

Alternando entre o GPT e as outras famílias

Um custo em créditos é consultado por modelo a cada turno, então o preço da próxima resposta é definido por qual modelo responde a ela. Mover uma conversa do GPT para outra família muda o que o próximo turno custa e deixa intactos os turnos já enviados. Uma conversa também carrega o modelo com que foi criada, e é por isso que um modelo nunca é removido do catálogo depois de ter sido oferecido.

O Auto é a outra forma de alcançar o GPT. Ele é uma linha roteadora, não um modelo, e se resolve para um modelo concreto antes de qualquer cobrança, então a cobrança em créditos, a trava de plano e o histórico armazenado registram todos o modelo que de fato rodou. Sua escada tem seis degraus. O mais barato cai no modelo da casa a 1 crédito, e dois caem em linhas da OpenAI: forma longa a 4 créditos e raciocínio em múltiplas etapas a 20 créditos.

O Auto nunca roteia acima do seu plano. Esse comportamento, e os outros motivos pelos quais uma linha que você espera está faltando no seletor ou se recusa a enviar, estão em modelo indisponível.

O que um modelo GPT no Whizi não faz

A coluna de janela de contexto acima é a janela do provedor, não o seu orçamento por turno. A maioria dos modelos do catálogo recebe um orçamento fixo de 40.000 tokens de entrada e 20.000 tokens de saída por turno, e um modelo cuja janela fique abaixo de 93.000 tokens recebe em vez disso um orçamento proporcional menor, com a saída limitada a 40 por cento da janela e uma margem de segurança de 1.000 tokens retida. Toda janela GPT na primeira tabela acima é de 400K ou 1M, bem acima desse limite, então essas linhas todas usam o orçamento fixo: uma janela de um milhão de tokens e uma de 400K entregam os mesmos 40.000 tokens por turno. Uma conversa que ultrapassa o orçamento é coberta em contexto longo demais.

A busca na web não é um recurso do GPT. É uma opção por requisição com três modos, aplicada a qualquer modelo em que o turno esteja, então não existe uma lista de modelos GPT que podem ou não navegar. Com a opção ativada, a requisição primeiro carrega uma sondagem barata de cerca de 50 tokens, e só um turno em que o modelo de fato a acione é reemitido com busca real. A busca nativa do provedor injeta um preâmbulo fixo de aproximadamente 4.400 tokens de entrada, e é por isso que a sondagem existe.

A velocidade de envio também não é uma configuração do GPT. O chat é limitado a 10 mensagens por minuto e 60 por hora por usuário, e esses dois limites são idênticos em todo nível, então nenhuma linha GPT e nenhum upgrade os move. O conjunto completo de janelas está em limites de taxa.

Lista de verificação
  • O GPT é acessado com uma assinatura do Whizi, não do ChatGPT
  • A linha GPT base custa 1 crédito por mensagem e está incluída no Starter
  • O Pro adiciona nove entradas da OpenAI, incluindo as linhas de 4 e 20 créditos
  • Tudo que não está na lista do Starter ou do Pro precisa do Powerhouse, incluindo as linhas especialistas em código
  • Uma conta gratuita não alcança nenhuma linha GPT: o Starter é o primeiro plano que alcança
  • O custo em créditos é fixo por modelo e por mensagem, seja qual for o tamanho da mensagem
  • A maioria dos modelos recebe 40.000 tokens de entrada e 20.000 de saída por turno, e um modelo com janela abaixo de 93.000 tokens recebe um orçamento proporcional menor

Perguntas frequentes

O que acontece com minhas 7 mensagens gratuitas quando eu assino?

A cota gratuita roda no seu próprio relógio: 7 no primeiro dia, depois 3 a cada meia-noite UTC, e uma assinatura a substitui em vez de somar a ela. Uma cota de plano é somada por período de cobrança, e num plano mensal o período é o mês calendário UTC, então o reinício é a virada do mês e créditos não usados não passam para o próximo. Registrar-se também não dá uma contagem gratuita nova, porque o uso de uma sessão de convidado é transferido para a conta quando ela é reivindicada.

Quantas mensagens GPT eu recebo por mês?

Um mês real é uma mistura de linhas, não uma só delas, então a conta é subtração. No Pro, 50 turnos numa linha GPT de 20 créditos gastam 1.000 dos 2.000 créditos e deixam 1.000, o que é mais 250 turnos na linha de 4 créditos ou 1.000 numa linha de 1 crédito. No Powerhouse, os mesmos 50 turnos caros deixam 7.000 créditos.

Por que um modelo GPT custa 1 crédito e outro custa 25?

Porque o degrau acompanha o que o modelo custa para rodar. Um crédito é uma mensagem no modelo da casa, e todo outro degrau é derivado da precificação real do provedor por token, medida no mesmo turno de referência. Dentro da família OpenAI isso coloca as linhas mais baratas a 1 crédito e as mais caras a 25, e as tabelas acima nomeiam qual linha é qual. A escala completa está em como os créditos funcionam.

Posso trocar do GPT para o Claude na mesma conversa?

Sim, e o que costuma pegar as pessoas de surpresa são os arquivos, não o preço. Apenas a mensagem mais recente do usuário que carrega anexos tem seus anexos encaminhados ao provedor, então um documento anexado seis turnos atrás não é reenviado quando o Claude responde. Reanexe-o no turno em que quiser que o Claude o leia. No lado dos planos, os modelos Anthropic começam no Pro, onde o Sonnet é o teto, e a classe Opus exige o Powerhouse.