Llama 4 Maverick: preço, janela de contexto e custo em créditos

Resposta rápida

O Llama 4 Maverick custa $0.0006 por uma resposta padrão, ou seja, 1.000 tokens de entrada e 500 de saída. As tarifas de tabela são $0.2 por milhão de tokens de entrada e $0.8 por milhão de tokens de saída. A janela de contexto é de 1M tokens, bem acima da mediana do catálogo. No Whizi custa 1 crédito por mensagem no plano Pro e acima.

A resposta rápida

O Llama 4 Maverick é um modelo da Meta com preço de $0.2 por milhão de tokens de entrada e $0.8 por milhão de tokens de saída, com uma janela de contexto de 1M tokens. Uma resposta padrão, ou seja, 1.000 tokens de entrada e 500 de saída, custa $0.0006. No Whizi custa 1 crédito por mensagem e exige o plano Pro ou superior.

Isso o torna um dos modelos mais baratos do catálogo: 71 dos 89 modelos com preço custam mais por resposta, e 17 custam menos.

Quanto custa o Llama 4 Maverick

As tarifas de tabela são o que o provedor cobra por token. O custo de uma resposta padrão é o número mais útil, porque precifica a mesma unidade de trabalho em todos os modelos, independentemente de como cada um é cobrado.

Entrada, por milhão de tokens$0.2
Saída, por milhão de tokens$0.8
Uma resposta padrão$0.0006
Mil respostas$0.6000
Janela de contexto1M tokens
Créditos por mensagem no Whizi1
Plano mínimo do WhiziPro
Posição por custo, de 89 modelos com preço18

Os preços são as tarifas publicadas pela Meta conforme divulgadas pela OpenRouter, com última atualização em 2026-08-20. O conjunto completo de dados, cobrindo os 100 modelos de 29 provedores, é o índice de custo de modelos de IA, que é livre para reutilização com atribuição.

Quanto custa dentro do Whizi

O Whizi mede mensagens em créditos em vez de tokens, e o Llama 4 Maverick é cobrado a 1 crédito por mensagem. O custo não muda com o tamanho da sua mensagem nem com o tamanho da resposta, então uma pergunta de uma linha e uma análise de documento longo custam o mesmo.

PlanoPreço por mêsCréditos mensaisMensagens neste modelo
Pro$29.99, ou $19.99 na cobrança anual2.0002.000
Powerhouse$49.99, ou $34.99 na cobrança anual8.0008.000

O Llama 4 Maverick está incluído a partir do plano Pro. O Pro é um nível selecionado, não tudo o que é barato: um ou dois modelos de ponta atuais de cada família, cada nível rápido e os modelos de alto volume. Veja planos e limites.

Como se compara em preço

Frente ao modelo mais barato do índice, o Ling-3.0-flash a $0.000053 por resposta, o Llama 4 Maverick custa 11 vezes mais. Frente à mediana, o Kimi K2 0711 a $0.0017, custa 2,9 vezes menos.

Seus vizinhos mais próximos da Meta:

ModeloUma respostaContextoCréditos
Llama 3.3 70B Instruct$0.0003131K1
Llama 4 Maverick (esta página)$0.00061M1
Muse Glimmer 30B$0.0011131K2
Muse Spark 1.2$0.00341M5

Se o Llama 4 Maverick é mais modelo do que uma determinada tarefa exige, o Llama 3.3 70B Instruct é a opção mais barata da Meta, a $0.0003 por resposta e 1 crédito por mensagem. Direcionar o trabalho de rotina para um nível mais baixo é a maior coisa que você pode fazer para fazer uma cota durar mais.

A janela de contexto na prática

O Llama 4 Maverick aceita 1M tokens de contexto, o equivalente a cerca de 1600 páginas de texto. Isso está bem acima da mediana do catálogo com preço.

Contexto anunciado e contexto utilizável não são a mesma coisa. A capacidade de recuperação tende a se degradar antes de atingir o limite declarado, principalmente para conteúdo no meio de uma entrada longa, então o teste prático é enviar um documento longo e perguntar sobre algo escondido na metade dele, em vez de confiar no número.

O número importa mais quando você está trabalhando com seus próprios arquivos. Se um documento é longo demais para o modelo escolhido, trocar para um modelo com janela maior na mesma conversa mantém o fio da conversa, então você não começa do zero. Veja como trocar de modelo no meio da conversa.

Lista de verificação
  • Entrada $0.2 e saída $0.8 por milhão de tokens
  • $0.0006 por uma resposta padrão, $0.6000 por mil
  • Janela de contexto de 1M tokens
  • 1 crédito por mensagem dentro do Whizi
  • Exige o plano Pro ou superior
  • Ocupa a posição 18 de 89 modelos com preço por custo

Perguntas frequentes

Quanto custa o Llama 4 Maverick?

$0.2 por milhão de tokens de entrada e $0.8 por milhão de tokens de saída nas tarifas de tabela, o que equivale a $0.0006 por uma resposta padrão de 1.000 tokens de entrada e 500 de saída, ou $0.6000 por mil respostas dessas. No Whizi é 1 crédito por mensagem dentro de uma cota mensal, em vez de medido por token.

Qual plano do Whizi inclui o Llama 4 Maverick?

Pro e acima, que custa $29.99 por mês ou $19.99 na cobrança anual. A 1 crédito por mensagem, uma cota Pro de 2.000 créditos cobre 2.000 mensagens neste modelo se você gastar toda a cota aqui, e a maioria das pessoas mistura um modelo de 1 crédito para o trabalho de rotina, para fazer render mais.

Qual é a janela de contexto do Llama 4 Maverick?

1M tokens, o equivalente a cerca de 1600 páginas de texto, bem acima da mediana do catálogo com preço. Trate isso como o teto e não como o número de trabalho: a capacidade de recuperação costuma se degradar antes do limite declarado, especialmente para conteúdo no meio de uma entrada longa.

O Llama 4 Maverick é caro em comparação a outros modelos?

Ele ocupa a posição 18 de 89 modelos com preço por custo de resposta, então 71 custam mais e 17 custam menos. A variação em todo o catálogo é de cerca de 2000 vezes entre o mais barato e o mais caro, bem mais ampla do que a maioria imagina, então "caro" só significa algo em relação à alternativa específica que você usaria.