A resposta rápida
O Llama 4 Maverick é um modelo da Meta com preço de $0.2 por milhão de tokens de entrada e $0.8 por milhão de tokens de saída, com uma janela de contexto de 1M tokens. Uma resposta padrão, ou seja, 1.000 tokens de entrada e 500 de saída, custa $0.0006. No Whizi custa 1 crédito por mensagem e exige o plano Pro ou superior.
Isso o torna um dos modelos mais baratos do catálogo: 71 dos 89 modelos com preço custam mais por resposta, e 17 custam menos.
Quanto custa o Llama 4 Maverick
As tarifas de tabela são o que o provedor cobra por token. O custo de uma resposta padrão é o número mais útil, porque precifica a mesma unidade de trabalho em todos os modelos, independentemente de como cada um é cobrado.
| Entrada, por milhão de tokens | $0.2 |
| Saída, por milhão de tokens | $0.8 |
| Uma resposta padrão | $0.0006 |
| Mil respostas | $0.6000 |
| Janela de contexto | 1M tokens |
| Créditos por mensagem no Whizi | 1 |
| Plano mínimo do Whizi | Pro |
| Posição por custo, de 89 modelos com preço | 18 |
Os preços são as tarifas publicadas pela Meta conforme divulgadas pela OpenRouter, com última atualização em 2026-08-20. O conjunto completo de dados, cobrindo os 100 modelos de 29 provedores, é o índice de custo de modelos de IA, que é livre para reutilização com atribuição.
Quanto custa dentro do Whizi
O Whizi mede mensagens em créditos em vez de tokens, e o Llama 4 Maverick é cobrado a 1 crédito por mensagem. O custo não muda com o tamanho da sua mensagem nem com o tamanho da resposta, então uma pergunta de uma linha e uma análise de documento longo custam o mesmo.
| Plano | Preço por mês | Créditos mensais | Mensagens neste modelo |
|---|---|---|---|
| Pro | $29.99, ou $19.99 na cobrança anual | 2.000 | 2.000 |
| Powerhouse | $49.99, ou $34.99 na cobrança anual | 8.000 | 8.000 |
O Llama 4 Maverick está incluído a partir do plano Pro. O Pro é um nível selecionado, não tudo o que é barato: um ou dois modelos de ponta atuais de cada família, cada nível rápido e os modelos de alto volume. Veja planos e limites.
Como se compara em preço
Frente ao modelo mais barato do índice, o Ling-3.0-flash a $0.000053 por resposta, o Llama 4 Maverick custa 11 vezes mais. Frente à mediana, o Kimi K2 0711 a $0.0017, custa 2,9 vezes menos.
Seus vizinhos mais próximos da Meta:
| Modelo | Uma resposta | Contexto | Créditos |
|---|---|---|---|
| Llama 3.3 70B Instruct | $0.0003 | 131K | 1 |
| Llama 4 Maverick (esta página) | $0.0006 | 1M | 1 |
| Muse Glimmer 30B | $0.0011 | 131K | 2 |
| Muse Spark 1.2 | $0.0034 | 1M | 5 |
Se o Llama 4 Maverick é mais modelo do que uma determinada tarefa exige, o Llama 3.3 70B Instruct é a opção mais barata da Meta, a $0.0003 por resposta e 1 crédito por mensagem. Direcionar o trabalho de rotina para um nível mais baixo é a maior coisa que você pode fazer para fazer uma cota durar mais.
A janela de contexto na prática
O Llama 4 Maverick aceita 1M tokens de contexto, o equivalente a cerca de 1600 páginas de texto. Isso está bem acima da mediana do catálogo com preço.
Contexto anunciado e contexto utilizável não são a mesma coisa. A capacidade de recuperação tende a se degradar antes de atingir o limite declarado, principalmente para conteúdo no meio de uma entrada longa, então o teste prático é enviar um documento longo e perguntar sobre algo escondido na metade dele, em vez de confiar no número.
O número importa mais quando você está trabalhando com seus próprios arquivos. Se um documento é longo demais para o modelo escolhido, trocar para um modelo com janela maior na mesma conversa mantém o fio da conversa, então você não começa do zero. Veja como trocar de modelo no meio da conversa.
- Entrada $0.2 e saída $0.8 por milhão de tokens
- $0.0006 por uma resposta padrão, $0.6000 por mil
- Janela de contexto de 1M tokens
- 1 crédito por mensagem dentro do Whizi
- Exige o plano Pro ou superior
- Ocupa a posição 18 de 89 modelos com preço por custo
Perguntas frequentes
Quanto custa o Llama 4 Maverick?
$0.2 por milhão de tokens de entrada e $0.8 por milhão de tokens de saída nas tarifas de tabela, o que equivale a $0.0006 por uma resposta padrão de 1.000 tokens de entrada e 500 de saída, ou $0.6000 por mil respostas dessas. No Whizi é 1 crédito por mensagem dentro de uma cota mensal, em vez de medido por token.
Qual plano do Whizi inclui o Llama 4 Maverick?
Pro e acima, que custa $29.99 por mês ou $19.99 na cobrança anual. A 1 crédito por mensagem, uma cota Pro de 2.000 créditos cobre 2.000 mensagens neste modelo se você gastar toda a cota aqui, e a maioria das pessoas mistura um modelo de 1 crédito para o trabalho de rotina, para fazer render mais.
Qual é a janela de contexto do Llama 4 Maverick?
1M tokens, o equivalente a cerca de 1600 páginas de texto, bem acima da mediana do catálogo com preço. Trate isso como o teto e não como o número de trabalho: a capacidade de recuperação costuma se degradar antes do limite declarado, especialmente para conteúdo no meio de uma entrada longa.
O Llama 4 Maverick é caro em comparação a outros modelos?
Ele ocupa a posição 18 de 89 modelos com preço por custo de resposta, então 71 custam mais e 17 custam menos. A variação em todo o catálogo é de cerca de 2000 vezes entre o mais barato e o mais caro, bem mais ampla do que a maioria imagina, então "caro" só significa algo em relação à alternativa específica que você usaria.