A resposta rápida
O Llama 3.3 70B Instruct é um modelo da Meta com preço de $0.1 por milhão de tokens de entrada e $0.32 por milhão de tokens de saída, com uma janela de contexto de 131K tokens. Uma resposta padrão, ou seja, 1,000 tokens de entrada e 500 de saída, custa $0.0003. No Whizi, custa 1 crédito por mensagem e exige o plano Pro ou superior.
Isso o torna um dos modelos mais baratos do catálogo: 79 dos 89 modelos com preço custam mais por resposta, e 9 custam menos.
Quanto custa o Llama 3.3 70B Instruct
As tarifas de tabela são o que o provedor cobra por token. O custo de uma resposta padrão é o número mais útil, porque precifica a mesma unidade de trabalho em todos os modelos, independentemente de como cada um é cobrado.
| Entrada, por milhão de tokens | $0.1 |
| Saída, por milhão de tokens | $0.32 |
| Uma resposta padrão | $0.0003 |
| Mil respostas | $0.2600 |
| Janela de contexto | 131K tokens |
| Créditos por mensagem no Whizi | 1 |
| Plano mínimo do Whizi | Pro |
| Posição por custo, de 89 modelos com preço | 10 |
Os preços são as tarifas oficiais da Meta conforme divulgadas pela OpenRouter, atualizadas pela última vez em 2026-08-20. O conjunto completo de dados, cobrindo os 100 modelos de 29 provedores, é o índice de custo de modelos de IA, que é gratuito para reutilizar com atribuição.
Quanto custa dentro do Whizi
O Whizi mede as mensagens em créditos, não em tokens, e o Llama 3.3 70B Instruct é cobrado a 1 crédito por mensagem. O custo não muda com o tamanho da sua mensagem ou da resposta, então uma pergunta de uma linha e a análise de um documento longo custam o mesmo.
| Plano | Preço por mês | Créditos mensais | Mensagens neste modelo |
|---|---|---|---|
| Pro | $29.99, ou $19.99 na cobrança anual | 2,000 | 2,000 |
| Powerhouse | $49.99, ou $34.99 na cobrança anual | 8,000 | 8,000 |
O Llama 3.3 70B Instruct está incluído a partir do plano Pro. O Pro é um nível selecionado, não simplesmente tudo o que é barato: um ou dois modelos principais atuais de cada família, cada nível rápido e os modelos de alto volume mais usados. Veja planos e limites.
Como ele se compara em preço
Comparado ao modelo mais barato do índice, o Ling-3.0-flash a $0.000053 por resposta, o Llama 3.3 70B Instruct custa 4.9 vezes mais. Comparado à mediana, o Kimi K2 0711 a $0.0017, ele custa 6.6 vezes menos.
Seus vizinhos mais próximos da Meta:
| Modelo | Uma resposta | Contexto | Créditos |
|---|---|---|---|
| Llama 3.3 70B Instruct (esta página) | $0.0003 | 131K | 1 |
| Llama 4 Maverick | $0.0006 | 1M | 1 |
| Muse Glimmer 30B | $0.0011 | 131K | 2 |
| Muse Spark 1.2 | $0.0034 | 1M | 5 |
É o modelo mais barato da Meta no índice com preços, então dentro deste provedor não há para onde migrar em busca de um valor menor.
A janela de contexto na prática
O Llama 3.3 70B Instruct aceita 131K tokens de contexto, o que equivale a aproximadamente 200 páginas de texto. Isso está abaixo da mediana do catálogo com preços.
A janela de contexto anunciada e a janela de contexto utilizável não são a mesma coisa. A capacidade de recuperação tende a se degradar antes de atingir o limite declarado, principalmente para material no meio de uma entrada longa, então o teste prático é enviar um documento longo e perguntar sobre algo no meio dele, em vez de confiar apenas no número.
O número importa mais quando você está trabalhando com seus próprios arquivos. Se um documento for longo demais para o modelo escolhido, mudar para um modelo com janela de contexto maior na mesma conversa mantém o fio da conversa, então você não precisa recomeçar do zero. Veja trocar de modelo no meio da conversa.
- Entrada a $0.1 e saída a $0.32 por milhão de tokens
- $0.0003 por uma resposta padrão, $0.2600 por mil
- Janela de contexto de 131K tokens
- 1 crédito por mensagem dentro do Whizi
- Exige o plano Pro ou superior
- Ocupa a posição 10 de 89 modelos com preço por custo por resposta
Perguntas frequentes
Quanto custa o Llama 3.3 70B Instruct?
$0.1 por milhão de tokens de entrada e $0.32 por milhão de tokens de saída nas tarifas de tabela, o que resulta em $0.0003 para uma resposta padrão de 1,000 tokens de entrada e 500 de saída, ou $0.2600 para mil delas. No Whizi, é 1 crédito por mensagem dentro de uma franquia mensal, em vez de ser medido por token.
Qual plano do Whizi inclui o Llama 3.3 70B Instruct?
Pro e acima, que custa $29.99 por mês ou $19.99 na cobrança anual. A 1 crédito por mensagem, uma franquia Pro de 2,000 créditos cobre 2,000 mensagens neste modelo se você usar toda a franquia aqui, e a maioria das pessoas combina com um modelo de 1 crédito para tarefas rotineiras, o que faz a franquia render mais.
Qual é a janela de contexto do Llama 3.3 70B Instruct?
131K tokens, o que equivale a aproximadamente 200 páginas de texto e fica abaixo da mediana do catálogo com preços. Trate isso como o teto, não como o valor prático: a capacidade de recuperação geralmente se degrada antes de atingir o limite declarado, especialmente para conteúdo no meio de uma entrada longa.
O Llama 3.3 70B Instruct é caro em comparação com outros modelos?
Ele ocupa a posição 10 de 89 modelos com preço por custo por resposta, então 79 custam mais e 9 custam menos. A variação em todo o catálogo é de cerca de 2000 vezes entre o mais barato e o mais caro, o que é muito maior do que a maioria das pessoas imagina, então "caro" só significa algo em relação à alternativa específica que você usaria de outra forma.