Llama 3.3 70B Instruct: preço, janela de contexto e custo em créditos

Resposta rápida

O Llama 3.3 70B Instruct custa $0.0003 por uma resposta padrão, ou seja, 1,000 tokens de entrada e 500 de saída. As tarifas de tabela são $0.1 por milhão de tokens de entrada e $0.32 por milhão de tokens de saída. A janela de contexto é de 131K tokens, abaixo da mediana do catálogo. No Whizi, custa 1 crédito por mensagem no plano Pro e acima.

A resposta rápida

O Llama 3.3 70B Instruct é um modelo da Meta com preço de $0.1 por milhão de tokens de entrada e $0.32 por milhão de tokens de saída, com uma janela de contexto de 131K tokens. Uma resposta padrão, ou seja, 1,000 tokens de entrada e 500 de saída, custa $0.0003. No Whizi, custa 1 crédito por mensagem e exige o plano Pro ou superior.

Isso o torna um dos modelos mais baratos do catálogo: 79 dos 89 modelos com preço custam mais por resposta, e 9 custam menos.

Quanto custa o Llama 3.3 70B Instruct

As tarifas de tabela são o que o provedor cobra por token. O custo de uma resposta padrão é o número mais útil, porque precifica a mesma unidade de trabalho em todos os modelos, independentemente de como cada um é cobrado.

Entrada, por milhão de tokens$0.1
Saída, por milhão de tokens$0.32
Uma resposta padrão$0.0003
Mil respostas$0.2600
Janela de contexto131K tokens
Créditos por mensagem no Whizi1
Plano mínimo do WhiziPro
Posição por custo, de 89 modelos com preço10

Os preços são as tarifas oficiais da Meta conforme divulgadas pela OpenRouter, atualizadas pela última vez em 2026-08-20. O conjunto completo de dados, cobrindo os 100 modelos de 29 provedores, é o índice de custo de modelos de IA, que é gratuito para reutilizar com atribuição.

Quanto custa dentro do Whizi

O Whizi mede as mensagens em créditos, não em tokens, e o Llama 3.3 70B Instruct é cobrado a 1 crédito por mensagem. O custo não muda com o tamanho da sua mensagem ou da resposta, então uma pergunta de uma linha e a análise de um documento longo custam o mesmo.

PlanoPreço por mêsCréditos mensaisMensagens neste modelo
Pro$29.99, ou $19.99 na cobrança anual2,0002,000
Powerhouse$49.99, ou $34.99 na cobrança anual8,0008,000

O Llama 3.3 70B Instruct está incluído a partir do plano Pro. O Pro é um nível selecionado, não simplesmente tudo o que é barato: um ou dois modelos principais atuais de cada família, cada nível rápido e os modelos de alto volume mais usados. Veja planos e limites.

Como ele se compara em preço

Comparado ao modelo mais barato do índice, o Ling-3.0-flash a $0.000053 por resposta, o Llama 3.3 70B Instruct custa 4.9 vezes mais. Comparado à mediana, o Kimi K2 0711 a $0.0017, ele custa 6.6 vezes menos.

Seus vizinhos mais próximos da Meta:

ModeloUma respostaContextoCréditos
Llama 3.3 70B Instruct (esta página)$0.0003131K1
Llama 4 Maverick$0.00061M1
Muse Glimmer 30B$0.0011131K2
Muse Spark 1.2$0.00341M5

É o modelo mais barato da Meta no índice com preços, então dentro deste provedor não há para onde migrar em busca de um valor menor.

A janela de contexto na prática

O Llama 3.3 70B Instruct aceita 131K tokens de contexto, o que equivale a aproximadamente 200 páginas de texto. Isso está abaixo da mediana do catálogo com preços.

A janela de contexto anunciada e a janela de contexto utilizável não são a mesma coisa. A capacidade de recuperação tende a se degradar antes de atingir o limite declarado, principalmente para material no meio de uma entrada longa, então o teste prático é enviar um documento longo e perguntar sobre algo no meio dele, em vez de confiar apenas no número.

O número importa mais quando você está trabalhando com seus próprios arquivos. Se um documento for longo demais para o modelo escolhido, mudar para um modelo com janela de contexto maior na mesma conversa mantém o fio da conversa, então você não precisa recomeçar do zero. Veja trocar de modelo no meio da conversa.

Lista de verificação
  • Entrada a $0.1 e saída a $0.32 por milhão de tokens
  • $0.0003 por uma resposta padrão, $0.2600 por mil
  • Janela de contexto de 131K tokens
  • 1 crédito por mensagem dentro do Whizi
  • Exige o plano Pro ou superior
  • Ocupa a posição 10 de 89 modelos com preço por custo por resposta

Perguntas frequentes

Quanto custa o Llama 3.3 70B Instruct?

$0.1 por milhão de tokens de entrada e $0.32 por milhão de tokens de saída nas tarifas de tabela, o que resulta em $0.0003 para uma resposta padrão de 1,000 tokens de entrada e 500 de saída, ou $0.2600 para mil delas. No Whizi, é 1 crédito por mensagem dentro de uma franquia mensal, em vez de ser medido por token.

Qual plano do Whizi inclui o Llama 3.3 70B Instruct?

Pro e acima, que custa $29.99 por mês ou $19.99 na cobrança anual. A 1 crédito por mensagem, uma franquia Pro de 2,000 créditos cobre 2,000 mensagens neste modelo se você usar toda a franquia aqui, e a maioria das pessoas combina com um modelo de 1 crédito para tarefas rotineiras, o que faz a franquia render mais.

Qual é a janela de contexto do Llama 3.3 70B Instruct?

131K tokens, o que equivale a aproximadamente 200 páginas de texto e fica abaixo da mediana do catálogo com preços. Trate isso como o teto, não como o valor prático: a capacidade de recuperação geralmente se degrada antes de atingir o limite declarado, especialmente para conteúdo no meio de uma entrada longa.

O Llama 3.3 70B Instruct é caro em comparação com outros modelos?

Ele ocupa a posição 10 de 89 modelos com preço por custo por resposta, então 79 custam mais e 9 custam menos. A variação em todo o catálogo é de cerca de 2000 vezes entre o mais barato e o mais caro, o que é muito maior do que a maioria das pessoas imagina, então "caro" só significa algo em relação à alternativa específica que você usaria de outra forma.