Llama 3.3 70B Instruct : prix, fenêtre de contexte et coût en crédits

Réponse rapide

Llama 3.3 70B Instruct coûte $0.0003 pour une réponse standard, soit 1 000 tokens en entrée et 500 en sortie. Les tarifs affichés sont de $0.1 par million de tokens en entrée et $0.32 par million en sortie. La fenêtre de contexte est de 131K tokens, en dessous de la médiane du catalogue. Dans Whizi, cela coûte 1 crédit par message sur le forfait Pro et au-delà.

La réponse courte

Llama 3.3 70B Instruct est un modèle de Meta facturé $0.1 par million de tokens en entrée et $0.32 par million de tokens en sortie, avec une fenêtre de contexte de 131K tokens. Une réponse standard, soit 1 000 tokens en entrée et 500 tokens en sortie, coûte $0.0003. Dans Whizi, cela coûte 1 crédit par message et nécessite le forfait Pro ou supérieur.

C'est l'un des modèles les moins chers du catalogue : 79 des 89 modèles tarifés coûtent plus cher par réponse, et 9 coûtent moins cher.

Ce que coûte Llama 3.3 70B Instruct

Les tarifs affichés sont ce que facture le fournisseur par token. Le coût d'une réponse standard est le chiffre le plus utile, car il évalue la même unité de travail pour chaque modèle, quel que soit son mode de facturation.

Entrée, par million de tokens$0.1
Sortie, par million de tokens$0.32
Une réponse standard$0.0003
Mille réponses$0.2600
Fenêtre de contexte131K tokens
Crédits par message dans Whizi1
Forfait Whizi minimumPro
Classement par coût, sur 89 modèles tarifés10

Les prix sont les tarifs Meta publiés tels que repris par OpenRouter, mis à jour pour la dernière fois le 2026-08-20. L'ensemble des données couvrant les 100 modèles de 29 fournisseurs est l'index des coûts des modèles d'IA, réutilisable gratuitement avec attribution.

Ce que ça coûte dans Whizi

Whizi facture les messages en crédits plutôt qu'en tokens, et Llama 3.3 70B Instruct est facturé 1 crédit par message. Le coût ne varie pas avec la longueur de votre message ni celle de la réponse, donc une question d'une ligne et l'analyse d'un long document coûtent la même chose.

ForfaitPrix par moisCrédits mensuelsMessages sur ce modèle
Pro$29.99, ou $19.99 facturé annuellement2 0002 000
Powerhouse$49.99, ou $34.99 facturé annuellement8 0008 000

Llama 3.3 70B Instruct est inclus à partir du forfait Pro. Pro est un palier sélectionné plutôt qu'un simple accès à tout ce qui est bon marché : un ou deux modèles phares actuels par famille de modèles, chaque palier rapide, et les modèles à haut volume. Voir forfaits et limites.

Comment il se positionne côté prix

Face au modèle le moins cher de l'index, Ling-3.0-flash à $0.000053 par réponse, Llama 3.3 70B Instruct coûte 4,9 fois plus. Face à la médiane, Kimi K2 0711 à $0.0017, il coûte 6,6 fois moins.

Ses voisins les plus proches chez Meta :

ModèleUne réponseContexteCrédits
Llama 3.3 70B Instruct (cette page)$0.0003131K1
Llama 4 Maverick$0.00061M1
Muse Glimmer 30B$0.0011131K2
Muse Spark 1.2$0.00341M5

C'est le modèle Meta le moins cher de l'index tarifé, donc il n'y a rien de moins cher vers lequel basculer chez ce fournisseur.

La fenêtre de contexte en pratique

Llama 3.3 70B Instruct accepte 131K tokens de contexte, soit environ 200 pages de texte. C'est en dessous de la médiane du catalogue tarifé.

Le contexte annoncé et le contexte réellement exploitable ne sont pas la même chose. La capacité de rappel a tendance à se dégrader avant d'atteindre la limite indiquée, en particulier pour un contenu situé au milieu d'une longue entrée, si bien que le test pratique consiste à charger un long document et à poser une question sur un élément enfoui à mi-parcours plutôt qu'à se fier au chiffre annoncé.

Ce chiffre compte surtout lorsque vous travaillez à partir de vos propres fichiers. Si un document est trop long pour le modèle choisi, passer à un modèle avec un contexte plus large dans la même conversation conserve le fil, pour ne pas repartir de zéro. Voir changer de modèle en cours de conversation.

Liste de vérification
  • Entrée $0.1 et sortie $0.32 par million de tokens
  • $0.0003 pour une réponse standard, $0.2600 pour mille
  • Fenêtre de contexte de 131K tokens
  • 1 crédit par message dans Whizi
  • Nécessite le forfait Pro ou supérieur
  • Classé 10e sur 89 modèles tarifés par coût

Questions fréquentes

Combien coûte Llama 3.3 70B Instruct ?

$0.1 par million de tokens en entrée et $0.32 par million de tokens en sortie au tarif affiché, ce qui représente $0.0003 pour une réponse standard de 1 000 tokens en entrée et 500 en sortie, ou $0.2600 pour mille d'entre elles. Dans Whizi, c'est 1 crédit par message sur une allocation mensuelle, plutôt qu'une facturation au token.

Quel forfait Whizi inclut Llama 3.3 70B Instruct ?

Pro et au-delà, soit $29.99 par mois ou $19.99 facturé annuellement. À 1 crédit par message, une allocation Pro de 2 000 crédits couvre 2 000 messages sur ce modèle si vous y consacrez toute votre allocation, et la plupart des gens mélangent avec un modèle à 1 crédit pour les tâches courantes afin de la faire durer plus longtemps.

Quelle est la fenêtre de contexte de Llama 3.3 70B Instruct ?

131K tokens, soit environ 200 pages de texte, ce qui se situe en dessous de la médiane du catalogue tarifé. Considérez ce chiffre comme un plafond plutôt qu'une valeur de travail : la capacité de rappel se dégrade généralement avant d'atteindre la limite indiquée, en particulier pour le contenu situé au milieu d'une longue entrée.

Llama 3.3 70B Instruct est-il cher par rapport aux autres modèles ?

Il se classe 10e sur 89 modèles tarifés par coût par réponse, donc 79 coûtent plus cher et 9 coûtent moins cher. L'écart sur l'ensemble du catalogue est d'environ 2000 fois entre le moins cher et le plus cher, ce qui est bien plus large que ce que la plupart des gens imaginent, donc « cher » ne veut dire quelque chose que par rapport à l'alternative précise que vous utiliseriez sinon.