La réponse courte
Llama 3.3 70B Instruct est un modèle de Meta facturé $0.1 par million de tokens en entrée et $0.32 par million de tokens en sortie, avec une fenêtre de contexte de 131K tokens. Une réponse standard, soit 1 000 tokens en entrée et 500 tokens en sortie, coûte $0.0003. Dans Whizi, cela coûte 1 crédit par message et nécessite le forfait Pro ou supérieur.
C'est l'un des modèles les moins chers du catalogue : 79 des 89 modèles tarifés coûtent plus cher par réponse, et 9 coûtent moins cher.
Ce que coûte Llama 3.3 70B Instruct
Les tarifs affichés sont ce que facture le fournisseur par token. Le coût d'une réponse standard est le chiffre le plus utile, car il évalue la même unité de travail pour chaque modèle, quel que soit son mode de facturation.
| Entrée, par million de tokens | $0.1 |
| Sortie, par million de tokens | $0.32 |
| Une réponse standard | $0.0003 |
| Mille réponses | $0.2600 |
| Fenêtre de contexte | 131K tokens |
| Crédits par message dans Whizi | 1 |
| Forfait Whizi minimum | Pro |
| Classement par coût, sur 89 modèles tarifés | 10 |
Les prix sont les tarifs Meta publiés tels que repris par OpenRouter, mis à jour pour la dernière fois le 2026-08-20. L'ensemble des données couvrant les 100 modèles de 29 fournisseurs est l'index des coûts des modèles d'IA, réutilisable gratuitement avec attribution.
Ce que ça coûte dans Whizi
Whizi facture les messages en crédits plutôt qu'en tokens, et Llama 3.3 70B Instruct est facturé 1 crédit par message. Le coût ne varie pas avec la longueur de votre message ni celle de la réponse, donc une question d'une ligne et l'analyse d'un long document coûtent la même chose.
| Forfait | Prix par mois | Crédits mensuels | Messages sur ce modèle |
|---|---|---|---|
| Pro | $29.99, ou $19.99 facturé annuellement | 2 000 | 2 000 |
| Powerhouse | $49.99, ou $34.99 facturé annuellement | 8 000 | 8 000 |
Llama 3.3 70B Instruct est inclus à partir du forfait Pro. Pro est un palier sélectionné plutôt qu'un simple accès à tout ce qui est bon marché : un ou deux modèles phares actuels par famille de modèles, chaque palier rapide, et les modèles à haut volume. Voir forfaits et limites.
Comment il se positionne côté prix
Face au modèle le moins cher de l'index, Ling-3.0-flash à $0.000053 par réponse, Llama 3.3 70B Instruct coûte 4,9 fois plus. Face à la médiane, Kimi K2 0711 à $0.0017, il coûte 6,6 fois moins.
Ses voisins les plus proches chez Meta :
| Modèle | Une réponse | Contexte | Crédits |
|---|---|---|---|
| Llama 3.3 70B Instruct (cette page) | $0.0003 | 131K | 1 |
| Llama 4 Maverick | $0.0006 | 1M | 1 |
| Muse Glimmer 30B | $0.0011 | 131K | 2 |
| Muse Spark 1.2 | $0.0034 | 1M | 5 |
C'est le modèle Meta le moins cher de l'index tarifé, donc il n'y a rien de moins cher vers lequel basculer chez ce fournisseur.
La fenêtre de contexte en pratique
Llama 3.3 70B Instruct accepte 131K tokens de contexte, soit environ 200 pages de texte. C'est en dessous de la médiane du catalogue tarifé.
Le contexte annoncé et le contexte réellement exploitable ne sont pas la même chose. La capacité de rappel a tendance à se dégrader avant d'atteindre la limite indiquée, en particulier pour un contenu situé au milieu d'une longue entrée, si bien que le test pratique consiste à charger un long document et à poser une question sur un élément enfoui à mi-parcours plutôt qu'à se fier au chiffre annoncé.
Ce chiffre compte surtout lorsque vous travaillez à partir de vos propres fichiers. Si un document est trop long pour le modèle choisi, passer à un modèle avec un contexte plus large dans la même conversation conserve le fil, pour ne pas repartir de zéro. Voir changer de modèle en cours de conversation.
- Entrée $0.1 et sortie $0.32 par million de tokens
- $0.0003 pour une réponse standard, $0.2600 pour mille
- Fenêtre de contexte de 131K tokens
- 1 crédit par message dans Whizi
- Nécessite le forfait Pro ou supérieur
- Classé 10e sur 89 modèles tarifés par coût
Questions fréquentes
Combien coûte Llama 3.3 70B Instruct ?
$0.1 par million de tokens en entrée et $0.32 par million de tokens en sortie au tarif affiché, ce qui représente $0.0003 pour une réponse standard de 1 000 tokens en entrée et 500 en sortie, ou $0.2600 pour mille d'entre elles. Dans Whizi, c'est 1 crédit par message sur une allocation mensuelle, plutôt qu'une facturation au token.
Quel forfait Whizi inclut Llama 3.3 70B Instruct ?
Pro et au-delà, soit $29.99 par mois ou $19.99 facturé annuellement. À 1 crédit par message, une allocation Pro de 2 000 crédits couvre 2 000 messages sur ce modèle si vous y consacrez toute votre allocation, et la plupart des gens mélangent avec un modèle à 1 crédit pour les tâches courantes afin de la faire durer plus longtemps.
Quelle est la fenêtre de contexte de Llama 3.3 70B Instruct ?
131K tokens, soit environ 200 pages de texte, ce qui se situe en dessous de la médiane du catalogue tarifé. Considérez ce chiffre comme un plafond plutôt qu'une valeur de travail : la capacité de rappel se dégrade généralement avant d'atteindre la limite indiquée, en particulier pour le contenu situé au milieu d'une longue entrée.
Llama 3.3 70B Instruct est-il cher par rapport aux autres modèles ?
Il se classe 10e sur 89 modèles tarifés par coût par réponse, donc 79 coûtent plus cher et 9 coûtent moins cher. L'écart sur l'ensemble du catalogue est d'environ 2000 fois entre le moins cher et le plus cher, ce qui est bien plus large que ce que la plupart des gens imaginent, donc « cher » ne veut dire quelque chose que par rapport à l'alternative précise que vous utiliseriez sinon.