La réponse courte
Llama 4 Maverick est un modèle Meta facturé $0.2 par million de tokens en entrée et $0.8 par million de tokens en sortie, avec une fenêtre de contexte de 1M tokens. Une réponse standard, soit 1 000 tokens en entrée et 500 tokens en sortie, coûte $0.0006. Dans Whizi, cela coûte 1 crédit par message et nécessite le plan Pro ou au-dessus.
Cela en fait l'un des modèles les moins chers du catalogue : 71 des 89 modèles tarifés coûtent plus cher par réponse, et 17 coûtent moins cher.
Ce que coûte Llama 4 Maverick
Les tarifs officiels sont ce que facture le fournisseur par token. Le coût d'une réponse standard est le chiffre le plus utile, car il évalue la même unité de travail pour chaque modèle, quel que soit son mode de facturation.
| Entrée, par million de tokens | $0.2 |
| Sortie, par million de tokens | $0.8 |
| Une réponse standard | $0.0006 |
| Mille réponses | $0.6000 |
| Fenêtre de contexte | 1M tokens |
| Crédits par message dans Whizi | 1 |
| Plan Whizi minimum | Pro |
| Rang par coût, sur 89 modèles tarifés | 18 |
Les prix sont les tarifs Meta publiés tels que relayés par OpenRouter, mis à jour le 2026-08-20. L'ensemble des données couvrant les 100 modèles de 29 fournisseurs est l'index des coûts des modèles d'IA, réutilisable gratuitement avec attribution.
Ce que ça coûte dans Whizi
Whizi facture les messages en crédits plutôt qu'en tokens, et Llama 4 Maverick est facturé 1 crédit par message. Le coût ne change pas selon la longueur de votre message ou de la réponse, donc une question d'une ligne et l'analyse d'un long document coûtent la même chose.
| Plan | Prix par mois | Crédits mensuels | Messages sur ce modèle |
|---|---|---|---|
| Pro | $29.99, ou $19.99 facturé annuellement | 2 000 | 2 000 |
| Powerhouse | $49.99, ou $34.99 facturé annuellement | 8 000 | 8 000 |
Llama 4 Maverick est inclus à partir du plan Pro. Pro est un palier sélectionné plutôt qu'un accès à tout le moins cher : un ou deux modèles phares actuels par famille, chaque palier rapide, et les chevaux de trait à haut volume. Voir plans et limites.
Comment il se situe côté prix
Face au modèle le moins cher de l'index, Ling-3.0-flash à $0.000053 par réponse, Llama 4 Maverick coûte 11 fois plus. Face à la médiane, Kimi K2 0711 à $0.0017, il coûte 2,9 fois moins.
Ses voisins les plus proches chez Meta :
| Modèle | Une réponse | Contexte | Crédits |
|---|---|---|---|
| Llama 3.3 70B Instruct | $0.0003 | 131K | 1 |
| Llama 4 Maverick (cette page) | $0.0006 | 1M | 1 |
| Muse Glimmer 30B | $0.0011 | 131K | 2 |
| Muse Spark 1.2 | $0.0034 | 1M | 5 |
Si Llama 4 Maverick est plus puissant que ce dont une tâche a besoin, Llama 3.3 70B Instruct est l'option Meta la moins chère à $0.0003 par réponse et 1 crédit par message. Orienter les tâches routinières vers un palier inférieur est le levier le plus efficace pour faire durer un forfait.
La fenêtre de contexte en pratique
Llama 4 Maverick accepte 1M tokens de contexte, soit environ 1600 pages de texte. C'est bien au-dessus de la médiane du catalogue tarifé.
La fenêtre annoncée et la fenêtre réellement utilisable ne sont pas la même chose. Le rappel tend à se dégrader avant d'atteindre la limite indiquée, en particulier pour le contenu situé au milieu d'un long texte, donc le vrai test consiste à charger un long document et poser une question sur un passage enfoui à mi-parcours, plutôt que de se fier au chiffre annoncé.
Ce chiffre compte surtout quand vous travaillez à partir de vos propres fichiers. Si un document est trop long pour le modèle choisi, passer à un modèle avec un contexte plus large dans la même conversation conserve le fil, donc vous ne repartez pas de zéro. Voir changer de modèle en cours de conversation.
- Entrée $0.2 et sortie $0.8 par million de tokens
- $0.0006 pour une réponse standard, $0.6000 pour mille
- Fenêtre de contexte de 1M tokens
- 1 crédit par message dans Whizi
- Nécessite le plan Pro ou au-dessus
- Se classe 18e sur 89 modèles tarifés par coût
Questions fréquentes
Combien coûte Llama 4 Maverick ?
$0.2 par million de tokens en entrée et $0.8 par million de tokens en sortie aux tarifs officiels, ce qui donne $0.0006 pour une réponse standard de 1 000 tokens en entrée et 500 en sortie, ou $0.6000 pour mille d'entre elles. Dans Whizi, cela coûte 1 crédit par message sur un forfait mensuel, plutôt qu'une facturation au token.
Quel plan Whizi inclut Llama 4 Maverick ?
Pro et au-dessus, soit $29.99 par mois ou $19.99 facturé annuellement. À 1 crédit par message, un forfait Pro de 2 000 crédits couvre 2 000 messages sur ce modèle si vous dépensez tout votre forfait ici, et la plupart des gens combinent avec un modèle à 1 crédit pour les tâches courantes afin de le faire durer plus longtemps.
Quelle est la fenêtre de contexte de Llama 4 Maverick ?
1M tokens, soit environ 1600 pages de texte, bien au-dessus de la médiane du catalogue tarifé. Considérez ce chiffre comme un plafond plutôt qu'une valeur de travail fiable : le rappel se dégrade généralement avant d'atteindre la limite indiquée, surtout pour le contenu situé au milieu d'un long texte.
Llama 4 Maverick est-il cher comparé aux autres modèles ?
Il se classe 18e sur 89 modèles tarifés par coût de réponse, donc 71 coûtent plus cher et 17 coûtent moins cher. L'écart sur l'ensemble du catalogue est d'environ 2000 fois entre le moins cher et le plus cher, bien plus large que ce que la plupart des gens imaginent, donc "cher" ne veut dire quelque chose que par rapport à l'alternative précise que vous utiliseriez sinon.