Llama 4 Maverick : prix, fenêtre de contexte et coût en crédits

Réponse rapide

Llama 4 Maverick coûte $0.0006 pour une réponse standard, soit 1 000 tokens en entrée et 500 en sortie. Les tarifs officiels sont de $0.2 par million de tokens en entrée et $0.8 par million en sortie. La fenêtre de contexte est de 1M tokens, bien au-dessus de la médiane du catalogue. Dans Whizi, cela coûte 1 crédit par message sur le plan Pro et au-dessus.

La réponse courte

Llama 4 Maverick est un modèle Meta facturé $0.2 par million de tokens en entrée et $0.8 par million de tokens en sortie, avec une fenêtre de contexte de 1M tokens. Une réponse standard, soit 1 000 tokens en entrée et 500 tokens en sortie, coûte $0.0006. Dans Whizi, cela coûte 1 crédit par message et nécessite le plan Pro ou au-dessus.

Cela en fait l'un des modèles les moins chers du catalogue : 71 des 89 modèles tarifés coûtent plus cher par réponse, et 17 coûtent moins cher.

Ce que coûte Llama 4 Maverick

Les tarifs officiels sont ce que facture le fournisseur par token. Le coût d'une réponse standard est le chiffre le plus utile, car il évalue la même unité de travail pour chaque modèle, quel que soit son mode de facturation.

Entrée, par million de tokens$0.2
Sortie, par million de tokens$0.8
Une réponse standard$0.0006
Mille réponses$0.6000
Fenêtre de contexte1M tokens
Crédits par message dans Whizi1
Plan Whizi minimumPro
Rang par coût, sur 89 modèles tarifés18

Les prix sont les tarifs Meta publiés tels que relayés par OpenRouter, mis à jour le 2026-08-20. L'ensemble des données couvrant les 100 modèles de 29 fournisseurs est l'index des coûts des modèles d'IA, réutilisable gratuitement avec attribution.

Ce que ça coûte dans Whizi

Whizi facture les messages en crédits plutôt qu'en tokens, et Llama 4 Maverick est facturé 1 crédit par message. Le coût ne change pas selon la longueur de votre message ou de la réponse, donc une question d'une ligne et l'analyse d'un long document coûtent la même chose.

PlanPrix par moisCrédits mensuelsMessages sur ce modèle
Pro$29.99, ou $19.99 facturé annuellement2 0002 000
Powerhouse$49.99, ou $34.99 facturé annuellement8 0008 000

Llama 4 Maverick est inclus à partir du plan Pro. Pro est un palier sélectionné plutôt qu'un accès à tout le moins cher : un ou deux modèles phares actuels par famille, chaque palier rapide, et les chevaux de trait à haut volume. Voir plans et limites.

Comment il se situe côté prix

Face au modèle le moins cher de l'index, Ling-3.0-flash à $0.000053 par réponse, Llama 4 Maverick coûte 11 fois plus. Face à la médiane, Kimi K2 0711 à $0.0017, il coûte 2,9 fois moins.

Ses voisins les plus proches chez Meta :

ModèleUne réponseContexteCrédits
Llama 3.3 70B Instruct$0.0003131K1
Llama 4 Maverick (cette page)$0.00061M1
Muse Glimmer 30B$0.0011131K2
Muse Spark 1.2$0.00341M5

Si Llama 4 Maverick est plus puissant que ce dont une tâche a besoin, Llama 3.3 70B Instruct est l'option Meta la moins chère à $0.0003 par réponse et 1 crédit par message. Orienter les tâches routinières vers un palier inférieur est le levier le plus efficace pour faire durer un forfait.

La fenêtre de contexte en pratique

Llama 4 Maverick accepte 1M tokens de contexte, soit environ 1600 pages de texte. C'est bien au-dessus de la médiane du catalogue tarifé.

La fenêtre annoncée et la fenêtre réellement utilisable ne sont pas la même chose. Le rappel tend à se dégrader avant d'atteindre la limite indiquée, en particulier pour le contenu situé au milieu d'un long texte, donc le vrai test consiste à charger un long document et poser une question sur un passage enfoui à mi-parcours, plutôt que de se fier au chiffre annoncé.

Ce chiffre compte surtout quand vous travaillez à partir de vos propres fichiers. Si un document est trop long pour le modèle choisi, passer à un modèle avec un contexte plus large dans la même conversation conserve le fil, donc vous ne repartez pas de zéro. Voir changer de modèle en cours de conversation.

Liste de vérification
  • Entrée $0.2 et sortie $0.8 par million de tokens
  • $0.0006 pour une réponse standard, $0.6000 pour mille
  • Fenêtre de contexte de 1M tokens
  • 1 crédit par message dans Whizi
  • Nécessite le plan Pro ou au-dessus
  • Se classe 18e sur 89 modèles tarifés par coût

Questions fréquentes

Combien coûte Llama 4 Maverick ?

$0.2 par million de tokens en entrée et $0.8 par million de tokens en sortie aux tarifs officiels, ce qui donne $0.0006 pour une réponse standard de 1 000 tokens en entrée et 500 en sortie, ou $0.6000 pour mille d'entre elles. Dans Whizi, cela coûte 1 crédit par message sur un forfait mensuel, plutôt qu'une facturation au token.

Quel plan Whizi inclut Llama 4 Maverick ?

Pro et au-dessus, soit $29.99 par mois ou $19.99 facturé annuellement. À 1 crédit par message, un forfait Pro de 2 000 crédits couvre 2 000 messages sur ce modèle si vous dépensez tout votre forfait ici, et la plupart des gens combinent avec un modèle à 1 crédit pour les tâches courantes afin de le faire durer plus longtemps.

Quelle est la fenêtre de contexte de Llama 4 Maverick ?

1M tokens, soit environ 1600 pages de texte, bien au-dessus de la médiane du catalogue tarifé. Considérez ce chiffre comme un plafond plutôt qu'une valeur de travail fiable : le rappel se dégrade généralement avant d'atteindre la limite indiquée, surtout pour le contenu situé au milieu d'un long texte.

Llama 4 Maverick est-il cher comparé aux autres modèles ?

Il se classe 18e sur 89 modèles tarifés par coût de réponse, donc 71 coûtent plus cher et 17 coûtent moins cher. L'écart sur l'ensemble du catalogue est d'environ 2000 fois entre le moins cher et le plus cher, bien plus large que ce que la plupart des gens imaginent, donc "cher" ne veut dire quelque chose que par rapport à l'alternative précise que vous utiliseriez sinon.