La réponse courte
La ligne la moins chère de l'index de coût Whizi est Ling, d'inclusionAI, à $0.000053 pour une réponse. Elle facture un crédit par message, comme toutes les autres lignes du bas de l'échelle, et le plancher sur un tour garantit qu'aucun message n'est jamais facturé moins d'un.
Une ligne pas chère par forfait, en introduction aux tableaux complets ci-dessous :
| Modèle | Fournisseur | Coût par réponse | Contexte | Crédits | Forfait |
|---|---|---|---|---|---|
| Ling-3.0-flash | inclusionAI | $0.000053 | 262K | 1 | Powerhouse |
| Llama 3.3 70B Instruct | Meta | $0.00026 | 131K | 1 | Pro |
| GPT-5.6 Luna | OpenAI | $0.0008 | 1M | 1 | Starter |
Une réponse standard dans l'index correspond à 1 000 jetons en entrée et 500 en sortie, ce qui rend comparables les tarifs catalogue de différents fournisseurs. Les prix source ont été récupérés sur OpenRouter le 2026-08-20. L'index tarife 100 lignes réparties sur 29 fournisseurs, et 89 de ces lignes portent une facturation en crédits Whizi. Le jeu de données complet est publié sous forme d'index de coût des modèles IA.
Cette page couvre le bas de gamme de cet index. Pour le catalogue par forfait, voir la liste des modèles, et pour l'échelle de crédits elle-même, voir la référence des crédits.
Les lignes à moins d'un dixième de centime par réponse
Une sélection des lignes qui répondent une fois pour moins de $0.001 à la taille de réponse standard. Toutes les lignes présentées ici sauf une facturent un seul crédit.
| Modèle | Fournisseur | Coût par réponse | Contexte | Crédits | Forfait |
|---|---|---|---|---|---|
| Ling-3.0-flash | inclusionAI | $0.000053 | 262K | 1 | Powerhouse |
| Nex-N2-Mini | Nex Agi | $0.000075 | 262K | 1 | Powerhouse |
| Solar Pro 4 | Upstage | $0.00009 | 524K | 1 | Powerhouse |
| Qwen3.7 Flash | Qwen | $0.000095 | 1M | 1 | Powerhouse |
| Granite 4.1 8B | IBM | $0.0001 | 131K | 1 | Powerhouse |
| Laguna XS 2.1 | Poolside | $0.00012 | 262K | 1 | Powerhouse |
| Phi 4 | Microsoft | $0.00014 | 16K | 1 | Powerhouse |
| Nemotron 3.5 Lightning | NVIDIA | $0.00018 | 262K | 1 | Powerhouse |
| Llama 3.3 70B Instruct | Meta | $0.00026 | 131K | 1 | Pro |
| DeepSeek V4 Flash 0731 | DeepSeek | $0.00028 | 1.31M | 1 | Powerhouse |
| Gemini 2.5 Flash Lite | $0.0003 | 1M | 1 | Pro | |
| DeepSeek V3.2 | DeepSeek | $0.000469 | 164K | 1 | Pro |
| Qwen3 Coder Next | Qwen | $0.00052 | 262K | 1 | Powerhouse |
| Llama 4 Maverick | Meta | $0.0006 | 1M | 1 | Pro |
| DeepSeek V3.1 | DeepSeek | $0.000725 | 164K | 1 | Pro |
| Codestral 2508 | Mistral | $0.00075 | 256K | 1 | Powerhouse |
| Qwen3.6 Flash | Qwen | $0.00075 | 1M | 1 | Powerhouse |
| MiniMax M2 | MiniMax | $0.000765 | 205K | 1 | Powerhouse |
| GPT-5.6 Luna | OpenAI | $0.0008 | 1M | 1 | Starter |
| GPT-5.4 Nano | OpenAI | $0.000825 | 400K | 2 | Powerhouse |
| MiniMax M3 | MiniMax | $0.0009 | 1M | 1 | Powerhouse |
| Qwen3.7 Plus | Qwen | $0.00096 | 1M | 1 | Pro |
Plusieurs des lignes les moins chères portent une fenêtre d'un million de jetons ou plus, et la plus grande fenêtre de tout l'index de prix appartient à une ligne proche du bas de la liste des coûts. Pas cher et petit ne sont pas le même axe ici. La plus petite fenêtre indiquée ci-dessus est de 16K.
La plupart de ces lignes se trouvent sur le forfait le plus cher, pour la raison exposée ci-dessous.
La tranche suivante, jusqu'à la médiane de l'index
La ligne au prix médian est une ligne de raisonnement Kimi à $0.00185 par réponse standard. Un échantillon des lignes entre un dixième de centime et cette médiane :
| Modèle | Fournisseur | Coût par réponse | Contexte | Crédits | Forfait |
|---|---|---|---|---|---|
| Gemini 3.1 Flash Lite | $0.001 | 1M | 1 | Powerhouse | |
| Muse Glimmer 30B | Meta | $0.0011 | 131K | 2 | Powerhouse |
| Mistral Large 3 2512 | Mistral | $0.00125 | 262K | 2 | Pro |
| GLM 4.7 | Z.ai | $0.001275 | 205K | 2 | Powerhouse |
| Gemini 3.7 Flash | $0.001313 | 1M | 2 | Pro | |
| Mistral Medium 3.1 | Mistral | $0.0014 | 131K | 2 | Pro |
| GLM 4.6 | Z.ai | $0.0015 | 205K | 1 | Powerhouse |
| Gemini 2.5 Flash | $0.00155 | 1M | 2 | Pro | |
| Gemini 3.5 Flash Lite | $0.00155 | 1M | 2 | Powerhouse | |
| GLM 5 | Z.ai | $0.00156 | 205K | 2 | Pro |
| Kimi K2 0711 | Moonshot | $0.00172 | 131K | 10 | Powerhouse |
| Kimi K2 Thinking | Moonshot | $0.00185 | 262K | 10 | Powerhouse |
La colonne des crédits et la colonne des dollars ne couvrent pas le même ensemble de lignes. Onze des 100 lignes tarifées ne portent aucune facturation en crédits : elles sont tarifées à titre de comparaison mais ne sont pas proposées comme leur propre ligne mesurée dans le produit. Un chiffre en dollars dans l'index ne signifie donc pas, à lui seul, que la ligne peut être ouverte dans le sélecteur.
Pourquoi la plupart des lignes les moins chères sont sur Powerhouse
La colonne des forfaits ci-dessus n'est pas une décision tarifaire, c'est un repli. L'accès aux modèles se résout par identifiant : les quatre identifiants Starter d'abord, puis les personas d'agents, puis une liste explicite de 37 identifiants supplémentaires pour Pro, et tout le reste retombe sur Powerhouse. Une ligne pas chère que personne n'a jamais fait promouvoir dans la liste Pro se retrouve donc sur le palier le plus élevé par défaut, ce qui explique pourquoi le bas de la liste des coûts se lit comme une colonne Powerhouse. Le repli lui-même est documenté sur la liste des modèles.
| Forfait | Ce qu'il atteint au bas de gamme |
|---|---|
| Free | Aucune allocation de crédits. Whizi AI et Auto uniquement, 7 messages le premier jour puis 3 par jour |
| Starter | Quatre identifiants au total : Auto, Whizi AI, GPT-5.6 Luna, Gemini 3 Flash. Tous coûtent 1 crédit |
| Pro | Starter plus 37 de plus, dont les lignes DeepSeek, Llama, Gemini Flash, Mistral et Qwen marquées Pro ci-dessus |
| Powerhouse | Tout le reste du catalogue, là où se trouvent les lignes des laboratoires plus petits tout en bas de la liste des coûts |
Le palier gratuit n'entre pas du tout dans cette comparaison : depuis le 2026-09-02, il atteint Whizi AI et Auto et rien d'autre, donc ni la ligne la moins chère de l'index ni la plus chère n'y sont accessibles. Ce qu'il permet, c'est 7 messages le premier jour, puis 3 par jour, dépensés sur ces deux lignes.
Starter est le plus restreint. Il atteint quatre identifiants, chacun facture un seul crédit, et son allocation de 400 crédits équivaut donc à 400 messages. Il n'y a aucun modèle Anthropic sur Starter, ni accès aux lignes pas chères de laboratoires plus petits dans les tableaux ci-dessus.
Ce qu'achète un crédit
Un crédit est défini comme un message sur le modèle maison, qui tourne sur le modèle OpenAI de base fixé à un crédit. Un test de build échoue si l'un des deux quitte un jour ce palier, car déplacer l'un ou l'autre redénomine toute l'échelle.
La facturation est un entier fixe par identifiant de modèle. À ce bout du catalogue, cela signifie qu'une ligne à 1 crédit coûte un crédit quelle que soit la longueur d'entrée ou de sortie : collez-y un long document, laissez la réponse s'étendre, et le tour reste facturé un.
| Ligne | Coût par réponse | Coût pour 1 000 réponses | Crédits |
|---|---|---|---|
| Nemotron 3.5 Lightning | $0.00018 | $0.18 | 1 |
| Llama 3.3 70B Instruct | $0.00026 | $0.26 | 1 |
| DeepSeek V4 Flash 0731 | $0.00028 | $0.28 | 1 |
| Gemini 2.5 Flash Lite | $0.0003 | $0.30 | 1 |
| DeepSeek V3.2 | $0.000469 | $0.469 | 1 |
| Llama 4 Maverick | $0.0006 | $0.60 | 1 |
| GPT-5.6 Luna | $0.0008 | $0.80 | 1 |
| Qwen3.7 Plus | $0.00096 | $0.96 | 1 |
Transformé en allocation, le palier du bas est le seul endroit où le chiffre de crédit et le chiffre de message sont le même nombre : chaque tour coûte un, donc une allocation de forfait de N crédits vaut N messages tant que vous restez sur des lignes à 1 crédit. L'allocation par forfait, la réinitialisation et la règle de report sont toutes dans la référence des crédits.
Un autre mécanisme qui compte au bout le moins cher : un tour qui ne rentre pas dans le solde restant est refusé en entier plutôt que facturé en partie. Vingt crédits sur trois crédits restants est rejeté, pas réduit. Sur un modèle à 1 crédit, cela ne se produit presque jamais.
D'où vient un palier de crédit, et quand la politique du propriétaire le prime
L'index de coût mesure une réponse standard de 1 000 jetons en entrée et 500 en sortie face aux tarifs catalogue des fournisseurs. L'échelle de crédits est dérivée d'un tour de référence différent, 3 000 jetons en entrée et 800 en sortie, divisé par ce que coûte ce même tour sur le modèle d'ancrage, soit $0.00156 de dépense fournisseur. Le résultat est ensuite arrondi au palier légal supérieur. L'échelle en compte dix-huit : 1, 2, 3, 4, 5, 6, 8, 10, 12, 15, 20, 25, 30, 40, 50, 60, 80, 100. Quatorze en portent au moins un modèle aujourd'hui, et les quatre vides sont conservés délibérément, car un palier manquant arrondirait le modèle suivant plus cher vers celui du dessus. L'arrondi se fait vers le haut quand un modèle tombe entre deux paliers.
En plus de cela, certaines lignes sont fixées par la politique du propriétaire plutôt que par le calcul. Trois exemples visibles dans les tableaux ci-dessus et dans le catalogue plus large :
- La famille Kimi est facturée 10 crédits contre des tarifs réels de 2, 3, 4 et 12 selon la ligne. C'est pourquoi deux lignes Moonshot se trouvent à un cheveu l'une de l'autre en dollars, à $0.00172 et $0.00185, tout en facturant toutes deux 10 crédits.
- La ligne Gemini sur Starter est facturée 1 crédit contre un tarif réel de 2, ce qui maintient Starter à un crédit plat par message.
- La ligne GPT Terra est facturée 4 crédits contre un tarif réel de 10.
Les lignes ancrées à la recherche sont tarifées différemment encore, car le fournisseur facture des frais fixes par recherche qui n'évoluent pas avec le tarif au jeton. Une recherche à $0.005 vaut 3.2 crédits, donc une seule recherche coûte plus qu'un message entier sur la majorité du catalogue. Ces paliers sont des planchers qui supposent une recherche par réponse.
Un identifiant de modèle sans aucun palier est facturé le sommet de l'échelle, 100 crédits, délibérément : un modèle non tarifé doit remonter comme un ticket de support plutôt que de ronger discrètement la marge. Un test de build échoue si un modèle du catalogue ou un identifiant d'agent atteint la production sans palier.
Enfin, la tarification en crédits est activée par plateforme. Une plateforme sur la liste blanche voit de vrais multiplicateurs dans le sélecteur et est facturée en conséquence sur l'allocation de crédits. Une plateforme qui n'y figure pas voit un crédit plat par tour et garde l'ancienne allocation de messages, soit 400 messages par mois sur Starter, 800 sur Pro et 5 000 sur Powerhouse. Le client web est aujourd'hui sur le système de crédits.
- La ligne la moins chère de l'index répond une fois pour $0.000053
- Une réponse standard correspond à 1 000 jetons en entrée et 500 en sortie, tarifée à partir des tarifs catalogue OpenRouter du 2026-08-20
- Chaque facturation est plafonnée au minimum à un crédit, donc aucun message ne coûte moins d'un
- La plupart des lignes les moins chères sont sur Powerhouse, car tout ce qui n'est pas sur la liste Starter ou Pro retombe sur le palier le plus élevé
- Starter atteint quatre identifiants et tous coûtent 1 crédit, donc 400 crédits équivalent à 400 messages
- Les comptes gratuits n'ont aucune allocation de crédits et atteignent deux lignes : Whizi AI et Auto
- Le palier de crédit est dérivé d'un tour de référence différent du chiffre de l'index, et certains paliers sont fixés par politique
Questions fréquentes
Quel est le modèle IA le moins cher sur Whizi ?
En coût par réponse standard, la ligne la moins chère de l'index de coût Whizi est Ling d'inclusionAI à $0.000053, suivie de Nex de Nex Agi, Solar Pro d'Upstage et le palier rapide de Qwen. Toutes facturent un crédit par message. En ce que vous payez réellement, elles sont à égalité avec toute autre ligne à un crédit, y compris le modèle maison Whizi, le modèle GPT de base sur Starter et plusieurs lignes DeepSeek, Llama et Gemini.
De quel forfait ai-je besoin pour atteindre les modèles les moins chers ?
Cela dépend de la ligne. Plusieurs des lignes les moins chères exigent Powerhouse, car l'accès aux modèles retombe sur le palier le plus élevé pour tout identifiant qui n'est pas sur la liste Starter à quatre éléments ou la liste Pro à 37 éléments. Les lignes pas chères accessibles sur Pro incluent les entrées DeepSeek, Llama, Mistral, Qwen et Gemini Flash marquées Pro dans les tableaux de cette page.
Un modèle moins cher coûte-t-il toujours moins de crédits ?
Non. Les deux chiffres sont mesurés différemment. L'index tarife une réponse standard de 1 000 en entrée, 500 en sortie face aux tarifs catalogue des fournisseurs, tandis que le palier de crédit vient d'un tour de référence de 3 000 en entrée, 800 en sortie arrondi au palier légal supérieur sur une échelle fixe, certaines lignes étant fixées par politique au dessus ou en dessous de leur calcul. C'est pourquoi une ligne à $0.0015 par réponse peut facturer un crédit tandis qu'une ligne à $0.000825 en facture deux.
Qu'advient-il du crédit si une réponse échoue en cours de route ?
Il revient. Une génération qui échoue ou est interrompue est remboursée en supprimant sa ligne d'usage, donc le solde revient là où il était. Le remboursement est rattaché à un identifiant de requête généré par le serveur plutôt qu'à quoi que ce soit fourni par le client, donc appliquer le même remboursement deux fois restitue exactement un tour et non deux. Une chose qui n'est pas remboursée : un tour rejeté pour dépassement de quota dépense quand même ses jetons de limitation de débit, sinon un client à court de crédits pourrait réessayer sans limite.
Puis-je essayer les modèles pas chers sans abonnement ?
Pas sur un compte gratuit, qui n'atteint que Whizi AI et Auto. Son allocation est de 7 messages le premier jour, puis 3 par jour, dépensés sur ces deux lignes, et l'utilisation d'un compte invité se reporte sur le compte enregistré, donc commencer en tant qu'invité puis s'inscrire ensuite ne redonne pas une journée fraîche.