La même réponse coûte 2 000 fois plus cher sur un modèle que sur un autre.

Les fournisseurs publient un prix par million de tokens, qui n'est pas comparable d'un modèle à l'autre. Cet index chiffre une réponse standard, 1 000 tokens en entrée plus 500 tokens en sortie, sur 100 modèles de 29 fournisseurs. Mis à jour le 20 août 2026.

Chiffres clés

  • Réponse la moins chère : $0.000053 sur Ling-3.0-flash (inclusionAI).
  • Réponse médiane : $0.0019 sur Kimi K2 Thinking.
  • Réponse la plus chère : $0.105 sur Claude Opus 4.7 (Fast) (Anthropic).
  • Écart de la moins chère à la plus chère : environ 2 000 fois.

Comment c'est calculé

Une réponse standard, c'est 1 000 tokens en entrée, environ un prompt avec deux paragraphes de contexte, et 500 tokens en sortie, environ une réponse substantielle. Chaque modèle est chiffré sur cette charge identique : (tarif d'entrée x 1 000 + tarif de sortie x 500) divisé par 1 000 000.

Changez le dosage et le classement bouge, et c'est bien l'idée : un modèle à l'entrée bon marché et à la sortie chère gagne sur les prompts courts et perd sur les longues réponses. La formule est publiée pour que vous puissiez la recalculer avec votre propre dosage.

Sources et limites

  • Les prix sont les tarifs publics du catalogue de modèles OpenRouter, en dollars par million de tokens, relevés le 20 août 2026.
  • Ils excluent les remises de cache de prompt, la tarification par lots et les tarifs négociés au volume. Les factures réelles à grande échelle sont plus basses.
  • Le coût n'est pas la qualité. Un modèle 2 000 fois moins cher n'est pas 2 000 fois moins bon, et sur beaucoup de tâches quotidiennes l'écart est faible.
  • La colonne des crédits correspond à ce que Whizi facture par message sur ses propres forfaits, affichée pour les 89 modèles qu'il compte individuellement. Ce n'est pas un tarif de fournisseur.

L'index complet

100 modèles, du moins cher au plus cher. Libre de réutilisation avec attribution au Whizi AI Model Cost Index et un lien vers cette page. Données brutes : JSON et CSV.

#ModèleFournisseurPar réponsePour 1 000 réponses$ / 1M entrée$ / 1M sortieContexteCrédits Whizi
1Ling-3.0-flashinclusionAI$0.000053$0.052$0.021$0.063262K1x
2Nex-N2-MiniNex Agi$0.000075$0.075$0.025$0.1262K1x
3Solar Pro 4Upstage$0.000090$0.090$0.03$0.12524K1x
4Qwen3.7 FlashQwen$0.000095$0.095$0.03$0.131M1x
5Granite 4.1 8BIbm Granite$0.000100$0.100$0.05$0.1131K1x
6Laguna XS 2.1Poolside$0.000120$0.120$0.06$0.12262K1x
7Hy-MT2-1.8BTencent$0.000133$0.133$0.044$0.1778Knon compté
8Phi 4Microsoft$0.000140$0.140$0.07$0.1416K1x
9Nemotron 3.5 LightningNVIDIA$0.000180$0.180$0.08$0.2262K1x
10Laguna S 2.1Poolside$0.000180$0.180$0.09$0.181M1x
11Hy-MT2-30B-A3BTencent$0.000222$0.222$0.074$0.2958Knon compté
12Llama 3.3 70B InstructMeta$0.000260$0.260$0.1$0.32131K1x
13DeepSeek V4 Flash 0731DeepSeek$0.000280$0.280$0.14$0.281M1x
14Gemini 2.5 Flash LiteGoogle$0.000300$0.300$0.1$0.41M1x
15Ring-2.6-1TinclusionAI$0.000388$0.388$0.075$0.625262K1x
16Hy3Tencent$0.000396$0.396$0.132$0.528262K1x
17KAT-Coder-Air V2.5Kwaipilot$0.000450$0.450$0.15$0.6256K1x
18DeepSeek V3.2DeepSeek$0.000469$0.469$0.269$0.4164K1x
19Qwen3 Coder NextQwen$0.000520$0.520$0.12$0.8262K1x
20Llama 4 MaverickMeta$0.000600$0.600$0.2$0.81M1x
21Qwen3.6 35B A3BQwen$0.000640$0.640$0.14$1262K1x
22DeepSeek V3.1DeepSeek$0.000725$0.725$0.25$0.95164K1x
23Codestral 2508Mistral$0.000750$0.750$0.3$0.9256K1x
24Qwen3.6 FlashQwen$0.000750$0.750$0.1875$1.1251M1x
25Nex-N2-ProNex Agi$0.000750$0.750$0.25$1262K1x
26MiniMax M2MiniMax$0.000765$0.765$0.255$1.02205K1x
27Step 3.7 FlashStepfun$0.000775$0.775$0.2$1.15262K1x
28GPT-5.6 Luna ProOpenAI$0.000800$0.800$0.2$1.21Mnon compté
29GPT-5.6 LunaOpenAI$0.000800$0.800$0.2$1.21M1x
30GPT-5.4 NanoOpenAI$0.000825$0.825$0.2$1.25400K2x
31MiniMax M3MiniMax$0.000900$0.900$0.3$1.21M1x
32LongCat 2.0Meituan$0.000900$0.900$0.3$1.21M1x
33Perceptron Mk1Perceptron$0.000900$0.900$0.15$1.533K1x
34Qwen3.7 PlusQwen$0.000960$0.960$0.32$1.281M1x
35Nano Banana 2 Lite (Gemini 3.1 Flash Lite Image)Google$0.0010$1.000$0.25$1.566Knon compté
36Gemini 3.1 Flash LiteGoogle$0.0010$1.000$0.25$1.51M1x
37Inkling SmallThinkingmachines$0.0010$1.050$0.45$1.2524K1x
38Muse Glimmer 30BMeta$0.0011$1.100$0.35$1.5131K2x
39Qwen3.5 Plus 2026-04-20Qwen$0.0012$1.200$0.3$1.81M1x
40Mistral Large 3 2512Mistral$0.0013$1.250$0.5$1.5262K2x
41GLM 4.7Z.ai$0.0013$1.275$0.4$1.75205K2x
42Gemini 3.7 FlashGoogle$0.0013$1.313$0.375$1.8751M2x
43Mistral Medium 3.1Mistral$0.0014$1.400$0.4$2131K2x
44Aion-3.0-MiniAion Labs$0.0014$1.400$0.7$1.4131K2x
45GLM 4.6Z.ai$0.0015$1.500$0.5$2205K1x
46Gemini 2.5 FlashGoogle$0.0015$1.550$0.3$2.51M2x
47Gemini 3.5 Flash LiteGoogle$0.0015$1.550$0.3$2.51M2x
48GLM 5Z.ai$0.0016$1.560$0.6$1.92205K2x
49Kimi K2 0711Moonshot$0.0017$1.720$0.57$2.3131K10x
50Seed 2.1 TurboBytedance Seed$0.0018$1.750$0.5$2.5262K2x
51Kimi K2 ThinkingMoonshot$0.0019$1.850$0.6$2.5262K10x
52R1DeepSeek$0.0019$1.950$0.7$2.564K2x
53Seed-2.0-CodeBytedance Seed$0.0020$2.000$0.5$3262K3x
54Nano Banana 2 (Gemini 3.1 Flash Image)Google$0.0020$2.000$0.5$3131Knon compté
55Grok Build 0.1xAI$0.0020$2.000$1$2256K3x
56Qwen3.8 27BQwen$0.0021$2.050$0.45$3.21M3x
57KAT-Coder-Pro V2.5Kwaipilot$0.0022$2.220$0.74$2.96256K3x
58Nova Pro 1.0Amazon$0.0024$2.400$0.8$3.2300K3x
59Nemotron 3 UltraNVIDIA$0.0024$2.400$0.6$3.6512K3x
60Kimi K2.7 CodeMoonshot$0.0025$2.460$0.71$3.5262K10x
61GLM 5.2Z.ai$0.0025$2.484$0.966$3.0361M3x
62Grok 4.3xAI$0.0025$2.500$1.25$2.51M4x
63Gemini 3.6 FlashGoogle$0.0026$2.625$0.75$3.751M3x
64Sakana NamazuSakana$0.0029$2.950$0.95$4262K4x
65DeepSeek V4 Pro 0813DeepSeek$0.0030$2.970$1.188$3.5641M2x
66InklingThinkingmachines$0.0030$2.975$0.95$4.051M4x
67GPT-5.4 MiniOpenAI$0.0030$3.000$0.75$4.5400K4x
68Muse Spark 1.2Meta$0.0034$3.375$1.25$4.251M5x
69Muse Spark 1.1Meta$0.0034$3.375$1.25$4.251M5x
70Claude Haiku 4.5Anthropic$0.0035$3.500$1$5200K4x
71GLM 5.3Z.ai$0.0036$3.600$1.4$4.41M5x
72Qwen3.7 MaxQwen$0.0037$3.688$1.475$4.4251M5x
73Grok 4.5xAI$0.0050$5.000$2$6500K6x
74Qwen3.8 MaxQwen$0.0050$5.000$2$61M6x
75Qwen3.8 2.4T A95BQwen$0.0050$5.000$2$61M8x
76Grok 4.6xAI$0.0050$5.000$2$6500K6x
77Mistral Medium 3.5Mistral$0.0053$5.250$1.5$7.5262K6x
78Gemini 3.5 FlashGoogle$0.0060$6.000$1.5$91M8x
79Aion-3.0Aion Labs$0.0060$6.000$3$6131K10x
80Claude Sonnet 5Anthropic$0.0070$7.000$2$101M10x
81Command ACohere$0.0075$7.500$2.5$10256K10x
82Gemini 3.1 Pro PreviewGoogle$0.0080$8.000$2$121M10x
83GPT-5.6 Terra ProOpenAI$0.0080$8.000$2$121Mnon compté
84GPT-5.6 TerraOpenAI$0.0080$8.000$2$121M4x
85Nano Banana Pro (Gemini 3 Pro Image)Google$0.0080$8.000$2$12131Knon compté
86GPT-5.4OpenAI$0.010$10.000$2.5$151M15x
87GPT-5.6 Sol ProOpenAI$0.010$10.000$2.5$151Mnon compté
88GPT-5.6 SolOpenAI$0.010$10.000$2.5$151M20x
89Claude Sonnet 4.6Anthropic$0.011$10.500$3$151M10x
90Claude Sonnet 4.5Anthropic$0.011$10.500$3$151M10x
91Kimi K3Moonshot$0.011$10.500$3$151M10x
92Claude Opus 5Anthropic$0.018$17.500$5$251M20x
93Claude Opus 4.8Anthropic$0.018$17.500$5$251M20x
94GPT-5.5OpenAI$0.020$20.000$5$301M20x
95GPT Chat LatestOpenAI$0.020$20.000$5$30400K25x
96Fugu UltraSakana$0.020$20.000$5$301M25x
97Claude Opus 5 (Fast)Anthropic$0.035$35.000$10$501Mnon compté
98Claude Fable 5Anthropic$0.035$35.000$10$501M50x
99Claude Opus 4.8 (Fast)Anthropic$0.035$35.000$10$501Mnon compté
100Claude Opus 4.7 (Fast)Anthropic$0.105$105.000$30$1501Mnon compté

Questions

Pourquoi chiffrer une réponse plutôt qu'un million de tokens ?

Parce que personne n'achète un million de tokens. Les fournisseurs facturent l'entrée et la sortie séparément à des tarifs différents, si bien que deux modèles peuvent sembler proches au million et diverger nettement sur la même tâche réelle. Chiffrer une charge de travail fixe rend les nombres comparables.

Quel modèle offre le meilleur rapport qualité-prix ?

Cela dépend de la tâche. Ce qu'il faut retenir, c'est que le milieu de ce tableau tient dans quelques centièmes de centime par réponse : pour l'essentiel du travail quotidien, l'écart de prix entre bons modèles est négligeable et le choix devrait se faire sur la qualité des réponses.

À quelle fréquence est-ce mis à jour ?

Les prix sont rafraîchis depuis le catalogue du fournisseur et la page porte la date du relevé, actuellement 20 août 2026. Les tarifs de ce marché bougent souvent, vérifiez donc la date avant de citer un chiffre.

Que sont les crédits Whizi ?

Whizi décompte chaque message d'un quota mensuel, et les modèles chers coûtent plus de crédits que les modèles bon marché, de 1x à 20x. La colonne montre ce multiplicateur pour que vous voyiez comment le tarif public d'un fournisseur se traduit en abonnement forfaitaire.

Comment citer cet index

Un jeu de données n'est réutilisé que s'il est facile à créditer, voici donc la ligne à copier :

Whizi AI Model Cost Index, prices as of 2026-08-20. https://whizi.io/fr/tools/model-cost-index/

Publié sous CC BY 4.0, qui autorise la réutilisation commerciale tant que l'index est nommé et cette page mise en lien. Les rédacteurs qui doivent faire vérifier un chiffre avant publication peuvent joindre les mainteneurs à [email protected].

Étape suivante

Chiffrez votre propre texte avec le Calculateur de coût des tokens, ou comparez les forfaits sur les tarifs Whizi.