Același răspuns costă de 2.000 ori mai mult pe un model decât pe altul.

Furnizorii publică prețul pe milionul de tokenuri, care nu se poate compara între modele. Acest index calculează prețul unui răspuns standard, 1.000 tokenuri de intrare plus 500 tokenuri de ieșire, pe 100 modele de la 29 furnizori. Actualizat la 20 august 2026.

Cifrele principale

  • Cel mai ieftin răspuns: $0.000053 pe Ling-3.0-flash (inclusionAI).
  • Răspunsul median: $0.0019 pe Kimi K2 Thinking.
  • Cel mai scump răspuns: $0.105 pe Claude Opus 4.7 (Fast) (Anthropic).
  • Diferența de la cel mai ieftin la cel mai scump: aproximativ de 2.000 ori.

Cum se calculează

Un răspuns standard înseamnă 1.000 tokenuri de intrare, cam un prompt cu vreo două paragrafe de context, și 500 tokenuri de ieșire, cam un răspuns consistent. Fiecare model e calculat pe aceeași sarcină: (tarif de intrare x 1.000 + tarif de ieșire x 500) împărțit la 1.000.000.

Schimbă proporția și ordinea se mută, și exact asta e ideea: un model cu intrare ieftină și ieșire scumpă câștigă la prompturi scurte și pierde la răspunsuri lungi. Formula e publicată ca s-o poți recalcula pe proporția ta.

Surse și limite

  • Prețurile sunt tarife publice de listă din catalogul de modele OpenRouter, în dolari pe milionul de tokenuri, preluate la 20 august 2026.
  • Nu includ reduceri pentru cache-ul de prompt, prețuri pe loturi sau tarife negociate pe volum. Facturile reale la scară ies mai mici.
  • Costul nu înseamnă calitate. Un model de 2.000 ori mai ieftin nu e de 2.000 ori mai slab, iar la multe sarcini de zi cu zi diferența e mică.
  • Coloana de credite arată cât percepe Whizi pe mesaj în propriile planuri, pentru cele 89 modele pe care le contorizează individual. Nu este un tarif al furnizorului.

Indexul complet

100 modele, de la cel mai ieftin. Se poate refolosi liber cu atribuire către Whizi AI Model Cost Index și un link către această pagină. Date brute: JSON și CSV.

#ModelFurnizorPe răspunsLa 1.000 de răspunsuri$ / 1M intrare$ / 1M ieșireContextCredite Whizi
1Ling-3.0-flashinclusionAI$0.000053$0.052$0.021$0.063262K1x
2Nex-N2-MiniNex Agi$0.000075$0.075$0.025$0.1262K1x
3Solar Pro 4Upstage$0.000090$0.090$0.03$0.12524K1x
4Qwen3.7 FlashQwen$0.000095$0.095$0.03$0.131M1x
5Granite 4.1 8BIbm Granite$0.000100$0.100$0.05$0.1131K1x
6Laguna XS 2.1Poolside$0.000120$0.120$0.06$0.12262K1x
7Hy-MT2-1.8BTencent$0.000133$0.133$0.044$0.1778Knecontorizat
8Phi 4Microsoft$0.000140$0.140$0.07$0.1416K1x
9Nemotron 3.5 LightningNVIDIA$0.000180$0.180$0.08$0.2262K1x
10Laguna S 2.1Poolside$0.000180$0.180$0.09$0.181M1x
11Hy-MT2-30B-A3BTencent$0.000222$0.222$0.074$0.2958Knecontorizat
12Llama 3.3 70B InstructMeta$0.000260$0.260$0.1$0.32131K1x
13DeepSeek V4 Flash 0731DeepSeek$0.000280$0.280$0.14$0.281M1x
14Gemini 2.5 Flash LiteGoogle$0.000300$0.300$0.1$0.41M1x
15Ring-2.6-1TinclusionAI$0.000388$0.388$0.075$0.625262K1x
16Hy3Tencent$0.000396$0.396$0.132$0.528262K1x
17KAT-Coder-Air V2.5Kwaipilot$0.000450$0.450$0.15$0.6256K1x
18DeepSeek V3.2DeepSeek$0.000469$0.469$0.269$0.4164K1x
19Qwen3 Coder NextQwen$0.000520$0.520$0.12$0.8262K1x
20Llama 4 MaverickMeta$0.000600$0.600$0.2$0.81M1x
21Qwen3.6 35B A3BQwen$0.000640$0.640$0.14$1262K1x
22DeepSeek V3.1DeepSeek$0.000725$0.725$0.25$0.95164K1x
23Codestral 2508Mistral$0.000750$0.750$0.3$0.9256K1x
24Qwen3.6 FlashQwen$0.000750$0.750$0.1875$1.1251M1x
25Nex-N2-ProNex Agi$0.000750$0.750$0.25$1262K1x
26MiniMax M2MiniMax$0.000765$0.765$0.255$1.02205K1x
27Step 3.7 FlashStepfun$0.000775$0.775$0.2$1.15262K1x
28GPT-5.6 Luna ProOpenAI$0.000800$0.800$0.2$1.21Mnecontorizat
29GPT-5.6 LunaOpenAI$0.000800$0.800$0.2$1.21M1x
30GPT-5.4 NanoOpenAI$0.000825$0.825$0.2$1.25400K2x
31MiniMax M3MiniMax$0.000900$0.900$0.3$1.21M1x
32LongCat 2.0Meituan$0.000900$0.900$0.3$1.21M1x
33Perceptron Mk1Perceptron$0.000900$0.900$0.15$1.533K1x
34Qwen3.7 PlusQwen$0.000960$0.960$0.32$1.281M1x
35Nano Banana 2 Lite (Gemini 3.1 Flash Lite Image)Google$0.0010$1.000$0.25$1.566Knecontorizat
36Gemini 3.1 Flash LiteGoogle$0.0010$1.000$0.25$1.51M1x
37Inkling SmallThinkingmachines$0.0010$1.050$0.45$1.2524K1x
38Muse Glimmer 30BMeta$0.0011$1.100$0.35$1.5131K2x
39Qwen3.5 Plus 2026-04-20Qwen$0.0012$1.200$0.3$1.81M1x
40Mistral Large 3 2512Mistral$0.0013$1.250$0.5$1.5262K2x
41GLM 4.7Z.ai$0.0013$1.275$0.4$1.75205K2x
42Gemini 3.7 FlashGoogle$0.0013$1.313$0.375$1.8751M2x
43Mistral Medium 3.1Mistral$0.0014$1.400$0.4$2131K2x
44Aion-3.0-MiniAion Labs$0.0014$1.400$0.7$1.4131K2x
45GLM 4.6Z.ai$0.0015$1.500$0.5$2205K1x
46Gemini 2.5 FlashGoogle$0.0015$1.550$0.3$2.51M2x
47Gemini 3.5 Flash LiteGoogle$0.0015$1.550$0.3$2.51M2x
48GLM 5Z.ai$0.0016$1.560$0.6$1.92205K2x
49Kimi K2 0711Moonshot$0.0017$1.720$0.57$2.3131K10x
50Seed 2.1 TurboBytedance Seed$0.0018$1.750$0.5$2.5262K2x
51Kimi K2 ThinkingMoonshot$0.0019$1.850$0.6$2.5262K10x
52R1DeepSeek$0.0019$1.950$0.7$2.564K2x
53Seed-2.0-CodeBytedance Seed$0.0020$2.000$0.5$3262K3x
54Nano Banana 2 (Gemini 3.1 Flash Image)Google$0.0020$2.000$0.5$3131Knecontorizat
55Grok Build 0.1xAI$0.0020$2.000$1$2256K3x
56Qwen3.8 27BQwen$0.0021$2.050$0.45$3.21M3x
57KAT-Coder-Pro V2.5Kwaipilot$0.0022$2.220$0.74$2.96256K3x
58Nova Pro 1.0Amazon$0.0024$2.400$0.8$3.2300K3x
59Nemotron 3 UltraNVIDIA$0.0024$2.400$0.6$3.6512K3x
60Kimi K2.7 CodeMoonshot$0.0025$2.460$0.71$3.5262K10x
61GLM 5.2Z.ai$0.0025$2.484$0.966$3.0361M3x
62Grok 4.3xAI$0.0025$2.500$1.25$2.51M4x
63Gemini 3.6 FlashGoogle$0.0026$2.625$0.75$3.751M3x
64Sakana NamazuSakana$0.0029$2.950$0.95$4262K4x
65DeepSeek V4 Pro 0813DeepSeek$0.0030$2.970$1.188$3.5641M2x
66InklingThinkingmachines$0.0030$2.975$0.95$4.051M4x
67GPT-5.4 MiniOpenAI$0.0030$3.000$0.75$4.5400K4x
68Muse Spark 1.2Meta$0.0034$3.375$1.25$4.251M5x
69Muse Spark 1.1Meta$0.0034$3.375$1.25$4.251M5x
70Claude Haiku 4.5Anthropic$0.0035$3.500$1$5200K4x
71GLM 5.3Z.ai$0.0036$3.600$1.4$4.41M5x
72Qwen3.7 MaxQwen$0.0037$3.688$1.475$4.4251M5x
73Grok 4.5xAI$0.0050$5.000$2$6500K6x
74Qwen3.8 MaxQwen$0.0050$5.000$2$61M6x
75Qwen3.8 2.4T A95BQwen$0.0050$5.000$2$61M8x
76Grok 4.6xAI$0.0050$5.000$2$6500K6x
77Mistral Medium 3.5Mistral$0.0053$5.250$1.5$7.5262K6x
78Gemini 3.5 FlashGoogle$0.0060$6.000$1.5$91M8x
79Aion-3.0Aion Labs$0.0060$6.000$3$6131K10x
80Claude Sonnet 5Anthropic$0.0070$7.000$2$101M10x
81Command ACohere$0.0075$7.500$2.5$10256K10x
82Gemini 3.1 Pro PreviewGoogle$0.0080$8.000$2$121M10x
83GPT-5.6 Terra ProOpenAI$0.0080$8.000$2$121Mnecontorizat
84GPT-5.6 TerraOpenAI$0.0080$8.000$2$121M4x
85Nano Banana Pro (Gemini 3 Pro Image)Google$0.0080$8.000$2$12131Knecontorizat
86GPT-5.4OpenAI$0.010$10.000$2.5$151M15x
87GPT-5.6 Sol ProOpenAI$0.010$10.000$2.5$151Mnecontorizat
88GPT-5.6 SolOpenAI$0.010$10.000$2.5$151M20x
89Claude Sonnet 4.6Anthropic$0.011$10.500$3$151M10x
90Claude Sonnet 4.5Anthropic$0.011$10.500$3$151M10x
91Kimi K3Moonshot$0.011$10.500$3$151M10x
92Claude Opus 5Anthropic$0.018$17.500$5$251M20x
93Claude Opus 4.8Anthropic$0.018$17.500$5$251M20x
94GPT-5.5OpenAI$0.020$20.000$5$301M20x
95GPT Chat LatestOpenAI$0.020$20.000$5$30400K25x
96Fugu UltraSakana$0.020$20.000$5$301M25x
97Claude Opus 5 (Fast)Anthropic$0.035$35.000$10$501Mnecontorizat
98Claude Fable 5Anthropic$0.035$35.000$10$501M50x
99Claude Opus 4.8 (Fast)Anthropic$0.035$35.000$10$501Mnecontorizat
100Claude Opus 4.7 (Fast)Anthropic$0.105$105.000$30$1501Mnecontorizat

Întrebări

De ce calculăm prețul unui răspuns și nu al unui milion de tokenuri?

Pentru că nimeni nu cumpără un milion de tokenuri. Furnizorii cotează intrarea și ieșirea separat, la tarife diferite, așa că două modele pot părea apropiate la milion și se pot depărta mult la aceeași sarcină reală. Calculul pe o sarcină fixă face cifrele comparabile.

Care model are cel mai bun raport preț-calitate?

Depinde de sarcină. Concluzia utilă e că mijlocul acestui tabel se încadrează în câteva sutimi de cent pe răspuns, deci pentru cea mai mare parte a muncii de zi cu zi diferența de preț dintre modele bune e neglijabilă, iar alegerea ar trebui făcută după calitatea răspunsurilor.

Cât de des este actualizat?

Prețurile sunt reîmprospătate din catalogul furnizorului, iar pagina poartă data preluării, în prezent 20 august 2026. Tarifele de pe piața asta se mișcă des, deci verifică data înainte să citezi o cifră.

Ce sunt creditele Whizi?

Whizi scade fiecare mesaj dintr-o alocație lunară, iar modelele scumpe costă mai multe credite decât cele ieftine, de la 1x până la 20x. Coloana arată acel multiplicator, ca să vezi cum se traduce tariful de listă al unui furnizor într-un abonament fix.

Cum se citează

Un set de date e refolosit doar dacă e ușor de creditat, așa că iată rândul de copiat:

Whizi AI Model Cost Index, prices as of 2026-08-20. https://whizi.io/ro/tools/model-cost-index/

Publicat sub CC BY 4.0, care permite refolosirea comercială atâta timp cât indexul este numit și această pagină este legată. Cei care vor să verifice o cifră înainte de publicare pot scrie întreținătorilor la [email protected].

Pasul următor

Calculează prețul textului tău cu Calculator de cost pe tokenuri sau compară planurile pe prețurile Whizi.