Dieselbe Antwort kostet bei einem Modell 2.000 mal mehr als bei einem anderen.

Anbieter veröffentlichen Preise pro Million Tokens, was sich zwischen Modellen nicht vergleichen lässt. Dieser Index berechnet den Preis einer Standardantwort, 1.000 Eingabe-Tokens plus 500 Ausgabe-Tokens, über 100 Modelle von 29 Anbietern. Zuletzt aktualisiert am 20. August 2026.

Die wichtigsten Zahlen

  • Günstigste Antwort: $0.000053 bei Ling-3.0-flash (inclusionAI).
  • Mittlere Antwort: $0.0019 bei Kimi K2 Thinking.
  • Teuerste Antwort: $0.105 bei Claude Opus 4.7 (Fast) (Anthropic).
  • Spanne von der günstigsten zur teuersten: etwa 2.000 mal.

So wird gerechnet

Eine Standardantwort sind 1.000 Eingabe-Tokens, ungefähr ein Prompt mit ein paar Absätzen Kontext, und 500 Ausgabe-Tokens, ungefähr eine ausführliche Antwort. Jedes Modell wird mit genau dieser Last berechnet: (Eingabesatz x 1.000 + Ausgabesatz x 500) geteilt durch 1.000.000.

Ändere das Verhältnis und die Reihenfolge verschiebt sich, und genau darum geht es: Ein Modell mit billiger Eingabe und teurer Ausgabe gewinnt bei kurzen Prompts und verliert bei langen Antworten. Die Formel ist veröffentlicht, damit du sie mit deinem eigenen Verhältnis nachrechnen kannst.

Quellen und Grenzen

  • Die Preise sind öffentliche Listenpreise aus dem OpenRouter-Modellkatalog, in US-Dollar pro Million Tokens, abgerufen am 20. August 2026.
  • Sie enthalten keine Rabatte für Prompt-Caching, keine Batch-Preise und keine ausgehandelten Volumentarife. Echte Rechnungen fallen im großen Maßstab niedriger aus.
  • Kosten sind nicht Qualität. Ein Modell, das 2.000 mal günstiger ist, ist nicht 2.000 mal schlechter, und bei vielen Alltagsaufgaben ist der Abstand klein.
  • Die Credits-Spalte ist das, was Whizi pro Nachricht in den eigenen Tarifen berechnet, gezeigt für die 89 Modelle, die einzeln gezählt werden. Es ist kein Anbietertarif.

Der vollständige Index

100 Modelle, günstigste zuerst. Frei zur Weiterverwendung mit Nennung des Whizi AI Model Cost Index und einem Link auf diese Seite. Rohdaten: JSON und CSV.

#ModellAnbieterPro AntwortPro 1.000 Antworten$ / 1 Mio. Eingabe$ / 1 Mio. AusgabeKontextWhizi-Credits
1Ling-3.0-flashinclusionAI$0.000053$0.052$0.021$0.063262K1x
2Nex-N2-MiniNex Agi$0.000075$0.075$0.025$0.1262K1x
3Solar Pro 4Upstage$0.000090$0.090$0.03$0.12524K1x
4Qwen3.7 FlashQwen$0.000095$0.095$0.03$0.131M1x
5Granite 4.1 8BIbm Granite$0.000100$0.100$0.05$0.1131K1x
6Laguna XS 2.1Poolside$0.000120$0.120$0.06$0.12262K1x
7Hy-MT2-1.8BTencent$0.000133$0.133$0.044$0.1778Knicht gezählt
8Phi 4Microsoft$0.000140$0.140$0.07$0.1416K1x
9Nemotron 3.5 LightningNVIDIA$0.000180$0.180$0.08$0.2262K1x
10Laguna S 2.1Poolside$0.000180$0.180$0.09$0.181M1x
11Hy-MT2-30B-A3BTencent$0.000222$0.222$0.074$0.2958Knicht gezählt
12Llama 3.3 70B InstructMeta$0.000260$0.260$0.1$0.32131K1x
13DeepSeek V4 Flash 0731DeepSeek$0.000280$0.280$0.14$0.281M1x
14Gemini 2.5 Flash LiteGoogle$0.000300$0.300$0.1$0.41M1x
15Ring-2.6-1TinclusionAI$0.000388$0.388$0.075$0.625262K1x
16Hy3Tencent$0.000396$0.396$0.132$0.528262K1x
17KAT-Coder-Air V2.5Kwaipilot$0.000450$0.450$0.15$0.6256K1x
18DeepSeek V3.2DeepSeek$0.000469$0.469$0.269$0.4164K1x
19Qwen3 Coder NextQwen$0.000520$0.520$0.12$0.8262K1x
20Llama 4 MaverickMeta$0.000600$0.600$0.2$0.81M1x
21Qwen3.6 35B A3BQwen$0.000640$0.640$0.14$1262K1x
22DeepSeek V3.1DeepSeek$0.000725$0.725$0.25$0.95164K1x
23Codestral 2508Mistral$0.000750$0.750$0.3$0.9256K1x
24Qwen3.6 FlashQwen$0.000750$0.750$0.1875$1.1251M1x
25Nex-N2-ProNex Agi$0.000750$0.750$0.25$1262K1x
26MiniMax M2MiniMax$0.000765$0.765$0.255$1.02205K1x
27Step 3.7 FlashStepfun$0.000775$0.775$0.2$1.15262K1x
28GPT-5.6 Luna ProOpenAI$0.000800$0.800$0.2$1.21Mnicht gezählt
29GPT-5.6 LunaOpenAI$0.000800$0.800$0.2$1.21M1x
30GPT-5.4 NanoOpenAI$0.000825$0.825$0.2$1.25400K2x
31MiniMax M3MiniMax$0.000900$0.900$0.3$1.21M1x
32LongCat 2.0Meituan$0.000900$0.900$0.3$1.21M1x
33Perceptron Mk1Perceptron$0.000900$0.900$0.15$1.533K1x
34Qwen3.7 PlusQwen$0.000960$0.960$0.32$1.281M1x
35Nano Banana 2 Lite (Gemini 3.1 Flash Lite Image)Google$0.0010$1.000$0.25$1.566Knicht gezählt
36Gemini 3.1 Flash LiteGoogle$0.0010$1.000$0.25$1.51M1x
37Inkling SmallThinkingmachines$0.0010$1.050$0.45$1.2524K1x
38Muse Glimmer 30BMeta$0.0011$1.100$0.35$1.5131K2x
39Qwen3.5 Plus 2026-04-20Qwen$0.0012$1.200$0.3$1.81M1x
40Mistral Large 3 2512Mistral$0.0013$1.250$0.5$1.5262K2x
41GLM 4.7Z.ai$0.0013$1.275$0.4$1.75205K2x
42Gemini 3.7 FlashGoogle$0.0013$1.313$0.375$1.8751M2x
43Mistral Medium 3.1Mistral$0.0014$1.400$0.4$2131K2x
44Aion-3.0-MiniAion Labs$0.0014$1.400$0.7$1.4131K2x
45GLM 4.6Z.ai$0.0015$1.500$0.5$2205K1x
46Gemini 2.5 FlashGoogle$0.0015$1.550$0.3$2.51M2x
47Gemini 3.5 Flash LiteGoogle$0.0015$1.550$0.3$2.51M2x
48GLM 5Z.ai$0.0016$1.560$0.6$1.92205K2x
49Kimi K2 0711Moonshot$0.0017$1.720$0.57$2.3131K10x
50Seed 2.1 TurboBytedance Seed$0.0018$1.750$0.5$2.5262K2x
51Kimi K2 ThinkingMoonshot$0.0019$1.850$0.6$2.5262K10x
52R1DeepSeek$0.0019$1.950$0.7$2.564K2x
53Seed-2.0-CodeBytedance Seed$0.0020$2.000$0.5$3262K3x
54Nano Banana 2 (Gemini 3.1 Flash Image)Google$0.0020$2.000$0.5$3131Knicht gezählt
55Grok Build 0.1xAI$0.0020$2.000$1$2256K3x
56Qwen3.8 27BQwen$0.0021$2.050$0.45$3.21M3x
57KAT-Coder-Pro V2.5Kwaipilot$0.0022$2.220$0.74$2.96256K3x
58Nova Pro 1.0Amazon$0.0024$2.400$0.8$3.2300K3x
59Nemotron 3 UltraNVIDIA$0.0024$2.400$0.6$3.6512K3x
60Kimi K2.7 CodeMoonshot$0.0025$2.460$0.71$3.5262K10x
61GLM 5.2Z.ai$0.0025$2.484$0.966$3.0361M3x
62Grok 4.3xAI$0.0025$2.500$1.25$2.51M4x
63Gemini 3.6 FlashGoogle$0.0026$2.625$0.75$3.751M3x
64Sakana NamazuSakana$0.0029$2.950$0.95$4262K4x
65DeepSeek V4 Pro 0813DeepSeek$0.0030$2.970$1.188$3.5641M2x
66InklingThinkingmachines$0.0030$2.975$0.95$4.051M4x
67GPT-5.4 MiniOpenAI$0.0030$3.000$0.75$4.5400K4x
68Muse Spark 1.2Meta$0.0034$3.375$1.25$4.251M5x
69Muse Spark 1.1Meta$0.0034$3.375$1.25$4.251M5x
70Claude Haiku 4.5Anthropic$0.0035$3.500$1$5200K4x
71GLM 5.3Z.ai$0.0036$3.600$1.4$4.41M5x
72Qwen3.7 MaxQwen$0.0037$3.688$1.475$4.4251M5x
73Grok 4.5xAI$0.0050$5.000$2$6500K6x
74Qwen3.8 MaxQwen$0.0050$5.000$2$61M6x
75Qwen3.8 2.4T A95BQwen$0.0050$5.000$2$61M8x
76Grok 4.6xAI$0.0050$5.000$2$6500K6x
77Mistral Medium 3.5Mistral$0.0053$5.250$1.5$7.5262K6x
78Gemini 3.5 FlashGoogle$0.0060$6.000$1.5$91M8x
79Aion-3.0Aion Labs$0.0060$6.000$3$6131K10x
80Claude Sonnet 5Anthropic$0.0070$7.000$2$101M10x
81Command ACohere$0.0075$7.500$2.5$10256K10x
82Gemini 3.1 Pro PreviewGoogle$0.0080$8.000$2$121M10x
83GPT-5.6 Terra ProOpenAI$0.0080$8.000$2$121Mnicht gezählt
84GPT-5.6 TerraOpenAI$0.0080$8.000$2$121M4x
85Nano Banana Pro (Gemini 3 Pro Image)Google$0.0080$8.000$2$12131Knicht gezählt
86GPT-5.4OpenAI$0.010$10.000$2.5$151M15x
87GPT-5.6 Sol ProOpenAI$0.010$10.000$2.5$151Mnicht gezählt
88GPT-5.6 SolOpenAI$0.010$10.000$2.5$151M20x
89Claude Sonnet 4.6Anthropic$0.011$10.500$3$151M10x
90Claude Sonnet 4.5Anthropic$0.011$10.500$3$151M10x
91Kimi K3Moonshot$0.011$10.500$3$151M10x
92Claude Opus 5Anthropic$0.018$17.500$5$251M20x
93Claude Opus 4.8Anthropic$0.018$17.500$5$251M20x
94GPT-5.5OpenAI$0.020$20.000$5$301M20x
95GPT Chat LatestOpenAI$0.020$20.000$5$30400K25x
96Fugu UltraSakana$0.020$20.000$5$301M25x
97Claude Opus 5 (Fast)Anthropic$0.035$35.000$10$501Mnicht gezählt
98Claude Fable 5Anthropic$0.035$35.000$10$501M50x
99Claude Opus 4.8 (Fast)Anthropic$0.035$35.000$10$501Mnicht gezählt
100Claude Opus 4.7 (Fast)Anthropic$0.105$105.000$30$1501Mnicht gezählt

Fragen

Warum eine Antwort bepreisen statt einer Million Tokens?

Weil niemand eine Million Tokens kauft. Anbieter berechnen Eingabe und Ausgabe getrennt zu unterschiedlichen Sätzen, deshalb können zwei Modelle pro Million dicht beieinander liegen und bei derselben echten Aufgabe weit auseinander. Eine feste Last zu bepreisen macht die Zahlen vergleichbar.

Welches Modell bietet das beste Preis-Leistungs-Verhältnis?

Das hängt von der Aufgabe ab. Die brauchbare Lesart: Die Mitte dieser Tabelle liegt innerhalb weniger Hundertstel Cent pro Antwort, für die meiste Alltagsarbeit ist der Preisunterschied zwischen guten Modellen also vernachlässigbar und die Wahl sollte über die Antwortqualität laufen.

Wie oft wird aktualisiert?

Die Preise werden aus dem Anbieterkatalog aufgefrischt und die Seite trägt das Abrufdatum, aktuell 20. August 2026. Die Tarife bewegen sich in diesem Markt oft, prüfe also das Datum, bevor du eine Zahl zitierst.

Was sind Whizi-Credits?

Whizi rechnet jede Nachricht gegen ein monatliches Kontingent, und teure Modelle kosten mehr Credits als günstige, von 1x bis 20x. Die Spalte zeigt diesen Faktor, damit du siehst, wie sich ein Listenpreis eines Anbieters auf einen Pauschaltarif abbildet.

So zitierst du das

Ein Datensatz wird nur so oft weiterverwendet, wie er leicht zu zitieren ist, also hier die Zeile zum Kopieren:

Whizi AI Model Cost Index, prices as of 2026-08-20. https://whizi.io/de/tools/model-cost-index/

Veröffentlicht unter CC BY 4.0, was kommerzielle Weiterverwendung erlaubt, solange der Index genannt und diese Seite verlinkt wird. Wer vor der Veröffentlichung eine Zahl prüfen lassen möchte, erreicht die Betreuer unter [email protected].

Nächster Schritt

Berechne deinen eigenen Text mit dem Token-Kostenrechner, oder vergleiche die Tarife unter Whizi-Preise.