Die kurze Antwort
Die günstigste Zeile im Whizi-Kostenindex ist Ling von inclusionAI, mit $0.000053 pro Antwort. Sie kostet einen Credit pro Nachricht, wie jede andere Zeile am unteren Ende der Leiter, und die Untergrenze pro Zug garantiert, dass nie weniger als ein Credit berechnet wird.
Eine günstige Zeile pro Plan, als Einstieg in die vollständigen Tabellen unten:
| Modell | Anbieter | Kosten pro Antwort | Kontext | Credits | Plan |
|---|---|---|---|---|---|
| Ling-3.0-flash | inclusionAI | $0.000053 | 262K | 1 | Powerhouse |
| Llama 3.3 70B Instruct | Meta | $0.00026 | 131K | 1 | Pro |
| GPT-5.6 Luna | OpenAI | $0.0008 | 1M | 1 | Starter |
Eine Standardantwort im Index besteht aus 1.000 Eingabe-Tokens plus 500 Ausgabe-Tokens, damit Listenpreise verschiedener Anbieter vergleichbar werden. Die Ausgangspreise wurden am 2026-08-20 von OpenRouter abgerufen. Der Index bepreist 100 Zeilen über 29 Anbieter, und 89 dieser Zeilen tragen eine Whizi-Credit-Gebühr. Der vollständige Datensatz ist als KI-Modell-Kostenindex veröffentlicht.
Diese Seite bildet das günstige Ende dieses Index ab. Für den Katalog nach Plan siehe die Modellliste, und für die Credit-Leiter selbst siehe die Credits-Referenz.
Zeilen unter einem Zehntel Cent pro Antwort
Eine Auswahl der Zeilen, die bei Standardantwortgröße für weniger als $0.001 einmal antworten. Alle bis auf eine der hier aufgeführten Zeilen berechnen einen einzigen Credit.
| Modell | Anbieter | Kosten pro Antwort | Kontext | Credits | Plan |
|---|---|---|---|---|---|
| Ling-3.0-flash | inclusionAI | $0.000053 | 262K | 1 | Powerhouse |
| Nex-N2-Mini | Nex Agi | $0.000075 | 262K | 1 | Powerhouse |
| Solar Pro 4 | Upstage | $0.00009 | 524K | 1 | Powerhouse |
| Qwen3.7 Flash | Qwen | $0.000095 | 1M | 1 | Powerhouse |
| Granite 4.1 8B | IBM | $0.0001 | 131K | 1 | Powerhouse |
| Laguna XS 2.1 | Poolside | $0.00012 | 262K | 1 | Powerhouse |
| Phi 4 | Microsoft | $0.00014 | 16K | 1 | Powerhouse |
| Nemotron 3.5 Lightning | NVIDIA | $0.00018 | 262K | 1 | Powerhouse |
| Llama 3.3 70B Instruct | Meta | $0.00026 | 131K | 1 | Pro |
| DeepSeek V4 Flash 0731 | DeepSeek | $0.00028 | 1.31M | 1 | Powerhouse |
| Gemini 2.5 Flash Lite | $0.0003 | 1M | 1 | Pro | |
| DeepSeek V3.2 | DeepSeek | $0.000469 | 164K | 1 | Pro |
| Qwen3 Coder Next | Qwen | $0.00052 | 262K | 1 | Powerhouse |
| Llama 4 Maverick | Meta | $0.0006 | 1M | 1 | Pro |
| DeepSeek V3.1 | DeepSeek | $0.000725 | 164K | 1 | Pro |
| Codestral 2508 | Mistral | $0.00075 | 256K | 1 | Powerhouse |
| Qwen3.6 Flash | Qwen | $0.00075 | 1M | 1 | Powerhouse |
| MiniMax M2 | MiniMax | $0.000765 | 205K | 1 | Powerhouse |
| GPT-5.6 Luna | OpenAI | $0.0008 | 1M | 1 | Starter |
| GPT-5.4 Nano | OpenAI | $0.000825 | 400K | 2 | Powerhouse |
| MiniMax M3 | MiniMax | $0.0009 | 1M | 1 | Powerhouse |
| Qwen3.7 Plus | Qwen | $0.00096 | 1M | 1 | Pro |
Mehrere der günstigsten Zeilen haben eine Million Tokens oder mehr, und das größte Fenster im gesamten Preisindex gehört zu einer Zeile nahe dem unteren Ende der Kostenliste. Günstig und klein sind hier nicht dieselbe Achse. Das kleinste oben aufgeführte Fenster beträgt 16K.
Die meisten dieser Zeilen liegen auf dem teuersten Plan, aus dem unten erläuterten Grund.
Das nächste Band, bis zum Indexmedian
Die Zeile mit dem Medianpreis ist eine Kimi-Reasoning-Zeile bei $0.00185 pro Standardantwort. Eine Stichprobe der Zeilen zwischen einem Zehntel Cent und diesem Median:
| Modell | Anbieter | Kosten pro Antwort | Kontext | Credits | Plan |
|---|---|---|---|---|---|
| Gemini 3.1 Flash Lite | $0.001 | 1M | 1 | Powerhouse | |
| Muse Glimmer 30B | Meta | $0.0011 | 131K | 2 | Powerhouse |
| Mistral Large 3 2512 | Mistral | $0.00125 | 262K | 2 | Pro |
| GLM 4.7 | Z.ai | $0.001275 | 205K | 2 | Powerhouse |
| Gemini 3.7 Flash | $0.001313 | 1M | 2 | Pro | |
| Mistral Medium 3.1 | Mistral | $0.0014 | 131K | 2 | Pro |
| GLM 4.6 | Z.ai | $0.0015 | 205K | 1 | Powerhouse |
| Gemini 2.5 Flash | $0.00155 | 1M | 2 | Pro | |
| Gemini 3.5 Flash Lite | $0.00155 | 1M | 2 | Powerhouse | |
| GLM 5 | Z.ai | $0.00156 | 205K | 2 | Pro |
| Kimi K2 0711 | Moonshot | $0.00172 | 131K | 10 | Powerhouse |
| Kimi K2 Thinking | Moonshot | $0.00185 | 262K | 10 | Powerhouse |
Die Credit-Spalte und die Dollar-Spalte decken nicht dieselbe Menge an Zeilen ab. Elf der 100 bepreisten Zeilen tragen überhaupt keine Credit-Gebühr: Sie sind zum Vergleich bepreist, werden aber nicht als eigene abgerechnete Zeile im Produkt angeboten. Ein Dollarbetrag im Index bedeutet daher nicht von selbst, dass die Zeile im Auswahlmenü geöffnet werden kann.
Warum die meisten der günstigsten Zeilen auf Powerhouse liegen
Die Plan-Spalte oben ist keine Preisentscheidung, sondern ein Rückfallmechanismus. Der Modellzugriff wird per Kennung aufgelöst: zuerst die vier Starter-Kennungen, dann die Agenten-Personas, dann eine explizite Liste von 37 weiteren Kennungen für Pro, und alles andere ergibt Powerhouse. Eine günstige Zeile, die nie jemand in die Pro-Liste befördert hat, liegt daher standardmäßig auf der obersten Stufe, weshalb das untere Ende der Kostenliste wie eine Powerhouse-Spalte wirkt. Der Rückfallmechanismus selbst ist auf der Modellliste dokumentiert.
| Plan | Was am günstigen Ende erreichbar ist |
|---|---|
| Free | Kein Credit-Kontingent. Nur Whizi AI und Auto, 7 Nachrichten am ersten Tag, danach 3 pro Tag |
| Starter | Insgesamt vier Kennungen: Auto, Whizi AI, GPT-5.6 Luna, Gemini 3 Flash. Alle kosten 1 Credit |
| Pro | Starter plus 37 weitere, einschließlich der oben mit Pro markierten DeepSeek-, Llama-, Gemini-Flash-, Mistral- und Qwen-Zeilen |
| Powerhouse | Alles andere im Katalog, wo auch die Zeilen der kleineren Labore ganz unten in der Kostenliste liegen |
Die Free-Stufe kommt in diesem Vergleich gar nicht vor: Seit dem 2026-09-02 erreicht sie nur Whizi AI und Auto und sonst nichts, sodass weder die günstigste noch die teuerste Zeile im Index darauf erreichbar ist. Sie bietet 7 Nachrichten am ersten Tag, danach 3 pro Tag, verteilt auf diese beiden Zeilen.
Starter ist die schmale Stufe. Sie erreicht vier Kennungen, jede davon kostet einen einzigen Credit, und ihr Kontingent von 400 Credits entspricht daher 400 Nachrichten. Es gibt kein Anthropic-Modell auf Starter, und keinen Zugriff auf die günstigen Zeilen kleinerer Labore aus den Tabellen oben.
Was ein Credit kauft
Ein Credit ist definiert als eine Nachricht auf dem Hausmodell, das auf dem angepinnten Basis-OpenAI-Modell bei einem Credit läuft. Ein Build-Test schlägt fehl, wenn eines der beiden je diese Stufe verlässt, weil das Verschieben eines der beiden die gesamte Leiter neu denominiert.
Die Gebühr ist eine feste Ganzzahl pro Modell-ID. An diesem Ende des Katalogs bedeutet das, eine 1-Credit-Zeile kostet einen Credit, unabhängig von Eingabe- oder Ausgabelänge: Ein langes Dokument hineinkopiert, die Antwort lang laufen lassen, der Zug wird trotzdem nur mit einem berechnet.
| Zeile | Kosten pro Antwort | Kosten pro 1.000 Antworten | Credits |
|---|---|---|---|
| Nemotron 3.5 Lightning | $0.00018 | $0.18 | 1 |
| Llama 3.3 70B Instruct | $0.00026 | $0.26 | 1 |
| DeepSeek V4 Flash 0731 | $0.00028 | $0.28 | 1 |
| Gemini 2.5 Flash Lite | $0.0003 | $0.30 | 1 |
| DeepSeek V3.2 | $0.000469 | $0.469 | 1 |
| Llama 4 Maverick | $0.0006 | $0.60 | 1 |
| GPT-5.6 Luna | $0.0008 | $0.80 | 1 |
| Qwen3.7 Plus | $0.00096 | $0.96 | 1 |
In ein Kontingent umgerechnet ist die unterste Stufe der einzige Ort, an dem Credit-Zahl und Nachrichtenzahl übereinstimmen: Jeder Zug kostet eins, also ist ein Plankontingent von N Credits gleich N Nachrichten, solange man bei 1-Credit-Zeilen bleibt. Das Kontingent pro Plan, die Rücksetzung und die Übertragungsregel stehen alle in der Credits-Referenz.
Ein weiterer Mechanismus, der am günstigen Ende zählt: Ein Zug, der nicht in das verbleibende Guthaben passt, wird ganz abgelehnt statt teilweise berechnet. Zwanzig Credits bei drei verbleibenden Credits wird zurückgewiesen, nicht rabattiert. Bei einem 1-Credit-Modell greift das fast nie.
Woher eine Credit-Stufe kommt, und wann die Eigentümerrichtlinie sie überschreibt
Der Kostenindex misst eine Standardantwort von 1.000 Eingabe-Tokens plus 500 Ausgabe-Tokens gegen die Listenpreise der Anbieter. Die Credit-Leiter wird aus einem anderen Referenzzug abgeleitet, 3.000 Eingabe-Tokens und 800 Ausgabe-Tokens, geteilt durch das, was derselbe Zug auf dem Ankermodell kostet, nämlich $0.00156 Anbieterausgaben. Das Ergebnis wird dann auf eine gültige Stufe aufgerundet. Die Leiter hat achtzehn davon: 1, 2, 3, 4, 5, 6, 8, 10, 12, 15, 20, 25, 30, 40, 50, 60, 80, 100. Vierzehn tragen heute mindestens ein Modell, und die vier leeren werden bewusst gehalten, weil eine fehlende Stufe das nächstteurere Modell auf die darüberliegende Stufe aufrunden würde. Gerundet wird immer nach oben, wenn ein Modell zwischen zwei Stufen fällt.
Zusätzlich sind manche Zeilen per Eigentümerrichtlinie statt durch Rechnung festgelegt. Drei Beispiele aus den obigen Tabellen und dem weiteren Katalog:
- Die Kimi-Familie wird mit 10 Credits berechnet, gegenüber kostenwahren Sätzen von 2, 3, 4 und 12 je nach Zeile. Deshalb liegen zwei Moonshot-Zeilen in Dollar nur eine Haaresbreite auseinander, bei $0.00172 und $0.00185, berechnen aber beide 10 Credits.
- Die Gemini-Zeile auf Starter wird mit 1 Credit berechnet, gegenüber einem kostenwahren Wert von 2, was Starter bei einem flachen Credit pro Nachricht hält.
- Die GPT-Terra-Zeile wird mit 4 Credits berechnet, gegenüber einem kostenwahren Wert von 10.
Suchbasierte Zeilen werden noch einmal anders bepreist, weil der Anbieter eine feste Gebühr pro Suche berechnet, die nicht mit dem Token-Satz skaliert. Eine Suche zu $0.005 ist 3,2 Credits wert, sodass eine einzelne Suche mehr kostet als eine ganze Nachricht bei den meisten Katalogeinträgen. Diese Stufen sind Untergrenzen, die von einer Suche pro Antwort ausgehen.
Eine Modellkennung ohne jede Stufe wird bewusst mit der Spitze der Leiter, 100 Credits, berechnet: Ein unbepreistes Modell soll als Support-Ticket auffallen, statt still an der Marge zu zehren. Ein Build-Test schlägt fehl, wenn ein Katalogmodell oder eine Agentenkennung ohne Stufe in Produktion geht.
Schließlich ist die Credit-Bepreisung pro Plattform aktivierbar. Eine Plattform auf der Zulassungsliste sieht echte Multiplikatoren im Auswahlmenü und wird damit gegen das Credit-Kontingent belastet. Eine Plattform, die nicht darauf steht, sieht einen flachen Credit pro Zug und behält stattdessen das ältere Nachrichtenkontingent, das sind 400 Nachrichten im Monat bei Starter, 800 bei Pro und 5.000 bei Powerhouse. Der Web-Client nutzt heute das Credit-System.
- Die günstigste Zeile im Index kostet einmalig $0.000053
- Eine Standardantwort besteht aus 1.000 Eingabe-Tokens plus 500 Ausgabe-Tokens, bepreist nach OpenRouter-Listenpreisen vom 2026-08-20
- Jede Gebühr ist auf mindestens einen Credit begrenzt, sodass keine Nachricht weniger kostet
- Die meisten der allergünstigsten Zeilen liegen auf Powerhouse, weil alles, was nicht auf der Starter- oder Pro-Liste steht, auf die oberste Stufe durchfällt
- Starter erreicht vier Kennungen und alle kosten 1 Credit, sodass 400 Credits 400 Nachrichten sind
- Free-Konten haben kein Credit-Kontingent und erreichen zwei Zeilen: Whizi AI und Auto
- Die Credit-Stufe wird aus einem anderen Referenzzug als der Indexwert abgeleitet, und manche Stufen sind per Richtlinie festgelegt
Häufige Fragen
Welches ist das günstigste KI-Modell auf Whizi?
Nach Kosten pro Standardantwort ist die günstigste Zeile im Whizi-Kostenindex Ling von inclusionAI bei $0.000053, gefolgt von Nex von Nex Agi, Solar Pro von Upstage und der schnellen Qwen-Stufe. Alle berechnen einen Credit pro Nachricht. Nach dem, was tatsächlich gezahlt wird, sind sie mit jeder anderen 1-Credit-Zeile gleichauf, einschließlich des Whizi-Hausmodells, des Basis-GPT-Modells auf Starter und mehrerer DeepSeek-, Llama- und Gemini-Zeilen.
Welchen Plan brauche ich, um die günstigsten Modelle zu erreichen?
Das hängt von der Zeile ab. Mehrere der allergünstigsten Zeilen erfordern Powerhouse, weil der Modellzugriff für jede Kennung, die nicht auf der vierteiligen Starter-Liste oder der 37-teiligen Pro-Liste steht, auf die oberste Stufe durchfällt. Zu den auf Pro erreichbaren günstigen Zeilen gehören die auf dieser Seite mit Pro markierten DeepSeek-, Llama-, Mistral-, Qwen- und Gemini-Flash-Einträge.
Kostet ein günstigeres Modell immer weniger Credits?
Nein. Die beiden Werte werden unterschiedlich gemessen. Der Index bepreist eine Standardantwort mit 1.000 Eingabe- und 500 Ausgabe-Tokens gegen die Listenpreise der Anbieter, während die Credit-Stufe aus einem Referenzzug von 3.000 Eingabe- und 800 Ausgabe-Tokens stammt, aufgerundet auf eine gültige Stufe einer festen Leiter, wobei manche Zeilen per Richtlinie über oder unter ihrem rechnerischen Wert festgelegt sind. Deshalb kann eine Zeile bei $0.0015 pro Antwort einen Credit kosten, während eine Zeile bei $0.000825 zwei kostet.
Was passiert mit dem Credit, wenn eine Antwort auf halbem Weg fehlschlägt?
Er kommt zurück. Eine Generierung, die fehlschlägt oder abgebrochen wird, wird erstattet, indem ihre Nutzungszeile gelöscht wird, sodass das Guthaben wieder dort steht, wo es war. Die Erstattung ist an eine vom Server erzeugte Anfrage-ID gebunden statt an etwas, das der Client liefert, sodass eine doppelte Anwendung derselben Erstattung genau einen Zug wiederherstellt und nicht zwei. Eine Sache wird nicht erstattet: Ein Zug, der wegen fehlenden Kontingents abgelehnt wird, verbraucht trotzdem seine Rate-Limit-Tokens, sonst könnte ein Client ohne Credits unbegrenzt neu versuchen.
Kann ich die günstigen Modelle ohne Abo ausprobieren?
Nicht mit einem Free-Konto, das nur Whizi AI und Auto erreicht. Sein Kontingent beträgt 7 Nachrichten am ersten Tag, danach 3 pro Tag, verteilt auf diese beiden Zeilen, und die Nutzung eines Gastkontos wird in das registrierte Konto übernommen, sodass ein Start als Gast mit anschließender Anmeldung keinen frischen Tag zurückgibt.