Die günstigsten KI-Modelle pro Antwort in Whizi, und was ein Credit kauft

Kurzantwort

Die günstigste Zeile im Whizi-Kostenindex ist Ling von inclusionAI, mit $0.000053 pro Antwort. Sie kostet einen Credit pro Nachricht, wie jede andere Zeile am unteren Ende der Leiter, und keine Nachricht wird je mit weniger als einem Credit berechnet. Eine Standardantwort besteht aus 1.000 Eingabe-Tokens plus 500 Ausgabe-Tokens.

Die kurze Antwort

Die günstigste Zeile im Whizi-Kostenindex ist Ling von inclusionAI, mit $0.000053 pro Antwort. Sie kostet einen Credit pro Nachricht, wie jede andere Zeile am unteren Ende der Leiter, und die Untergrenze pro Zug garantiert, dass nie weniger als ein Credit berechnet wird.

Eine günstige Zeile pro Plan, als Einstieg in die vollständigen Tabellen unten:

ModellAnbieterKosten pro AntwortKontextCreditsPlan
Ling-3.0-flashinclusionAI$0.000053262K1Powerhouse
Llama 3.3 70B InstructMeta$0.00026131K1Pro
GPT-5.6 LunaOpenAI$0.00081M1Starter

Eine Standardantwort im Index besteht aus 1.000 Eingabe-Tokens plus 500 Ausgabe-Tokens, damit Listenpreise verschiedener Anbieter vergleichbar werden. Die Ausgangspreise wurden am 2026-08-20 von OpenRouter abgerufen. Der Index bepreist 100 Zeilen über 29 Anbieter, und 89 dieser Zeilen tragen eine Whizi-Credit-Gebühr. Der vollständige Datensatz ist als KI-Modell-Kostenindex veröffentlicht.

Diese Seite bildet das günstige Ende dieses Index ab. Für den Katalog nach Plan siehe die Modellliste, und für die Credit-Leiter selbst siehe die Credits-Referenz.

Zeilen unter einem Zehntel Cent pro Antwort

Eine Auswahl der Zeilen, die bei Standardantwortgröße für weniger als $0.001 einmal antworten. Alle bis auf eine der hier aufgeführten Zeilen berechnen einen einzigen Credit.

ModellAnbieterKosten pro AntwortKontextCreditsPlan
Ling-3.0-flashinclusionAI$0.000053262K1Powerhouse
Nex-N2-MiniNex Agi$0.000075262K1Powerhouse
Solar Pro 4Upstage$0.00009524K1Powerhouse
Qwen3.7 FlashQwen$0.0000951M1Powerhouse
Granite 4.1 8BIBM$0.0001131K1Powerhouse
Laguna XS 2.1Poolside$0.00012262K1Powerhouse
Phi 4Microsoft$0.0001416K1Powerhouse
Nemotron 3.5 LightningNVIDIA$0.00018262K1Powerhouse
Llama 3.3 70B InstructMeta$0.00026131K1Pro
DeepSeek V4 Flash 0731DeepSeek$0.000281.31M1Powerhouse
Gemini 2.5 Flash LiteGoogle$0.00031M1Pro
DeepSeek V3.2DeepSeek$0.000469164K1Pro
Qwen3 Coder NextQwen$0.00052262K1Powerhouse
Llama 4 MaverickMeta$0.00061M1Pro
DeepSeek V3.1DeepSeek$0.000725164K1Pro
Codestral 2508Mistral$0.00075256K1Powerhouse
Qwen3.6 FlashQwen$0.000751M1Powerhouse
MiniMax M2MiniMax$0.000765205K1Powerhouse
GPT-5.6 LunaOpenAI$0.00081M1Starter
GPT-5.4 NanoOpenAI$0.000825400K2Powerhouse
MiniMax M3MiniMax$0.00091M1Powerhouse
Qwen3.7 PlusQwen$0.000961M1Pro

Mehrere der günstigsten Zeilen haben eine Million Tokens oder mehr, und das größte Fenster im gesamten Preisindex gehört zu einer Zeile nahe dem unteren Ende der Kostenliste. Günstig und klein sind hier nicht dieselbe Achse. Das kleinste oben aufgeführte Fenster beträgt 16K.

Die meisten dieser Zeilen liegen auf dem teuersten Plan, aus dem unten erläuterten Grund.

Das nächste Band, bis zum Indexmedian

Die Zeile mit dem Medianpreis ist eine Kimi-Reasoning-Zeile bei $0.00185 pro Standardantwort. Eine Stichprobe der Zeilen zwischen einem Zehntel Cent und diesem Median:

ModellAnbieterKosten pro AntwortKontextCreditsPlan
Gemini 3.1 Flash LiteGoogle$0.0011M1Powerhouse
Muse Glimmer 30BMeta$0.0011131K2Powerhouse
Mistral Large 3 2512Mistral$0.00125262K2Pro
GLM 4.7Z.ai$0.001275205K2Powerhouse
Gemini 3.7 FlashGoogle$0.0013131M2Pro
Mistral Medium 3.1Mistral$0.0014131K2Pro
GLM 4.6Z.ai$0.0015205K1Powerhouse
Gemini 2.5 FlashGoogle$0.001551M2Pro
Gemini 3.5 Flash LiteGoogle$0.001551M2Powerhouse
GLM 5Z.ai$0.00156205K2Pro
Kimi K2 0711Moonshot$0.00172131K10Powerhouse
Kimi K2 ThinkingMoonshot$0.00185262K10Powerhouse

Die Credit-Spalte und die Dollar-Spalte decken nicht dieselbe Menge an Zeilen ab. Elf der 100 bepreisten Zeilen tragen überhaupt keine Credit-Gebühr: Sie sind zum Vergleich bepreist, werden aber nicht als eigene abgerechnete Zeile im Produkt angeboten. Ein Dollarbetrag im Index bedeutet daher nicht von selbst, dass die Zeile im Auswahlmenü geöffnet werden kann.

Warum die meisten der günstigsten Zeilen auf Powerhouse liegen

Die Plan-Spalte oben ist keine Preisentscheidung, sondern ein Rückfallmechanismus. Der Modellzugriff wird per Kennung aufgelöst: zuerst die vier Starter-Kennungen, dann die Agenten-Personas, dann eine explizite Liste von 37 weiteren Kennungen für Pro, und alles andere ergibt Powerhouse. Eine günstige Zeile, die nie jemand in die Pro-Liste befördert hat, liegt daher standardmäßig auf der obersten Stufe, weshalb das untere Ende der Kostenliste wie eine Powerhouse-Spalte wirkt. Der Rückfallmechanismus selbst ist auf der Modellliste dokumentiert.

PlanWas am günstigen Ende erreichbar ist
FreeKein Credit-Kontingent. Nur Whizi AI und Auto, 7 Nachrichten am ersten Tag, danach 3 pro Tag
StarterInsgesamt vier Kennungen: Auto, Whizi AI, GPT-5.6 Luna, Gemini 3 Flash. Alle kosten 1 Credit
ProStarter plus 37 weitere, einschließlich der oben mit Pro markierten DeepSeek-, Llama-, Gemini-Flash-, Mistral- und Qwen-Zeilen
PowerhouseAlles andere im Katalog, wo auch die Zeilen der kleineren Labore ganz unten in der Kostenliste liegen

Die Free-Stufe kommt in diesem Vergleich gar nicht vor: Seit dem 2026-09-02 erreicht sie nur Whizi AI und Auto und sonst nichts, sodass weder die günstigste noch die teuerste Zeile im Index darauf erreichbar ist. Sie bietet 7 Nachrichten am ersten Tag, danach 3 pro Tag, verteilt auf diese beiden Zeilen.

Starter ist die schmale Stufe. Sie erreicht vier Kennungen, jede davon kostet einen einzigen Credit, und ihr Kontingent von 400 Credits entspricht daher 400 Nachrichten. Es gibt kein Anthropic-Modell auf Starter, und keinen Zugriff auf die günstigen Zeilen kleinerer Labore aus den Tabellen oben.

Was ein Credit kauft

Ein Credit ist definiert als eine Nachricht auf dem Hausmodell, das auf dem angepinnten Basis-OpenAI-Modell bei einem Credit läuft. Ein Build-Test schlägt fehl, wenn eines der beiden je diese Stufe verlässt, weil das Verschieben eines der beiden die gesamte Leiter neu denominiert.

Die Gebühr ist eine feste Ganzzahl pro Modell-ID. An diesem Ende des Katalogs bedeutet das, eine 1-Credit-Zeile kostet einen Credit, unabhängig von Eingabe- oder Ausgabelänge: Ein langes Dokument hineinkopiert, die Antwort lang laufen lassen, der Zug wird trotzdem nur mit einem berechnet.

ZeileKosten pro AntwortKosten pro 1.000 AntwortenCredits
Nemotron 3.5 Lightning$0.00018$0.181
Llama 3.3 70B Instruct$0.00026$0.261
DeepSeek V4 Flash 0731$0.00028$0.281
Gemini 2.5 Flash Lite$0.0003$0.301
DeepSeek V3.2$0.000469$0.4691
Llama 4 Maverick$0.0006$0.601
GPT-5.6 Luna$0.0008$0.801
Qwen3.7 Plus$0.00096$0.961

In ein Kontingent umgerechnet ist die unterste Stufe der einzige Ort, an dem Credit-Zahl und Nachrichtenzahl übereinstimmen: Jeder Zug kostet eins, also ist ein Plankontingent von N Credits gleich N Nachrichten, solange man bei 1-Credit-Zeilen bleibt. Das Kontingent pro Plan, die Rücksetzung und die Übertragungsregel stehen alle in der Credits-Referenz.

Ein weiterer Mechanismus, der am günstigen Ende zählt: Ein Zug, der nicht in das verbleibende Guthaben passt, wird ganz abgelehnt statt teilweise berechnet. Zwanzig Credits bei drei verbleibenden Credits wird zurückgewiesen, nicht rabattiert. Bei einem 1-Credit-Modell greift das fast nie.

Woher eine Credit-Stufe kommt, und wann die Eigentümerrichtlinie sie überschreibt

Der Kostenindex misst eine Standardantwort von 1.000 Eingabe-Tokens plus 500 Ausgabe-Tokens gegen die Listenpreise der Anbieter. Die Credit-Leiter wird aus einem anderen Referenzzug abgeleitet, 3.000 Eingabe-Tokens und 800 Ausgabe-Tokens, geteilt durch das, was derselbe Zug auf dem Ankermodell kostet, nämlich $0.00156 Anbieterausgaben. Das Ergebnis wird dann auf eine gültige Stufe aufgerundet. Die Leiter hat achtzehn davon: 1, 2, 3, 4, 5, 6, 8, 10, 12, 15, 20, 25, 30, 40, 50, 60, 80, 100. Vierzehn tragen heute mindestens ein Modell, und die vier leeren werden bewusst gehalten, weil eine fehlende Stufe das nächstteurere Modell auf die darüberliegende Stufe aufrunden würde. Gerundet wird immer nach oben, wenn ein Modell zwischen zwei Stufen fällt.

Zusätzlich sind manche Zeilen per Eigentümerrichtlinie statt durch Rechnung festgelegt. Drei Beispiele aus den obigen Tabellen und dem weiteren Katalog:

  • Die Kimi-Familie wird mit 10 Credits berechnet, gegenüber kostenwahren Sätzen von 2, 3, 4 und 12 je nach Zeile. Deshalb liegen zwei Moonshot-Zeilen in Dollar nur eine Haaresbreite auseinander, bei $0.00172 und $0.00185, berechnen aber beide 10 Credits.
  • Die Gemini-Zeile auf Starter wird mit 1 Credit berechnet, gegenüber einem kostenwahren Wert von 2, was Starter bei einem flachen Credit pro Nachricht hält.
  • Die GPT-Terra-Zeile wird mit 4 Credits berechnet, gegenüber einem kostenwahren Wert von 10.

Suchbasierte Zeilen werden noch einmal anders bepreist, weil der Anbieter eine feste Gebühr pro Suche berechnet, die nicht mit dem Token-Satz skaliert. Eine Suche zu $0.005 ist 3,2 Credits wert, sodass eine einzelne Suche mehr kostet als eine ganze Nachricht bei den meisten Katalogeinträgen. Diese Stufen sind Untergrenzen, die von einer Suche pro Antwort ausgehen.

Eine Modellkennung ohne jede Stufe wird bewusst mit der Spitze der Leiter, 100 Credits, berechnet: Ein unbepreistes Modell soll als Support-Ticket auffallen, statt still an der Marge zu zehren. Ein Build-Test schlägt fehl, wenn ein Katalogmodell oder eine Agentenkennung ohne Stufe in Produktion geht.

Schließlich ist die Credit-Bepreisung pro Plattform aktivierbar. Eine Plattform auf der Zulassungsliste sieht echte Multiplikatoren im Auswahlmenü und wird damit gegen das Credit-Kontingent belastet. Eine Plattform, die nicht darauf steht, sieht einen flachen Credit pro Zug und behält stattdessen das ältere Nachrichtenkontingent, das sind 400 Nachrichten im Monat bei Starter, 800 bei Pro und 5.000 bei Powerhouse. Der Web-Client nutzt heute das Credit-System.

Checkliste
  • Die günstigste Zeile im Index kostet einmalig $0.000053
  • Eine Standardantwort besteht aus 1.000 Eingabe-Tokens plus 500 Ausgabe-Tokens, bepreist nach OpenRouter-Listenpreisen vom 2026-08-20
  • Jede Gebühr ist auf mindestens einen Credit begrenzt, sodass keine Nachricht weniger kostet
  • Die meisten der allergünstigsten Zeilen liegen auf Powerhouse, weil alles, was nicht auf der Starter- oder Pro-Liste steht, auf die oberste Stufe durchfällt
  • Starter erreicht vier Kennungen und alle kosten 1 Credit, sodass 400 Credits 400 Nachrichten sind
  • Free-Konten haben kein Credit-Kontingent und erreichen zwei Zeilen: Whizi AI und Auto
  • Die Credit-Stufe wird aus einem anderen Referenzzug als der Indexwert abgeleitet, und manche Stufen sind per Richtlinie festgelegt

Häufige Fragen

Welches ist das günstigste KI-Modell auf Whizi?

Nach Kosten pro Standardantwort ist die günstigste Zeile im Whizi-Kostenindex Ling von inclusionAI bei $0.000053, gefolgt von Nex von Nex Agi, Solar Pro von Upstage und der schnellen Qwen-Stufe. Alle berechnen einen Credit pro Nachricht. Nach dem, was tatsächlich gezahlt wird, sind sie mit jeder anderen 1-Credit-Zeile gleichauf, einschließlich des Whizi-Hausmodells, des Basis-GPT-Modells auf Starter und mehrerer DeepSeek-, Llama- und Gemini-Zeilen.

Welchen Plan brauche ich, um die günstigsten Modelle zu erreichen?

Das hängt von der Zeile ab. Mehrere der allergünstigsten Zeilen erfordern Powerhouse, weil der Modellzugriff für jede Kennung, die nicht auf der vierteiligen Starter-Liste oder der 37-teiligen Pro-Liste steht, auf die oberste Stufe durchfällt. Zu den auf Pro erreichbaren günstigen Zeilen gehören die auf dieser Seite mit Pro markierten DeepSeek-, Llama-, Mistral-, Qwen- und Gemini-Flash-Einträge.

Kostet ein günstigeres Modell immer weniger Credits?

Nein. Die beiden Werte werden unterschiedlich gemessen. Der Index bepreist eine Standardantwort mit 1.000 Eingabe- und 500 Ausgabe-Tokens gegen die Listenpreise der Anbieter, während die Credit-Stufe aus einem Referenzzug von 3.000 Eingabe- und 800 Ausgabe-Tokens stammt, aufgerundet auf eine gültige Stufe einer festen Leiter, wobei manche Zeilen per Richtlinie über oder unter ihrem rechnerischen Wert festgelegt sind. Deshalb kann eine Zeile bei $0.0015 pro Antwort einen Credit kosten, während eine Zeile bei $0.000825 zwei kostet.

Was passiert mit dem Credit, wenn eine Antwort auf halbem Weg fehlschlägt?

Er kommt zurück. Eine Generierung, die fehlschlägt oder abgebrochen wird, wird erstattet, indem ihre Nutzungszeile gelöscht wird, sodass das Guthaben wieder dort steht, wo es war. Die Erstattung ist an eine vom Server erzeugte Anfrage-ID gebunden statt an etwas, das der Client liefert, sodass eine doppelte Anwendung derselben Erstattung genau einen Zug wiederherstellt und nicht zwei. Eine Sache wird nicht erstattet: Ein Zug, der wegen fehlenden Kontingents abgelehnt wird, verbraucht trotzdem seine Rate-Limit-Tokens, sonst könnte ein Client ohne Credits unbegrenzt neu versuchen.

Kann ich die günstigen Modelle ohne Abo ausprobieren?

Nicht mit einem Free-Konto, das nur Whizi AI und Auto erreicht. Sein Kontingent beträgt 7 Nachrichten am ersten Tag, danach 3 pro Tag, verteilt auf diese beiden Zeilen, und die Nutzung eines Gastkontos wird in das registrierte Konto übernommen, sodass ein Start als Gast mit anschließender Anmeldung keinen frischen Tag zurückgibt.