Kontextfenster im Vergleich: was die bepreisten Modelle in Whizi fassen können

Kurzantwort

Die Kontextfenster im Whizi-Preisindex reichen von 8,192 Tokens bis 1,310,720 Tokens, und 47 der 100 Zeilen bieten 1,000,000 Tokens oder mehr. Das Fenster entscheidet nicht über dein Ergebnis. Jedes Modell erhält pro Turn ein festes Kontingent von 40,000 Eingabe-Tokens und 20,000 Ausgabe-Tokens, und nur ein Fenster unter 93,000 Tokens senkt dieses Kontingent.

Die kurze Antwort

Die Fenster im bepreisten Index reichen von 8,192 Tokens bis 1,310,720 Tokens, und 47 der 100 bepreisten Zeilen bieten ein Fenster von 1,000,000 Tokens oder mehr. Das Fenster ist das Maximum, das ein Modell in einer Anfrage berücksichtigen kann, gezählt in Tokens, aber es ist nicht die Zahl, die dein Ergebnis in Whizi entscheidet.

Die Zahl, die es entscheidet, ist das Budget pro Turn. Jedes Modell im Katalog erhält für einen Turn dasselbe feste Kontingent: 40,000 Eingabe-Tokens und 20,000 Ausgabe-Tokens. Ein größeres Fenster erhöht dieses Budget nicht. Ein Fenster unter 93,000 Tokens senkt es.

KennzahlWert
Größtes Fenster im bepreisten IndexDeepSeek V4 Flash 0731, 1,310,720 Tokens
Kleinste Fenster im bepreisten IndexDie beiden Tencent Hy-MT2 Zeilen, 8,192 Tokens
Zeilen mit 1,000,000 Tokens oder mehr47 der 100 bepreisten Zeilen
Eingabe pro Turn gesendet, jedes Modell im Katalog40,000 Tokens
Ausgabe pro Turn erlaubt, jedes Modell im Katalog20,000 Tokens
Fenster, unter dem dieses Budget schrumpft93,000 Tokens

Bei einem echten Dokument greifen also zwei Grenzen wirklich: das Limit von 100,000 Zeichen pro Chatnachricht und dieses Eingabebudget von 40,000 Tokens. Keine der beiden ist die Fensterspalte.

Kontextfenster nach Modell, mit Kosten und Plan

Jede Zeile unten stammt aus dem Whizi Cost Index, der 100 OpenRouter-Zeilen über 29 Anbieter hinweg für eine Standardantwort von 1,000 Eingabe-Tokens plus 500 Ausgabe-Tokens bepreist. Die Anbieterpreise hinter diesen Zahlen wurden am 2026-08-20 abgerufen. Im Web zeigt die Credits-Spalte, was eine Nachricht auf diesem Modell dein Credit-Kontingent kostet, und die Plan-Spalte ist der niedrigste Plan, der es freischaltet. Eine Plattform, die nicht auf der Credit-Zulassungsliste steht, sieht stattdessen pauschal 1x, wird pro Turn mit einer Einheit belastet und behält das Nachrichtenkontingent.

OpenAI.

ModellKontextfensterKosten pro AntwortCreditsNiedrigster Plan
GPT-5.6 Luna1M$0.00081Starter
GPT-5.4 Nano400K$0.0008252Powerhouse
GPT-5.4 Mini400K$0.0034Powerhouse
GPT-5.6 Terra1M$0.0084Pro
GPT-5.41M$0.0115Powerhouse
GPT-5.6 Sol1M$0.0120Powerhouse
GPT-5.51M$0.0220Pro
GPT Chat Latest400K$0.0225Powerhouse

Anthropic.

ModellKontextfensterKosten pro AntwortCreditsNiedrigster Plan
Claude Haiku 4.5200K$0.00354Pro
Claude Sonnet 51M$0.00710Pro
Claude Sonnet 4.61M$0.010510Pro
Claude Sonnet 4.51M$0.010510Pro
Claude Opus 51M$0.017520Powerhouse
Claude Opus 4.81M$0.017520Powerhouse
Claude Fable 51M$0.03550Powerhouse

Google.

ModellKontextfensterKosten pro AntwortCreditsNiedrigster Plan
Gemini 2.5 Flash Lite1M$0.00031Pro
Gemini 3.1 Flash Lite1M$0.0011Powerhouse
Gemini 3.7 Flash1M$0.0013132Pro
Gemini 2.5 Flash1M$0.001552Pro
Gemini 3.5 Flash Lite1M$0.001552Powerhouse
Gemini 3.6 Flash1M$0.0026253Pro
Gemini 3.5 Flash1M$0.0068Pro
Gemini 3.1 Pro Preview1M$0.00810Pro

DeepSeek.

ModellKontextfensterKosten pro AntwortCreditsNiedrigster Plan
DeepSeek V4 Flash 07311.31M$0.000281Powerhouse
DeepSeek V3.2164K$0.0004691Pro
DeepSeek V3.1164K$0.0007251Pro
DeepSeek V4 Pro 08131M$0.002972Powerhouse

Qwen.

ModellKontextfensterKosten pro AntwortCreditsNiedrigster Plan
Qwen3.7 Flash1M$0.0000951Powerhouse
Qwen3 Coder Next262K$0.000521Powerhouse
Qwen3.6 Flash1M$0.000751Powerhouse
Qwen3.7 Plus1M$0.000961Pro
Qwen3.8 27B1M$0.002053Powerhouse
Qwen3.7 Max1M$0.0036885Powerhouse
Qwen3.8 Max1M$0.0056Powerhouse

xAI.

ModellKontextfensterKosten pro AntwortCreditsNiedrigster Plan
Grok Build 0.1256K$0.0023Powerhouse
Grok 4.31M$0.00254Powerhouse
Grok 4.5500K$0.0056Powerhouse
Grok 4.6500K$0.0056Pro

Meta.

ModellKontextfensterKosten pro AntwortCreditsNiedrigster Plan
Llama 3.3 70B Instruct131K$0.000261Pro
Llama 4 Maverick1M$0.00061Pro
Muse Glimmer 30B131K$0.00112Powerhouse
Muse Spark 1.21M$0.0033755Powerhouse

Mistral.

ModellKontextfensterKosten pro AntwortCreditsNiedrigster Plan
Codestral 2508256K$0.000751Powerhouse
Mistral Large 3 2512262K$0.001252Pro
Mistral Medium 3.1131K$0.00142Pro
Mistral Medium 3.5262K$0.005256Powerhouse

Z.ai und Moonshot.

ModellKontextfensterKosten pro AntwortCreditsNiedrigster Plan
GLM 4.6205K$0.00151Powerhouse
GLM 4.7205K$0.0012752Powerhouse
GLM 5205K$0.001562Pro
GLM 5.21M$0.0024843Powerhouse
GLM 5.31M$0.00365Powerhouse
Kimi K2 0711131K$0.0017210Powerhouse
Kimi K2 Thinking262K$0.0018510Powerhouse
Kimi K2.7 Code262K$0.0024610Powerhouse
Kimi K31M$0.010510Pro

Vierzehn weitere Zeilen.

Dies ist eine Auswahl der bepreisten Zeilen der übrigen Anbieter, nicht alle davon.

ModellKontextfensterKosten pro AntwortCreditsNiedrigster Plan
MiniMax M2205K$0.0007651Powerhouse
MiniMax M31M$0.00091Powerhouse
Nemotron 3.5 Lightning, NVIDIA262K$0.000181Powerhouse
Nemotron 3 Ultra, NVIDIA512K$0.00243Powerhouse
Nova Pro 1.0, Amazon300K$0.00243Powerhouse
Command A, Cohere256K$0.007510Powerhouse
Solar Pro 4, Upstage524K$0.000091Powerhouse
Ling-3.0-flash, inclusionAI262K$0.0000531Powerhouse
Nex-N2-Mini, Nex Agi262K$0.0000751Powerhouse
Laguna XS 2.1, Poolside262K$0.000121Powerhouse
Granite 4.1 8B, IBM131K$0.00011Powerhouse
Phi 4, Microsoft16K$0.000141Powerhouse
Inkling, Thinkingmachines1M$0.0029754Powerhouse
Fugu Ultra, Sakana1M$0.0225Powerhouse

Der Katalog umfasst 280+ Modelle, und die Zeilen oben stammen aus dem Cost Index, der zum Vergleich 100 OpenRouter-Zeilen bepreist, und weder die Tabellen noch der Index sind der gesamte Katalog. Die Plan-Spalte ist abgeleitet und nicht direkt hinterlegt, und die Modellliste erklärt, wie diese Ableitung funktioniert.

Starter ist der eine Plan, den die Tabelle kaum abdeckt. Seine vier Einträge sind Auto, das hauseigene Modell Whizi AI, das Basis-GPT-Modell, auf dem Whizi AI läuft, und ein schnelles Gemini-Modell. Whizi AI ist eine hauseigene Persona auf diesem Basis-GPT-Modell und kein eigenständiges Modell, und es kostet 1 Credit pro Nachricht. Kostenlose Konten liegen darunter: Sie erreichen nur Whizi AI und Auto, mit 7 Nachrichten am ersten Tag, danach 3 pro Tag, und ein kostenloser Turn ist zusätzlich auf etwa 5,000 Tokens ein und 5,000 aus begrenzt.

Die Fenster, die klein genug sind, um das Budget zu verändern

Die Fensterspalte ist nicht die entscheidende Spalte für die Länge, weil das Budget pro Turn im gesamten Katalog gleich ist. Wie dieses Budget aufgebaut ist und was passiert, wenn ein Gespräch darüber hinausgeht, steht in wenn das Gespräch zu lang ist.

Was ein Fenster tatsächlich entscheidet, ist, ob dieses feste Budget überhaupt gilt, und die Grenze liegt bei 93,000 Tokens. Sechs der 100 bepreisten Zeilen liegen darunter, und zwei davon sind die kleinsten Fenster im gesamten bepreisten Index.

ZeileKontextfensterIn den obigen Tabellen aufgeführt
Tencent Hy-MT2, zwei Zeilen8,192Nein
Phi 4, Microsoft16KJa
Perceptron Mk133KNein
DeepSeek R164KNein
Nano Banana 2 Lite, Google66KNein

Was ein Fenster für ein echtes Dokument bedeutet

Die erste Grenze, an die ein Dokument stößt, ist nicht das Kontextfenster. Es ist das Limit von 100,000 Zeichen pro Nachricht, und Text, der aus einer angehängten Datei extrahiert wird, zählt genau wie getippter Text dagegen.

Im Web werden PDF-, Word- und Tabellendateien in deinem Browser in Text umgewandelt, bevor irgendetwas gesendet wird, sodass das Modell genau diesen extrahierten Text erhält. Jede Datei ist auf 10 MB begrenzt. Die vollständige Formatliste steht in unterstützte Dateitypen.

Projekte sind der eine Ort, an dem ein Dokument wirklich am Budget zehrt, weil eine angeheftete Projektdatei bei jedem einzelnen Turn in diesem Projekt neu in den Prompt eingebaut wird, innerhalb desselben festen Eingabebudgets, egal welches Fenster das Modell trägt. Die Grenzen für angeheftete Dateien und Projektblöcke stehen in wenn das Gespräch zu lang ist.

Fenster im Verhältnis zu Preis und Credits, in den Zeilen oben

Sortiere die Tabellen nach Fenster, und sonst sortiert sich nichts mit. Das größte Fenster im bepreisten Index, mit 1,310,720 Tokens, kostet $0.00028 pro Standardantwort, berechnet 1 Credit pro Nachricht und liegt auf Powerhouse. Die günstigste Zeile von allen kostet $0.000053 pro Antwort bei einem 262K-Fenster. Die mittlere Zeile liegt bei $0.00185 pro Antwort, ebenfalls bei einem 262K-Fenster. Die teuerste Zeile kostet $0.105 pro Standardantwort und trägt überhaupt keine Credit-Stufe, weil sie nicht zu den Zeilen gehört, die Whizi anbietet.

Die Streuung lässt sich am leichtesten bei Zeilen mit demselben Fenster ablesen.

ZeileKontextfensterKosten pro AntwortCredits
DeepSeek V4 Flash 07311.31M$0.000281
Qwen3.7 Flash1M$0.0000951
Inkling, Thinkingmachines1M$0.0029754
Claude Fable 51M$0.03550
Granite 4.1 8B, IBM131K$0.00011
Kimi K2 0711131K$0.0017210

Drei Zeilen dort tragen dasselbe Fenster von 1,000,000 Tokens und berechnen 1, 4 und 50 Credits. Zwei Zeilen tragen dasselbe 131K-Fenster und berechnen 1 und 10. Der bepreiste Index umspannt vom günstigsten bis zum teuersten Wert etwa das 2000-fache, und die Zeilen oben zeigen, dass diese Spanne nicht der Fensterspalte folgt.

Checkliste
  • Die Fenster im bepreisten Index reichen von 8,192 Tokens bis 1,310,720 Tokens
  • 47 der 100 bepreisten Zeilen bieten ein Fenster von 1,000,000 Tokens oder mehr
  • Das größte Fenster im Index beantwortet eine Anfrage für $0.00028 und berechnet 1 Credit
  • Die günstigste Zeile im Index trägt ein 262K-Fenster, nicht das größte
  • Die mittlere bepreiste Zeile liegt bei $0.00185 pro Standardantwort, ebenfalls bei einem 262K-Fenster
  • Im Web zeigt die Credits-Spalte, was eine Nachricht vom Credit-Kontingent verbraucht
  • Eine Credit-Stufe wird aus den Pro-Token-Preisen der Anbieter abgeleitet, die Fenstergröße fließt also nicht ein
  • Whizi AI ist eine hauseigene Persona auf einem Basis-GPT-Modell, für 1 Credit pro Nachricht
  • Kostenlose Konten erreichen zwei Zeilen, und ein kostenloser Turn ist auf 5,000 Tokens ein und aus begrenzt
  • Der Cost Index bepreist 100 OpenRouter-Zeilen, was nicht der gesamte 280+ Katalog ist

Häufige Fragen

Bekomme ich bei einem höheren Plan ein größeres Kontextfenster?

Nein. Das Fenster gehört zum Modell, nicht zu deinem Abo. Was ein höherer Plan kauft, ist Zugang zu mehr Modellen und ein größeres monatliches Credit-Kontingent: 400 Credits auf Starter, 2,000 auf Pro und 8,000 auf Powerhouse.

Kostet ein Modell mit größerem Kontextfenster mehr Credits?

Nicht in den obigen Tabellen. Das größte Fenster im bepreisten Index, mit 1,310,720 Tokens, berechnet 1 Credit pro Nachricht, während eine Zeile mit 131K-Fenster in denselben Tabellen 10 berechnet. Eine Credit-Stufe wird aus einem Referenz-Turn von 3,000 Eingabe-Tokens und 800 Ausgabe-Tokens gegen die aktuellen Pro-Token-Preise der Anbieter abgeleitet, dann auf eine gültige Stufe aufgerundet, und die Fenstergröße ist keiner der Eingangswerte.

Kann ich ein Modell mit großem Kontextfenster auf einem kostenlosen Konto ausprobieren?

Nein, seit dem 2026-09-02 nicht mehr. Ein kostenloses Konto schaltet Whizi AI und Auto frei, sodass die Zeilen mit 1,000,000 Tokens einen Plan brauchen. Ein kostenloser Turn ist außerdem auf etwa 5,000 Tokens ein und 5,000 aus begrenzt, was strenger ist als jedes Kontextfenster auf dieser Seite, und das Kontingent beträgt 7 Nachrichten am ersten Tag, danach 3 pro Tag.

Veröffentlicht Whizi für jedes Modell im Katalog ein Kontextfenster?

Nein. Die Fenster auf dieser Seite stammen aus dem Cost Index, der zum Vergleich 100 OpenRouter-Zeilen bepreist, und der Katalog umfasst 280+ Modelle. Die Modellauswahl in der App ist eine separate Oberfläche, die live vom gemeinsamen Worker bedient wird, und listet daher den aktuellen Katalog statt diesen Index.

Woher stammen die Kontextfenster-Zahlen auf dieser Seite?

Aus dem Whizi Cost Index, der 100 OpenRouter-Zeilen für eine Standardantwort von 1,000 Eingabe-Tokens plus 500 Ausgabe-Tokens bepreist, wobei die Quellpreise am 2026-08-20 von OpenRouter abgerufen wurden. Der Cost Index hält dieses eine Abrufdatum fest, behandle die Dollarwerte also als Stand jenes Tages und nicht als Live-Kurse.