Die kurze Antwort
Die Fenster im bepreisten Index reichen von 8,192 Tokens bis 1,310,720 Tokens, und 47 der 100 bepreisten Zeilen bieten ein Fenster von 1,000,000 Tokens oder mehr. Das Fenster ist das Maximum, das ein Modell in einer Anfrage berücksichtigen kann, gezählt in Tokens, aber es ist nicht die Zahl, die dein Ergebnis in Whizi entscheidet.
Die Zahl, die es entscheidet, ist das Budget pro Turn. Jedes Modell im Katalog erhält für einen Turn dasselbe feste Kontingent: 40,000 Eingabe-Tokens und 20,000 Ausgabe-Tokens. Ein größeres Fenster erhöht dieses Budget nicht. Ein Fenster unter 93,000 Tokens senkt es.
| Kennzahl | Wert |
|---|---|
| Größtes Fenster im bepreisten Index | DeepSeek V4 Flash 0731, 1,310,720 Tokens |
| Kleinste Fenster im bepreisten Index | Die beiden Tencent Hy-MT2 Zeilen, 8,192 Tokens |
| Zeilen mit 1,000,000 Tokens oder mehr | 47 der 100 bepreisten Zeilen |
| Eingabe pro Turn gesendet, jedes Modell im Katalog | 40,000 Tokens |
| Ausgabe pro Turn erlaubt, jedes Modell im Katalog | 20,000 Tokens |
| Fenster, unter dem dieses Budget schrumpft | 93,000 Tokens |
Bei einem echten Dokument greifen also zwei Grenzen wirklich: das Limit von 100,000 Zeichen pro Chatnachricht und dieses Eingabebudget von 40,000 Tokens. Keine der beiden ist die Fensterspalte.
Kontextfenster nach Modell, mit Kosten und Plan
Jede Zeile unten stammt aus dem Whizi Cost Index, der 100 OpenRouter-Zeilen über 29 Anbieter hinweg für eine Standardantwort von 1,000 Eingabe-Tokens plus 500 Ausgabe-Tokens bepreist. Die Anbieterpreise hinter diesen Zahlen wurden am 2026-08-20 abgerufen. Im Web zeigt die Credits-Spalte, was eine Nachricht auf diesem Modell dein Credit-Kontingent kostet, und die Plan-Spalte ist der niedrigste Plan, der es freischaltet. Eine Plattform, die nicht auf der Credit-Zulassungsliste steht, sieht stattdessen pauschal 1x, wird pro Turn mit einer Einheit belastet und behält das Nachrichtenkontingent.
OpenAI.
| Modell | Kontextfenster | Kosten pro Antwort | Credits | Niedrigster Plan |
|---|---|---|---|---|
| GPT-5.6 Luna | 1M | $0.0008 | 1 | Starter |
| GPT-5.4 Nano | 400K | $0.000825 | 2 | Powerhouse |
| GPT-5.4 Mini | 400K | $0.003 | 4 | Powerhouse |
| GPT-5.6 Terra | 1M | $0.008 | 4 | Pro |
| GPT-5.4 | 1M | $0.01 | 15 | Powerhouse |
| GPT-5.6 Sol | 1M | $0.01 | 20 | Powerhouse |
| GPT-5.5 | 1M | $0.02 | 20 | Pro |
| GPT Chat Latest | 400K | $0.02 | 25 | Powerhouse |
Anthropic.
| Modell | Kontextfenster | Kosten pro Antwort | Credits | Niedrigster Plan |
|---|---|---|---|---|
| Claude Haiku 4.5 | 200K | $0.0035 | 4 | Pro |
| Claude Sonnet 5 | 1M | $0.007 | 10 | Pro |
| Claude Sonnet 4.6 | 1M | $0.0105 | 10 | Pro |
| Claude Sonnet 4.5 | 1M | $0.0105 | 10 | Pro |
| Claude Opus 5 | 1M | $0.0175 | 20 | Powerhouse |
| Claude Opus 4.8 | 1M | $0.0175 | 20 | Powerhouse |
| Claude Fable 5 | 1M | $0.035 | 50 | Powerhouse |
Google.
| Modell | Kontextfenster | Kosten pro Antwort | Credits | Niedrigster Plan |
|---|---|---|---|---|
| Gemini 2.5 Flash Lite | 1M | $0.0003 | 1 | Pro |
| Gemini 3.1 Flash Lite | 1M | $0.001 | 1 | Powerhouse |
| Gemini 3.7 Flash | 1M | $0.001313 | 2 | Pro |
| Gemini 2.5 Flash | 1M | $0.00155 | 2 | Pro |
| Gemini 3.5 Flash Lite | 1M | $0.00155 | 2 | Powerhouse |
| Gemini 3.6 Flash | 1M | $0.002625 | 3 | Pro |
| Gemini 3.5 Flash | 1M | $0.006 | 8 | Pro |
| Gemini 3.1 Pro Preview | 1M | $0.008 | 10 | Pro |
DeepSeek.
| Modell | Kontextfenster | Kosten pro Antwort | Credits | Niedrigster Plan |
|---|---|---|---|---|
| DeepSeek V4 Flash 0731 | 1.31M | $0.00028 | 1 | Powerhouse |
| DeepSeek V3.2 | 164K | $0.000469 | 1 | Pro |
| DeepSeek V3.1 | 164K | $0.000725 | 1 | Pro |
| DeepSeek V4 Pro 0813 | 1M | $0.00297 | 2 | Powerhouse |
Qwen.
| Modell | Kontextfenster | Kosten pro Antwort | Credits | Niedrigster Plan |
|---|---|---|---|---|
| Qwen3.7 Flash | 1M | $0.000095 | 1 | Powerhouse |
| Qwen3 Coder Next | 262K | $0.00052 | 1 | Powerhouse |
| Qwen3.6 Flash | 1M | $0.00075 | 1 | Powerhouse |
| Qwen3.7 Plus | 1M | $0.00096 | 1 | Pro |
| Qwen3.8 27B | 1M | $0.00205 | 3 | Powerhouse |
| Qwen3.7 Max | 1M | $0.003688 | 5 | Powerhouse |
| Qwen3.8 Max | 1M | $0.005 | 6 | Powerhouse |
xAI.
| Modell | Kontextfenster | Kosten pro Antwort | Credits | Niedrigster Plan |
|---|---|---|---|---|
| Grok Build 0.1 | 256K | $0.002 | 3 | Powerhouse |
| Grok 4.3 | 1M | $0.0025 | 4 | Powerhouse |
| Grok 4.5 | 500K | $0.005 | 6 | Powerhouse |
| Grok 4.6 | 500K | $0.005 | 6 | Pro |
Meta.
| Modell | Kontextfenster | Kosten pro Antwort | Credits | Niedrigster Plan |
|---|---|---|---|---|
| Llama 3.3 70B Instruct | 131K | $0.00026 | 1 | Pro |
| Llama 4 Maverick | 1M | $0.0006 | 1 | Pro |
| Muse Glimmer 30B | 131K | $0.0011 | 2 | Powerhouse |
| Muse Spark 1.2 | 1M | $0.003375 | 5 | Powerhouse |
Mistral.
| Modell | Kontextfenster | Kosten pro Antwort | Credits | Niedrigster Plan |
|---|---|---|---|---|
| Codestral 2508 | 256K | $0.00075 | 1 | Powerhouse |
| Mistral Large 3 2512 | 262K | $0.00125 | 2 | Pro |
| Mistral Medium 3.1 | 131K | $0.0014 | 2 | Pro |
| Mistral Medium 3.5 | 262K | $0.00525 | 6 | Powerhouse |
Z.ai und Moonshot.
| Modell | Kontextfenster | Kosten pro Antwort | Credits | Niedrigster Plan |
|---|---|---|---|---|
| GLM 4.6 | 205K | $0.0015 | 1 | Powerhouse |
| GLM 4.7 | 205K | $0.001275 | 2 | Powerhouse |
| GLM 5 | 205K | $0.00156 | 2 | Pro |
| GLM 5.2 | 1M | $0.002484 | 3 | Powerhouse |
| GLM 5.3 | 1M | $0.0036 | 5 | Powerhouse |
| Kimi K2 0711 | 131K | $0.00172 | 10 | Powerhouse |
| Kimi K2 Thinking | 262K | $0.00185 | 10 | Powerhouse |
| Kimi K2.7 Code | 262K | $0.00246 | 10 | Powerhouse |
| Kimi K3 | 1M | $0.0105 | 10 | Pro |
Vierzehn weitere Zeilen.
Dies ist eine Auswahl der bepreisten Zeilen der übrigen Anbieter, nicht alle davon.
| Modell | Kontextfenster | Kosten pro Antwort | Credits | Niedrigster Plan |
|---|---|---|---|---|
| MiniMax M2 | 205K | $0.000765 | 1 | Powerhouse |
| MiniMax M3 | 1M | $0.0009 | 1 | Powerhouse |
| Nemotron 3.5 Lightning, NVIDIA | 262K | $0.00018 | 1 | Powerhouse |
| Nemotron 3 Ultra, NVIDIA | 512K | $0.0024 | 3 | Powerhouse |
| Nova Pro 1.0, Amazon | 300K | $0.0024 | 3 | Powerhouse |
| Command A, Cohere | 256K | $0.0075 | 10 | Powerhouse |
| Solar Pro 4, Upstage | 524K | $0.00009 | 1 | Powerhouse |
| Ling-3.0-flash, inclusionAI | 262K | $0.000053 | 1 | Powerhouse |
| Nex-N2-Mini, Nex Agi | 262K | $0.000075 | 1 | Powerhouse |
| Laguna XS 2.1, Poolside | 262K | $0.00012 | 1 | Powerhouse |
| Granite 4.1 8B, IBM | 131K | $0.0001 | 1 | Powerhouse |
| Phi 4, Microsoft | 16K | $0.00014 | 1 | Powerhouse |
| Inkling, Thinkingmachines | 1M | $0.002975 | 4 | Powerhouse |
| Fugu Ultra, Sakana | 1M | $0.02 | 25 | Powerhouse |
Der Katalog umfasst 280+ Modelle, und die Zeilen oben stammen aus dem Cost Index, der zum Vergleich 100 OpenRouter-Zeilen bepreist, und weder die Tabellen noch der Index sind der gesamte Katalog. Die Plan-Spalte ist abgeleitet und nicht direkt hinterlegt, und die Modellliste erklärt, wie diese Ableitung funktioniert.
Starter ist der eine Plan, den die Tabelle kaum abdeckt. Seine vier Einträge sind Auto, das hauseigene Modell Whizi AI, das Basis-GPT-Modell, auf dem Whizi AI läuft, und ein schnelles Gemini-Modell. Whizi AI ist eine hauseigene Persona auf diesem Basis-GPT-Modell und kein eigenständiges Modell, und es kostet 1 Credit pro Nachricht. Kostenlose Konten liegen darunter: Sie erreichen nur Whizi AI und Auto, mit 7 Nachrichten am ersten Tag, danach 3 pro Tag, und ein kostenloser Turn ist zusätzlich auf etwa 5,000 Tokens ein und 5,000 aus begrenzt.
Die Fenster, die klein genug sind, um das Budget zu verändern
Die Fensterspalte ist nicht die entscheidende Spalte für die Länge, weil das Budget pro Turn im gesamten Katalog gleich ist. Wie dieses Budget aufgebaut ist und was passiert, wenn ein Gespräch darüber hinausgeht, steht in wenn das Gespräch zu lang ist.
Was ein Fenster tatsächlich entscheidet, ist, ob dieses feste Budget überhaupt gilt, und die Grenze liegt bei 93,000 Tokens. Sechs der 100 bepreisten Zeilen liegen darunter, und zwei davon sind die kleinsten Fenster im gesamten bepreisten Index.
| Zeile | Kontextfenster | In den obigen Tabellen aufgeführt |
|---|---|---|
| Tencent Hy-MT2, zwei Zeilen | 8,192 | Nein |
| Phi 4, Microsoft | 16K | Ja |
| Perceptron Mk1 | 33K | Nein |
| DeepSeek R1 | 64K | Nein |
| Nano Banana 2 Lite, Google | 66K | Nein |
Was ein Fenster für ein echtes Dokument bedeutet
Die erste Grenze, an die ein Dokument stößt, ist nicht das Kontextfenster. Es ist das Limit von 100,000 Zeichen pro Nachricht, und Text, der aus einer angehängten Datei extrahiert wird, zählt genau wie getippter Text dagegen.
Im Web werden PDF-, Word- und Tabellendateien in deinem Browser in Text umgewandelt, bevor irgendetwas gesendet wird, sodass das Modell genau diesen extrahierten Text erhält. Jede Datei ist auf 10 MB begrenzt. Die vollständige Formatliste steht in unterstützte Dateitypen.
Projekte sind der eine Ort, an dem ein Dokument wirklich am Budget zehrt, weil eine angeheftete Projektdatei bei jedem einzelnen Turn in diesem Projekt neu in den Prompt eingebaut wird, innerhalb desselben festen Eingabebudgets, egal welches Fenster das Modell trägt. Die Grenzen für angeheftete Dateien und Projektblöcke stehen in wenn das Gespräch zu lang ist.
Fenster im Verhältnis zu Preis und Credits, in den Zeilen oben
Sortiere die Tabellen nach Fenster, und sonst sortiert sich nichts mit. Das größte Fenster im bepreisten Index, mit 1,310,720 Tokens, kostet $0.00028 pro Standardantwort, berechnet 1 Credit pro Nachricht und liegt auf Powerhouse. Die günstigste Zeile von allen kostet $0.000053 pro Antwort bei einem 262K-Fenster. Die mittlere Zeile liegt bei $0.00185 pro Antwort, ebenfalls bei einem 262K-Fenster. Die teuerste Zeile kostet $0.105 pro Standardantwort und trägt überhaupt keine Credit-Stufe, weil sie nicht zu den Zeilen gehört, die Whizi anbietet.
Die Streuung lässt sich am leichtesten bei Zeilen mit demselben Fenster ablesen.
| Zeile | Kontextfenster | Kosten pro Antwort | Credits |
|---|---|---|---|
| DeepSeek V4 Flash 0731 | 1.31M | $0.00028 | 1 |
| Qwen3.7 Flash | 1M | $0.000095 | 1 |
| Inkling, Thinkingmachines | 1M | $0.002975 | 4 |
| Claude Fable 5 | 1M | $0.035 | 50 |
| Granite 4.1 8B, IBM | 131K | $0.0001 | 1 |
| Kimi K2 0711 | 131K | $0.00172 | 10 |
Drei Zeilen dort tragen dasselbe Fenster von 1,000,000 Tokens und berechnen 1, 4 und 50 Credits. Zwei Zeilen tragen dasselbe 131K-Fenster und berechnen 1 und 10. Der bepreiste Index umspannt vom günstigsten bis zum teuersten Wert etwa das 2000-fache, und die Zeilen oben zeigen, dass diese Spanne nicht der Fensterspalte folgt.
- Die Fenster im bepreisten Index reichen von 8,192 Tokens bis 1,310,720 Tokens
- 47 der 100 bepreisten Zeilen bieten ein Fenster von 1,000,000 Tokens oder mehr
- Das größte Fenster im Index beantwortet eine Anfrage für $0.00028 und berechnet 1 Credit
- Die günstigste Zeile im Index trägt ein 262K-Fenster, nicht das größte
- Die mittlere bepreiste Zeile liegt bei $0.00185 pro Standardantwort, ebenfalls bei einem 262K-Fenster
- Im Web zeigt die Credits-Spalte, was eine Nachricht vom Credit-Kontingent verbraucht
- Eine Credit-Stufe wird aus den Pro-Token-Preisen der Anbieter abgeleitet, die Fenstergröße fließt also nicht ein
- Whizi AI ist eine hauseigene Persona auf einem Basis-GPT-Modell, für 1 Credit pro Nachricht
- Kostenlose Konten erreichen zwei Zeilen, und ein kostenloser Turn ist auf 5,000 Tokens ein und aus begrenzt
- Der Cost Index bepreist 100 OpenRouter-Zeilen, was nicht der gesamte 280+ Katalog ist
Häufige Fragen
Bekomme ich bei einem höheren Plan ein größeres Kontextfenster?
Nein. Das Fenster gehört zum Modell, nicht zu deinem Abo. Was ein höherer Plan kauft, ist Zugang zu mehr Modellen und ein größeres monatliches Credit-Kontingent: 400 Credits auf Starter, 2,000 auf Pro und 8,000 auf Powerhouse.
Kostet ein Modell mit größerem Kontextfenster mehr Credits?
Nicht in den obigen Tabellen. Das größte Fenster im bepreisten Index, mit 1,310,720 Tokens, berechnet 1 Credit pro Nachricht, während eine Zeile mit 131K-Fenster in denselben Tabellen 10 berechnet. Eine Credit-Stufe wird aus einem Referenz-Turn von 3,000 Eingabe-Tokens und 800 Ausgabe-Tokens gegen die aktuellen Pro-Token-Preise der Anbieter abgeleitet, dann auf eine gültige Stufe aufgerundet, und die Fenstergröße ist keiner der Eingangswerte.
Kann ich ein Modell mit großem Kontextfenster auf einem kostenlosen Konto ausprobieren?
Nein, seit dem 2026-09-02 nicht mehr. Ein kostenloses Konto schaltet Whizi AI und Auto frei, sodass die Zeilen mit 1,000,000 Tokens einen Plan brauchen. Ein kostenloser Turn ist außerdem auf etwa 5,000 Tokens ein und 5,000 aus begrenzt, was strenger ist als jedes Kontextfenster auf dieser Seite, und das Kontingent beträgt 7 Nachrichten am ersten Tag, danach 3 pro Tag.
Veröffentlicht Whizi für jedes Modell im Katalog ein Kontextfenster?
Nein. Die Fenster auf dieser Seite stammen aus dem Cost Index, der zum Vergleich 100 OpenRouter-Zeilen bepreist, und der Katalog umfasst 280+ Modelle. Die Modellauswahl in der App ist eine separate Oberfläche, die live vom gemeinsamen Worker bedient wird, und listet daher den aktuellen Katalog statt diesen Index.
Woher stammen die Kontextfenster-Zahlen auf dieser Seite?
Aus dem Whizi Cost Index, der 100 OpenRouter-Zeilen für eine Standardantwort von 1,000 Eingabe-Tokens plus 500 Ausgabe-Tokens bepreist, wobei die Quellpreise am 2026-08-20 von OpenRouter abgerufen wurden. Der Cost Index hält dieses eine Abrufdatum fest, behandle die Dollarwerte also als Stand jenes Tages und nicht als Live-Kurse.