Kontextfenster-Vergleich: jedes wichtige KI-Modell in einer Tabelle

Kurzantwort

Das größte Kontextfenster im Katalog von August 2026 sind 1M Tokens, gehalten von DeepSeek V4 Flash 0731 von DeepSeek. Die Tabellen unten vergleichen jedes wichtige KI-Modell in Tokens und in normalen Textseiten, auf demselben Katalog-Schnappschuss wie der AI Model Cost Index. Ein Token entspricht etwa drei Vierteln eines englischen Worts.

Welches KI-Modell hat das größte Kontextfenster?

Das größte Kontextfenster im Katalog von August 2026 sind 1M Tokens, gehalten von DeepSeek V4 Flash 0731 von DeepSeek. Als grobe Faustregel: ein Token entspricht etwa drei Vierteln eines englischen Worts, und eine Manuskriptseite hat etwa 400 Wörter, deshalb übersetzt die Tabelle unten jedes Fenster in Seiten.

Eine Zeile pro großem Anbieter, mit seinem Modell mit dem größten Kontext:

AnbieterModell mit größtem KontextKontextfensterPasst ungefähr
DeepSeekDeepSeek V4 Flash 07311M Tokensetwa 2,500 Seiten
OpenAIGPT-5.41M Tokensetwa 2,000 Seiten
GoogleGemini 2.5 Flash1M Tokensetwa 2,000 Seiten
MetaLlama 4 Maverick1M Tokensetwa 2,000 Seiten
QwenQwen3.8 2.4T A95B1M Tokensetwa 2,000 Seiten
MoonshotKimi K31M Tokensetwa 2,000 Seiten
Z.aiGLM 5.21M Tokensetwa 2,000 Seiten
MiniMaxMiniMax M31M Tokensetwa 2,000 Seiten
AnthropicClaude Fable 51M Tokensetwa 1,900 Seiten
xAIGrok 4.31M Tokensetwa 1,900 Seiten
MistralMistral Large 3 2512262K Tokensetwa 492 Seiten

Wenn die Frage hinter deiner Suche "was ist ein Kontextfenster überhaupt" lautet, starte mit der einfach erklärten Einführung unter Was ist ein Kontextfenster? und komm dann für die Zahlen zurück.

Wie schneiden alle 100 Modelle beim Kontextfenster ab?

Der vollständige Katalog, sortiert nach Kontextfenster. Die Daten stammen aus derselben Quelle wie der AI Model Cost Index und wurden am 2026-08-20 abgerufen; es handelt sich um einen Schnappschuss dieses Datums und nicht um einen Live-Feed, also prüf das Datum, bevor du eine Zahl zitierst. Die Credits-Spalte zeigt, was jedes Modell pro Nachricht in Whizi kostet, sofern ein Plan es enthält.

ModellAnbieterKontextfensterPasst ungefährCredits in Whizi
DeepSeek V4 Flash 0731DeepSeek1Metwa 2,500 Seiten1
GPT-5.4OpenAI1Metwa 2,000 Seiten15
GPT-5.5OpenAI1Metwa 2,000 Seiten20
GPT-5.6 LunaOpenAI1Metwa 2,000 Seiten1
GPT-5.6 Luna ProOpenAI1Metwa 2,000 SeitenNicht abgerechnet
GPT-5.6 SolOpenAI1Metwa 2,000 Seiten20
GPT-5.6 Sol ProOpenAI1Metwa 2,000 SeitenNicht abgerechnet
GPT-5.6 TerraOpenAI1Metwa 2,000 Seiten4
GPT-5.6 Terra ProOpenAI1Metwa 2,000 SeitenNicht abgerechnet
LongCat 2.0Meituan1Metwa 2,000 Seiten1
DeepSeek V4 Pro 0813DeepSeek1Metwa 2,000 Seiten2
Gemini 2.5 FlashGoogle1Metwa 2,000 Seiten2
Gemini 2.5 Flash LiteGoogle1Metwa 2,000 Seiten1
Gemini 3.1 Flash LiteGoogle1Metwa 2,000 Seiten1
Gemini 3.1 Pro PreviewGoogle1Metwa 2,000 Seiten10
Gemini 3.5 FlashGoogle1Metwa 2,000 Seiten8
Gemini 3.5 Flash LiteGoogle1Metwa 2,000 Seiten2
Gemini 3.6 FlashGoogle1Metwa 2,000 Seiten3
Gemini 3.7 FlashGoogle1Metwa 2,000 Seiten2
GLM 5.2Z.ai1Metwa 2,000 Seiten3
GLM 5.3Z.ai1Metwa 2,000 Seiten5
InklingThinkingmachines1Metwa 2,000 Seiten4
Kimi K3Moonshot1Metwa 2,000 Seiten10
Laguna S 2.1Poolside1Metwa 2,000 Seiten1
Llama 4 MaverickMeta1Metwa 2,000 Seiten1
MiniMax M3MiniMax1Metwa 2,000 Seiten1
Muse Spark 1.1Meta1Metwa 2,000 Seiten5
Muse Spark 1.2Meta1Metwa 2,000 Seiten5
Qwen3.8 2.4T A95BQwen1Metwa 2,000 Seiten8
Claude Fable 5Anthropic1Metwa 1,900 Seiten50
Claude Opus 4.7 (Fast)Anthropic1Metwa 1,900 SeitenNicht abgerechnet
Claude Opus 4.8Anthropic1Metwa 1,900 Seiten20
Claude Opus 4.8 (Fast)Anthropic1Metwa 1,900 SeitenNicht abgerechnet
Claude Opus 5Anthropic1Metwa 1,900 Seiten20
Claude Opus 5 (Fast)Anthropic1Metwa 1,900 SeitenNicht abgerechnet
Claude Sonnet 4.5Anthropic1Metwa 1,900 Seiten10
Claude Sonnet 4.6Anthropic1Metwa 1,900 Seiten10
Claude Sonnet 5Anthropic1Metwa 1,900 Seiten10
Fugu UltraSakana1Metwa 1,900 Seiten25
Grok 4.3xAI1Metwa 1,900 Seiten4
Qwen3.5 Plus 2026-04-20Qwen1Metwa 1,900 Seiten1
Qwen3.6 FlashQwen1Metwa 1,900 Seiten1
Qwen3.7 FlashQwen1Metwa 1,900 Seiten1
Qwen3.7 MaxQwen1Metwa 1,900 Seiten5
Qwen3.7 PlusQwen1Metwa 1,900 Seiten1
Qwen3.8 27BQwen1Metwa 1,900 Seiten3
Qwen3.8 MaxQwen1Metwa 1,900 Seiten6
Inkling SmallThinkingmachines524Ketwa 983 Seiten1
Solar Pro 4Upstage524Ketwa 983 Seiten1
Nemotron 3 UltraNVIDIA512Ketwa 961 Seiten3
Grok 4.5xAI500Ketwa 938 Seiten6
Grok 4.6xAI500Ketwa 938 Seiten6
GPT Chat LatestOpenAI400Ketwa 750 Seiten25
GPT-5.4 MiniOpenAI400Ketwa 750 Seiten4
GPT-5.4 NanoOpenAI400Ketwa 750 Seiten2
Nova Pro 1.0Amazon300Ketwa 563 Seiten3
Hy3Tencent262Ketwa 492 Seiten1
Kimi K2 ThinkingMoonshot262Ketwa 492 Seiten10
Kimi K2.7 CodeMoonshot262Ketwa 492 Seiten10
Laguna XS 2.1Poolside262Ketwa 492 Seiten1
Ling-3.0-flashinclusionAI262Ketwa 492 Seiten1
Mistral Large 3 2512Mistral262Ketwa 492 Seiten2
Mistral Medium 3.5Mistral262Ketwa 492 Seiten6
Nemotron 3.5 LightningNVIDIA262Ketwa 492 Seiten1
Nex-N2-MiniNex Agi262Ketwa 492 Seiten1
Nex-N2-ProNex Agi262Ketwa 492 Seiten1
Qwen3 Coder NextQwen262Ketwa 492 Seiten1
Qwen3.6 35B A3BQwen262Ketwa 492 Seiten1
Ring-2.6-1TinclusionAI262Ketwa 492 Seiten1
Sakana NamazuSakana262Ketwa 492 Seiten4
Seed 2.1 TurboBytedance Seed262Ketwa 492 Seiten2
Seed-2.0-CodeBytedance Seed262Ketwa 492 Seiten3
Step 3.7 FlashStepfun262Ketwa 492 Seiten1
Codestral 2508Mistral256Ketwa 480 Seiten1
Command ACohere256Ketwa 480 Seiten10
Grok Build 0.1xAI256Ketwa 480 Seiten3
KAT-Coder-Air V2.5Kwaipilot256Ketwa 480 Seiten1
KAT-Coder-Pro V2.5Kwaipilot256Ketwa 480 Seiten3
GLM 4.6Z.ai205Ketwa 384 Seiten1
GLM 4.7Z.ai205Ketwa 384 Seiten2
GLM 5Z.ai205Ketwa 384 Seiten2
MiniMax M2MiniMax205Ketwa 384 Seiten1
Claude Haiku 4.5Anthropic200Ketwa 375 Seiten4
DeepSeek V3.1DeepSeek164Ketwa 307 Seiten1
DeepSeek V3.2DeepSeek164Ketwa 307 Seiten1
Aion-3.0Aion Labs131Ketwa 246 Seiten10
Aion-3.0-MiniAion Labs131Ketwa 246 Seiten2
Granite 4.1 8BIbm Granite131Ketwa 246 Seiten1
Kimi K2 0711Moonshot131Ketwa 246 Seiten10
Llama 3.3 70B InstructMeta131Ketwa 246 Seiten1
Mistral Medium 3.1Mistral131Ketwa 246 Seiten2
Muse Glimmer 30BMeta131Ketwa 246 Seiten2
Nano Banana 2 (Gemini 3.1 Flash Image)Google131Ketwa 246 SeitenNicht abgerechnet
Nano Banana Pro (Gemini 3 Pro Image)Google131Ketwa 246 SeitenNicht abgerechnet
Nano Banana 2 Lite (Gemini 3.1 Flash Lite Image)Google66Ketwa 123 SeitenNicht abgerechnet
R1DeepSeek64Ketwa 120 Seiten2
Perceptron Mk1Perceptron33Ketwa 61 Seiten1
Phi 4Microsoft16Ketwa 31 Seiten1
Hy-MT2-1.8BTencent8Ketwa 15 SeitenNicht abgerechnet
Hy-MT2-30B-A3BTencent8Ketwa 15 SeitenNicht abgerechnet

Wie du diese Zahlen ehrlich liest

Das Fenster wird geteilt. Alles zählt gleichzeitig hinein: dein Prompt, jede frühere Nachricht im Gespräch, alle angehängten Dokumente und die gerade geschriebene Antwort. Ein Modell mit einem 128K-Fenster, das bereits einen 100K-Token-Vertrag gelesen hat, hat nicht mehr 128K für die Diskussion übrig, sondern 28K.

Beworben ist nicht wirksam. Forschung zu langem Kontext findet immer wieder dasselbe Muster: Modelle erinnern sich an Anfang und Ende eines riesigen Kontexts besser als an die Mitte. In den Lost-in-the-Middle-Experimenten (Liu et al., 2023) kostete es die Modelle rund 20 Punkte an Genauigkeit, das Schlüsseldokument von den Rändern der Eingabe in die Mitte zu verschieben. Ein Modell kann also eine Million Tokens akzeptieren und trotzdem die Klausel bei Token 400,000 übersehen. Für Arbeit mit hohem Risiko an langen Dokumenten frag gezielt nach den mittleren Abschnitten oder gib das Dokument in beschrifteten Teilen ein.

Größer ist nicht automatisch besser. Große Fenster kosten mehr im Betrieb und können die Aufmerksamkeit über irrelevanten Text verdünnen. Wenn deine Arbeit aus E-Mails und kurzen Entwürfen besteht, wirst du die Fenstergröße nie bemerken. Sie beginnt bei ganzen Verträgen, Codebasen, Transkripten und Büchern zu zählen.

Tokens sind keine Wörter. Die Drei-Viertel-Regel ist ein guter Durchschnitt für Englisch, aber Code, Zahlen und Nicht-Englisch tokenisieren oft weniger effizient, deshalb sind die Seitenschätzungen in der Tabelle bewusst grob.

Das Fenster zur Aufgabe passen

Die praktische Schlussfolgerung aus der Tabelle ist, dass das Kontextfenster eine Entscheidung pro Aufgabe ist, nicht pro Abo. Das Modell mit dem größten Fenster ist selten der beste Autor, und der beste Autor ist selten der günstigste Weg, 800 Seiten zusammenzufassen.

Das ist das Argument dafür, den Katalog in einem Arbeitsbereich zu haben. In Whizi kannst du das 200-Seiten-PDF an ein Modell mit großem Kontext geben und dann im selben Gespräch zu Claude oder GPT wechseln, um daraus zu entwerfen, ohne dass das Dokument den Thread verlässt. Der ehrliche Gegeneinwand: wenn alles, was du einem Modell gibst, bequem in ein 128K-Fenster passt, was die meiste E-Mail-, Entwurfs- und Kurzdokumentarbeit abdeckt, ist diese ganze Tabelle irrelevant, und ein Abo bei einem einzigen Anbieter ist der einfachere Kauf. Der Leitfaden wie man ein Modell wählt behandelt dieselbe Entscheidung für Qualität und Kosten.

Zum Zitieren dieser Seite: die ankerfreie URL ist stabil, das Datum der Daten steht über der vollständigen Tabelle, und die Token-Zahlen stammen aus dem Anbieterkatalog, nicht aus Marketing-Seiten.

Checkliste
  • Zieh deine Dokumente und den Verlauf vom Fenster ab, bevor du der Schlagzeilenzahl vertraust
  • Teste bei langen Dokumenten die Erinnerung aus der Mitte, nicht nur vom Anfang
  • Übersetze Tokens mit der Drei-Viertel-Regel in Seiten, bevor du irgendetwas entscheidest
  • Wähle das Fenster pro Aufgabe statt pro Abo
  • Prüf das Datum über der vollständigen Tabelle, wenn du eine Zahl zitierst

Häufige Fragen

Welches KI-Modell hat das größte Kontextfenster?

Im Katalog von August 2026 ist es DeepSeek V4 Flash 0731 von DeepSeek mit 1M Tokens. Die vollständige Tabelle oben listet alle 100 Modelle sortiert nach Fenstergröße, mit dem Datum der Daten darüber.

Was ist das größte Claude-Kontextfenster?

Das größte Claude-Kontextfenster im Index sind 1M Tokens (Claude Fable 5), was etwa 1,900 Seiten Text entspricht. Kleinere Claude-Varianten sind in der vollständigen Tabelle oben aufgeführt.

Was ist das größte GPT-Kontextfenster?

Das größte GPT-Kontextfenster im Index sind 1M Tokens (GPT-5.4), was etwa 2,000 Seiten Text entspricht. Kleinere GPT-Varianten sind in der vollständigen Tabelle oben aufgeführt.

Was ist das größte Gemini-Kontextfenster?

Das größte Gemini-Kontextfenster im Index sind 1M Tokens (Gemini 2.5 Flash), was etwa 2,000 Seiten Text entspricht. Kleinere Gemini-Varianten sind in der vollständigen Tabelle oben aufgeführt.

Was ist das größte Grok-Kontextfenster?

Das größte Grok-Kontextfenster im Index sind 1M Tokens (Grok 4.3), was etwa 1,900 Seiten Text entspricht. Kleinere Grok-Varianten sind in der vollständigen Tabelle oben aufgeführt.

Ist ein größeres Kontextfenster immer besser?

Nein. Größere Fenster kosten mehr, und die Erinnerung lässt zur Mitte eines sehr großen Kontexts hin nach. Größer ist entscheidend für ganze Bücher, Codebasen und lange Transkripte, und irrelevant für alltägliche Chats. Pass das Fenster an die Aufgabe an, statt für die größte Zahl zu zahlen.

Wie viele Seiten passen in ein Kontextfenster?

Teile die Token-Zahl durch etwa 530, um Manuskriptseiten zu erhalten: ein Token entspricht etwa drei Vierteln eines englischen Worts, und eine Seite hat etwa 400 Wörter. Also sind 128K Tokens etwa 240 Seiten, und eine Million Tokens sind etwa 1,900 Seiten. Code und Nicht-Englisch passen meist weniger.