Kontekstvindu AI: modellene i Whizi sammenlignet

Kort svar

Kontekstvinduene i Whizis prisede indeks går fra 8 192 tokens til 1 310 720 tokens, og 47 av de 100 radene har 1 000 000 tokens eller mer. Vinduet er ikke det som avgjør resultatet ditt. Hver modell får et fast budsjett på 40 000 input-tokens og 20 000 output-tokens per svar, og bare et vindu under 93 000 tokens senker det.

Det korte svaret

Vinduene i den prisede indeksen går fra 8 192 tokens til 1 310 720 tokens, og 47 av de 100 prisede radene har et vindu på 1 000 000 tokens eller mer. Vinduet er det maksimale en modell kan vurdere i én forespørsel, målt i tokens, men det er ikke tallet som avgjør resultatet ditt i Whizi.

Tallet som avgjør det, er budsjettet per svar. Hver modell i katalogen får den samme faste rammen for ett svar: 40 000 input-tokens og 20 000 output-tokens. Et større vindu øker ikke det budsjettet. Et vindu mindre enn 93 000 tokens senker det.

TallVerdi
Størst vindu i den prisede indeksenDeepSeek V4 Flash 0731, 1 310 720 tokens
Minste vinduer i den prisede indeksenDe to Tencent Hy-MT2-radene, 8 192 tokens
Rader med 1 000 000 tokens eller mer47 av de 100 prisede radene
Input sendt per svar, alle katalogmodeller40 000 tokens
Output tillatt per svar, alle katalogmodeller20 000 tokens
Vindu under hvilket budsjettet krymper93 000 tokens

For et virkelig dokument er det derfor de to grensene som faktisk slår til: grensen på 100 000 tegn per chatmelding og det budsjettet på 40 000 input-tokens. Ingen av dem er vindu-kolonnen.

Kontekstvindu per modell, med kostnad og plan

Hver rad nedenfor kommer fra Whizi Cost Index, som priser 100 OpenRouter-rader hos 29 leverandører på et standardsvar på 1 000 input-tokens pluss 500 output-tokens. Leverandørprisene bak disse tallene ble hentet 2026-08-20. På nettsiden er kredittkolonnen hva én melding på den modellen koster mot kredittrammen din, og plankolonnen er den laveste planen som gir tilgang til den. En plattform som ikke er på kredittlisten, får en flat 1x i stedet, belastes én per svar, og beholder meldingsrammen.

OpenAI.

ModellKontekstvinduKostnad per svarKreditterLaveste plan
GPT-5.6 Luna1M$0.00081Starter
GPT-5.4 Nano400K$0.0008252Powerhouse
GPT-5.4 Mini400K$0.0034Powerhouse
GPT-5.6 Terra1M$0.0084Pro
GPT-5.41M$0.0115Powerhouse
GPT-5.6 Sol1M$0.0120Pro
GPT-5.51M$0.0220Pro
GPT Chat Latest400K$0.0225Powerhouse

Anthropic.

ModellKontekstvinduKostnad per svarKreditterLaveste plan
Claude Haiku 4.5200K$0.00354Pro
Claude Sonnet 51M$0.00710Pro
Claude Sonnet 4.61M$0.010510Pro
Claude Sonnet 4.51M$0.010510Pro
Claude Opus 51M$0.017520Powerhouse
Claude Opus 4.81M$0.017520Powerhouse
Claude Fable 51M$0.03550Powerhouse

Google.

ModellKontekstvinduKostnad per svarKreditterLaveste plan
Gemini 2.5 Flash Lite1M$0.00031Pro
Gemini 3.1 Flash Lite1M$0.0011Powerhouse
Gemini 3.7 Flash1M$0.0013132Pro
Gemini 2.5 Flash1M$0.001552Pro
Gemini 3.5 Flash Lite1M$0.001552Powerhouse
Gemini 3.6 Flash1M$0.0026253Pro
Gemini 3.5 Flash1M$0.0068Pro
Gemini 3.1 Pro Preview1M$0.00810Pro

DeepSeek.

ModellKontekstvinduKostnad per svarKreditterLaveste plan
DeepSeek V4 Flash 07311.31M$0.000281Powerhouse
DeepSeek V3.2164K$0.0004691Pro
DeepSeek V3.1164K$0.0007251Pro
DeepSeek V4 Pro 08131M$0.002972Powerhouse

Qwen.

ModellKontekstvinduKostnad per svarKreditterLaveste plan
Qwen3.7 Flash1M$0.0000951Powerhouse
Qwen3 Coder Next262K$0.000521Powerhouse
Qwen3.6 Flash1M$0.000751Powerhouse
Qwen3.7 Plus1M$0.000961Pro
Qwen3.8 27B1M$0.002053Powerhouse
Qwen3.7 Max1M$0.0036885Powerhouse
Qwen3.8 Max1M$0.0056Powerhouse

xAI.

ModellKontekstvinduKostnad per svarKreditterLaveste plan
Grok Build 0.1256K$0.0023Powerhouse
Grok 4.31M$0.00254Powerhouse
Grok 4.5500K$0.0056Powerhouse
Grok 4.6500K$0.0056Pro

Meta.

ModellKontekstvinduKostnad per svarKreditterLaveste plan
Llama 3.3 70B Instruct131K$0.000261Pro
Llama 4 Maverick1M$0.00061Pro
Muse Glimmer 30B131K$0.00112Powerhouse
Muse Spark 1.21M$0.0033755Powerhouse

Mistral.

ModellKontekstvinduKostnad per svarKreditterLaveste plan
Codestral 2508256K$0.000751Powerhouse
Mistral Large 3 2512262K$0.001252Pro
Mistral Medium 3.1131K$0.00142Pro
Mistral Medium 3.5262K$0.005256Powerhouse

Z.ai og Moonshot.

ModellKontekstvinduKostnad per svarKreditterLaveste plan
GLM 4.6205K$0.00151Powerhouse
GLM 4.7205K$0.0012752Powerhouse
GLM 5205K$0.001562Pro
GLM 5.21M$0.0024843Powerhouse
GLM 5.31M$0.00365Powerhouse
Kimi K2 0711131K$0.0017210Powerhouse
Kimi K2 Thinking262K$0.0018510Powerhouse
Kimi K2.7 Code262K$0.0024610Powerhouse
Kimi K31M$0.010510Pro

Fjorten flere rader.

Dette er et utvalg av de prisede radene fra de resterende laboratoriene, ikke alle sammen.

ModellKontekstvinduKostnad per svarKreditterLaveste plan
MiniMax M2205K$0.0007651Powerhouse
MiniMax M31M$0.00091Powerhouse
Nemotron 3.5 Lightning, NVIDIA262K$0.000181Powerhouse
Nemotron 3 Ultra, NVIDIA512K$0.00243Powerhouse
Nova Pro 1.0, Amazon300K$0.00243Powerhouse
Command A, Cohere256K$0.007510Powerhouse
Solar Pro 4, Upstage524K$0.000091Powerhouse
Ling-3.0-flash, inclusionAI262K$0.0000531Powerhouse
Nex-N2-Mini, Nex Agi262K$0.0000751Powerhouse
Laguna XS 2.1, Poolside262K$0.000121Powerhouse
Granite 4.1 8B, IBM131K$0.00011Powerhouse
Phi 4, Microsoft16K$0.000141Powerhouse
Inkling, Thinkingmachines1M$0.0029754Powerhouse
Fugu Ultra, Sakana1M$0.0225Powerhouse

Katalogen har 280+ modeller, og radene ovenfor er hentet fra Cost Index, som priser 100 OpenRouter-rader for sammenligning, og verken tabellene eller indeksen er hele katalogen. Plankolonnen er avledet snarere enn oppført, og modellisten forklarer hvordan den utledningen fungerer.

Starter er den ene planen tabellen nesten ikke dekker. De fire oppføringene er Auto, husmodellen Whizi AI, basismodellen for GPT som Whizi AI kjører på, og en rask Gemini-modell. Whizi AI er en huspersona på den basismodellen for GPT snarere enn en egen modell, og den koster 1 kreditt per melding. Gratiskontoer ligger under den: de har bare tilgang til Whizi AI og Auto, med 7 meldinger den første dagen, deretter 3 per dag, og et gratis svar er dessuten begrenset til rundt 5 000 tokens inn og 5 000 ut.

Vinduene som er små nok til å endre budsjettet

Vindu-kolonnen er ikke den avgjørende kolonnen for lengde, fordi budsjettet per svar er flatt over hele katalogen. Hvordan det budsjettet er bygget opp, og hva som skjer når en samtale går forbi det, er beskrevet i når samtalen blir for lang.

Det et vindu avgjør, er om det faste budsjettet gjelder i det hele tatt, og grensen ligger på 93 000 tokens. Seks av de 100 prisede radene faller under den, og to av dem er de minste vinduene i hele den prisede indeksen.

RadKontekstvinduVist i tabellene ovenfor
Tencent Hy-MT2, to rader8 192Nei
Phi 4, Microsoft16KJa
Perceptron Mk133KNei
DeepSeek R164KNei
Nano Banana 2 Lite, Google66KNei

Hva et vindu betyr for et virkelig dokument

Den første grensen et dokument treffer, er ikke kontekstvinduet. Det er grensen på 100 000 tegn per melding, og tekst hentet ut fra en vedlagt fil telles med akkurat som skrevet tekst.

På nettsiden trekkes PDF-, Word- og regnearkfiler ut til tekst i nettleseren din før noe sendes, så det modellen mottar er den utpakkede teksten. Hver fil kan være opptil 100 MB på nettsiden, eller 10 MB i iOS-appen. Den fullstendige formatlisten finnes i støttede filtyper.

Prosjekter er det ene stedet et dokument virkelig spiser av budsjettet, fordi en fastnålet prosjektfil bygges inn i prompten på nytt hver eneste gang i det prosjektet, innenfor det samme faste input-budsjettet uansett hvilket vindu modellen har. Grensene for fastnålet fil og prosjektblokk står i når samtalen blir for lang.

Vindu mot pris og kreditter, i radene ovenfor

Sorter tabellene etter vindu, og ingenting annet følger med i sorteringen. Det største vinduet i den prisede indeksen, på 1 310 720 tokens, koster $0.00028 per standardsvar, belaster 1 kreditt per melding og ligger på Powerhouse. Den billigste raden av alle koster $0.000053 per svar på et 262K-vindu. Medianraden ligger på $0.00185 per svar, også på et 262K-vindu. Den dyreste raden koster $0.105 per standardsvar og har ingen kredittrangering i det hele tatt, fordi den ikke er en av radene Whizi tilbyr.

Spredningen er lettest å lese på rader som deler et vindu.

RadKontekstvinduKostnad per svarKreditter
DeepSeek V4 Flash 07311.31M$0.000281
Qwen3.7 Flash1M$0.0000951
Inkling, Thinkingmachines1M$0.0029754
Claude Fable 51M$0.03550
Granite 4.1 8B, IBM131K$0.00011
Kimi K2 0711131K$0.0017210

Tre rader der har det samme vinduet på 1 000 000 tokens og belaster 1, 4 og 50 kreditter. To rader har det samme 131K-vinduet og belaster 1 og 10. Den prisede indeksen spenner over rundt 2000x fra billigste til dyreste rad, og radene ovenfor viser at den spredningen ikke følger vindu-kolonnen.

Sjekkliste
  • Vinduene i den prisede indeksen går fra 8 192 tokens til 1 310 720 tokens
  • 47 av de 100 prisede radene har et vindu på 1 000 000 tokens eller mer
  • Det største vinduet i indeksen svarer én gang for $0.00028 og belaster 1 kreditt
  • Den billigste raden i indeksen har et 262K-vindu, ikke det største
  • Medianraden i indeksen ligger på $0.00185 per standardsvar, også på et 262K-vindu
  • På nettsiden er kredittkolonnen hva én melding koster mot kredittrammen
  • En kredittrangering utledes fra leverandørens pris per token, så vindustørrelse er ikke et input til den
  • Whizi AI er en huspersona på en basismodell for GPT, til 1 kreditt per melding
  • Gratiskontoer har tilgang til to rader, og et gratis svar er begrenset til 5 000 tokens inn og ut
  • Cost Index priser 100 OpenRouter-rader, som ikke er hele 280+-katalogen

Vanlige spørsmål

Får jeg et større kontekstvindu på en høyere plan?

Nei. Vinduet tilhører modellen, ikke abonnementet ditt. Det en høyere plan gir deg, er tilgang til flere modeller og en større månedlig kredittramme: 600 kreditter på Starter, 2 000 på Pro og 8 000 på Powerhouse.

Koster en modell med et større kontekstvindu flere kreditter?

Ikke i tabellene ovenfor. Det største vinduet i den prisede indeksen, på 1 310 720 tokens, belaster 1 kreditt per melding, mens en rad med 131K-vindu i de samme tabellene belaster 10. En kredittrangering utledes fra et referansesvar på 3 000 input-tokens og 800 output-tokens mot leverandørens gjeldende pris per token, deretter rundet opp til en gyldig rangering, og vindustørrelse er ikke en del av dette.

Kan jeg prøve en modell med stort kontekstvindu på en gratiskonto?

Nei, ikke siden 2026-09-02. En gratiskonto har tilgang til Whizi AI og Auto, så radene med 1 000 000 tokens krever en plan. Et gratis svar er også begrenset til rundt 5 000 tokens inn og 5 000 ut, som er en strammere grense enn noe kontekstvindu på denne siden, og rammen er 7 meldinger den første dagen, deretter 3 per dag.

Publiserer Whizi et kontekstvindu for hver modell i katalogen?

Nei. Vinduene på denne siden kommer fra Cost Index, som priser 100 OpenRouter-rader for sammenligning, og katalogen har 280+ modeller. Velgeren i appen er en egen flate servert direkte av den delte serveren, så den viser den gjeldende katalogen snarere enn denne indeksen.

Hvor kommer kontekstvindutallene på denne siden fra?

Fra Whizi Cost Index, som priser 100 OpenRouter-rader på et standardsvar på 1 000 input-tokens pluss 500 output-tokens, med kildepriser hentet fra OpenRouter 2026-08-20. Cost Index registrerer den ene innhentingen, så behandle dollartallene som gjeldende for den dagen, ikke som live rater.