Fenêtres de contexte comparées : combien l'IA lit de votre document dans Whizi

Réponse rapide

Les fenêtres de contexte de l'index tarifé Whizi vont de 8,192 à 1,310,720 tokens, et 47 des 100 lignes disposent de 1,000,000 tokens ou plus. Ce n'est pas la fenêtre qui décide de votre résultat. Chaque modèle reçoit un budget fixe de 40,000 tokens en entrée et 20,000 tokens en sortie par échange, et seule une fenêtre inférieure à 93,000 tokens réduit ce budget.

La réponse courte

Les fenêtres de l'index tarifé vont de 8,192 à 1,310,720 tokens, et 47 des 100 lignes tarifées disposent d'une fenêtre de 1,000,000 tokens ou plus. La fenêtre est le maximum qu'un modèle peut prendre en compte en une seule requête, compté en tokens, mais ce n'est pas ce chiffre qui décide de votre résultat dans Whizi.

Ce qui décide, c'est le budget par échange. Chaque modèle du catalogue reçoit la même allocation fixe pour un échange : 40,000 tokens en entrée et 20,000 tokens en sortie. Une fenêtre plus grande n'augmente pas ce budget. Une fenêtre inférieure à 93,000 tokens le réduit.

DonnéeValeur
Plus grande fenêtre de l'index tariféDeepSeek V4 Flash 0731, 1,310,720 tokens
Plus petites fenêtres de l'index tariféLes deux lignes Tencent Hy-MT2, 8,192 tokens
Lignes à 1,000,000 tokens ou plus47 des 100 lignes tarifées
Entrée envoyée par échange, chaque modèle du catalogue40,000 tokens
Sortie autorisée par échange, chaque modèle du catalogue20,000 tokens
Fenêtre en dessous de laquelle ce budget se réduit93,000 tokens

Donc pour un document réel, les deux limites qui comptent vraiment sont la limite de 100,000 caractères par message de chat et ce budget de 40,000 tokens en entrée. Aucune des deux n'est la colonne fenêtre.

Fenêtres de contexte par modèle, avec coût et plan

Chaque ligne ci-dessous provient de l'index des coûts Whizi, qui tarife 100 lignes OpenRouter chez 29 fournisseurs sur une réponse standard de 1,000 tokens en entrée plus 500 tokens en sortie. Les tarifs des fournisseurs derrière ces chiffres ont été relevés le 2026-08-20. Sur le web, la colonne crédits indique ce que coûte un message sur ce modèle sur votre allocation de crédits, et la colonne plan indique le plan le plus bas qui y donne accès. Une plateforme absente de la liste autorisée pour les crédits voit un tarif fixe de 1x à la place, est facturée un crédit par échange, et conserve l'allocation de messages.

OpenAI.

ModèleFenêtre de contexteCoût par réponseCréditsPlan minimum
GPT-5.6 Luna1M$0.00081Starter
GPT-5.4 Nano400K$0.0008252Powerhouse
GPT-5.4 Mini400K$0.0034Powerhouse
GPT-5.6 Terra1M$0.0084Pro
GPT-5.41M$0.0115Powerhouse
GPT-5.6 Sol1M$0.0120Powerhouse
GPT-5.51M$0.0220Pro
GPT Chat Latest400K$0.0225Powerhouse

Anthropic.

ModèleFenêtre de contexteCoût par réponseCréditsPlan minimum
Claude Haiku 4.5200K$0.00354Pro
Claude Sonnet 51M$0.00710Pro
Claude Sonnet 4.61M$0.010510Pro
Claude Sonnet 4.51M$0.010510Pro
Claude Opus 51M$0.017520Powerhouse
Claude Opus 4.81M$0.017520Powerhouse
Claude Fable 51M$0.03550Powerhouse

Google.

ModèleFenêtre de contexteCoût par réponseCréditsPlan minimum
Gemini 2.5 Flash Lite1M$0.00031Pro
Gemini 3.1 Flash Lite1M$0.0011Powerhouse
Gemini 3.7 Flash1M$0.0013132Pro
Gemini 2.5 Flash1M$0.001552Pro
Gemini 3.5 Flash Lite1M$0.001552Powerhouse
Gemini 3.6 Flash1M$0.0026253Pro
Gemini 3.5 Flash1M$0.0068Pro
Gemini 3.1 Pro Preview1M$0.00810Pro

DeepSeek.

ModèleFenêtre de contexteCoût par réponseCréditsPlan minimum
DeepSeek V4 Flash 07311.31M$0.000281Powerhouse
DeepSeek V3.2164K$0.0004691Pro
DeepSeek V3.1164K$0.0007251Pro
DeepSeek V4 Pro 08131M$0.002972Powerhouse

Qwen.

ModèleFenêtre de contexteCoût par réponseCréditsPlan minimum
Qwen3.7 Flash1M$0.0000951Powerhouse
Qwen3 Coder Next262K$0.000521Powerhouse
Qwen3.6 Flash1M$0.000751Powerhouse
Qwen3.7 Plus1M$0.000961Pro
Qwen3.8 27B1M$0.002053Powerhouse
Qwen3.7 Max1M$0.0036885Powerhouse
Qwen3.8 Max1M$0.0056Powerhouse

xAI.

ModèleFenêtre de contexteCoût par réponseCréditsPlan minimum
Grok Build 0.1256K$0.0023Powerhouse
Grok 4.31M$0.00254Powerhouse
Grok 4.5500K$0.0056Powerhouse
Grok 4.6500K$0.0056Pro

Meta.

ModèleFenêtre de contexteCoût par réponseCréditsPlan minimum
Llama 3.3 70B Instruct131K$0.000261Pro
Llama 4 Maverick1M$0.00061Pro
Muse Glimmer 30B131K$0.00112Powerhouse
Muse Spark 1.21M$0.0033755Powerhouse

Mistral.

ModèleFenêtre de contexteCoût par réponseCréditsPlan minimum
Codestral 2508256K$0.000751Powerhouse
Mistral Large 3 2512262K$0.001252Pro
Mistral Medium 3.1131K$0.00142Pro
Mistral Medium 3.5262K$0.005256Powerhouse

Z.ai et Moonshot.

ModèleFenêtre de contexteCoût par réponseCréditsPlan minimum
GLM 4.6205K$0.00151Powerhouse
GLM 4.7205K$0.0012752Powerhouse
GLM 5205K$0.001562Pro
GLM 5.21M$0.0024843Powerhouse
GLM 5.31M$0.00365Powerhouse
Kimi K2 0711131K$0.0017210Powerhouse
Kimi K2 Thinking262K$0.0018510Powerhouse
Kimi K2.7 Code262K$0.0024610Powerhouse
Kimi K31M$0.010510Pro

Quatorze lignes supplémentaires.

Ce sont une sélection des lignes tarifées des autres laboratoires, pas la totalité.

ModèleFenêtre de contexteCoût par réponseCréditsPlan minimum
MiniMax M2205K$0.0007651Powerhouse
MiniMax M31M$0.00091Powerhouse
Nemotron 3.5 Lightning, NVIDIA262K$0.000181Powerhouse
Nemotron 3 Ultra, NVIDIA512K$0.00243Powerhouse
Nova Pro 1.0, Amazon300K$0.00243Powerhouse
Command A, Cohere256K$0.007510Powerhouse
Solar Pro 4, Upstage524K$0.000091Powerhouse
Ling-3.0-flash, inclusionAI262K$0.0000531Powerhouse
Nex-N2-Mini, Nex Agi262K$0.0000751Powerhouse
Laguna XS 2.1, Poolside262K$0.000121Powerhouse
Granite 4.1 8B, IBM131K$0.00011Powerhouse
Phi 4, Microsoft16K$0.000141Powerhouse
Inkling, Thinkingmachines1M$0.0029754Powerhouse
Fugu Ultra, Sakana1M$0.0225Powerhouse

Le catalogue compte 280+ modèles, et les lignes ci-dessus proviennent de l'index des coûts, qui tarife 100 lignes OpenRouter à des fins de comparaison, et ni les tableaux ni l'index ne couvrent tout le catalogue. La colonne plan est déduite plutôt que listée, et la liste des modèles explique comment fonctionne cette déduction.

Starter est le seul plan à peine couvert par le tableau. Ses quatre entrées sont Auto, le modèle maison Whizi AI, le modèle GPT de base sur lequel tourne Whizi AI, et un modèle Gemini rapide. Whizi AI est une persona maison sur ce modèle GPT de base plutôt qu'un modèle à part entière, et il coûte 1 crédit par message. Les comptes gratuits se situent en dessous : ils n'accèdent qu'à Whizi AI et à Auto, avec 7 messages le premier jour, puis 3 par jour, et un échange gratuit est en plus plafonné à environ 5,000 tokens en entrée et 5,000 en sortie.

Les fenêtres assez petites pour changer le budget

La colonne fenêtre n'est pas la colonne déterminante pour la longueur, car le budget par échange est fixe dans tout le catalogue. La façon dont ce budget est construit, et ce qui se passe quand une conversation le dépasse, est expliqué dans quand la conversation est trop longue.

Ce que la fenêtre décide vraiment, c'est si ce budget fixe s'applique ou non, et la limite se situe à 93,000 tokens. Six des 100 lignes tarifées sont en dessous, et deux d'entre elles ont les plus petites fenêtres de tout l'index tarifé.

LigneFenêtre de contextePrésent dans les tableaux ci-dessus
Tencent Hy-MT2, deux lignes8,192Non
Phi 4, Microsoft16KOui
Perceptron Mk133KNon
DeepSeek R164KNon
Nano Banana 2 Lite, Google66KNon

Ce qu'une fenêtre signifie pour un document réel

La première limite que rencontre un document n'est pas la fenêtre de contexte. C'est la limite de 100,000 caractères par message, et le texte extrait d'un fichier joint compte dedans exactement comme du texte saisi.

Sur le web, les fichiers PDF, Word et tableurs sont convertis en texte dans votre navigateur avant tout envoi, donc ce que reçoit le modèle est ce texte extrait. Chaque fichier est plafonné à 10 MB. La liste complète des formats se trouve dans types de fichiers pris en charge.

Les projets sont le seul endroit où un document consomme réellement le budget, car un fichier épinglé dans un projet est reconstruit dans le prompt à chaque échange de ce projet, dans le même budget d'entrée fixe quelle que soit la fenêtre du modèle. Les plafonds sur le fichier épinglé et le bloc de projet sont détaillés dans quand la conversation est trop longue.

Fenêtre face au prix et aux crédits, dans les lignes ci-dessus

Triez les tableaux par fenêtre et rien d'autre ne suit ce tri. La plus grande fenêtre de l'index tarifé, à 1,310,720 tokens, coûte $0.00028 par réponse standard, facture 1 crédit par message et se situe sur Powerhouse. La ligne la moins chère de toutes coûte $0.000053 par réponse sur une fenêtre de 262K. La ligne médiane se situe à $0.00185 par réponse, également sur une fenêtre de 262K. La ligne la plus chère coûte $0.105 par réponse standard et ne porte aucun palier de crédits, car elle ne fait pas partie des lignes que Whizi propose.

L'écart est plus simple à lire sur des lignes qui partagent la même fenêtre.

LigneFenêtre de contexteCoût par réponseCrédits
DeepSeek V4 Flash 07311.31M$0.000281
Qwen3.7 Flash1M$0.0000951
Inkling, Thinkingmachines1M$0.0029754
Claude Fable 51M$0.03550
Granite 4.1 8B, IBM131K$0.00011
Kimi K2 0711131K$0.0017210

Trois lignes partagent la même fenêtre de 1,000,000 tokens et facturent 1, 4 et 50 crédits. Deux lignes partagent la même fenêtre de 131K et facturent 1 et 10. L'index tarifé s'étend sur environ 2000x entre la ligne la moins chère et la plus chère, et les lignes ci-dessus montrent que cet écart ne suit pas la colonne fenêtre.

Liste de vérification
  • Les fenêtres de l'index tarifé vont de 8,192 à 1,310,720 tokens
  • 47 des 100 lignes tarifées ont une fenêtre de 1,000,000 tokens ou plus
  • La plus grande fenêtre de l'index répond une fois pour $0.00028 et facture 1 crédit
  • La ligne la moins chère de l'index a une fenêtre de 262K, pas la plus grande
  • La ligne médiane tarifée se situe à $0.00185 par réponse standard, également sur une fenêtre de 262K
  • Sur le web, la colonne crédits indique ce que dépense un message sur l'allocation de crédits
  • Un palier de crédits est déduit des tarifs par token des fournisseurs, donc la taille de la fenêtre n'entre pas dans ce calcul
  • Whizi AI est une persona maison sur un modèle GPT de base, à 1 crédit par message
  • Les comptes gratuits accèdent à deux lignes, et un échange gratuit est plafonné à 5,000 tokens en entrée et en sortie
  • L'index des coûts tarife 100 lignes OpenRouter, ce qui ne représente pas tout le catalogue de 280+ modèles

Questions fréquentes

Est-ce que j'obtiens une fenêtre de contexte plus grande avec un plan supérieur ?

Non. La fenêtre appartient au modèle, pas à votre abonnement. Ce qu'achète un plan supérieur, c'est l'accès à plus de modèles et une allocation mensuelle de crédits plus grande : 400 crédits sur Starter, 2,000 sur Pro et 8,000 sur Powerhouse.

Un modèle avec une fenêtre de contexte plus grande coûte-t-il plus de crédits ?

Pas dans les tableaux ci-dessus. La plus grande fenêtre de l'index tarifé, à 1,310,720 tokens, facture 1 crédit par message, alors qu'une ligne avec une fenêtre de 131K dans les mêmes tableaux facture 10. Un palier de crédits est déduit d'un échange de référence de 3,000 tokens en entrée et 800 tokens en sortie face aux tarifs par token en direct des fournisseurs, puis arrondi au palier légal supérieur, et la taille de la fenêtre n'entre pas dans ce calcul.

Puis-je essayer un modèle à grande fenêtre de contexte avec un compte gratuit ?

Non, plus depuis le 2026-09-02. Un compte gratuit donne accès à Whizi AI et à Auto, donc les lignes à 1,000,000 tokens nécessitent un plan. Un échange gratuit est également plafonné à environ 5,000 tokens en entrée et 5,000 en sortie, une limite plus stricte que n'importe quelle fenêtre de contexte de cette page, et l'allocation est de 7 messages le premier jour, puis 3 par jour.

Whizi publie-t-il une fenêtre de contexte pour chaque modèle du catalogue ?

Non. Les fenêtres de cette page proviennent de l'index des coûts, qui tarife 100 lignes OpenRouter à des fins de comparaison, et le catalogue compte 280+ modèles. Le sélecteur dans l'application est une interface distincte servie en direct par le worker partagé, donc il liste le catalogue actuel plutôt que cet index.

D'où viennent les chiffres de fenêtre de contexte de cette page ?

De l'index des coûts Whizi, qui tarife 100 lignes OpenRouter sur une réponse standard de 1,000 tokens en entrée plus 500 tokens en sortie, avec des tarifs sources relevés sur OpenRouter le 2026-08-20. L'index des coûts n'enregistre que cette seule date de relevé, donc considérez les montants en dollars comme valables à cette date plutôt que comme des tarifs en direct.