La réponse courte
Les fenêtres de l'index tarifé vont de 8,192 à 1,310,720 tokens, et 47 des 100 lignes tarifées disposent d'une fenêtre de 1,000,000 tokens ou plus. La fenêtre est le maximum qu'un modèle peut prendre en compte en une seule requête, compté en tokens, mais ce n'est pas ce chiffre qui décide de votre résultat dans Whizi.
Ce qui décide, c'est le budget par échange. Chaque modèle du catalogue reçoit la même allocation fixe pour un échange : 40,000 tokens en entrée et 20,000 tokens en sortie. Une fenêtre plus grande n'augmente pas ce budget. Une fenêtre inférieure à 93,000 tokens le réduit.
| Donnée | Valeur |
|---|---|
| Plus grande fenêtre de l'index tarifé | DeepSeek V4 Flash 0731, 1,310,720 tokens |
| Plus petites fenêtres de l'index tarifé | Les deux lignes Tencent Hy-MT2, 8,192 tokens |
| Lignes à 1,000,000 tokens ou plus | 47 des 100 lignes tarifées |
| Entrée envoyée par échange, chaque modèle du catalogue | 40,000 tokens |
| Sortie autorisée par échange, chaque modèle du catalogue | 20,000 tokens |
| Fenêtre en dessous de laquelle ce budget se réduit | 93,000 tokens |
Donc pour un document réel, les deux limites qui comptent vraiment sont la limite de 100,000 caractères par message de chat et ce budget de 40,000 tokens en entrée. Aucune des deux n'est la colonne fenêtre.
Fenêtres de contexte par modèle, avec coût et plan
Chaque ligne ci-dessous provient de l'index des coûts Whizi, qui tarife 100 lignes OpenRouter chez 29 fournisseurs sur une réponse standard de 1,000 tokens en entrée plus 500 tokens en sortie. Les tarifs des fournisseurs derrière ces chiffres ont été relevés le 2026-08-20. Sur le web, la colonne crédits indique ce que coûte un message sur ce modèle sur votre allocation de crédits, et la colonne plan indique le plan le plus bas qui y donne accès. Une plateforme absente de la liste autorisée pour les crédits voit un tarif fixe de 1x à la place, est facturée un crédit par échange, et conserve l'allocation de messages.
OpenAI.
| Modèle | Fenêtre de contexte | Coût par réponse | Crédits | Plan minimum |
|---|---|---|---|---|
| GPT-5.6 Luna | 1M | $0.0008 | 1 | Starter |
| GPT-5.4 Nano | 400K | $0.000825 | 2 | Powerhouse |
| GPT-5.4 Mini | 400K | $0.003 | 4 | Powerhouse |
| GPT-5.6 Terra | 1M | $0.008 | 4 | Pro |
| GPT-5.4 | 1M | $0.01 | 15 | Powerhouse |
| GPT-5.6 Sol | 1M | $0.01 | 20 | Powerhouse |
| GPT-5.5 | 1M | $0.02 | 20 | Pro |
| GPT Chat Latest | 400K | $0.02 | 25 | Powerhouse |
Anthropic.
| Modèle | Fenêtre de contexte | Coût par réponse | Crédits | Plan minimum |
|---|---|---|---|---|
| Claude Haiku 4.5 | 200K | $0.0035 | 4 | Pro |
| Claude Sonnet 5 | 1M | $0.007 | 10 | Pro |
| Claude Sonnet 4.6 | 1M | $0.0105 | 10 | Pro |
| Claude Sonnet 4.5 | 1M | $0.0105 | 10 | Pro |
| Claude Opus 5 | 1M | $0.0175 | 20 | Powerhouse |
| Claude Opus 4.8 | 1M | $0.0175 | 20 | Powerhouse |
| Claude Fable 5 | 1M | $0.035 | 50 | Powerhouse |
Google.
| Modèle | Fenêtre de contexte | Coût par réponse | Crédits | Plan minimum |
|---|---|---|---|---|
| Gemini 2.5 Flash Lite | 1M | $0.0003 | 1 | Pro |
| Gemini 3.1 Flash Lite | 1M | $0.001 | 1 | Powerhouse |
| Gemini 3.7 Flash | 1M | $0.001313 | 2 | Pro |
| Gemini 2.5 Flash | 1M | $0.00155 | 2 | Pro |
| Gemini 3.5 Flash Lite | 1M | $0.00155 | 2 | Powerhouse |
| Gemini 3.6 Flash | 1M | $0.002625 | 3 | Pro |
| Gemini 3.5 Flash | 1M | $0.006 | 8 | Pro |
| Gemini 3.1 Pro Preview | 1M | $0.008 | 10 | Pro |
DeepSeek.
| Modèle | Fenêtre de contexte | Coût par réponse | Crédits | Plan minimum |
|---|---|---|---|---|
| DeepSeek V4 Flash 0731 | 1.31M | $0.00028 | 1 | Powerhouse |
| DeepSeek V3.2 | 164K | $0.000469 | 1 | Pro |
| DeepSeek V3.1 | 164K | $0.000725 | 1 | Pro |
| DeepSeek V4 Pro 0813 | 1M | $0.00297 | 2 | Powerhouse |
Qwen.
| Modèle | Fenêtre de contexte | Coût par réponse | Crédits | Plan minimum |
|---|---|---|---|---|
| Qwen3.7 Flash | 1M | $0.000095 | 1 | Powerhouse |
| Qwen3 Coder Next | 262K | $0.00052 | 1 | Powerhouse |
| Qwen3.6 Flash | 1M | $0.00075 | 1 | Powerhouse |
| Qwen3.7 Plus | 1M | $0.00096 | 1 | Pro |
| Qwen3.8 27B | 1M | $0.00205 | 3 | Powerhouse |
| Qwen3.7 Max | 1M | $0.003688 | 5 | Powerhouse |
| Qwen3.8 Max | 1M | $0.005 | 6 | Powerhouse |
xAI.
| Modèle | Fenêtre de contexte | Coût par réponse | Crédits | Plan minimum |
|---|---|---|---|---|
| Grok Build 0.1 | 256K | $0.002 | 3 | Powerhouse |
| Grok 4.3 | 1M | $0.0025 | 4 | Powerhouse |
| Grok 4.5 | 500K | $0.005 | 6 | Powerhouse |
| Grok 4.6 | 500K | $0.005 | 6 | Pro |
Meta.
| Modèle | Fenêtre de contexte | Coût par réponse | Crédits | Plan minimum |
|---|---|---|---|---|
| Llama 3.3 70B Instruct | 131K | $0.00026 | 1 | Pro |
| Llama 4 Maverick | 1M | $0.0006 | 1 | Pro |
| Muse Glimmer 30B | 131K | $0.0011 | 2 | Powerhouse |
| Muse Spark 1.2 | 1M | $0.003375 | 5 | Powerhouse |
Mistral.
| Modèle | Fenêtre de contexte | Coût par réponse | Crédits | Plan minimum |
|---|---|---|---|---|
| Codestral 2508 | 256K | $0.00075 | 1 | Powerhouse |
| Mistral Large 3 2512 | 262K | $0.00125 | 2 | Pro |
| Mistral Medium 3.1 | 131K | $0.0014 | 2 | Pro |
| Mistral Medium 3.5 | 262K | $0.00525 | 6 | Powerhouse |
Z.ai et Moonshot.
| Modèle | Fenêtre de contexte | Coût par réponse | Crédits | Plan minimum |
|---|---|---|---|---|
| GLM 4.6 | 205K | $0.0015 | 1 | Powerhouse |
| GLM 4.7 | 205K | $0.001275 | 2 | Powerhouse |
| GLM 5 | 205K | $0.00156 | 2 | Pro |
| GLM 5.2 | 1M | $0.002484 | 3 | Powerhouse |
| GLM 5.3 | 1M | $0.0036 | 5 | Powerhouse |
| Kimi K2 0711 | 131K | $0.00172 | 10 | Powerhouse |
| Kimi K2 Thinking | 262K | $0.00185 | 10 | Powerhouse |
| Kimi K2.7 Code | 262K | $0.00246 | 10 | Powerhouse |
| Kimi K3 | 1M | $0.0105 | 10 | Pro |
Quatorze lignes supplémentaires.
Ce sont une sélection des lignes tarifées des autres laboratoires, pas la totalité.
| Modèle | Fenêtre de contexte | Coût par réponse | Crédits | Plan minimum |
|---|---|---|---|---|
| MiniMax M2 | 205K | $0.000765 | 1 | Powerhouse |
| MiniMax M3 | 1M | $0.0009 | 1 | Powerhouse |
| Nemotron 3.5 Lightning, NVIDIA | 262K | $0.00018 | 1 | Powerhouse |
| Nemotron 3 Ultra, NVIDIA | 512K | $0.0024 | 3 | Powerhouse |
| Nova Pro 1.0, Amazon | 300K | $0.0024 | 3 | Powerhouse |
| Command A, Cohere | 256K | $0.0075 | 10 | Powerhouse |
| Solar Pro 4, Upstage | 524K | $0.00009 | 1 | Powerhouse |
| Ling-3.0-flash, inclusionAI | 262K | $0.000053 | 1 | Powerhouse |
| Nex-N2-Mini, Nex Agi | 262K | $0.000075 | 1 | Powerhouse |
| Laguna XS 2.1, Poolside | 262K | $0.00012 | 1 | Powerhouse |
| Granite 4.1 8B, IBM | 131K | $0.0001 | 1 | Powerhouse |
| Phi 4, Microsoft | 16K | $0.00014 | 1 | Powerhouse |
| Inkling, Thinkingmachines | 1M | $0.002975 | 4 | Powerhouse |
| Fugu Ultra, Sakana | 1M | $0.02 | 25 | Powerhouse |
Le catalogue compte 280+ modèles, et les lignes ci-dessus proviennent de l'index des coûts, qui tarife 100 lignes OpenRouter à des fins de comparaison, et ni les tableaux ni l'index ne couvrent tout le catalogue. La colonne plan est déduite plutôt que listée, et la liste des modèles explique comment fonctionne cette déduction.
Starter est le seul plan à peine couvert par le tableau. Ses quatre entrées sont Auto, le modèle maison Whizi AI, le modèle GPT de base sur lequel tourne Whizi AI, et un modèle Gemini rapide. Whizi AI est une persona maison sur ce modèle GPT de base plutôt qu'un modèle à part entière, et il coûte 1 crédit par message. Les comptes gratuits se situent en dessous : ils n'accèdent qu'à Whizi AI et à Auto, avec 7 messages le premier jour, puis 3 par jour, et un échange gratuit est en plus plafonné à environ 5,000 tokens en entrée et 5,000 en sortie.
Les fenêtres assez petites pour changer le budget
La colonne fenêtre n'est pas la colonne déterminante pour la longueur, car le budget par échange est fixe dans tout le catalogue. La façon dont ce budget est construit, et ce qui se passe quand une conversation le dépasse, est expliqué dans quand la conversation est trop longue.
Ce que la fenêtre décide vraiment, c'est si ce budget fixe s'applique ou non, et la limite se situe à 93,000 tokens. Six des 100 lignes tarifées sont en dessous, et deux d'entre elles ont les plus petites fenêtres de tout l'index tarifé.
| Ligne | Fenêtre de contexte | Présent dans les tableaux ci-dessus |
|---|---|---|
| Tencent Hy-MT2, deux lignes | 8,192 | Non |
| Phi 4, Microsoft | 16K | Oui |
| Perceptron Mk1 | 33K | Non |
| DeepSeek R1 | 64K | Non |
| Nano Banana 2 Lite, Google | 66K | Non |
Ce qu'une fenêtre signifie pour un document réel
La première limite que rencontre un document n'est pas la fenêtre de contexte. C'est la limite de 100,000 caractères par message, et le texte extrait d'un fichier joint compte dedans exactement comme du texte saisi.
Sur le web, les fichiers PDF, Word et tableurs sont convertis en texte dans votre navigateur avant tout envoi, donc ce que reçoit le modèle est ce texte extrait. Chaque fichier est plafonné à 10 MB. La liste complète des formats se trouve dans types de fichiers pris en charge.
Les projets sont le seul endroit où un document consomme réellement le budget, car un fichier épinglé dans un projet est reconstruit dans le prompt à chaque échange de ce projet, dans le même budget d'entrée fixe quelle que soit la fenêtre du modèle. Les plafonds sur le fichier épinglé et le bloc de projet sont détaillés dans quand la conversation est trop longue.
Fenêtre face au prix et aux crédits, dans les lignes ci-dessus
Triez les tableaux par fenêtre et rien d'autre ne suit ce tri. La plus grande fenêtre de l'index tarifé, à 1,310,720 tokens, coûte $0.00028 par réponse standard, facture 1 crédit par message et se situe sur Powerhouse. La ligne la moins chère de toutes coûte $0.000053 par réponse sur une fenêtre de 262K. La ligne médiane se situe à $0.00185 par réponse, également sur une fenêtre de 262K. La ligne la plus chère coûte $0.105 par réponse standard et ne porte aucun palier de crédits, car elle ne fait pas partie des lignes que Whizi propose.
L'écart est plus simple à lire sur des lignes qui partagent la même fenêtre.
| Ligne | Fenêtre de contexte | Coût par réponse | Crédits |
|---|---|---|---|
| DeepSeek V4 Flash 0731 | 1.31M | $0.00028 | 1 |
| Qwen3.7 Flash | 1M | $0.000095 | 1 |
| Inkling, Thinkingmachines | 1M | $0.002975 | 4 |
| Claude Fable 5 | 1M | $0.035 | 50 |
| Granite 4.1 8B, IBM | 131K | $0.0001 | 1 |
| Kimi K2 0711 | 131K | $0.00172 | 10 |
Trois lignes partagent la même fenêtre de 1,000,000 tokens et facturent 1, 4 et 50 crédits. Deux lignes partagent la même fenêtre de 131K et facturent 1 et 10. L'index tarifé s'étend sur environ 2000x entre la ligne la moins chère et la plus chère, et les lignes ci-dessus montrent que cet écart ne suit pas la colonne fenêtre.
- Les fenêtres de l'index tarifé vont de 8,192 à 1,310,720 tokens
- 47 des 100 lignes tarifées ont une fenêtre de 1,000,000 tokens ou plus
- La plus grande fenêtre de l'index répond une fois pour $0.00028 et facture 1 crédit
- La ligne la moins chère de l'index a une fenêtre de 262K, pas la plus grande
- La ligne médiane tarifée se situe à $0.00185 par réponse standard, également sur une fenêtre de 262K
- Sur le web, la colonne crédits indique ce que dépense un message sur l'allocation de crédits
- Un palier de crédits est déduit des tarifs par token des fournisseurs, donc la taille de la fenêtre n'entre pas dans ce calcul
- Whizi AI est une persona maison sur un modèle GPT de base, à 1 crédit par message
- Les comptes gratuits accèdent à deux lignes, et un échange gratuit est plafonné à 5,000 tokens en entrée et en sortie
- L'index des coûts tarife 100 lignes OpenRouter, ce qui ne représente pas tout le catalogue de 280+ modèles
Questions fréquentes
Est-ce que j'obtiens une fenêtre de contexte plus grande avec un plan supérieur ?
Non. La fenêtre appartient au modèle, pas à votre abonnement. Ce qu'achète un plan supérieur, c'est l'accès à plus de modèles et une allocation mensuelle de crédits plus grande : 400 crédits sur Starter, 2,000 sur Pro et 8,000 sur Powerhouse.
Un modèle avec une fenêtre de contexte plus grande coûte-t-il plus de crédits ?
Pas dans les tableaux ci-dessus. La plus grande fenêtre de l'index tarifé, à 1,310,720 tokens, facture 1 crédit par message, alors qu'une ligne avec une fenêtre de 131K dans les mêmes tableaux facture 10. Un palier de crédits est déduit d'un échange de référence de 3,000 tokens en entrée et 800 tokens en sortie face aux tarifs par token en direct des fournisseurs, puis arrondi au palier légal supérieur, et la taille de la fenêtre n'entre pas dans ce calcul.
Puis-je essayer un modèle à grande fenêtre de contexte avec un compte gratuit ?
Non, plus depuis le 2026-09-02. Un compte gratuit donne accès à Whizi AI et à Auto, donc les lignes à 1,000,000 tokens nécessitent un plan. Un échange gratuit est également plafonné à environ 5,000 tokens en entrée et 5,000 en sortie, une limite plus stricte que n'importe quelle fenêtre de contexte de cette page, et l'allocation est de 7 messages le premier jour, puis 3 par jour.
Whizi publie-t-il une fenêtre de contexte pour chaque modèle du catalogue ?
Non. Les fenêtres de cette page proviennent de l'index des coûts, qui tarife 100 lignes OpenRouter à des fins de comparaison, et le catalogue compte 280+ modèles. Le sélecteur dans l'application est une interface distincte servie en direct par le worker partagé, donc il liste le catalogue actuel plutôt que cet index.
D'où viennent les chiffres de fenêtre de contexte de cette page ?
De l'index des coûts Whizi, qui tarife 100 lignes OpenRouter sur une réponse standard de 1,000 tokens en entrée plus 500 tokens en sortie, avec des tarifs sources relevés sur OpenRouter le 2026-08-20. L'index des coûts n'enregistre que cette seule date de relevé, donc considérez les montants en dollars comme valables à cette date plutôt que comme des tarifs en direct.