컨텍스트 윈도우 비교: 모든 주요 AI 모델을 한 표에

빠른 답변

2026년 8월 카탈로그에서 가장 큰 컨텍스트 윈도우는 1M 토큰으로, DeepSeek의 DeepSeek V4 Flash 0731이 보유하고 있습니다. 아래 표는 모든 주요 AI 모델을 토큰과 평범한 페이지 수로 비교하며, AI 모델 비용 지수와 같은 카탈로그 스냅샷을 기준으로 합니다. 토큰 하나는 영어 단어 약 4분의 3에 해당합니다.

어떤 AI 모델이 가장 큰 컨텍스트 윈도우를 가지고 있나요?

2026년 8월 카탈로그에서 가장 큰 컨텍스트 윈도우는 1M 토큰으로, DeepSeek의 DeepSeek V4 Flash 0731이 보유하고 있습니다. 대략적인 감을 잡자면, 토큰 하나는 영어 단어 약 4분의 3에 해당하고 원고지 한 페이지는 약 400단어이므로, 아래 표는 모든 윈도우를 페이지 수로 환산해 보여줍니다.

주요 제공업체별로 한 행씩, 그 업체의 가장 큰 컨텍스트 모델을 보여줍니다.

제공업체최대 컨텍스트 모델컨텍스트 윈도우대략적인 분량
DeepSeekDeepSeek V4 Flash 07311M 토큰약 2,500페이지
OpenAIGPT-5.41M 토큰약 2,000페이지
GoogleGemini 2.5 Flash1M 토큰약 2,000페이지
MetaLlama 4 Maverick1M 토큰약 2,000페이지
QwenQwen3.8 2.4T A95B1M 토큰약 2,000페이지
MoonshotKimi K31M 토큰약 2,000페이지
Z.aiGLM 5.21M 토큰약 2,000페이지
MiniMaxMiniMax M31M 토큰약 2,000페이지
AnthropicClaude Fable 51M 토큰약 1,900페이지
xAIGrok 4.31M 토큰약 1,900페이지
MistralMistral Large 3 2512262K 토큰약 492페이지

검색 뒤에 숨은 질문이 "애초에 컨텍스트 윈도우가 뭔가요"라면, 컨텍스트 윈도우란?의 쉬운 설명부터 읽고, 숫자를 보러 다시 돌아오세요.

100개 모델 전체는 컨텍스트 윈도우 기준으로 어떻게 순위가 매겨지나요?

컨텍스트 윈도우 기준으로 정렬한 전체 카탈로그입니다. 데이터는 AI 모델 비용 지수와 같은 출처에서 오며 2026-08-20에 수집한 스냅샷입니다. 실시간 피드가 아니므로 수치를 인용하기 전에 날짜를 확인하세요. 크레딧 열은 플랜에 포함된 경우 Whizi 안에서 각 모델이 메시지당 얼마인지 보여줍니다.

모델제공업체컨텍스트 윈도우대략적인 분량Whizi 크레딧
DeepSeek V4 Flash 0731DeepSeek1M약 2,500페이지1
GPT-5.4OpenAI1M약 2,000페이지15
GPT-5.5OpenAI1M약 2,000페이지20
GPT-5.6 LunaOpenAI1M약 2,000페이지1
GPT-5.6 Luna ProOpenAI1M약 2,000페이지측정 안 함
GPT-5.6 SolOpenAI1M약 2,000페이지20
GPT-5.6 Sol ProOpenAI1M약 2,000페이지측정 안 함
GPT-5.6 TerraOpenAI1M약 2,000페이지4
GPT-5.6 Terra ProOpenAI1M약 2,000페이지측정 안 함
LongCat 2.0Meituan1M약 2,000페이지1
DeepSeek V4 Pro 0813DeepSeek1M약 2,000페이지2
Gemini 2.5 FlashGoogle1M약 2,000페이지2
Gemini 2.5 Flash LiteGoogle1M약 2,000페이지1
Gemini 3.1 Flash LiteGoogle1M약 2,000페이지1
Gemini 3.1 Pro PreviewGoogle1M약 2,000페이지10
Gemini 3.5 FlashGoogle1M약 2,000페이지8
Gemini 3.5 Flash LiteGoogle1M약 2,000페이지2
Gemini 3.6 FlashGoogle1M약 2,000페이지3
Gemini 3.7 FlashGoogle1M약 2,000페이지2
GLM 5.2Z.ai1M약 2,000페이지3
GLM 5.3Z.ai1M약 2,000페이지5
InklingThinkingmachines1M약 2,000페이지4
Kimi K3Moonshot1M약 2,000페이지10
Laguna S 2.1Poolside1M약 2,000페이지1
Llama 4 MaverickMeta1M약 2,000페이지1
MiniMax M3MiniMax1M약 2,000페이지1
Muse Spark 1.1Meta1M약 2,000페이지5
Muse Spark 1.2Meta1M약 2,000페이지5
Qwen3.8 2.4T A95BQwen1M약 2,000페이지8
Claude Fable 5Anthropic1M약 1,900페이지50
Claude Opus 4.7 (Fast)Anthropic1M약 1,900페이지측정 안 함
Claude Opus 4.8Anthropic1M약 1,900페이지20
Claude Opus 4.8 (Fast)Anthropic1M약 1,900페이지측정 안 함
Claude Opus 5Anthropic1M약 1,900페이지20
Claude Opus 5 (Fast)Anthropic1M약 1,900페이지측정 안 함
Claude Sonnet 4.5Anthropic1M약 1,900페이지10
Claude Sonnet 4.6Anthropic1M약 1,900페이지10
Claude Sonnet 5Anthropic1M약 1,900페이지10
Fugu UltraSakana1M약 1,900페이지25
Grok 4.3xAI1M약 1,900페이지4
Qwen3.5 Plus 2026-04-20Qwen1M약 1,900페이지1
Qwen3.6 FlashQwen1M약 1,900페이지1
Qwen3.7 FlashQwen1M약 1,900페이지1
Qwen3.7 MaxQwen1M약 1,900페이지5
Qwen3.7 PlusQwen1M약 1,900페이지1
Qwen3.8 27BQwen1M약 1,900페이지3
Qwen3.8 MaxQwen1M약 1,900페이지6
Inkling SmallThinkingmachines524K약 983페이지1
Solar Pro 4Upstage524K약 983페이지1
Nemotron 3 UltraNVIDIA512K약 961페이지3
Grok 4.5xAI500K약 938페이지6
Grok 4.6xAI500K약 938페이지6
GPT Chat LatestOpenAI400K약 750페이지25
GPT-5.4 MiniOpenAI400K약 750페이지4
GPT-5.4 NanoOpenAI400K약 750페이지2
Nova Pro 1.0Amazon300K약 563페이지3
Hy3Tencent262K약 492페이지1
Kimi K2 ThinkingMoonshot262K약 492페이지10
Kimi K2.7 CodeMoonshot262K약 492페이지10
Laguna XS 2.1Poolside262K약 492페이지1
Ling-3.0-flashinclusionAI262K약 492페이지1
Mistral Large 3 2512Mistral262K약 492페이지2
Mistral Medium 3.5Mistral262K약 492페이지6
Nemotron 3.5 LightningNVIDIA262K약 492페이지1
Nex-N2-MiniNex Agi262K약 492페이지1
Nex-N2-ProNex Agi262K약 492페이지1
Qwen3 Coder NextQwen262K약 492페이지1
Qwen3.6 35B A3BQwen262K약 492페이지1
Ring-2.6-1TinclusionAI262K약 492페이지1
Sakana NamazuSakana262K약 492페이지4
Seed 2.1 TurboBytedance Seed262K약 492페이지2
Seed-2.0-CodeBytedance Seed262K약 492페이지3
Step 3.7 FlashStepfun262K약 492페이지1
Codestral 2508Mistral256K약 480페이지1
Command ACohere256K약 480페이지10
Grok Build 0.1xAI256K약 480페이지3
KAT-Coder-Air V2.5Kwaipilot256K약 480페이지1
KAT-Coder-Pro V2.5Kwaipilot256K약 480페이지3
GLM 4.6Z.ai205K약 384페이지1
GLM 4.7Z.ai205K약 384페이지2
GLM 5Z.ai205K약 384페이지2
MiniMax M2MiniMax205K약 384페이지1
Claude Haiku 4.5Anthropic200K약 375페이지4
DeepSeek V3.1DeepSeek164K약 307페이지1
DeepSeek V3.2DeepSeek164K약 307페이지1
Aion-3.0Aion Labs131K약 246페이지10
Aion-3.0-MiniAion Labs131K약 246페이지2
Granite 4.1 8BIbm Granite131K약 246페이지1
Kimi K2 0711Moonshot131K약 246페이지10
Llama 3.3 70B InstructMeta131K약 246페이지1
Mistral Medium 3.1Mistral131K약 246페이지2
Muse Glimmer 30BMeta131K약 246페이지2
Nano Banana 2 (Gemini 3.1 Flash Image)Google131K약 246페이지측정 안 함
Nano Banana Pro (Gemini 3 Pro Image)Google131K약 246페이지측정 안 함
Nano Banana 2 Lite (Gemini 3.1 Flash Lite Image)Google66K약 123페이지측정 안 함
R1DeepSeek64K약 120페이지2
Perceptron Mk1Perceptron33K약 61페이지1
Phi 4Microsoft16K약 31페이지1
Hy-MT2-1.8BTencent8K약 15페이지측정 안 함
Hy-MT2-30B-A3BTencent8K약 15페이지측정 안 함

이 숫자를 정직하게 읽는 법

윈도우는 공유됩니다. 프롬프트, 대화의 이전 메시지 전부, 첨부한 문서, 그리고 지금 쓰이고 있는 답변까지 모든 것이 한꺼번에 그 윈도우를 갉아먹습니다. 128K 윈도우를 가진 모델이 이미 10만 토큰짜리 계약서를 읽었다면 남은 논의용 여유는 128K가 아니라 28K입니다.

광고된 수치가 곧 실효 수치는 아닙니다. 긴 맥락을 다룬 연구는 계속 같은 패턴을 발견합니다. 모델은 거대한 맥락의 시작과 끝은 잘 기억하지만 중간은 그렇지 못합니다. Lost in the Middle 실험(Liu et al., 2023)에서는 핵심 문서를 입력의 가장자리에서 중간으로 옮기자 정확도가 약 20포인트 떨어졌습니다. 그러니 모델이 백만 토큰을 받아들여도 40만 번째 토큰에 묻힌 조항을 대충 넘길 수 있습니다. 이해관계가 큰 긴 문서 작업에서는 중간 구간에 대해 구체적으로 물어보거나, 문서를 라벨을 붙인 조각으로 나눠 먹이세요.

크다고 자동으로 좋은 건 아닙니다. 큰 윈도우는 실행 비용이 더 들고 관련 없는 텍스트에 주의가 흩어질 수 있습니다. 업무가 이메일과 짧은 초안이라면 윈도우 크기는 결코 체감되지 않습니다. 계약서 전체, 코드베이스, 녹취록, 책처럼 큰 단위에서야 비로소 중요해지기 시작합니다.

토큰은 단어가 아닙니다. 4분의 3 법칙은 영어 평균으로는 괜찮지만, 코드와 숫자, 비영어권 언어는 대개 토큰화 효율이 떨어지므로 표의 페이지 추정치는 일부러 대략적으로 잡았습니다.

윈도우를 작업에 맞추세요

이 표에서 얻을 수 있는 실용적인 결론은 컨텍스트 윈도우가 구독 단위가 아니라 작업 단위의 선택이라는 것입니다. 윈도우가 가장 큰 모델이 최고의 글쓰기 실력자인 경우는 드물고, 최고의 글쓰기 실력자가 800페이지를 요약하는 가장 저렴한 방법인 경우도 드뭅니다.

그것이 바로 카탈로그 전체를 한 작업 공간에 두어야 하는 이유입니다. Whizi에서는 200페이지짜리 PDF를 대용량 컨텍스트 모델에게 맡긴 뒤, 같은 대화 안에서 Claude나 GPT로 바꿔 그 모델이 찾아낸 내용으로 초안을 잡을 수 있습니다. 문서가 스레드를 벗어날 필요가 없습니다. 정직한 반론도 있습니다. 모델에 먹이는 모든 것이 128K 윈도우 안에 편안히 들어간다면, 대부분의 이메일과 초안 작성, 짧은 문서 작업이 여기에 해당하는데, 이 표 전체가 무의미해지고 단일 제공업체 구독이 더 간단한 선택입니다. 모델 고르는 법 가이드가 품질과 비용을 기준으로 같은 결정을 다룹니다.

이 페이지를 인용할 때 참고하세요. 앵커 없는 URL은 안정적이고, 데이터 날짜는 전체 표 위에 표시되어 있으며, 토큰 수치는 마케팅 페이지가 아니라 제공업체 카탈로그에서 가져옵니다.

체크리스트
  • 헤드라인 숫자를 믿기 전에 내 문서와 대화 기록을 윈도우에서 빼보세요
  • 긴 문서에서는 시작 부분뿐 아니라 중간 부분의 기억력도 테스트하세요
  • 무언가 결정하기 전에 4분의 3 법칙으로 토큰을 페이지로 환산해 보세요
  • 윈도우는 구독 단위가 아니라 작업 단위로 고르세요
  • 수치를 인용할 때는 전체 표 위의 데이터 날짜를 확인하세요

자주 묻는 질문

어떤 AI 모델이 가장 큰 컨텍스트 윈도우를 가지고 있나요?

2026년 8월 카탈로그 기준으로는 DeepSeek의 DeepSeek V4 Flash 0731이 1M 토큰으로 가장 큽니다. 위의 전체 표에 100개 모델 전부가 윈도우 크기순으로 정리되어 있고, 그 위에 데이터 날짜가 표시되어 있습니다.

가장 큰 Claude 컨텍스트 윈도우는 얼마인가요?

이 인덱스에서 가장 큰 Claude 컨텍스트 윈도우는 1M 토큰(Claude Fable 5)이며, 텍스트 약 1,900페이지에 해당합니다. 더 작은 Claude 모델들은 위의 전체 표에 있습니다.

가장 큰 GPT 컨텍스트 윈도우는 얼마인가요?

이 인덱스에서 가장 큰 GPT 컨텍스트 윈도우는 1M 토큰(GPT-5.4)이며, 텍스트 약 2,000페이지에 해당합니다. 더 작은 GPT 모델들은 위의 전체 표에 있습니다.

가장 큰 Gemini 컨텍스트 윈도우는 얼마인가요?

이 인덱스에서 가장 큰 Gemini 컨텍스트 윈도우는 1M 토큰(Gemini 2.5 Flash)이며, 텍스트 약 2,000페이지에 해당합니다. 더 작은 Gemini 모델들은 위의 전체 표에 있습니다.

가장 큰 Grok 컨텍스트 윈도우는 얼마인가요?

이 인덱스에서 가장 큰 Grok 컨텍스트 윈도우는 1M 토큰(Grok 4.3)이며, 텍스트 약 1,900페이지에 해당합니다. 더 작은 Grok 모델들은 위의 전체 표에 있습니다.

컨텍스트 윈도우는 클수록 항상 좋은가요?

아닙니다. 큰 윈도우는 비용이 더 들고, 아주 큰 맥락에서는 중간으로 갈수록 기억력이 떨어집니다. 책 전체나 코드베이스, 긴 녹취록에는 크기가 결정적이지만 일상적인 대화에서는 상관없습니다. 가장 큰 숫자에 돈을 내기보다 윈도우를 작업에 맞추세요.

컨텍스트 윈도우에는 페이지가 몇 장 들어가나요?

토큰 수를 대략 530으로 나누면 원고지 페이지 수가 나옵니다. 토큰 하나는 영어 단어 약 4분의 3이고, 한 페이지는 약 400단어이기 때문입니다. 그래서 128K 토큰은 약 240페이지, 100만 토큰은 약 1,900페이지입니다. 코드와 비영어권 텍스트는 대개 더 적게 들어갑니다.