今年
最新のエントリーは、2026年8月14日のZ.aiによるGLM-5.3です。この表は新しい順に並んでおり、2026年8月までのリリースを扱っています。
| 日付 | モデル | 提供元 | 重要だった理由 |
|---|---|---|---|
| 2026年8月14日 | GLM-5.3 | Z.ai | 混み合うオープンウェイト月における、GLMラインの8月のリフレッシュ。 |
| 2026年8月13日 | Gemini 3.7 Flash | 高速ティアが、Proのリリースの合間にも着実に能力を吸収し続けている。 | |
| 2026年8月6日 | Grok 4.6 | xAI | 長時間動くエージェントに焦点を当て、50万トークンのコンテキストウィンドウを備える。 |
| 2026年8月2日 | Qwen3.8 Max | Qwen | この夏でもっとも規模の大きいAlibabaのQwenリリース。 |
| 2026年7月16日 | Grok 4.5 | xAI | xAIによる年央のコーディングとコスト面の押し上げ。 |
| 2026年7月16日 | Kimi K3 | Moonshot | 2.8兆パラメータのオープンウェイト旗艦モデルとして発表され、重みは7月27日に公開された。 |
| 2026年7月9日 | GPT-5.6 (Sol, Terra, Luna) | OpenAI | 単一の旗艦モデルという型に代わり、3つの名前付きバリアントが登場。 |
| 2026年6月30日 | Claude Sonnet 5 | Anthropic | 5ファミリーの働き手。Sonnetの価格で旗艦に近い品質を提供し、Anthropic製品全体で既定モデルになった。 |
| 2026年6月9日 | Claude Fable 5 | Anthropic | 最初のMythosクラスのモデルで、Opusティアの上にAnthropicの5ファミリーを開いた。 |
| 2026年5月28日 | Claude Opus 4.8 | Anthropic | Opusラインの春の集大成。 |
| 2026年4月24日 | DeepSeek V4 | DeepSeek | DeepSeekの次の主要ラインが、GPT-5.5のわずか1日後に登場。 |
| 2026年4月23日 | GPT-5.5 | OpenAI | OpenAI史上もっとも賢く直感的なモデルと謳われ、Instant版は5月に無料ユーザーにも届いた。 |
| 2026年4月16日 | Claude Opus 4.7 | Anthropic | 8日間に詰め込まれた3件のフロンティアリリースの最初の1つ。 |
| 2026年3月5日 | GPT-5.4 | OpenAI | 5シリーズのペースが、およそ四半期に1回のリリースに落ち着く。 |
| 2026年2月19日 | Gemini 3.1 Pro | Googleの春の旗艦モデルのリフレッシュ。 | |
| 2026年2月5日 | GPT-5.3-Codex | OpenAI | エージェント型のソフトウェア作業を狙った、コーディング専用の旗艦モデル。 |
2025年:推論競争と価格崩壊
DeepSeek R1が安価な推論を市場を揺るがす出来事に変えた年であり、推論モデルがフロンティアの標準形式になり、11月には13日間で4件のフロンティアリリースが詰め込まれました。GPT-5.1、Grok 4.1、Gemini 3 Pro、Claude Opus 4.5です。Grok 4.1はポイントアップデートだったため、この期間には数えられるものの、表の行としては数えていません。
| 日付 | モデル | 提供元 | 重要だった理由 |
|---|---|---|---|
| 2025年12月11日 | GPT-5.2 | OpenAI | OpenAIによる5シリーズの12月のリフレッシュ。 |
| 2025年12月1日 | DeepSeek V3.2 | DeepSeek | スパースアテンションのリリースが安定版になり、推論モードでのツール呼び出しに対応。 |
| 2025年11月24日 | Claude Opus 4.5 | Anthropic | Anthropicが旗艦ティアの大幅な値下げとともに、11月の波を締めくくる。 |
| 2025年11月18日 | Gemini 3 Pro | この分野がこれまでで最も密集したリリース月に投入された、Googleの11月のエントリー。 | |
| 2025年11月12日 | GPT-5.1 | OpenAI | InstantとThinkingの2つのバリアントで、詰め込まれた11月の幕開けを飾る。 |
| 2025年9月29日 | DeepSeek V3.2-Exp | DeepSeek | オープンな場でのスパースアテンション。のちにV3.2となる実験版。 |
| 2025年8月7日 | GPT-5 | OpenAI | 待望の旗艦モデルで、高速モードと思考モードのあいだを自動的に振り分ける。 |
| 2025年7月11日 | Kimi K2 | Moonshot | 中国のMoonshotによる1兆パラメータのオープンウェイトモデルで、エージェント型のタスクに強い。 |
| 2025年7月9日 | Grok 4 | xAI | xAIがフロンティアティアに到達。リアルタイムのXのデータが差別化要因。 |
| 2025年5月22日 | Claude Opus 4 and Sonnet 4 | Anthropic | コーディングと長時間動くエージェント作業に真正面から狙いを定めた。 |
| 2025年4月16日 | o3 and o4-mini | OpenAI | 推論モデルがツール利用に対応。思考に加えて検索、コーディング、画像の読み取りができるようになった。 |
| 2025年4月5日 | Llama 4 (Scout, Maverick) | Meta | Metaのオープンウェイトラインが、非常に長いコンテキストを備えてマルチモーダル化。 |
| 2025年3月25日 | Gemini 2.5 Pro | 100万トークンのコンテキストウィンドウを目玉に、Googleがベンチマークで首位に立つ。 | |
| 2025年2月24日 | Claude 3.7 Sonnet | Anthropic | ハイブリッド推論。ひとつのモデルが、いつ長く考えるかを自分で判断する。 |
| 2025年1月20日 | DeepSeek R1 | DeepSeek | 市場を動かしたリリース。西側のAPI価格のおよそ10分の1で、オープンウェイトの推論を実現した。 |
助走期間:2022年から2024年まで
現在の勢力図を作ったリリース群です。ChatGPTのローンチ、最初のフロンティア競争、そしてマルチモーダルモデルと推論モデルの登場です。
| 日付 | モデル | 提供元 | 重要だった理由 |
|---|---|---|---|
| 2024年12月26日 | DeepSeek V3 | DeepSeek | 学習コストのわずかな割合で、フロンティアに近い品質のオープンウェイトを実現。翌年1月への布石となった。 |
| 2024年12月11日 | Gemini 2.0 Flash | 高速ティアのモデルが本当に有能になり、安価なモデルの価格崩壊を予感させた。 | |
| 2024年9月12日 | o1-preview | OpenAI | 初めて広く使われた推論モデル。答える前に考えるぶん、応答は遅くなる。 |
| 2024年6月20日 | Claude 3.5 Sonnet | Anthropic | ミドルティアのモデルが前世代の旗艦モデルを上回り、Sonnetティアへの期待をリセットした。 |
| 2024年5月13日 | GPT-4o | OpenAI | 音声と視覚をひとつのモデルにネイティブで統合し、無料ティアでもフロンティア級の能力に触れられるようにした。 |
| 2024年3月4日 | Claude 3 (Opus, Sonnet, Haiku) | Anthropic | 定着したティア名。旗艦モデル、働き手のモデル、そして速くて安いモデルという構成。 |
| 日付 | モデル | 提供元 | 重要だった理由 |
|---|---|---|---|
| 2023年12月6日 | Gemini | GoogleによるGPT-4への回答であり、三つ巴のフロンティア競争の始まり。 | |
| 2023年7月11日 | Claude 2 | Anthropic | Anthropicが一般向けにClaudeを公開。当時としては巨大な10万トークンのコンテキストウィンドウを備えていた。 |
| 2023年3月14日 | GPT-4 | OpenAI | 多くの専門職が初めて使ったフロンティアモデルであり、有料AIサブスクリプションが大規模に始まるきっかけとなった。 |
| 日付 | モデル | 提供元 | 重要だった理由 |
|---|---|---|---|
| 2022年11月30日 | ChatGPT | OpenAI | 対話型AIを一般消費者向け製品に変えたローンチ。 |
リリースの間隔が示すもの
間隔はどんどん縮んでいます。 GPT-4は1年以上フロンティアの座を保ちました。2025年後半には、4つのラボがひと月のうちにフロンティアモデルを出し、2026年4月には3件が8日間のうちに着地しました。「どのモデルが最良か」で決めたサブスクリプションの選択は、いまや数週間しか持ちません。
| 期間 | 何が出たか | サブスクリプションにとっての意味 |
|---|---|---|
| GPT-4の時代 | ひとつのモデルが1年以上フロンティアの座を保った | 「どのモデルが最良か」という選択が何か月も有効だった |
| 2025年11月 | 13日間に4件のフロンティアリリース | ローンチ週のベンチマーク表は、もう何も決着させなくなった |
| 2026年4月 | Claude Opus 4.7、GPT-5.5、DeepSeek V4が8日間のうちに | 請求サイクルのあいだにフロンティアの顔ぶれが変わりうる |
| 2024年から2026年 | DeepSeek、Kimi、Qwen、GLM、Llamaが脚注からフロンティア争いの当事者へ | 広がっているのは能力の差ではなく価格の差 |
リリースの集中は意図的です。 各ラボは互いのローンチの時期を狙って出してきます。2026年4月にはDeepSeek V4がGPT-5.5のわずか1日後に登場し、2025年11月にはGPT-5.1が開いた窓を、12日後にGemini 3 ProとClaude Opus 4.5が閉じました。こうした時期のローンチ週のベンチマーク表はマーケティングの弾薬であり、だからこそめったに何も決着させません。
オープンウェイトの系譜は、もう遅れていません。 DeepSeek、Kimi、Qwen、GLM、Llamaは、2年のあいだに脚注からフロンティア争いの当事者へと移り、しかもたいてい価格はほんのわずかです。タスクごとの最良モデルでは、これらのリリースのうちどれが現在それぞれのタスク枠を占めているかを追っています。実務上の効果としては、AIモデル費用インデックスが追っている、コスト差の拡大となって現れています。
実務上の結論は、GPT-4の時代から変わっていません。リリースが出たら、発表だけで乗り換えないことです。新しいモデルを、いまのモデルと並べて自分の本物の3つのタスクで走らせましょう。リリース評価ガイドは、まさにそのための1時間でできる方法です。Whiziでは新しいフロンティアモデルが既存のモデルと同じピッカーに並ぶので、比較は2つ目のサブスクリプションではなく、ひとつの会話で済みます。
手法、情報源、訂正について
日付は公開されたリリース発表日で、項目を追加する前に提供元の発表と同日の報道と照らし合わせて確認しています。月しか確実に裏づけが取れない場合は、日をでっち上げず月だけを表示します。プレビュー、ウェイトリスト、段階的な展開については、最初に一般提供が発表された日を採用しています。
この表は、すべてのチェックポイントではなく意図的に主要なリリースだけを追跡しています。一般的な利用者や開発者が買える、動かせる、比較できるものを変えたリリースだけが項目として載ります。小さなポイントアップデートや、告知のないモデルの入れ替えは対象外です。
訂正は歓迎しており、すぐに反映します。ここに載っている日付が一次情報源と食い違っている場合は、サポートページの連絡先から出典とともにご連絡ください。このページは引用されることを意図しているため、正確さそのものが製品です。
- このページの最新エントリーの日付を確認してから、現在の情報として引用する
- ローンチ週のベンチマーク表は、第三者が再現するまでマーケティングとして扱う
- 何かを乗り換える前に、新しいリリースを自分の3つのタスクで試す
- フロンティアは数週間で顔ぶれが変わるものと見込んで、それを追えるツールを選ぶ
- 引用するのは報道日ではなく項目の日付。段階的な展開ではこの2つが異なる
よくある質問
最も新しい主要なAIモデルのリリースは何ですか。
この年表で最も新しいエントリーは、2026年8月14日にリリースされたZ.aiのGLM-5.3です。この年表は2026年8月までのリリースを扱っているため、いちばん上の行を現在の情報として扱う前にその日付を確認してください。
新しいAIモデルはどのくらいの頻度で出ますか。
速く、しかも加速しています。2026年8月までの12か月には、フロンティアラボとオープンウェイトのエコシステムを合わせて22件の主要なリリースがあり、これは項目に値するほど重要なローンチだけを数えたものです。実務上の教訓は、永遠の勝者を前提に最適化するのをやめることです。
ChatGPTがリリースされたのはいつですか。
2022年11月30日です。大規模言語モデルが一般消費者向け製品になった瞬間であり、この年表のすべての項目は、そのとき生まれたサブスクリプション市場の延長線上にあります。
新しいものが出るたびにモデルを乗り換えるべきですか。
いいえ。乗り換えるべきなのは、ローンチ時のベンチマークではなく、自分自身が繰り返し行うタスクで新しいモデルが勝ったときです。上でリンクしたリリースガイドの1時間の評価で十分に判断でき、複数モデルのワークスペースの中で行えば、そのテストにかかる費用は新しいサブスクリプションではなく、ひとつの会話で済みます。