今年
最新的條目是Z.ai在2026年8月14日發布的GLM-5.3。表格依時間由新到舊排列,涵蓋到2026年8月為止的發布。
| 日期 | 模型 | 供應商 | 為什麼重要 |
|---|---|---|---|
| August 14, 2026 | GLM-5.3 | Z.ai | 在開放權重百家爭鳴的8月裡,GLM系列的一次更新。 |
| August 13, 2026 | Gemini 3.7 Flash | 快速版持續在Pro版本之間吸收更多能力。 | |
| August 6, 2026 | Grok 4.6 | xAI | 專注在長時間運作的代理任務,上下文視窗達50萬token。 |
| August 2, 2026 | Qwen3.8 Max | Qwen | 阿里巴巴這個夏天最大型的Qwen發布。 |
| July 16, 2026 | Grok 4.5 | xAI | xAI年中在程式設計和成本上的一次推進。 |
| July 16, 2026 | Kimi K3 | Moonshot | 一款2.8兆參數的開放權重旗艦模型,權重檔在7月27日跟進釋出。 |
| July 9, 2026 | GPT-5.6 (Sol, Terra, Luna) | OpenAI | 三個具名版本,取代了單一旗艦模型的模式。 |
| June 30, 2026 | Claude Sonnet 5 | Anthropic | 5系列的主力機型:以Sonnet的價格,提供接近旗艦等級的品質,成為Anthropic各產品的預設模型。 |
| June 9, 2026 | Claude Fable 5 | Anthropic | 第一款Mythos等級的模型,在Opus之上,開啟了Anthropic的5系列。 |
| May 28, 2026 | Claude Opus 4.8 | Anthropic | Opus系列春季的壓軸之作。 |
| April 24, 2026 | DeepSeek V4 | DeepSeek | DeepSeek的下一個主要系列,在GPT-5.5發布隔天就登場。 |
| April 23, 2026 | GPT-5.5 | OpenAI | 號稱是OpenAI最聰明、最直覺的模型;Instant版本在5月開放給免費使用者。 |
| April 16, 2026 | Claude Opus 4.7 | Anthropic | 八天內三次前沿發布中的第一個。 |
| March 5, 2026 | GPT-5.4 | OpenAI | 5系列的發布節奏,穩定在大約每季一次。 |
| February 19, 2026 | Gemini 3.1 Pro | Google春季旗艦機型的更新。 | |
| February 5, 2026 | GPT-5.3-Codex | OpenAI | 一款專門的程式設計旗艦模型,瞄準能自主執行任務的軟體開發工作。 |
2025年:推理競賽與價格崩跌
這一年,DeepSeek R1讓便宜的推理能力成為一件市場大事,推理模型變成前沿模型的預設格式,11月更是在短短13天內塞進了四次前沿發布:GPT-5.1、Grok 4.1、Gemini 3 Pro和Claude Opus 4.5。Grok 4.1只是一次小更新,所以雖然算在這波發布之內,卻沒有獨立列進表格。
| 日期 | 模型 | 供應商 | 為什麼重要 |
|---|---|---|---|
| December 11, 2025 | GPT-5.2 | OpenAI | OpenAI在12月對5系列做的一次更新。 |
| December 1, 2025 | DeepSeek V3.2 | DeepSeek | 稀疏注意力版本正式轉為穩定版,推理模式下支援工具呼叫。 |
| November 24, 2025 | Claude Opus 4.5 | Anthropic | Anthropic在11月這波發布的收尾之作,旗艦等級大幅降價。 |
| November 18, 2025 | Gemini 3 Pro | Google在這個業界密度最高的發布月份裡的11月之作。 | |
| November 12, 2025 | GPT-5.1 | OpenAI | Instant和Thinking兩種版本,揭開了塞滿發布的11月序幕。 |
| September 29, 2025 | DeepSeek V3.2-Exp | DeepSeek | 公開的稀疏注意力實驗版本,後來演變成V3.2。 |
| August 7, 2025 | GPT-5 | OpenAI | 眾所期待的旗艦模型,在快速模式與思考模式之間自動路由。 |
| July 11, 2025 | Kimi K2 | Moonshot | 來自中國Moonshot、參數量達一兆的開放權重模型,在代理型任務上表現突出。 |
| July 9, 2025 | Grok 4 | xAI | xAI進入前沿等級,以即時的X資料作為差異化優勢。 |
| May 22, 2025 | Claude Opus 4 and Sonnet 4 | Anthropic | 明確定位在程式設計和長時間運作的代理任務上。 |
| April 16, 2025 | o3 and o4-mini | OpenAI | 推理模型獲得工具使用能力:一邊思考,一邊搜尋、寫程式、讀取圖片。 |
| April 5, 2025 | Llama 4 (Scout, Maverick) | Meta | Meta的開放權重系列邁向多模態,上下文視窗非常長。 |
| March 25, 2025 | Gemini 2.5 Pro | Google以100萬token的上下文視窗作為主打,拿下多項基準測試的領先地位。 | |
| February 24, 2025 | Claude 3.7 Sonnet | Anthropic | 混合式推理:由同一個模型自己判斷要不要多想一點。 |
| January 20, 2025 | DeepSeek R1 | DeepSeek | 撼動市場的一次發布:開放權重的推理能力,價格大約只有西方API的十分之一。 |
醞釀期:2022年到2024年
打造出今天這片局面的那些發布:ChatGPT的推出、第一波前沿競賽,以及多模態和推理模型的到來。
| 日期 | 模型 | 供應商 | 為什麼重要 |
|---|---|---|---|
| December 26, 2024 | DeepSeek V3 | DeepSeek | 以訓練成本的一小部分,做出接近前沿品質的開放權重模型。為1月的大事鋪好了舞台。 |
| December 11, 2024 | Gemini 2.0 Flash | 快速版模型變得真正夠力,預示了廉價模型即將出現的價格崩跌。 | |
| September 12, 2024 | o1-preview | OpenAI | 第一款主流的推理模型:回答變慢,但會先想過再答。 |
| June 20, 2024 | Claude 3.5 Sonnet | Anthropic | 一款中階模型打敗了前一代旗艦,重新設定了大家對Sonnet等級的期待。 |
| May 13, 2024 | GPT-4o | OpenAI | 把原生語音和視覺放進同一個模型,並讓免費用戶也能用到前沿等級的能力。 |
| March 4, 2024 | Claude 3 (Opus, Sonnet, Haiku) | Anthropic | 沿用至今的分級命名方式:一個旗艦機型、一個主力機型,和一個又快又便宜的機型。 |
| 日期 | 模型 | 供應商 | 為什麼重要 |
|---|---|---|---|
| December 6, 2023 | Gemini | Google對GPT-4的回應,也是三方前沿競賽的開端。 | |
| July 11, 2023 | Claude 2 | Anthropic | Anthropic把Claude開放給大眾使用,當時10萬token的上下文視窗算是很驚人的規模。 |
| March 14, 2023 | GPT-4 | OpenAI | 大多數專業人士第一次用到的前沿模型,也是付費AI訂閱大規模興起的開端。 |
| 日期 | 模型 | 供應商 | 為什麼重要 |
|---|---|---|---|
| November 30, 2022 | ChatGPT | OpenAI | 讓對話式AI成為一款消費性產品的那次發布。 |
發布節奏告訴你的事
發布間隔越來越短。 GPT-4曾經獨占前沿地位超過一年。到了2025年底,四間實驗室在同一個月內都推出了前沿模型,而2026年4月,更是有三款模型在八天內接連登場。一個基於「哪個模型最強」做出的訂閱決定,現在的有效期大概只剩幾個星期。
| 時期 | 發生了什麼 | 對訂閱決策的意義 |
|---|---|---|
| GPT-4時代 | 一款模型獨占前沿地位超過一年 | 「哪個模型最強」的判斷可以維持好幾個月 |
| 2025年11月 | 十三天內四次前沿發布 | 發布週的基準測試圖表,已經無法定調任何事 |
| 2026年4月 | Claude Opus 4.7、GPT-5.5和DeepSeek V4在八天內接連登場 | 前沿寶座,可能在兩次帳單週期之間就易主 |
| 2024年到2026年 | DeepSeek、Kimi、Qwen、GLM和Llama從註腳,變成了角逐前沿地位的對手 | 差距拉大的是價格,不是能力 |
發布會刻意扎堆。 各家實驗室會刻意選在彼此的發布窗口裡推出產品:2026年4月,DeepSeek V4就在GPT-5.5發布隔天登場,而GPT-5.1在2025年11月開啟的那個窗口,也在十二天後被Gemini 3 Pro和Claude Opus 4.5收尾。在這些窗口裡,發布週的基準測試圖表,只是行銷上互相較勁的砲火,這也是為什麼它們很少真正定調任何事。
開放權重陣營已經不再落後。 DeepSeek、Kimi、Qwen、GLM和Llama這些名字,在短短兩年內,從註腳變成了角逐前沿地位的對手,而且價格通常只是零頭。每項任務最適合的模型持續追蹤這些發布目前各自佔據哪個任務類別的位置。實際帶來的效果,就是AI模型成本指數所追蹤的那個不斷拉大的成本差距。
從GPT-4那時候到現在,實際上的結論始終沒變:一款新模型登場時,不要單憑發布消息就換過去。拿自己真實的三項任務,把新模型跟你現在用的模型放在一起實測;發布評估指南就是專門為這件事設計的一小時做法。在Whizi裡,新的前沿模型會出現在跟舊模型同一個選單裡,所以做比較只是一段對話,不用多訂一份訂閱。
查核方法、資料來源與更正
表格裡的日期,都是公開的發布公告日期,每一筆條目在加入前,都會對照供應商自己的公告和當天的媒體報導做查核。如果可靠來源只能確定到月份,條目就只顯示月份,不會捏造一個日子出來。搶先體驗、候補名單和分階段推出的模型,日期以第一次公開可用公告為準。
這份表格刻意只追蹤重大發布,而不是每一個檢查點:只有當一次發布改變了一般使用者或開發者能買到、能執行、能拿來比較的東西時,才會列入條目。小型的版本更新和沒有公告的模型悄悄替換,都不會被列入。
歡迎指正,我們也會盡快處理:如果這裡的日期跟原始來源不一致,請透過支援頁面上的聯絡方式告訴我們,並附上來源。這個頁面的設計目的就是要能被引用,所以準確度本身就是這個頁面的產品價值。
- 在引用這個頁面之前,先確認最新一筆條目的日期,看內容是不是還算最新
- 在第三方重現結果之前,把發布週的基準測試圖表當成行銷素材看待
- 在真正換用新模型之前,先拿自己的三項任務實測一次
- 預期前沿地位會在幾週內就易主,選擇能讓你跟著這個變化走的工具
- 引用時用條目本身的日期,而不是媒體報導的日期;分階段推出的模型,這兩個日期會不一樣
常見問題
最新的重大AI模型發布是什麼?
這份時間軸裡最新的條目,是Z.ai在2026年8月14日發布的GLM-5.3。這份時間軸涵蓋到2026年8月為止的發布,所以在把最上面那一列當成最新資訊之前,記得先確認一下這個日期。
新的AI模型多久會推出一次?
頻率很快,而且還在加速:截至2026年8月的這十二個月裡,前沿實驗室和開放權重生態系加起來,一共有22次重大發布,而且這還只計算了重要到值得列成一筆條目的發布。實際上該有的心態是:別再想著找出一個能永遠稱霸的贏家。
ChatGPT是什麼時候發布的?
2022年11月30日。那是大型語言模型變成一款消費性產品的時刻,這份時間軸裡的每一筆條目,都是接在它一手催生出來的訂閱市場之後才發生的。
每次有新模型推出,我都該換過去嗎?
不用。應該在一款新模型在你自己反覆執行的任務上勝出時才換,而不是因為它在發布時的基準測試上表現好。上面連結的發布評估指南裡那套一小時的做法,就足夠讓你判斷,而在一個能同時使用多個模型的工作區裡做這件事,測試的成本只是一段對話,不是一份新訂閱。