Kimi K3 與 GLM-5.2,站進同一個擂台
月之暗面 Kimi K3 與智譜 GLM-5.2 都站進百萬上下文俱樂部,一個走 2.8 兆參數開源出海、一個守國產晶片地盤。這一期的判斷不是「誰贏」,而是「格局變了」——連 Claude Fable 5 都被美國出口管制三起三落,對自己動手做的人只指向一件事:別效忠品牌,讓工具鏈可替換。

這一期的料,是昨天才剛落地的。月之暗面的 Kimi K3 在 7 月 16 日深夜發布,權重預計 7 月 27 日開放。同一段時間,智譜的 GLM-5.2 已經在六月端上桌。兩家都被叫「中國 AI 國家隊」,但定位南轅北轍。
老樣子,這欄是 AI 協作整理的:掃描是機器的,判斷是我的。我的判斷這次只有一句主旋律——它們還沒超車美系,但已經站進同一個擂台,而這件事的意義,不在它們身上,在你身上。
一、Claude Fable 5 三起三落:最強的模型也是棋子
先把視角拉到最上面。
做 Claude 的 Anthropic,六月初端出新的頂級分級 Fable 5(以及更上層、只給特定夥伴的 Mythos 5)。六月九日上線,六月十二日因為美國出口管制暫停,七月一日解除管制後重新部署。
三個禮拜,一顆全世界最強的模型之一,被地緣政治三起三落。
判斷:這件事對用工具的人,比任何跑分都重要。它揭穿一個幻覺——再強的模型,只要它在別人的伺服器上、受別人的政府管,你今天能用不代表明天能用。三年前我們以為 API 是自來水,現在才看清它是會被關起來的水龍頭。這正是我一直把產線往本地搬、在接案裡死守「資料一個位元組都不出門」的同一個理由:架構要比模型耐用。
二、國產國家隊的兩隻手:一個守內,一個出海
國家隊不是一個模型,是兩條戰略路線同時下注。
智譜這隻手守內。它是清華大學計算機系唐傑團隊孵化的學院派,2026 年一月八日以 02513.HK 掛牌港交所,被稱為「全球大模型第一股」;七月又做了一筆約四十億美元的港股配售,股價較上市已漲了約十五倍。它最重要的戰略任務不是跑分,是國產晶片大適配——GLM-5 從華為昇騰、寒武紀、摩爾線程到昆侖芯、沐曦、燧原、海光,一口氣打通七款國產算力。GLM-5.2 發布當天就完成適配。這條線的核心是基礎設施自主。
月之暗面這隻手出海。創辦人楊植麟是九零後明星科學家,CMU 博士、Transformer-XL 與 XLNet 的第一作者,待過 Meta 與 Google Brain。早期靠阿里、美團等商業資本扶持,2026 年五月新一輪二十億美元融資裡,正式引入國智投、北京人工智能產業基金,以及央企中國移動;同一時間啟動 VIE 紅籌架構拆除,籌備赴港上市。Kimi K3 端出的是兩百八十億參數(總參數 2.8 兆,MoE 混合專家架構)的開放權重,被官方稱為「目前全球參數最大的開源模型」。這條線的核心是在全球開源市場搶話語權。
判斷:兩隻手不是內鬥,是分工。一隻把國內的算力地基打穩,一隻把開源旗幟插到全世界。智譜問的是「中國能不能自己跑起來」,月之暗面問的是「中國能不能成為別人選的那一個」。對在台灣、自己動手做的人,這兩條線的意義完全不同——守內那條離你遠(你大概不會去部署華為昇騰),出海那條離你近(你下載權重就能用)。我盯的、寫進兵器庫的,是後者。
三、價格斷層:國產不等於便宜
先把話講清楚:GLM-5.2 的官方牌價是輸入每百萬 token 一點四美元、輸出四點四美元;Kimi K3 的官方牌價是輸入三美元、輸出十五美元。對比美系旗艦,Claude Fable 5 輸出五十美元、GPT-5.6 Sol 輸出三十美元。
幾個會被忽略的細節:
- 國產內部也在分化。GLM 還在地板價防守(輸出四點四),Kimi K3 已經不便宜了(輸出十五,是 GLM 的三點四倍)。它卡在「逼近美系戰力、價格打七折」的中間帶,而不是大家直覺以為的「國產就便宜」。
- 快取命中(prompt caching)是省錢關鍵。在程式開發或 Agent 這種高頻重複輸入的場景,Kimi K3 的快取命中率可以超過九成,而它的快取輸入定價只要標準輸入的十分之一。同一套邏輯,GLM、Fable、GPT 都有。差別在於:Kimi K3 的回覆普遍偏長(verbose),同樣的任務它吐出的 token 常常是別的模型的兩倍,在輸出單價較高的情況下,實際帳單會比想像中累積得快。
- 美系內部也有斷層。Fable 5(輸出五十)是 GPT-5.6 Sol(輸出三十)的一點七倍,Anthropic 同時給了到八月底前的限時價(輸入二、輸出十)——頂規降價促銷,在搶市佔的訊號很明確。
判斷:這個價格結構對我的意義很具體。我上一期講過,我用 GLM-5.2 接手 Claude Code 裡的日常任務省配額,硬任務留頂規。Kimi K3 這個價位打不進我「日常分流」那一格(它比 GLM 貴太多),但它的長文本與 Agent 能力,可能讓它卡進另一個位置——做需要讀百萬字文件、或長鏈條自動化的工作。這個要等我自己實測,不會光看牌價下結論。
四、跑分的真相:逼近但未超越
這是我查證最久的一塊,因為草稿圈裡流傳的數字跟官方榜對不上。我直接讀 Artificial Analysis 的排行榜,把可以查到的放進來:
| 指標(來源:Artificial Analysis) | GLM-5.2 | Kimi K3 | Claude Fable 5 | GPT-5.6 Sol |
|---|---|---|---|---|
| AA-Briefcase Elo(長程知識工作) | 1260(#9) | 1547(#2) | 1583(#1) | 1495(#3) |
| GDPval-AA v2 Elo(真實工作任務) | 1514(#14) | 1668(#4) | 1760(#1) | 1748(#2) |
| 百萬上下文 | 一百萬(無損) | 一百零四萬 | 一百萬 | 一萬億級 |
幾件必須講清楚的事:
第一,網路上流傳「Kimi K3 在 Agent 與前端代碼拿下全球第一」的說法,在主要來源找不到支持。Kimi K3 在兩個 Agent 指標都是第二或第四,沒拿過第一。那些「第一」的數字多半來自次級聚合站,互相矛盾,不能引。
第二,GLM-5.2 是「開源 SOTA」,不是整體 coding SOTA。Z.ai 官方措辭很謹慎,從來沒說自己贏過 Claude Opus 4.8。SWE-bench Pro 上 GLM-5.2 的六十二點一,是智譜自己用 OpenHands 跑出來的自報值,尚未經 Scale Labs 獨立驗證;而 Scale 的公開榜目前連這幾個最新模型都還沒收錄。所以讀跑分,當方向、別當定論。
第三,這張表真正的故事不在誰第一,而在「位階」。三年前國產模型跟美系頂規差一整個世代,現在同榜前十名裡擠進三個國產,差距壓到個位數 Elo。它們還沒超車,但已經站進同一個擂台——這跟三年前是質變,不是量變。
判斷:對自己動手做的人,「站進同一個擂台」比「誰是第一名」有意義得多。因為第一名半年後會換人,但「有能力做出逼近頂規的開源模型」這件事一旦成立,你就有後路——你能下載、能改、能自己部署,這是閉源美系給不了你的。我兵器庫裡那些標「觀望」的開源工具,就是這種「隨時有後路」的保險。
五、所以對你,代表什麼
把前面四段收攏成一句:這一期真正的訊號,不在模型,在你。
模型半年一翻,今天的 SOTA 明天被超。Kimi K3 昨天剛發布,可能下個月就被別人蓋過。問「選哪個模型」是錯的問題,該問的是「我能不能隨時換掉它」。
這正是我搭產線一貫的原則——每一段獨立,按需求換引擎,壞了哪段換哪段。我的生圖、配音、組裝,沒有一段是焊死在單一供應商身上的。雲端漲價、配額砍半、模型被地緣政治下架,我換掉那一段就好,整條線不會倒。
Fable 5 三個禮拜三起三落,智譜股價三個月漲十五倍,月之暗面拆 VIE 赴港——這些都是「別人的戰爭」。我們在乎的只有三件事:工具夠不夠好、會不會被綁架、成本能不能控。而這一期的所有消息,剛好都在往同一個方向推:能力正在擴散,別把自己鎖死在任何一家門裡。
門會換人,工具會留下。前提是,你一開始就沒把門焊死。
這一期,濃縮成一句
國產 AI 還沒超車美系,但已經站進同一個擂台;連最強的模型都是地緣政治的棋子——所以該效忠的從來不是品牌,是你自己隨時能換掉它的能力。
主要來源:Z.ai GLM-5.2 官方、Kimi K3 官方、Anthropic:Redeploying Fable 5、Artificial Analysis:GDPval-AA v2、Artificial Analysis:AA-Briefcase、Reuters:智譜四十億美元配售、財聯社:月之暗面引入國智投、中國移動。事件是它們報的,怎麼解讀、跟產線怎麼接,是我的。
常見問題
Kimi K3 和 GLM-5.2 哪個比較強?
在 Artificial Analysis 的獨立排行榜上,Kimi K3 的綜合表現略高於 GLM-5.2,但兩者都還沒超越美系旗艦 Claude Fable 5 與 GPT-5.6 Sol。以 Agent 類指標來看,GDPval-AA v2 上 Kimi K3 排第四、GLM-5.2 排第十四;AA-Briefcase 長程知識工作上 Kimi K3 排第二、GLM-5.2 排第九。但 GLM-5.2 是開源 SOTA,且價格只有 Kimi K3 的三分之一,定位不同,不能單看跑分論高下。
Kimi K3 和 GLM-5.2 的 API 價格差多少?
官方牌價:GLM-5.2 輸入每百萬 token 一點四美元、輸出四點四美元;Kimi K3 輸入三美元、輸出十五美元。Kimi K3 的輸出價大約是 GLM-5.2 的三點四倍。對比美系旗艦 Claude Fable 5 輸出五十美元、GPT-5.6 Sol 輸出三十美元,Kimi K3 卡在「逼近美系戰力、價格打七折」的中間帶。值得注意的是 Kimi K3 回覆偏長,實際帳單會比牌價累積得快,靠 prompt caching 快取命中才能顯著壓低輸入成本。
Kimi K3 真的是全球最大開源模型嗎?
Kimi K3 於 2026 年 7 月 16 日發布,總參數量二點八兆(2800B),採 MoE 混合專家架構,被官方與新華社稱為「目前全球參數最大的開源模型」,也是全球首個超過兩兆級別的開源模型。需注意的是,二點八兆是總參數,MoE 架構下單次推理激活的參數遠小於此;權重預計 7 月 27 日開放下載。
GLM-5.2 和 Kimi K3 的上下文視窗各是多少?
兩者都跨進百萬 token 俱樂部。GLM-5.2 是一百萬無損上下文(從前代二十萬擴展而來);Kimi K3 是一百零四萬八千五百七十六 token。這打破了許多人以為「國產模型上下文比美系小」的過時印象——Claude Fable 5 與 GPT-5.6 Sol 也都在百萬等級。長文本已不再是國產模型的弱項。
為什麼說 Claude Fable 5 三起三落?
Anthropic 在 2026 年 6 月 9 日上線 Fable 5,6 月 12 日因美國出口管制暫停,7 月 1 日解除管制後重新部署。三個禮拜內一顆全世界最強的模型之一被地緣政治上下架又上架,這說明再強的閉源模型,只要在別人的伺服器上、受別人的政府管轄,你今天能用不代表明天能用——這是推動許多人把工作流轉向開源、本地部署的關鍵理由。
智譜和月之暗面為什麼都被稱為中國 AI 國家隊?
智譜是清華大學計算機系唐傑團隊孵化,早期即獲中關村科學城、北京人工智能產業投資基金等國資直接投資,並負責華為昇騰、寒武紀等國產晶片的深度適配,屬於守內、基礎設施自主路線。月之暗面由楊植麟創立,早期是純民間獨角獸,2026 年五月新一輪融資才正式引入國智投、北京人工智能基金及央企中國移動,並拆除 VIE 架構籌備赴港上市,走的是開源出海、搶全球話語權路線。一守內一出海,是分工不是內鬥。