DeepSeek 漲價、阿里開源 2.4 兆旗艦、GLM-5.3 躍升:中國大模型 8 月為何集體變陣?
誰卡住了?正在把 Agent 接到 DeepSeek、Qwen 或 GLM 的工程負責人,同時面對「漲 1100%」「旗艦權重釋出」「同基座暴漲」三組標題,帳單與授權對不上。本文結論:國產模型正在從「卷價格」轉向「卷定價權」;headline 數字、自訂授權與後訓練槓桿必須分開看。結構:三個決策陷阱、兩週時間線、三張資料表、橫向價卡、爭議標註、五步隔離 Mac 驗收與 FAQ。
目錄
8/3 GA 見 Qwen3.8-Max 正式發布;Flash 評測見 V4 Flash 正式版評測;美方降價見 GPT-5.6 Luna 調價。
8 月 12 日至 17 日這五天,中國大模型圈連續做了三件表面矛盾、底層呼應的事:DeepSeek 公告 API 漲價最高超過 1100%;阿里把從未開源過的 Qwen-Max 級 2.4 兆參數權重放到 ModelScope/Hugging Face;智譜用同一個 7430 億基座、只靠後訓練把程式測試成績拉高數倍。三家公司、三種打法,指向同一訊號——國產大模型正在從「卷價格」轉向「卷定價權」。
01 · 三個決策陷阱
- 漲幅口徑不能混用。「漲 11 倍」「漲超 1100%」「漲 350%」都對,但分別對應快取命中輸入、輸出與未命中輸入。對帳單殺傷力較大的通常是輸出價。
- 權重可下載 ≠ Apache 2.0。年營收超過 5000 萬美元的「模型即服務」或「AI 工作助手」必須另行談商業授權;月活超過 1 億或月收入超過 2000 萬美元必須在介面顯著標示模型名稱。
- 「國產=最便宜」正在失效。離峰 V4-Pro 仍低於 Claude Opus 5,但阿里國際站 Qwen3.8-Max 與 OpenAI Luna 已在至少一個維度更便宜。
02 · 兩週時間線
| 日期 | 事件 |
|---|---|
| 7月16日 | 月之暗面 Kimi K3(2.8 兆參數)開源,此前已引發美方安全關注 |
| 8月2–3日 | 阿里 Qwen3.8-Max 預告後上線雲端 API |
| 8月10日 | Meta 釋出 Muse Glimmer(300 億,Apache 2.0),預告旗艦 Muse Spark 1.2 權重「即將開源」 |
| 8月12日 | 阿里放出 Qwen3.8-2.4T-A95B 開源權重;同日 xAI 發布 Grok 4.6 |
| 8月13日 | DeepSeek-V4-Pro 正式版上線,同步公告 8 月 17 日起漲價;Google 發布降價的 Gemini 3.7 Flash |
| 8月14日 | 智譜發布 GLM-5.3,沿用 GLM-5.2 的 7430 億參數基座 |
| 8月17日 0 點(北京時間) | DeepSeek 新定價生效 |
再往前看:7 月 30 日 OpenAI 已把最便宜檔 GPT-5.6 Luna 降價 80%,8 月 6–7 日再把 Luna 設為免費使用者預設模型並開放無限文字對話。中國廠商在漲價與開源上做加法的同一時間,美國廠商在免費與降價上做加法——同一場定價博弈的兩個側面。
03 · 核心數據
DeepSeek 漲價明細(8 月 17 日 0 點起;北京時間 9–12、14–18 為尖峰)
| 計費項(每百萬 tokens) | 漲價前 | 離峰(新) | 尖峰(新) | 漲幅(尖峰) |
|---|---|---|---|---|
| V4-Flash 快取命中輸入 | ¥0.02 | ¥0.05 | ¥0.10 | 約 400% |
| V4-Flash 快取未命中輸入 | ¥1.0 | ¥1.5 | ¥3.0 | 200% |
| V4-Flash 輸出 | ¥2.0 | ¥4.5 | ¥9.0 | 350% |
| V4-Pro 快取命中輸入 | ¥0.025 | ¥0.15 | ¥0.30 | 約 1100% |
| V4-Pro 快取未命中輸入 | ¥3.0 | ¥4.5 | ¥9.0 | 200% |
| V4-Pro 輸出 | ¥6.0 | ¥13.5 | ¥27.0 | 350% |
資料來自 DeepSeek 官方公告,並經華爾街見聞、IT之家、V2EX 交叉核對。快取命中漲幅最大(最高約 12 倍/1100%+),但絕對金額仍小;對重度呼叫者影響更大的是輸出價(350%)與未命中輸入價。有分析測算:約 8400 萬 tokens/月、多半離峰、一半命中的重度負載,帳單較接近 1.8 倍。
Qwen3.8-2.4T-A95B 規格
| 項目 | 數據 |
|---|---|
| 參數規模 | 2.4 兆總參數,950 億啟動參數(MoE,512 專家,10 路由 + 1 共享) |
| 上下文 | 開源權重原生 26.2 萬 tokens,可擴至約 101 萬;雲端 Max 預設 100 萬 |
| 節奏 | 8/2 預告 → 8/3 API → 8/12 開源權重 |
| 國際站 API | 輸入 $2/M,輸出 $6/M |
| 授權 | 非 Apache 2.0,自訂 Qwen3.8-Max License |
| 意義 | 阿里首次把 Max 級旗艦開源;Qwen3.5/3.6/3.7 Max 均為閉源 API |
GLM-5.3 vs 5.2:同基座、只換後訓練
| 基準 | 5.2 | 5.3 | 變化 |
|---|---|---|---|
| Terminal-Bench 3.0 | 4.6% | 28.3% | +23.7 |
| DeepSWE v1.1 | 46.2% | 66.9% | +20.7 |
| Agents' Last Exam(CLI) | 23.8% | 28.5% | +4.7 |
| CyberGym | 77.2% | 84.5% | +7.3 |
| AutomationBench | 26.2% | 48.2% | +22.0 |
以上為智譜官方自測,尚無獨立第三方複測。Terminal-Bench 3.0 上 GLM-5.3 仍落後 GPT-5.6 Sol(34.6%)與 Claude Fable 5(33.7%),屬開源第一梯隊,而非全面登頂。
04 · 三種打法
DeepSeek:分時定價是算力不夠用的顯性化
這次漲價容易被讀成「跟漲」,結構上更像把算力帳單攤開。過去不分時段的統一低價,是用低價換規模,再靠快取命中與錯峰攤薄成本。呼叫量指數成長、GPU 產能跟不上時,公告裡「鼓勵更靈活的工作負載排程」等於明講:尖峰算力已經不夠,請你自己錯峰。
另一個常被忽略的細節:尖峰時段官方 API 已反超部分第三方轉售(GMI Cloud、Novita 等目前報價仍低於官方尖峰價)。「官方一定最便宜」這道護城河第一次被打破。
阿里:用權重換生態,用自訂授權鎖住收入天花板
2.4 兆參數權重可公開下載,授權卻不是以往的 Apache 2.0。年營收超過 5000 萬美元的模型即服務或 AI 工作助手必須另行談商業授權;月活超過 1 億或月收入超過 2000 萬美元必須在介面顯著展示模型名稱。這與 Meta Muse Glimmer(完全 Apache 2.0、無附加條款)的「開源程度」不是同一量級。
網傳授權禁止美國、歐盟、英國、韓國使用者下載,與原文不符——官方條款沒有任何地域限制。發布節奏這麼快,先讀 LICENSE 檔,比轉傳公告串文更可靠。
智譜:不換基座,只換後訓練配方
基座與 GLM-5.2 完全相同(7430 億參數),沒有重新預訓練,只靠擴大強化學習環境,就把 Terminal-Bench 3.0 從 4.6% 拉到 28.3%,接近六倍。預訓練 Scaling Law 邊際收益放緩後,「後訓練強化學習規模化」成為門檻更低的性能槓桿,中小型實驗室也有機會靠精裝修追上頭部模型。
05 · 還是最便宜的旗艦嗎?
| 模型 | 輸入/百萬 tokens | 輸出/百萬 tokens | 開源程度 |
|---|---|---|---|
| DeepSeek V4-Pro(尖峰) | ¥9.0(約 $1.26) | ¥27.0(約 $3.78) | 權重未開源 |
| DeepSeek V4-Pro(離峰) | ¥4.5(約 $0.63) | ¥13.5(約 $1.89) | 權重未開源 |
| Qwen3.8-Max(國際站) | $2 | $6 | 開源(自訂授權) |
| OpenAI GPT-5.6 Luna | $0.20 | $1.20 | 閉源 |
| Claude Opus 5(依阿里披露倍數推算) | 約 $5 | 約 $25 | 閉源 |
匯率按約 ¥7.15/$1 估算。離峰 V4-Pro 仍明顯低於 Claude Opus 5,但已不是全場最低——國際站 Qwen3.8-Max 與 Luna 都比 DeepSeek 離峰價更便宜。「國產=最便宜」的等式正在瓦解,價格競爭進入分層階段。
06 · 未經獨立驗證的說法
- 1100% 只對應尖峰快取命中輸入,輸出漲 350%。不同媒體引用不同計費項,讀的時候要看清欄位。
- 震悟 M890/盤古 AL128:多家中文財經媒體稱 Qwen3.8-Max 部分推理跑在阿里自研晶片與超節點上,目前僅見轉述,未見官方技術文件或第三方基準,標為未經獨立驗證。
- GLM-5.3「發現 Cursor 嚴重漏洞」:來自 VentureBeat 與智譜單方面披露,細節未公開,屬廠商單方面說法。
- 中國商務部醞釀反制出口管制:目前未見官方正式確認,屬媒體推測/傳聞。
07 · 兩線戰爭
過去一個月,中國頭部實驗室呈現「一週三更」:DeepSeek、阿里、智譜之外,還有 Kimi K3(7 月 16 日,2.8 兆參數開源)與 MiniMax H3。國內財經媒體普遍解讀為「中國開源模型密集發布,倒逼全球 AI 重新定價」。
美國側走另一條路:OpenAI 7 月 30 日 Luna 降 80%,8 月 6–7 日設為免費預設並開放無限文字對話;Google 8 月 13 日發布價格減半的 Gemini 3.7 Flash。中國廠商「開源旗艦+梯度漲價」,美國廠商「消費端免費+降價防守」——2026 年 8 月因此成為定價邏輯重構的節點。
地緣層面:Kimi K3 開源已引發美方安全審查關注,阿里在這個窗口放出 2.4 兆旗艦,被部分分析讀成「在潛在監管收緊前搶先鞏固國際影響力與技術對等敘事」。這是帶推測成分的解讀,卻是理解時機時不該忽略的背景。
08 · 五步隔離 Mac 驗收
若要在正式環境切換模型或驗證尖離峰排程,不要直接改主力機上的金鑰與路由:
- 對照尖離峰。把可批次、可快取的呼叫改到北京時間非 9–12、14–18 點;先用近 30 日帳單判斷自己是「約 1.8 倍」還是 headline 1100% 那一類負載。
- 核對授權門檻。年營收 5000 萬美元、月活 1 億或月收入 2000 萬美元三條線走一遍。個人專案與內部使用通常不受影響,但「權重能下」不等于「可以轉售推論」。
- 統一評測任務。用同一套程式/CLI Agent 任務對照 V4-Pro、Qwen3.8-Max 與 GLM-5.3,記錄快取命中率、輸出佔比與單任務成本。
- 隔離 Mac 試跑。在 裸機 macOS 定價 選按日節點,只裝多模型路由與最小工具鏈;金鑰與公司 Keychain 分倉。
- 驗收後銷毀。匯出成本模型與錯峰 cron 後銷毀租用節點,避免實驗設定污染下一輪發布。
09 · FAQ
Q1:漲價之後是不是一定更貴?
A:離峰且快取命中率高的重度使用者,實際漲幅會明顯低於「350%」「1100%」這類 headline(有分析測算約 1.8 倍);尖峰且命中率低,才會接近甚至達到 headline。
Q2:個人開發者能免費商用 Qwen3.8-Max 嗎?
A:個人與內部使用大致不受影響。模型即服務或 AI 工作助手過去 12 個月累計收入超過 5000 萬美元,需另行向阿里申請商業授權;月活超過 1 億或月收入超過 2000 萬美元,需在介面顯著標註模型名稱。
Q3:GLM-5.3 和 5.2 是同一個模型嗎?
A:基座完全相同(7430 億參數),沒有重新訓練。分數來自後訓練階段大幅擴大強化學習環境,說明「後訓練規模化」本身就是獨立槓桿。
Q4:網傳授權禁止美歐使用者下載,是真的嗎?
A:不是。官方授權原文沒有任何地域限制,主要限制針對超過特定營收規模的商業化服務,與使用者所在地區無關。
Q5:Meta 開源 Muse Glimmer,代表 Llama 時代的開源精神回來了嗎?
A:目前只能算部分回歸。Glimmer 是 300 億蒸餾小模型,旗艦 Muse Spark 1.2 尚未開源,祖克柏只是預告未來會開放權重。若真落地,才稱得上美國廠商首次把旗艦級閉源模型轉為開源。
10 · 為何改租 Mac,而不是在主力機或雲主機上試
你可以在個人筆電直接改 API Key,或在 Windows/Linux 雲主機跑一輪對照,但主力機更適合穩定交付,而不是尖離峰排程、授權自檢與多模型路由實驗。常見限制包括:金鑰與公司憑證混在同一 Keychain、尖峰誤觸發把帳單打滿、以及通用雲映像在原生 macOS/Apple Silicon 工具鏈側車上的相容性缺口。若你要的是可重現的成本結論、按日計費與真實 Apple 硬體,隔離 Mac 通常是較優解;租用能降低「為一次定價實驗買機器」的前期投入。計費見 裸機 macOS 定價,開通見 訂購 M4 計算節點。
11 · 資料來源
- DeepSeek 官方漲價公告,經華爾街見聞、IT之家、AIGC 工具導航、V2EX 交叉核對
- 阿里 Qwen 官方模型倉庫(Hugging Face/ModelScope)及南華早報(SCMP)關於授權條款的報導
- 智譜(Z.ai)GLM-5.3 官方技術頁面及 VentureBeat、StableLearn 相關報導
- Meta AI Research 官方部落格及 VentureBeat 關於 Muse Glimmer 的報導
- 第一財經、搜狐財經等關於中國大模型密集發布節奏的綜合報導
以上數據截至發稿前公開資訊整理。價格、授權條款與基準分數建議發布前再核最新官方公告;晶片服務、安全漏洞與出口管制傳聞已在正文標為未經獨立驗證。自訂來源:桌面《中國大模型開源漲價潮-博客文章-中英雙語.md》。