中國國產大模型密集調價 競爭邏輯由「拼價格」轉向「拼生態」

2026-09-16

中國國產大模型近期迎來新一輪密集調價。9月10日起,DeepSeek下調Flash系列模型API價格,其中閒時輸入(緩存命中)價格由每百萬詞元0.05元降至0.02元,降幅達60%。有行業分析師表示,本輪調價並非簡單價格競爭,而是大模型從「賣能力」走向「賣服務」的必然階段,行業競爭邏輯正從「拼價格」悄然轉向「拼生態」。

國產大模型調價並非單一走勢。智能體應用快速增長帶來算力壓力,長上下文請求高度依賴緩存,大幅推高推理成本,部分廠商率先提價以覆蓋成本。8月,智譜GLM Coding Plan新版訂閱套餐三檔月費分別為118元、538元和1078元,較此前49元、149元、469元分別上漲約141%、261%和130%。與此同時,低價替代方案迅速跟進,智譜開源GLM-5.3-Flash,定價僅為旗艦版十分之一;阿里開源Qwen3.8-Flash,官方稱價格最低可至DeepSeek V4 Flash的三分之一。

當前國產大模型API價格已呈明顯「梯隊分化」。從9月各家官網定價看,經濟型模型輸入價格普遍降至每百萬詞元1元左右;旗艦模型之間價差顯著拉大,Kimi K3輸入、輸出價格高達每百萬詞元20元、100元,而MiniMax M3在「永久五折」後僅為2.1元、8.4元。有測算顯示,同樣一項典型任務,選用不同模型的成本差距接近60倍。廣州艾媒數聚信息諮詢股份有限公司CEO張毅表示,看似矛盾的漲價與降價,實則是同一本賬的兩面,提價端以峰谷定價引導批量任務向低谷時段轉移,攤薄單位算力成本;降價端則以貼近邊際成本的價格搶佔詞元入口。降價有利於擴大智能體和推理調用量,但單位詞元收入下降,雲廠商需依靠調用量增長和推理效率提升來維持算力回報,單純降價換市場的空間正在收窄。

需求端放量是此輪調價的底層動因。中國電信研究院近日發布的《智能體時代AI基礎設施發展研究報告(2026)》預計,2026年中國詞元年消耗量將達10億億。智譜、MiniMax等廠商財報亦顯示,開放平台和API業務已成為主要增長來源。不過單價降至「分幣級」,並不意味着開發者和企業用戶會單純為低價買單。有軟件開發企業負責人表示,模型調用只是成本一部分,若模型輸出不稳定、需要反覆調整和重複調用,綜合成本未必划算,企業真正需要衡量的是「成功成本」與總擁有成本。當旗艦模型能力差距收窄到用戶難以感知時,決定開發者去留的就不再是價目表上的數字,而是遷移成本。

頭部廠商已在為低價競爭之後的階段布局。智譜構建「基礎模型+編程工具+訂閱服務」生態組合,將模型深度嵌入開發工作流以提高用戶遷移成本;月之暗面為Kimi K3量身定製開源許可條款,對通過MaaS服務第三方且連續12個月收入超過2000萬美元的企業要求另行簽署商業協議;DeepSeek則以V4.1 Flash承接旗艦流量,探索「降本」與「穩價」之間的平衡。三條路徑打法各異,指向卻一致,就是把一次性的模型買賣變成對開發者工作流的長期綁定。有觀點認為,詞元經濟上半場看產能、價格和調用規模,下半場則看「誰能用更少的詞元,完成更複雜的任務」。當詞元本身趨於同質,承載詞元的平台、工具與服務,才是差異化競爭的真正戰場。張毅認為,能够在推理成本、服務穩定性與生態黏性之間找到平衡的廠商,才能在下一階段佔據主動,價格可以持續下探,但商業模式的護城河終究要靠生態來構築。