內地詞元服務良莠不齊 業界訂基準助計量標準化

2026-08-05

在中國,大模型計量單位「詞元」的服務質素與收費透明度,正成為人工智能行業關注焦點。詞元如同水電按量收費,惟市場上不同平台的計價方式及服務表現差異懸殊,用戶往往難以分辨價格與質量的對應關係。

衡量詞元服務質素主要有三項指標:每秒輸出詞元數決定回答速度,首詞元時延反映反應快慢,調用成功率則體現服務穩定性。業內人士指出,低價但速度慢、頻繁超時的詞元服務,如同水壓不足的自來水,便宜未必實惠。高質量詞元服務並非單靠模型本身,而是算力芯片、推理框架、調度緩存、網絡傳輸與模型架構層層配合的系統工程,任何環節出現短板,整體表現便會打折扣。同一開源模型交由不同平台部署,速度、穩定性及成本甚至可能「判若兩人」,差距正源自系統集成能力。

詞元成本主要來自算力芯片折舊及電費開支,攤薄成本主要依靠模型架構創新、推理工程優化及規模效應。國產模型DeepSeek-V3僅以約558萬美元訓練成本,便達到國際前列性能水平,印證低價可以源自技術創新而非能力縮水。反之,高價亦不一定代表優質,可能反映工程效率低下,讓用戶為浪費付費。

目前市場存在技術、定價及營銷三方面不透明問題。技術上,不同模型對同一段文字的分詞方式各異,詞元數量可相差數倍;多輪對話中,模型需重複處理歷史對話,帳單如滾雪球般增加,而緩存命中率只有服務商知曉。有媒體調查發現,同一模型解算同一道數學題,不同平台消耗詞元數量最大相差十倍,如同乘搭路線迂迴的的士,車費自然較高。定價方面,市場報價與真實成本脫節,用戶難以即時識別;套餐設計越趨複雜,按量計費、包月、會員訂閱互相嵌套,資訊不對稱進一步擴大。

業界正推動詞元服務計量標準化。中國信息通信研究院聯同十多家企業啟動詞元服務能力攀登計劃,發布首批企業級基準,將高質量服務量化為每秒輸出詞元不少於55個、首詞元時延不超過0.9秒、調用成功率不低於99.9%,並按季動態更新,定期公布達標企業名單。此舉猶如為詞元市場裝上經檢定的計價器,用戶可對照基準識別服務真偽。

長遠而言,詞元調用量有望成為衡量智能化水平的新指標,如同以發電量觀察工業景氣、貨運量感知經濟冷暖。當詞元服務如水電般標準計量、物美價廉,人工智能普及的圖景便將真正實現。