中國AI業者商湯科技(SenseTime)宣布,旗下AI推理基礎設施「大裝置」已為智譜AI(Z.ai)新發布的GLM-5.3-Flash模型提供中國自製運算支援與Token服務。根據商湯揭露的數據,「大裝置」7月單日平均處理的Token服務量達到2.42兆個。
根據中國《證券時報》報導,商湯「大裝置」近期為剛公開並開源的GLM-5.3-Flash提供了中國自製算力支援與Token服務。商湯同時表示,預估到2026年底,單日平均Token服務量有望突破10兆個。
這項消息呼應了智譜AI公開GLM-5.3-Flash並轉為開源後外界關注的問題:實際支撐模型運作的運算基礎設施究竟從何而來。值得留意的是,這裡所說的「Token」並非加密貨幣,而是AI模型處理文字與資料時所使用的基本運算單位。
智譜AI於8月26日透過官方部落格公開GLM-5.3-Flash,並表示在正式發布前,曾以代號「ox-alpha」在OpenCode與OpenRouter平台上進行匿名測試。這款模型是GLM-5系列首款原生多模態模型,總參數量達3200億,活躍參數量為180億。所謂多模態模型,指的是除了文字之外,還能同時處理圖像與影片輸入的AI模型。
商湯「大裝置」將AI模型推理服務比喻為「Token工廠」,把處理用戶請求所需的運算資源、晶片、叢集、能源與部署節點整合在一起,藉此提升Token生產效率。智譜AI在部落格中也重申,GLM-5.3-Flash在正式發布前已以「ox-alpha」之名於OpenCode與OpenRouter完成測試。
商湯特別強調此次採用的是中國自製異質混合推理技術,並表示提供的是中國自製運算基礎設施與Token服務。不過,各類晶片配置的實際效率、與輝達(NVDA)產品線的比較數據,以及成本對生產能力的具體換算,商湯並未另外公開。
此次揭露的資訊,主要以Token處理量與技術效率呈現商湯與智譜AI的合作規模。至於實際營收貢獻、客戶數量,以及對外部開發者使用量的影響,目前均未另外公開。
評論:中國AI業者近來密集強調「自製算力」,商湯與智譜AI的這起合作案顯示,在晶片供應受限的背景下,中國企業正嘗試以基礎設施整合能力彌補與海外大廠的技術落差,但實際效能與成本優勢仍有待更多公開數據佐證。
留言 0