Back to top
  • 공유 分享
  • 인쇄 列印
  • 글자크기 字體大小
已複製網址

日均2.42兆Token!商湯供能智譜GLM-5.3-Flash運算

中國製AI運算設備與冷卻系統 / TokenPost.ai

中國AI業者商湯科技(SenseTime)宣布,旗下AI推理基礎設施「大裝置」已為智譜AI(Z.ai)新發布的GLM-5.3-Flash模型提供中國自製運算支援與Token服務。根據商湯揭露的數據,「大裝置」7月單日平均處理的Token服務量達到2.42兆個。

根據中國《證券時報》報導,商湯「大裝置」近期為剛公開並開源的GLM-5.3-Flash提供了中國自製算力支援與Token服務。商湯同時表示,預估到2026年底,單日平均Token服務量有望突破10兆個。

這項消息呼應了智譜AI公開GLM-5.3-Flash並轉為開源後外界關注的問題:實際支撐模型運作的運算基礎設施究竟從何而來。值得留意的是,這裡所說的「Token」並非加密貨幣,而是AI模型處理文字與資料時所使用的基本運算單位。

智譜AI於8月26日透過官方部落格公開GLM-5.3-Flash,並表示在正式發布前,曾以代號「ox-alpha」在OpenCode與OpenRouter平台上進行匿名測試。這款模型是GLM-5系列首款原生多模態模型,總參數量達3200億,活躍參數量為180億。所謂多模態模型,指的是除了文字之外,還能同時處理圖像與影片輸入的AI模型。

商湯「大裝置」將AI模型推理服務比喻為「Token工廠」,把處理用戶請求所需的運算資源、晶片、叢集、能源與部署節點整合在一起,藉此提升Token生產效率。智譜AI在部落格中也重申,GLM-5.3-Flash在正式發布前已以「ox-alpha」之名於OpenCode與OpenRouter完成測試。

商湯特別強調此次採用的是中國自製異質混合推理技術,並表示提供的是中國自製運算基礎設施與Token服務。不過,各類晶片配置的實際效率、與輝達(NVDA)產品線的比較數據,以及成本對生產能力的具體換算,商湯並未另外公開。

此次揭露的資訊,主要以Token處理量與技術效率呈現商湯與智譜AI的合作規模。至於實際營收貢獻、客戶數量,以及對外部開發者使用量的影響,目前均未另外公開。

評論:中國AI業者近來密集強調「自製算力」,商湯與智譜AI的這起合作案顯示,在晶片供應受限的背景下,中國企業正嘗試以基礎設施整合能力彌補與海外大廠的技術落差,但實際效能與成本優勢仍有待更多公開數據佐證。

<版權所有 ⓒ TokenPost,未經授權禁止轉載與散佈>

最受歡迎

其他相關文章

留言 0

留言小技巧

好文章。 希望有後續報導。 分析得很棒。

0/1000

留言小技巧

好文章。 希望有後續報導。 分析得很棒。
1