阿里巴巴(BABA)旗下 AI 品牌 Qwen(通義千問)公開一款總參數達 2.4 兆個的新「大型語言模型」(LLM),採用可同時處理文字與影像的「多模態」架構,訓練權重(weight)預定下周釋出。
CryptoBriefing 於 2 日(當地時間)報導,Qwen 團隊主張,這款模型在自家基準測試中展現可與競爭模型相比的表現。不過,報導未列出具體比較對象,也未揭露活躍參數(總參數中推論時實際運作的比例)數字。換言之,即使總參數規模很大,若實際運算時啟用的參數較少,使用者感受到的效能仍可能不同,目前仍不宜直接判定性能排名。
CryptoBriefing 也提到,部分服務已開放早期使用申請,並搭配最高 90% 折扣活動。不過,報導未寫明具體平台名稱。
這次發布距離月之暗面(Moonshot AI) 於上月 27 日公開 2.8 兆參數模型「Kimi K3」權重,約隔一周。中國 AI 企業近期接連把大型模型權重對外開放,相關動向正持續受到開發者社群關注。
「開放權重」是指企業把自行訓練模型的參數值對外公開,讓外部使用者可下載並在自有伺服器上運行。這種方式不必透過雲端 API 呼叫模型,與封閉式(proprietary) AI 服務常見的付費訂閱與 API 計費模式不同。黃仁勳(Jensen Huang) 輝達(NVIDIA)創辦人兼執行長曾表態支持公開權重模型,並加入美國 AI 主導權討論;馬克·祖克柏(Mark Zuckerberg) Meta(META)執行長也曾表示,美國若要維持 AI 競爭優勢,不應禁止中國 AI 模型。圍繞中國開源 AI 模型的爭論,已延伸到美國大型科技公司高層之間。
CryptoBriefing 於同篇報導指出,這類公開可能對封閉式 AI 業者的收益結構形成壓力,也可能隨著開發者希望在中心化雲端之外運行模型,帶動外界對「去中心化運算」(decentralized compute)網路的關注。不過,目前尚未有實際數據證實去中心化運算需求已出現變化,對加密市場的影響仍需進一步確認。
留言 0