Back to top
  • 공유 分享
  • 인쇄 列印
  • 글자크기 字體大小
已複製網址

Qwen公開2.4兆參數LLM,權重下周釋出

阿里巴巴(BABA)旗下 AI 品牌 Qwen(通義千問)公開一款總參數達 2.4 兆個的新「大型語言模型」(LLM),採用可同時處理文字與影像的「多模態」架構,訓練權重(weight)預定下周釋出。

CryptoBriefing 於 2 日(當地時間)報導,Qwen 團隊主張,這款模型在自家基準測試中展現可與競爭模型相比的表現。不過,報導未列出具體比較對象,也未揭露活躍參數(總參數中推論時實際運作的比例)數字。換言之,即使總參數規模很大,若實際運算時啟用的參數較少,使用者感受到的效能仍可能不同,目前仍不宜直接判定性能排名。

CryptoBriefing 也提到,部分服務已開放早期使用申請,並搭配最高 90% 折扣活動。不過,報導未寫明具體平台名稱。

這次發布距離月之暗面(Moonshot AI) 於上月 27 日公開 2.8 兆參數模型「Kimi K3」權重,約隔一周。中國 AI 企業近期接連把大型模型權重對外開放,相關動向正持續受到開發者社群關注。

「開放權重」是指企業把自行訓練模型的參數值對外公開,讓外部使用者可下載並在自有伺服器上運行。這種方式不必透過雲端 API 呼叫模型,與封閉式(proprietary) AI 服務常見的付費訂閱與 API 計費模式不同。黃仁勳(Jensen Huang) 輝達(NVIDIA)創辦人兼執行長曾表態支持公開權重模型,並加入美國 AI 主導權討論;馬克·祖克柏(Mark Zuckerberg) Meta(META)執行長也曾表示,美國若要維持 AI 競爭優勢,不應禁止中國 AI 模型。圍繞中國開源 AI 模型的爭論,已延伸到美國大型科技公司高層之間。

CryptoBriefing 於同篇報導指出,這類公開可能對封閉式 AI 業者的收益結構形成壓力,也可能隨著開發者希望在中心化雲端之外運行模型,帶動外界對「去中心化運算」(decentralized compute)網路的關注。不過,目前尚未有實際數據證實去中心化運算需求已出現變化,對加密市場的影響仍需進一步確認。

<版權所有 ⓒ TokenPost,未經授權禁止轉載與散佈>

最受歡迎

其他相關文章

留言 0

留言小技巧

好文章。 希望有後續報導。 分析得很棒。

0/1000

留言小技巧

好文章。 希望有後續報導。 分析得很棒。
1