Back to top
  • 공유 分享
  • 인쇄 列印
  • 글자크기 字體大小
已複製網址

中國 AI 模型與美國基準測試分數差距縮至 3%

筆電螢幕上顯示的人工智慧模型比較圖表 / TokenPost.ai

中國頂尖人工智慧(AI)模型與美國模型的基準測試分數差距已縮小至 3%,低於 5 月的約 9%及今年初的 15%。

彭博情報(Bloomberg Intelligence,BI)資深分析師羅伯特・利(Robert Lea)表示,DeepSeek(深度求索)於 9 月發布 V4.1 Flash 後,中國頂尖模型與美國競爭對手的基準測試分數差距縮至 3%。不過,單憑分數差距難以判斷市場競爭力或獲利能力。

DeepSeek V4.1 Flash 上月在 AI 模型評測指標 LiveBench 得分 81.1,排名全球第 6,接近 Anthropic 旗下最佳模型的 83.4 分。利評估,該模型的效能足以媲美 Anthropic 與 OpenAI 的領先系統。不過,LiveBench 排名前 15 的模型中,中國模型有 3 個。

中國 AI 模型進展的背景因素包括 AI 專業能力的累積,以及針對國產硬體最佳化模型的能力。這些進展也引發外界質疑,美國限制半導體出口對遏止中國 AI 發展究竟有多大效果。BI 的分析並未據此認定出口限制已失去成效。

效能提升能否轉化為商業收益,仍是另一項挑戰。中國 AI 產業有超過 1,100 個大型語言模型(LLM),而 Token 供應利潤偏低、價格競爭與模型間競爭,都被視為壓縮獲利能力的因素。字節跳動(ByteDance)的豆包在 AI App 商業化方面領先,但 DeepSeek 與騰訊(Tencent)的聊天機器人目前免費提供。

<版權所有 ⓒ TokenPost,未經授權禁止轉載與散佈>

最受歡迎

其他相關文章

留言 0

留言小技巧

好文章。 希望有後續報導。 分析得很棒。

0/1000

留言小技巧

好文章。 希望有後續報導。 分析得很棒。
1