Back to top
  • 공유 分享
  • 인쇄 列印
  • 글자크기 字體大小
已複製網址

GLM宣稱每日處理10兆Token,戈麥斯:中國AI不能只靠蒸餾解釋

訪談中說明AI模型效能的畫面 / TokenPost.ai

部分中國人工智慧(AI)模型據稱在特定基準測試中超越美國頂尖效能模型,GLM也被指僅使用中國製半導體,每日可處理約10兆Token。不過,相關基準測試條件與處理量仍有待獨立驗證。

艾丹・戈麥斯(Aidan Gomez)Cohere共同創辦人兼執行長在 CNBC《The Tech Download》訪談中表示:「不能把中國AI的全部成果定義為單純複製美國技術的結果。」他承認中國AI可能曾部分使用從美國模型提取知識的蒸餾技術,但表示最新中國模型的進展不能只用蒸餾解釋。

蒸餾是利用高效能模型的輸出,訓練相對較小且成本較低模型的技術。這項技術可合法用於AI研究,但若大規模提取競爭模型功能,可能引發技術竊取及規避存取限制的爭議。

美國國家安全局(NSA)、聯邦調查局(FBI)及網路安全暨基礎設施安全局(CISA)主張,中國AI企業正以產業規模提取美國前沿模型的功能與能力,用於訓練自有模型。這些機構表示,此類方式可能在不投入大量運算資源、電力與研發成本的情況下縮小技術差距,但也指出蒸餾本身是合法且有用的研究技術。

戈麥斯表示,中國最新GLM模型在部分基準測試中已超越美國頂尖效能模型。不過,公開資料尚未確認所使用的基準測試、比較條件及模型版本。

他提到,GLM僅使用中國製半導體,每日處理量約達10兆Token。這項數字來自戈麥斯的訪談說法,但目前沒有GLM開發商或獨立數據業者正式確認相同數據。

美國方面也提出了另一個案例。Anthropic在致美國參議院的信函中主張,與阿里巴巴及其Qwen研究所相關的操作者,利用約2萬5000個虛假帳戶,與Claude生成超過2880萬次對話。

Anthropic認為,相關活動是為了提取模型功能,但這項主張尚未獲得獨立最終確認。虛假帳戶及大規模生成對話究竟以何種方式用於模型訓練,仍有待進一步驗證。

中國政府反駁美方解讀。中國外交部發言人毛寧(Mao Ning)表示,中國AI的發展來自「科技自立自強」與開放合作,並要求美國停止對中國進行「虛假指責和抹黑」。

這場爭議已從模型效能延伸至半導體與資料中心基礎設施的自主能力。美國出口管制一直聚焦於限制中國取得高效能AI半導體及相關設備。

中國AI企業取得高效能半導體及美國出口管制先前曾探討中國AI產業取得運算資源,以及出口管制成效所引發的爭議。此次發言也再次引發討論,除模型效能外,還需同步確認實際半導體採購結構。

若戈麥斯的說法獲得證實,中國企業可能透過結合自有模型與中國製半導體,部分降低美國出口管制的影響。不過,GLM的處理量及中國製半導體使用比例,是否足以反映實際運作規模,目前仍難以判斷。

模型效能、訓練方式與推論處理量是不同指標。僅憑特定基準測試領先,不能據此判定整體中國AI已超越美國AI;高處理量的說法也不足以證明半導體自主能力。

美國情報機構提出的蒸餾疑慮,同樣難以直接擴大解讀為中國AI整體都是複製品。蒸餾是否被部分模型開發採用,以及最新模型的效能是否來自獨立研發,仍需分別驗證。

後續仍需進一步核查實際模型效能、訓練方式及半導體採購結構。GLM處理量與中國製半導體使用比例,是否獲得開發商或獨立數據業者驗證,也將成為關注焦點。

<版權所有 ⓒ TokenPost,未經授權禁止轉載與散佈>

最受歡迎

其他相關文章

留言 0

留言小技巧

好文章。 希望有後續報導。 分析得很棒。

0/1000

留言小技巧

好文章。 希望有後續報導。 分析得很棒。
1