美國新創加速器Y Combinator執行長蓋瑞·坦(Garry Tan)表示,與其封鎖人工智慧(AI)模型的「蒸餾」,不如打造讓開放權重模型與最先進模型並存的市場結構。談到AI模型蒸餾議題,他直言「什麼都不會做」。
根據CNBC的報導,坦執行長於10日(當地時間)在Y Combinator Demo Day活動上接受採訪,就中國企業利用OpenAI與Anthropic模型輸出內容開發自家模型一事做出上述回應。CNBC報導指出,坦執行長認為與其封鎖蒸餾技術本身,監管重點應放在市場結構上。
所謂模型蒸餾,是利用高性能模型的輸出結果,訓練出體積更小、成本更低模型的技術。OpenAI已提供官方蒸餾功能,讓開發者能以GPT-4o等大型模型的輸出結果,微調出具成本效益的模型。
爭議發生在未經授權擷取競爭對手模型能力的情況。換言之,合法的模型輕量化,與試圖以低成本取得競爭對手能力的未授權蒸餾,兩者需要區分開來。
Anthropic今年2月曾指控,中國的深度求索(DeepSeek)、月之暗面(Moonshot AI)與MiniMax透過約2萬4000個違規帳號,與其AI模型Claude進行超過1600萬次對話。Anthropic將此定調為,企圖以產業規模非法擷取自家模型能力的蒸餾行動。
Anthropic說明,蒸餾雖可作為合法的訓練方式,但也可能遭濫用,成為競爭對手以低成本取得能力的手段。先前Anthropic對中國企業提出模型複製質疑的案例,也是同一場爭論的延伸。
OpenAI同樣在今年2月向美國國會提交的資料中表示,已確認與DeepSeek有關聯的帳號規避存取限制,企圖取得美國AI模型的輸出結果並用於蒸餾。不過OpenAI也說明,公司在自家平台上也提供負責任的蒸餾管道。
美國政府機關則將未經授權的蒸餾視為國家安全問題。國家安全局(NSA)、聯邦調查局(FBI)與網路安全暨基礎設施安全局(CISA)於8日發出警告,指中國AI企業正有系統地擷取美國最先進模型的功能與能力。
上述機關雖承認蒸餾是研究上實用的技術,但也表示,產業規模的未授權蒸餾可能被用於縮小中國模型的技術差距,並強化其軍事與網路能力。這代表相關機關主張,應將技術應用與安全應對分開處理。
相較之下,坦執行長更重視市場結構而非技術封鎖。他解釋,開放權重模型能為使用者提供存取與修改的彈性,而頂尖模型開發商則需維持價格溢價才能持續營運。
他表示,讓這兩套模型體系能夠並存、取得平衡,應是監管的目標。這與美國AI企業及政府機關強調的存取控管與偵測強化方向不同。
在AI安全議題上,坦執行長也主張,比起長期的「AI滅絕」風險,更應聚焦當下正在發生的網路安全威脅。他認為,與其爭論長期風險,不如優先應對眼前已確認的安全威脅。
Y Combinator在這次Demo Day發表的196家新創中,有149家被歸類為機器學習與AI企業,這項數據也與此次爭論相互呼應。隨著AI領域的創業與投資持續增加,企業之間圍繞模型存取權的利害關係也逐漸擴大。
模型蒸餾之所以被當作降低成本的手段,是因為只要大量呼叫高性能AI模型並蒐集其回應,就能訓練出成本更低的模型。但從原始模型開發商的角度來看,這也可能遭競爭對手濫用,成為以低成本取得自家模型能力的途徑。
這場爭論的核心,並非是否該全面禁止蒸餾技術,而是如何區分合法應用與未授權的能力擷取,以及存取控管與偵測應強化到什麼程度。美國AI企業與政府機關持續強調阻斷與偵測未授權蒸餾的重要性,而坦執行長則提出,讓開放權重模型與最先進模型並存,才是應該追求的監管目標。
留言 0