Anthropic因應風險限制網路安全相關人工智慧(AI)功能後,出現研究人員改用較容易取得的中國系AI模型執行防禦工作的案例。不過,目前尚無證據顯示中國系模型比美國模型更安全或效能更佳。
Anthropic於6月12日依照美國政府出口管制指示,暫停Claude Fable 5與Mythos 5的存取。這項措施限制外國籍人士使用模型,Anthropic其後表示出口管制已解除,相關內容載於Anthropic公告。
Anthropic於6月30日重新發布Fable 5,並說明將網路安全請求分為四個風險等級。惡意程式開發、攻擊自動化等高風險工作會被封鎖;以防禦為目的的漏洞識別則在限制下獲准。新的分類器設計為阻擋超過99%的特定繞過技術。
網路安全領域的防禦與攻擊往往使用相同技術。尋找漏洞並修補程式碼有助於提升安全性,但也可能被用來尋找攻擊路徑或製作漏洞利用工具。
Anthropic表示,滲透測試、權限提升與漏洞利用開發屬於高風險雙重用途工作,原則上會予以封鎖。相關安全防護措施可在Anthropic文件中查閱。
這類限制可能促使安全研究人員尋找其他模型。OpenAI限制網路安全功能後出現中國系AI模型使用案例一文,也介紹了存取受限與替代模型選擇相互作用的趨勢。
深度求索已公開API價格表;Hugging Face在分析7月安全事故時,則使用中國系開放權重模型GLM 5.2。Hugging Face表示,封閉式模型的安全防護無法區分攻擊指令與事故應變分析,因而阻礙調查工作。相關價格、存取性與調查應用案例,分別可在深度求索API價格表與Hugging Face事故分析中確認。
然而,不能僅憑存取性與成本就將中國系模型評為替代方案。博思艾倫漢密爾頓(Booz Allen Hamilton)6月以超過2800項測試與約45萬行程式碼,比較4款中國系大型語言模型與1款美國模型。
在4款中國系模型中,有3款在假設面向美國政府使用者的請求中,生成了較脆弱的程式碼。不過,這些結果是根據博思艾倫設計的測試得出,能否適用於所有中國系模型與實際運作環境,仍未獲確認。相關數據載於博思艾倫分析。
美國網路安全暨基礎設施安全局(CISA)、國家安全局(NSA)與聯邦調查局(FBI)指稱,中國系AI企業大規模進行模型蒸餾,抽取美國前沿模型的功能。模型蒸餾是利用大型模型的回應,訓練更小且成本更低的模型。
美國機構的說法是,中國系企業自2024年底起便展開相關活動。具體證據與法律判斷仍須另行確認,相關指控載於CISA、NSA與FBI聯合公告。
中國商務部於9月9日反駁美方說法,稱其缺乏事實與法律依據。中方主張,模型蒸餾是多家AI企業使用的通用技術,美國企圖以此為由壟斷AI產業與運算資源。相關反駁內容載於中國商務部公告。
Reddit社群使用者對此看法分歧。一方認為美國企業的封鎖可能妨礙防禦性安全研究,另一方則擔心中國系模型的資料處理方式與安全性。相關意見可在Reddit社群討論中確認。
選擇網路安全工作使用的模型時,除了回答品質與成本,也應檢視資料處理方式、存取控制與稽核功能。尤其要在國內安全工作中導入特定模型,仍須另行評估模型安全性與運作環境的適配程度。
目前可確認的趨勢是,美國AI模型限制高風險網路安全功能之際,部分中國系模型因價格與存取性而被使用。但尚無依據判定中國系模型更適合國內安全工作,也無法確認美國監管措施將在多大程度上增加中國系模型的使用。
留言 0