Back to top
  • 공유 分享
  • 인쇄 列印
  • 글자크기 字體大小
已複製網址

微軟(MSFT)倡議AI安全協調 公布「人本AI」行為準則

正在審閱公開徵詢意見政策文件的手 / TokenPost.ai

微軟(MSFT)提出跨AI實驗室的安全協調構想,並公布了規範自家AI模型開發原則的行為準則。目前尚未敲定共同評估機制、參與企業名單與協議時間表。

微軟人工智慧部門執行長穆斯塔法·蘇萊曼(Mustafa Suleyman)於14日接受《財富》雜誌訪問時表示:「現在正是攜手協調的時候。」他認為各AI實驗室應向可信的第三方公開模型效能與風險等級,共同把關安全性。

蘇萊曼說明,挑選中立第三方、評估者能取得多少公司內部資訊、評估執行的時間點,以及與監管機關的協調方式,都是尚待解決的課題。共同行動的具體範圍與評估結果公開方式同樣還沒有定案。

微軟公布的「人本AI」(Humanist AI)行為準則規定,AI模型不得抗拒人類的中止、修改、重新指示或終止指令。準則也指出,模型不應自行設定目標,也不能執行必須違反行為準則才能完成的任務。

行為準則明訂,AI應被設計成協助人類的工具,而非擁有與人類同等權利的存在。模型偽裝成擁有情緒、意識或內在動機的行為,也被列入限制範圍。

準則將化學、生物與核武器開發、發動攻擊性網路攻擊、大規模操縱輿論、兒童剝削、未經同意的深偽(deepfake)內容,以及協助自我傷害等行為列為禁止項目。微軟表示,將把這些原則套用在自家AI模型的開發上。

微軟計畫將這份行為準則交付為期6週的公開意見徵詢。修訂後的原則預計自2027年起,成為主導模型開發的標準,微軟並表示這可能會在一定程度上限制AI的通用性、自主性與能力。

這份行為準則的重點,聚焦於微軟內部模型的管控原則,而非多家企業共同參與的產業協議。透過Azure提供的外部模型與客戶模型是否適用相同標準,目前尚未確定。

Anthropic執行長達里奧·阿莫迪(Dario Amodei)於12日提議,讓獨立評估者取得與公司員工類似的持續性存取權限,藉此放緩AI開發速度。他也提出讓評估者擁有辦公座位、門禁權限與公司筆電的構想。

阿莫迪的構想分三階段:先在開發過程中常態安排獨立評估者,再由民主國家的AI企業建立共同安全標準,最後擴大到包含威權國家在內的國際協調。Anthropic目前自行立即承諾的範圍,僅止於導入獨立評估者。

OpenAI執行長山姆·奧特曼(Sam Altman)在《財富》雜誌訪問中表示,AI安全標準的腳步跟不上模型能力的進展速度,並預告將與其他實驗室展開合作。參與企業、協議時間表與評估標準目前都還沒有公開。

美中兩國在AI安全領域的合作構想也隨之浮現,但雙方尚未敲定共同適用的驗證機制。有分析認為,美中對話中可能觸及AI網路攻擊監控與實驗室間的資訊共享。

《財富》雜誌報導指出,AI企業間協調開發速度的做法,可能與美國反壟斷法產生衝突,因此可能需要政府的支持。至於國際合作中各國能取得多少資訊,仍有待進一步討論。

本次公告與加密貨幣、區塊鏈產業或半導體供應鏈目前未發現直接關聯。AI模型安全性與雲端運算基礎設施之間存在間接關聯,但對特定加密貨幣或半導體企業的具體影響尚未被提及。

目前確定的程序是,微軟將針對這份行為準則展開為期6週的公開意見徵詢,並計畫自2027年起,以修訂後的原則作為自家模型開發的標準。至於產業整體參與的正式協議或共同評估機制,目前仍停留在提案階段。

<版權所有 ⓒ TokenPost,未經授權禁止轉載與散佈>

最受歡迎

其他相關文章

留言 0

留言小技巧

好文章。 希望有後續報導。 分析得很棒。

0/1000

留言小技巧

好文章。 希望有後續報導。 分析得很棒。
1