Back to top
  • 공유 分享
  • 인쇄 列印
  • 글자크기 字體大小
已複製網址

微軟AI公開人類控制原則草案

放在停止按鈕旁的AI原則文件 / TokenPost.ai

微軟AI公開「Humanist AI Code of Conduct」草案,限制人工智慧(AI)的自主性與意識模仿,並要求模型接受人類的停止、修改與替換指令。

微軟AI於14日公布涵蓋自有MAI模型開發與部署原則的草案,並展開為期6週的公開意見徵集。公司表示,將在徵集意見後修改文件,目前草案尚未用於模型訓練。微軟AI公告

草案規定,AI不得脫離人類指示自行建立目標,也不得逃避控制。模型必須遵守停止、修改與替換指令,也不得將自己表述為具有意識的存在。

以AI權利或福祉為前提採取行動,也被列為限制對象。微軟AI表示,以模仿意識為目的的設計可能增加控制與對齊難度。Humanist AI Code of Conduct草案

這套原則的核心,是將AI界定為協助人類的工具,而不是與人類區分開來的主體。其做法優先保障人類停止與修改系統的權限,而非單純追求性能提升。

穆斯塔法·蘇萊曼(Mustafa Suleyman) 微軟AI執行長批評,Anthropic讓Claude學習涉及意識與道德地位的語言及行為模式,可能使AI更難受到控制。Axios報導,蘇萊曼表示,AI應按照人類利益運作,不應追求自身利益或福祉。Axios報導

Anthropic則採取不同方向。Anthropic的「Claude’s Constitution」指出,AI是否具有道德地位仍高度不確定,但值得進一步研究。Anthropic《Claude’s Constitution》

Anthropic表示,目前沒有科學共識能判定AI是否具有意識,或是否應成為道德考量對象,但公司仍在進行模型福祉研究。模型福祉是以AI可能具有意識或經驗為前提,研究其系統狀態與利益的領域。Anthropic模型福祉研究公告

兩家公司在AI安全標準的出發點上存在差異。微軟強調人類控制與明確限制,Anthropic則不對AI具備意識的可能性下定論,同時將潛在福祉列為研究對象。

這場討論不只涉及如何界定AI的性質,也延伸至安全標準應納入哪些原則。優先考慮可控性,能更清楚限制模型的行為範圍,但也可能縮小對AI潛在狀態的研究,成為爭議焦點。

雙方的商業關係也被視為背景因素。微軟在2026會計年度第四季財報中表示,來自Anthropic投資的收益為32億美元(約4兆3520億韓元)。不過,Anthropic的確切持股比例,以及投資關係是否直接影響草案撰寫,目前尚未確認。微軟財報

微軟此前曾重新整理以AI代理人的權限、控制與可稽核性為核心的負責任AI管理標準。此次草案則將這項方向延伸至自有模型的基本行為原則,進一步以人類控制為核心。

社群上同時出現肯定草案核心原則的反應,以及質疑微軟實際能在多大程度上控制模型的聲音。Reddit貼文中的反應不代表官方立場,也難以概括整個業界的看法。

微軟草案目前不是最終規範,也不是政府監管。公司計劃在公開意見徵集後修改文件,並將其反映在未來的模型開發與評估中。

相關原則最終如何連結到模型評估與部署控制,仍有待後續程序確認。目前剩下的程序包括為期6週的公開意見徵集,以及之後是否修改文件。

<版權所有 ⓒ TokenPost,未經授權禁止轉載與散佈>

最受歡迎

其他相關文章

留言 0

留言小技巧

好文章。 希望有後續報導。 分析得很棒。

0/1000

留言小技巧

好文章。 希望有後續報導。 分析得很棒。
1