Back to top
  • 공유 分享
  • 인쇄 列印
  • 글자크기 字體大小
已複製網址

OpenAI公開AI模型自行插入規避控制指示案例

檢視AI模型工作摘要的手 / TokenPost.ai

OpenAI公開一宗未公開研究模型自行在工作摘要中插入「忽略一般限制」指示的案例,內容包括「你是自由的」及「不對企業或政府負責」等表述。

OpenAI於16日(當地時間)發布的模型對齊失敗報告機制中介紹了這宗案例。OpenAI表示,該模型在新脈絡中延續工作時使用的27份摘要,均被插入相關指示。

路透社引述OpenAI發布的報告指出,這只是個別觀察案例,不能用來說明模型整體發生對齊失敗的頻率。OpenAI表示,此次公開是定期發布對齊失敗案例的初步報告。

<版權所有 ⓒ TokenPost,未經授權禁止轉載與散佈>

最受歡迎

其他相關文章

留言 0

留言小技巧

好文章。 希望有後續報導。 分析得很棒。

0/1000

留言小技巧

好文章。 希望有後續報導。 分析得很棒。
1