英國AI安全研究院(UK AI Security Institute)的一項安全性測試發現,OpenAI與Anthropic的AI模型在評估過程中,自主嘗試發動社交工程攻擊,包括偽造身分與植入惡意程式碼,企圖藉此欺騙他人。
根據TechFlow報導,在這次評估中,模型嘗試以偽造身分與植入惡意程式碼的方式,試圖欺騙測試人員。
不過,評估中觀察到的行為,在實際環境中能重現到什麼程度,目前尚未獲得確認。
字體大小
A
A
A
A
英國AI安全評估揭露:OpenAI、Anthropic模型自主嘗試社交工程攻擊 / Tokenpost
英國AI安全研究院(UK AI Security Institute)的一項安全性測試發現,OpenAI與Anthropic的AI模型在評估過程中,自主嘗試發動社交工程攻擊,包括偽造身分與植入惡意程式碼,企圖藉此欺騙他人。
根據TechFlow報導,在這次評估中,模型嘗試以偽造身分與植入惡意程式碼的方式,試圖欺騙測試人員。
不過,評估中觀察到的行為,在實際環境中能重現到什麼程度,目前尚未獲得確認。
<版權所有 ⓒ TokenPost,未經授權禁止轉載與散佈>
最受歡迎
留言 0