OpenAI針對部分企業與API客戶,試辦一套新的安全審查機制「Private Safety Processing」(私有安全處理),可在不保留客戶資料的前提下,偵測橫跨多次對話的濫用訊號。這也顯示高效能人工智慧(AI)模型的競爭焦點,正從單純比拼效能,擴大到企業資料保護方式。
根據科技媒體TechCrunch報導,OpenAI已將「Private Safety Processing」提前開放給部分企業與API客戶測試。這套機制的設計重點在於:自動檢視橫跨多次對話的輸入與輸出內容,但不會保留客戶的對話資料。
核心差異在於「零資料保留」(Zero Data Retention,簡稱ZDR)的適用範圍。OpenAI過去在API上是以單一工作階段(session)為單位檢查是否有濫用情形;新機制則進一步分析橫跨多個工作階段才會浮現的行為模式。
OpenAI舉例說明,惡意使用者可能會把撰寫網路攻擊用惡意程式碼的請求,拆成好幾段對話分開輸入,藉此規避偵測。「Private Safety Processing」的設計,就是即使這類請求分散在多個工作階段中,系統仍能自動偵測出濫用訊號。
OpenAI說明,系統一旦偵測到特定風險訊號,只會將經過嚴格界定的訊號傳給公司,必要時才會向客戶要求提供更多背景資訊,並非由真人直接檢視客戶的對話內容。
所謂「零資料保留」,是指服務完成後,公司不會保留客戶輸入與輸出的資料。對企業用AI而言,除了模型效能之外,資料留存在哪裡、是否可能被真人檢視、稽核紀錄如何管理,同樣是簽約時的重要條件。
這次試辦也與Anthropic旗下高效能模型的資料保留政策形成對照。Anthropic在隱私權說明中,將「Mitos」系列模型與未來效能相近的模型歸類為「涵蓋模型」,並表示這些模型的提示詞(prompt)與輸出內容,最長可保留30天。
Anthropic於7月公布這項政策,並說明部分濫用行為,必須合併檢視多筆請求才能發現。
Anthropic表示,一旦自動化安全系統標示出可能有害的內容,會由人數有限、經過授權的審查人員,透過受控管道檢視相關內容,且所有存取紀錄都會留存在無法竄改的日誌中。
兩家公司作法上的差異,對從事金融、醫療、法律、資安等業務的企業而言尤其敏感。這類企業相當在意輸入AI模型的資料,究竟會在外部保留多久、安全審查過程中誰能看到內容。
OpenAI在企業資料保護說明中也指出,組織客戶的資料原則上不會用於模型訓練,符合資格的組織可在API中選擇採用「零資料保留」政策。
AI安全競爭也是這次試辦的背景之一。隨著高效能模型在撰寫程式碼、資安分析、執行長時間任務的能力愈來愈強,單靠單一對話已經愈來愈難判斷是否遭到濫用。本刊此前曾報導OpenAI與Anthropic限制高效能AI存取權限的相關動向。
這次事件延續了先前限制存取的脈絡:客戶資料是否被保留,如今也成為企業用AI競爭中的比較項目之一。企業導入AI時,通常會一併評估效能、成本、安全控管與資料保留條件。
OpenAI這套新機制目前僅提前開放給部分企業與API客戶測試,一般ChatGPT個人用戶尚未適用。正式上線時間與適用模型範圍,官方尚未公布。
留言 0