Back to top
  • 공유 分享
  • 인쇄 列印
  • 글자크기 字體大小
已複製網址

404 Media:OpenAI找數百名承包商審查ChatGPT對話

個資經遮蔽處理的聊天機器人對話審查資料 / TokenPost.ai

有報導指出,OpenAI(OpenAI)讓外部承包商閱讀真實的ChatGPT(ChatGPT)使用者對話,並評估回覆品質。承包商審查了使用者輸入的提示與ChatGPT的回覆內容,而個資告知方式也成為爭議焦點。

404 Media(404 Media)14日報導,根據內部指導文件、Slack頻道紀錄與真實使用者提示,OpenAI透過代號「Project Lily」的計畫招募了數百名承包商。據報導,承包商需先整理使用者提問的意圖,再閱讀ChatGPT產生的多個回覆版本,並以1到7分為品質評分。

評分項目也包括降低ChatGPT表現得過於擬人化,或對使用者過度附和的傾向。不過,該計畫具體針對哪個模型並未公開。

據報導,這些承包商是透過Crossing Hurdles與Mercor招募而來。一名接受404 Media採訪的工作者表示,時薪超過50美元,但整體承包商人數與薪酬制度並未公開。

OpenAI表示,對話在交給承包商之前會先套用Privacy Filter,偵測並刪除姓名、地址、電子郵件、電話號碼、帳戶號碼等個人資訊。Privacy Filter並非能取代去識別化工具或法規遵循認證的機制。

OpenAI在Privacy Filter官方說明中表示,這項工具可能會遺漏罕見的識別資訊或含糊的個人資料。官方也補充說明,在法律、醫療、金融等敏感領域,仍需要人工審查與額外評估。

即使姓名或帳戶資訊被刪除,單憑對話脈絡仍有可能推測出使用者身分。因為職業、居住地、事件經過、家庭關係等多項資訊組合起來,可能足以鎖定特定個人。

OpenAI過去已公開表示,會同時運用自動化系統與人工審查,以確認服務安全性及是否違反使用條款。不過,確認是否違反安全規範的流程,與承包商為改善模型語氣、準確性及附和傾向所做的審查,兩者目的並不相同。

404 Media詢問OpenAI是否曾明確告知使用者,其提示內容有可能被真人審查,但OpenAI並未直接回答這項提問。此次報導點出的核心爭議,與其說是人工審查本身的存在,不如說是審查範圍與告知方式。

一般使用者可在設定中關閉「Improve the model for everyone」,讓新的對話不被用於模型改進。根據OpenAI資料管理說明,Temporary Chat不會用於模型改進,並會在30天後刪除,但仍可能因安全目的而受到有限度的審查。

關閉「Improve the model for everyone」的設定是否會回溯適用於過去的對話,需要另外確認。404 Media報導稱該設定不會回溯適用於過去對話,而OpenAI的說明頁面則是針對設定變更後的新對話說明處理原則。

企業版的ChatGPT Business、Enterprise、Edu帳號,對話預設不會用於模型訓練。OpenAI在企業版個資說明中表示,基於安全性與濫用調查、法規遵循的需要,經授權的員工或專業外部承包商可在有限範圍內存取對話內容。

民主與科技中心(Center for Democracy & Technology)研究員米哈爾·魯里亞(Michal Luria)評估,人工審查可能是改善聊天機器人複雜行為所必需的,但她也指出,對話式介面可能讓使用者誤以為自己身處比實際情況更私密的空間。這意味著審查的必要性與使用者期待之間存在落差。

加州大學洛杉磯分校(UCLA)教授莎拉·T·羅伯茲(Sarah T. Roberts)則認為,人工審查員在AI服務中的角色一直被低估。另一方面,雖然Reddit使用者批評個資過濾工具的侷限性,以及承包商審查事前告知不足,但社群反應本身無法視為獨立的事實佐證。

這篇報導凸顯的重點,不只是「ChatGPT對話可能被用於改善模型」這項既有政策,更在於真人實際閱讀使用者對話的範圍有多大,以及這項事實對使用者的告知是否足夠清楚。使用者有必要依帳號類型與資料設定,分別確認新對話與既有對話的處理方式。

<版權所有 ⓒ TokenPost,未經授權禁止轉載與散佈>

最受歡迎

其他相關文章

留言 0

留言小技巧

好文章。 希望有後續報導。 分析得很棒。

0/1000

留言小技巧

好文章。 希望有後續報導。 分析得很棒。
1