AI 搜尋服務「Perplexity」的「컴퓨터(Computer)」檔案被發現出現在 Google、Bing、DuckDuckGo 等搜尋結果中。繼「Claude」用戶資料外洩爭議尚未完全平息,又爆出類似問題,生成式 AI 的「個資保護」機制再度亮起紅燈。「Perplexity」「生成式 AI」「個人資料」等議題,再次成為產業與監管關注焦點。
根據美國媒體 Protos 於 27 日(當地時間)的報導,只要輸入特定格式的標準共享連結結構,就能存取多位用戶在 Perplexity 上建立的「컴퓨터」檔案,數量達數十筆以上。這些頁面皆掛載於 perplexity.ai 網域之下,為實際可瀏覽的「線上頁面」。從檔案標題即可推測,其中包含大量與個人生活、工作相關的敏感內容,顯示使用者並未意識到這些資料可能被公開檢索。
這次事件與上週剛曝露的 Anthropic「Claude」共享連結外洩問題高度相似。當時,使用者在建立分享連結時,平台並未充分說明內容可能被搜尋引擎「索引(Index)」的風險,而「noindex」等阻擋機制也未有效啟動,導致對話與檔案被外部搜尋引擎收錄。事後,各大搜尋引擎雖已下架 Claude 的公開分享目錄,但 Protos 指出,與 Perplexity 相關的頁面目前仍可被搜尋到。
外界批評指出,Perplexity 僅以「Anyone with the link can view(持有連結者皆可檢視)」作為提示,卻未明確說明這些連結在實務上可能被搜尋引擎抓取、進而被廣泛公開。「評論」這種設計讓一般用戶以為只有「知道連結的人」才看得到,忽略了搜尋引擎爬蟲亦屬「持有連結」的一種情況,風險認知出現落差。
更具爭議的是,Perplexity 其實已設有專門用於「公開展示」的 pplx.app 獨立網域,用來區隔一般私人對話與刻意公開內容。但這次被搜尋引擎收錄的,卻仍是掛在 perplexity.ai 主網域、原本應偏向「使用者操作環境」的頁面。這代表部分用戶並非有意將內容「公開上網」,卻因平台設計與說明不足,而在不知情的情況下被搜尋引擎收錄與散播。
多位資安與隱私專家認為,生成式 AI 平台在積極強化「分享」「協作」功能的同時,反而忽略了最基本的「預設隱私保護」原則。尤其在大量企業與專業人士,已把這些服務當作「工作輔助工具」的情況下,對話與檔案中往往夾雜公司內部資料、客戶資訊甚至機密內容,一旦被搜尋引擎收錄,影響層面遠不只一般個人隱私。
事實上,OpenAI 也曾在 2025 年 7 月遭遇類似問題,部分以分享連結公開的「ChatGPT(ChatGPT)」對話被搜尋引擎檢索並出現在搜尋結果中。事件曝光後,OpenAI 緊急取消預設的「可被搜尋」選項,並調整分享機制,將搜尋引擎曝光風險降到最低。「評論」這顯示,即便是產業龍頭,同樣可能在「產品便利性」與「用戶隱私」之間做出錯誤權衡。
如今從 Claude、ChatGPT 到 Perplexity,接連爆出同型態的外洩案例,突顯出整個生成式 AI 產業在「共享功能設計」上的結構性問題。平台若一味強調「可分享」「可協作」「可嵌入」,卻沒有把「noindex 預設啟用」「是否允許被搜尋」等選項清楚交由使用者選擇,就很容易在規模擴張後引發大規模資訊外洩。
「評論」對使用者而言,關鍵在於重新檢視自己在各家 AI 服務上的「分享設定」,包括:是否真的需要外部共享連結、是否允許搜尋引擎索引、是否在工作環境中上傳或貼入機密資料等。對服務提供者而言,則必須把「隱私預設為封閉」「清楚標示是否可能被搜尋引擎收錄」「提供一鍵阻擋索引功能」視為基本標配,而非事後補救。
隨著生成式 AI 服務滲透至企業、金融與個人日常生活,如何在「便利的分享體驗」與「嚴謹的個資保護」之間取得平衡,已不再是技術細節,而是攸關信任與監管的核心議題。未來,「共享」功能的事前告知、可見範圍的精準控制,以及預設啟用的搜尋引擎阻擋設定,恐將成為所有 AI 平台不可迴避的標準要求。
留言 0