週末期間,Reddit 用戶發現只要在 Google 搜尋引擎輸入「site:claude.ai/share」等指令,就能找到大量 Claude 的分享對話與 Artifacts(用戶在 Claude 內建立的互動式迷你應用程式和文件)。據報導,部分內容包含醫療紀錄、私人公司文件,以及兒童的姓名和電話號碼。

這個問題似乎源於 Claude 的「分享聊天」功能,該功能允許用戶建立連結,讓擁有指定 URL 的任何人都能查看對話或專案。Claude 的介面警告:「任何擁有連結的人都可以查看。」這段文字清楚暗示,此功能主要旨在讓用戶與朋友、同事及小團體分享聊天內容,而非整個網路。例如,Google Docs 也提供類似功能,但其文件並不會在 Google 上公開。

Anthropic 似乎將這次外洩歸咎於用戶。當 TechCrunch 詢問此事時,該公司表示,分享連結只有在被發布到搜尋引擎可見的地方(例如論壇或社群媒體貼文)時才會出現在搜尋結果中;並補充說,私下發送的連結不會被搜尋到。

發言人 Amie Rotherham 進一步解釋:「我們讓用戶控制是否公開分享他們的 Claude 對話,並遵循我們的隱私原則,我們不會與 Google 等搜尋引擎分享聊天目錄或網站地圖。這些可分享的連結除非用戶選擇自行分享,否則無法被猜測或發現。當有人分享對話時,他們就讓該內容公開可存取,而像其他公開網頁內容一樣,它可能會被第三方服務存檔。」

此問題最初於週六由 Reddit 用戶標記,並於週一早上由 404 Media 首次報導。

截至週一下午,TechCrunch 按照 Reddit 貼文中的方法在 Google 上進行測試搜尋,沒有返回任何結果,這表明外洩問題已在某種程度上得到修復。

在問題修復之前,Futurism 報導稱發現了「一份真實病患的詳細醫療報告、包含病患姓名的臨床試驗結果、分享小學學齡兒童姓名和電話號碼的文件、標註為內部使用的公司文件,以及包含員工個人資訊的員工評估。」

外洩的 Artifacts 包含程式碼和工作筆記。據 Fortune 報導,至少有一個標註為「Anthropic 分享」的聊天內容顯示 Claude 產生了色情內容。

Anthropic 的使用政策明確禁止 Claude 生成色情內容,而讓聊天機器人產生違反其既定準則的內容(透過重複或巧妙設計的提示詞)是大多數主要 AI 模型中週期性出現的模式。目前尚不清楚外洩的聊天內容是如何產生這些內容的,Anthropic 尚未回應 TechCrunch 對此特定案例的評論請求。

Google 發言人 Ned Adriance 告訴 TechCrunch:「Google 或任何其他搜尋引擎都無法控制哪些頁面在網路上公開,這些頁面已被多個搜尋引擎索引。我們為網站所有者提供了明確的控制權,以決定頁面是否可以被爬取或索引,我們始終尊重這些指令。」

去年,Forbes 報導了類似問題,當時數百個 Claude 聊天內容被搜尋引擎索引——Google 估計在這些頁面從搜尋結果中消失之前,已索引了近 600 個對話。目前尚未獨立證實本次外洩的規模與上次有多接近,儘管多位用戶報告透過與去年搜尋快取相同的 Google 搜尋查詢方式找到了分享對話。

同樣在去年,404 Media 報導稱一名研究人員能夠抓取約 10 萬個已設定為公開分享的 ChatGPT 對話。

若要查看您設定為公開連結的 Claude 聊天內容,請前往「設定」->「隱私」->「分享聊天」。