一名 Reddit 用戶近日發現,在 Google 輸入搜尋指令「site:claude.ai/share」,可叫出數百則與 Claude 對話紀錄,共曝光超過 200 則對話,橫跨至少 25 頁搜尋結果,部分對話為幾週前發生。Anthropic 已補上 noindex 標籤,谷歌在 7 月 26 日下架相關搜尋結果。
外洩內容的類型:加密貨幣憑證、臨床試驗病患資料與企業未發布產品規劃
(來源:Reddit)
網友實測後發現,外洩的 Claude 對話涵蓋多類敏感個人和企業資訊:
· 加密貨幣錢包憑證
· 疑似社會安全碼
· 法律諮詢和健康紀錄(含臨床試驗的病患全名、年齡、性別、種族與治療日期)
· 企業內部文件(薪資表、CRM 系統對話紀錄、尚未發布的產品規劃)
· 兒童姓名與電話號碼
· 位置資料(疑似含地址與公寓門禁密碼的「位置資料收集」資料庫)
Om Patel(BigIdeasDB 創辦人)補充,外洩不只限於對話紀錄,也涵蓋 Claude「Artifacts」功能產生的互動式小程式與文件。
技術根因:noindex 標籤缺失與 robots.txt 的限制
此次外洩的直接原因是 Claude 分享頁面缺少「noindex」標籤。Anthropic 自 2025 年 9 月起已設有 robots.txt 指示搜尋引擎爬蟲不要存取分享連結,但這不夠完整:根據 Google 開發者說明,如果一個網頁已被其他網站連結,Google 在決定是否收錄時,需要網頁本身加上 noindex 標籤或在回應標頭加入 x-robots-tag 才能真正阻擋收錄。
外媒《Wired》審視外洩頁面後確認,這些頁面確實未加上 noindex 標籤;這也解釋了部分搜尋結果顯示「沒有此頁面的相關資訊」——Google 知道連結存在但無法讀取頁面內容,同樣的問題也出現在 Claude 的公開 Artifacts 頁面上。
修復進度與永久封存問題:453 則對話已被封存
(來源:Claude)
Anthropic 已補上 noindex 標籤,Google 在 7 月 26 日左右開始下架 Claude 的相關搜尋結果;但 Bing 在截稿時仍可搜尋到部分內容。更無法挽回的是,GitHub 上名為「Shared-Claude-Chats」的倉庫已永久封存 453 則 Claude 對話、519 則 Grok 對話,共 11,241 則訊息,全數以純文字形式存放。
此次事件並非首例:ChatGPT 在 11 個月前也發生幾乎相同的狀況(「讓此對話可被發現」功能導致數千則對話被搜尋引擎收錄,功能已被下架);Anthropic 去年也曾有約 600 則對話被 Google 收錄的類似情況。
常見問題
什麼是導致 Claude 對話外洩的直接技術原因?
直接原因是 Claude 分享頁面缺少「noindex」標籤。雖然 Anthropic 自 2025 年 9 月起已設有 robots.txt,但根據 Google 開發者說明,對於已被其他網站連結的頁面,Google 需要頁面本身加上 noindex 標籤才能完全阻擋搜尋收錄;外媒《Wired》審視外洩頁面後確認這些頁面缺少此標籤。Anthropic 已在事件後補上 noindex 標籤修復問題。
即使 Anthropic 已修復,過去外洩的對話是否已被永久保存?
是的。GitHub 上名為「Shared-Claude-Chats」的倉庫已封存 453 則 Claude 對話和 519 則 Grok 對話,共 11,241 則訊息,以純文字形式永久存放;此外,Bing 截至報道時仍可搜尋到部分內容。使用者可在 Claude 設定的隱私權分頁管理已分享的對話,但已被封存的內容無法藉此刪除。
Anthropic 和 Google 如何回應此次事件?
Anthropic 發言人 Amie Rotherham 表示,分享連結非可猜測,使用者選擇分享就等於公開,如同其他公開的網路內容可能被第三方保存;Google 發言人 Ned Adriance 表示,搜尋引擎無法控制哪些頁面被公開在網路上,Google 提供網站擁有者明確工具決定頁面是否被收錄,並一向遵守這些設定。