上週末有用戶發現,Claude 的 AI 會話分享竟直接出現在 Google 搜索結果裏。問題的癥結在於,Anthropic 並沒有給分享鏈接設置禁止搜索引擎抓取的標識,因此只要用 SITE: 指令,就能查到大量已經被 Google 或其它搜索引擎收錄的會話分享鏈接,其中部分還裹着用戶的私密信息。
需要先釐清的是,這既不是 Anthropic 後臺數據庫被黑,也不是用戶從未分享的聊天記錄遭泄露。被搜索引擎抓到的主要是用戶主動生成的會話分享鏈接——這類鏈接本就任何人知道地址都能公開訪問。麻煩在於,很多用戶以爲分享鏈接只是發給同事或朋友看,卻沒意識到只要它出現在公共網頁、論壇、社交平臺等任何地方,就可能被搜索引擎發現並公開索引,陌生人也能借搜索拿到鏈接、直接翻看對話內容。

有網友測試後發現,部分用戶的會話分享裏塞着錢包私鑰、違規諮詢、公司任務信息以及可識別個人身份的內容。這類信息攤到互聯網上顯然是個巨大的安全風險。儘管 Claude 在用戶生成分享鏈接時會彈窗提醒存在風險,但很多用戶並不清楚,只要生成了分享鏈接,會話就有泄露的可能,而裏面的敏感內容也會被他人公開看到。
更多用戶可能以爲,只要不把鏈接轉發給不認識的人就是安全的——非專業用戶顯然摸不透搜索引擎爬蟲的工作邏輯。於是 Anthropic 本該設置禁止抓取的標識,卻因沒有嚴格配置,導致大量分享鏈接被 Google、必應、Yandex 等搜索引擎成功抓取。
目前 Anthropic 已經與搜索引擎提供商溝通撤下鏈接,不過部分引擎可能還留着殘留或緩存的鏈接;如果用戶曾分享過會話、且裏面含有敏感內容,建議直接找到那條會話把它刪掉。
出現這個問題的根本原因,大概率是一處技術配置錯誤。Claude 的 /share/* 路徑在 robots.txt 裏被設成了禁止抓取,但頁面響應頭又加了 X-Robots-Tag: none 屬性,這個屬性等同於 noindex、nofollow。聽起來像雙保險,實際效果卻可能適得其反。Google 官方文檔說得很明白:如果頁面被 robots.txt 阻止抓取,搜索爬蟲就讀不到頁面裏的 noindex 或響應頭裏的 X-Robots-Tag,結果就是搜索引擎可能抓不到正文內容,卻仍可能因爲外部鏈接發現這個 URL,並把它顯示在搜索結果中。於是 Google 搜索裏 claude.ai/share/* 路徑下大量 URL 被抓取並收錄,頁面描述雖然顯示"沒有可用信息",但其他用戶照樣能點進鏈接直接查看會話內容。
這並非頭一遭。2025年 ChatGPT 大量分享鏈接也曾被發現掛在 Google 搜索裏,當時 OpenAI 同樣沒設置嚴格的禁止爬蟲抓取,它認爲分享時已經提醒了必要風險,卻同樣高估了用戶的專業程度——對多數普通用戶來說,可能根本不會去讀那句警告,就直接生成了分享鏈接。更早之前,百度網盤也出過類似狀況:用戶設置了免密碼的公開分享鏈接,以爲只要不把鏈接給外人就是安全的,但搜索引擎爬蟲同樣能抓到這些鏈接,於是存在網盤裏的文件也被公開曝光。
