header-langage
简体中文
繁體中文
English
Tiếng Việt
한국어
日本語
ภาษาไทย
Türkçe
掃碼下載APP

输入<think>能偷看别人聊天记录?DeepSeek这個「漏洞」被嚴重誤讀了

据動察 Beating 監測,近日社交平台上流傳一則消息,稱在 DeepSeek 對話框輸入 等特殊標記,就能看到其他使用者的歷史對話,並將其定性為 P0 級多租戶隔離失效。這一說法迅速引發恐慌,不少人開始擔心自己的聊天記錄被陌生人看到。


實際情況與多租戶隔離無關。輸入 think 或 <|begin_of_sentence|> 這類特殊標記後,模型會被騙進訓練時的格式模式,隨後基於自身記憶和當前系統提示詞(包含當天日期)生成一段看起來像真實對話的內容。這些內容是模型自己編出來的,不是從別的使用者對話裡實時調取的。


這種現象在學術界叫訓練數據記憶提取(Training Data Extraction),是所有大模型的共性問題,不是 DeepSeek 獨有的。Google DeepMind 早在 2023 年就發表過專門研究,證明用特殊輸入可以從 GPT、PaLM 等主流模型中套出訓練數據。ICLR 2025 收錄的 Magpie 論文更是直接把這個機制當工具用,給對齊後的模型餵模板 token 就能批量刷出訓練數據。


有人用「洩露內容包含今天日期」來反駁,認為訓練數據不可能是今天的。但 DeepSeek 每個對話的系統提示詞裡都寫著當天日期,模型生成的內容自然會包含這個日期,這不能證明內容來自另一個真實使用者。要證明是多租戶隔離問題,需要確認洩露的信息確實屬於某個真實存在的其他使用者,目前沒有任何證據支持這一點。

举报 糾錯/舉報
糾錯/舉報
提交
新增文庫
僅自己可見
公開
保存
選擇文庫
新增文庫
取消
完成