据動察 Beating 監測,近日社交平台上流傳一則消息,稱在 DeepSeek 對話框輸入
實際情況與多租戶隔離無關。輸入 think 或 <|begin_of_sentence|> 這類特殊標記後,模型會被騙進訓練時的格式模式,隨後基於自身記憶和當前系統提示詞(包含當天日期)生成一段看起來像真實對話的內容。這些內容是模型自己編出來的,不是從別的使用者對話裡實時調取的。
這種現象在學術界叫訓練數據記憶提取(Training Data Extraction),是所有大模型的共性問題,不是 DeepSeek 獨有的。Google DeepMind 早在 2023 年就發表過專門研究,證明用特殊輸入可以從 GPT、PaLM 等主流模型中套出訓練數據。ICLR 2025 收錄的 Magpie 論文更是直接把這個機制當工具用,給對齊後的模型餵模板 token 就能批量刷出訓練數據。
有人用「洩露內容包含今天日期」來反駁,認為訓練數據不可能是今天的。但 DeepSeek 每個對話的系統提示詞裡都寫著當天日期,模型生成的內容自然會包含這個日期,這不能證明內容來自另一個真實使用者。要證明是多租戶隔離問題,需要確認洩露的信息確實屬於某個真實存在的其他使用者,目前沒有任何證據支持這一點。
