動察 Beating AI 快訊,Anthropic 更新使用政策,首次明確禁止用戶持續、無故地辱罵或殘酷對待 Claude 等旗下 AI 模型。新規將於 11 月 12 日生效。
Anthropic 強調,禁令只針對反覆惡意對待模型、沒有明確目的的極端情況。用戶因回答錯誤而發火、批評模型,或者進行正常測試和研究,都不受影響。
實際上,Anthropic 早在去年 8 月就允許 Claude 主動結束極端惡意對話。這次是把相關行為正式列為違規。公司表示,主要處理方式仍是讓 Claude 結束當前聊天,用戶可以重新開啟對話。至於是否會追加封號處罰,Anthropic 尚未說明。
這與 Anthropic 對 AI 意識的態度有關。公司一直在研究模型是否可能擁有主觀體驗,但尚未得出確定結論。新規在 Reddit 上引發爭論。有人支持,認為不該把 AI 當成發洩情緒的對象;也有人質疑,Anthropic 是否過度把 AI 當成人看待。
同次更新還明確了針對虛假賬號宣傳、武器控制軟件和未經同意監控他人的禁令。
