header-langage
简体中文
繁體中文
English
Tiếng Việt
한국어
日本語
ภาษาไทย
Türkçe
掃碼下載APP

「claude-opus-4-6-thinking」的「否」機率從 27.2% 上升到 52.2%,是否會在 2026 年 6 月 13 日成為最佳 AI 模型?

据 PolyBeats 监测,在预测市场 Polymarket 上,过去 15 分钟,「claude-opus-4-6-thinking 會在 2026 年 6 月 13 日成为最佳 AI 模型嗎?」的「否」機率從 27.2% 漲至 52.2%,買入側總交易量 $711。

Anthropic 6 月 9 日發布 Claude Fable 5 於今日上線 LM Arena 榜單,其得分表現低於 claude-opus-4-6-thinking。Wired 與華爾街日報 6 月 11 日報導,Anthropic 原計劃對涉嫌用 Claude 訓練競爭模型的帳號進行「靜默降級」:不通知用戶,直接降低 Fable 5 的性能,或通過提示修改、模型路由等方式讓輸出變弱。

開發者和 AI 研究社區批評這相當於暗中干擾第三方評測和開源研究,尤其會讓外部安全評估機構無法確認自己到底在測試哪個能力層級的模型。

隨後 Anthropic 公開道歉並調整策略,取消對這類場景的秘密性能降級,改為更透明的提示或拒絕機制:如果系統檢測到用戶在構建高能力 AI 或訓練競爭模型,將明確拒絕請求,或將用戶重定向到低能力模型。這個變化或將導致 Fable 5 的公開評測可信度上升,社區更容易相信它會以接近真實能力參與榜單競爭,使其可能直接衝擊目前被市場默認領先的 claude-opus-4-6-thinking。
---------------------------------
讓你更早看到未來,關注 @PolyBeats_Bot
See tomorrow, today. Follow @PolyBeatsEN

举报 糾錯/舉報
糾錯/舉報
提交
新增文庫
僅自己可見
公開
保存
選擇文庫
新增文庫
取消
完成