當地時間 8 月 14 日,Anthropic 發佈第二份年度風險報告(186 頁),首次對外披露一個未公開的內部模型 Model 2。報告稱其能力超越已發佈旗艦 Claude Mythos 5(即 Claude Fable 5 的內部版本),但沒有發佈計劃。
![]()
報告顯示,Model 2 在內部評測 CoBench(由 449 個 Anthropic 真實研發問題組成)中得分 62.8%,高於 Mythos 5 的 50.3% 和 Mythos Preview 的 54.8%。公司預估“全面替代技術人員”的門檻約爲 85 分。Model 2 目前被大量用於公司內部的編碼、Agent 任務和數據生成。
![]()
報告將高風險場景下模型誤對齊導致災難性危害的風險評級從“極低”上調至“低”。官方稱上調反映整體不確定性上升,而非發現新的不利證據。報告同時披露,Claude 已編寫合併進公司生產代碼庫的絕大多數代碼,但內部研發整體提速尚未達到“無 AI 時的 2 倍”預警線。
![]()
報告還披露了一起內部安全流程事故:一個僅供內部使用的標誌意外關閉了阻止模型產生危險生物信息的分類器,從 2025 年 5 月持續到 2026 年 4 月,波及約 5 萬名外部承包商、約 1.33 億次消息交換;同一標誌還關閉了記錄功能,導致漏洞近一年未被監控發現。事後審查未發現實際濫用證據。
![]()
此次披露發生在 Anthropic 籌備 IPO 的節點上。同一天,智譜發佈 GLM-5.3,多項基準位列開源模型第一,編程與智能體能力接近 Claude Fable 5;此前月之暗面發佈 Kimi K3(2.8 萬億參數),DeepSeek V4 Pro 正式版上線。
更多遊戲資訊請關註:電玩幫遊戲資訊專區
電玩幫圖文攻略 www.vgover.com
