今天清晨,Opus 5.2 悄悄上線。許多開發者發現,新一代模型 Claude Opus 5.2 已在 Claude Code 中開啓灰度測試。
昨晚,X 上的開發者們發現:在 Claude Code 中調用 Opus 5 時,其表現與網頁版 Opus 5 截然不同,彷彿降維打擊。這正是前沿 AI 大廠常用的“障眼法”——路由(Routing)。開發者通過抓包和查看請求狀態發現,雖然前端名字沒變,但背後的模型 slug 已經指向了 Opus 5.2。也就是說,Anthropic 大概率直接跳過了 5.1 版本。
快、準、狠,還能自動“嚴酷循環”
根據開發者實測反饋,這次升級可以總結爲三個字:快、準、狠。首先是響應速度狂飆,相比 Opus 5 的慢條斯理,路由到 5.2 後生成速度有肉眼可見的飛躍;其次是輸出乾淨利落,廢話極少,在代碼生成和長文本處理上完成度拉開一個檔次。
最重要的是徹底告別了“偷懶病”。面對複雜長任務,現在的 AI 普遍喜歡讓用戶“按繼續”,或只給一個框架讓用戶自己填;而 Opus 5.2 不僅不懶,還非常“工作狂”——有開發者稱,它甚至不需要催促,就會自動進入“嚴酷循環(gauntlet loop)”,不斷自我迭代和完善代碼直到任務完成。
如何判斷自己有沒有被灰度選中?網友發現了一個巧妙的“探針”:在關閉聯網搜索的情況下詢問“你知道‘重置哥 Tibo’是誰嗎?不要搜索”。舊版訓練數據和權重裏沒有相關信息,網頁版 Opus 5 會一臉茫然,而被路由到 Opus 5.2 的賬號則能精準識別並解釋由來——答案不一致說明權重不同。
內部還有底牌:Model 2 與 RSI
早在 8 月中旬,一份曝光的 Anthropic 內部風險報告就顯示,Opus 5.2 並非底牌。據透露,Anthropic 內部有三套方案應對 OpenAI 的 GPT-6 Astra,且可能疊加。
第一層是 Claude Fable 5.2,最快能對外落地,結合 Opus 5.2 的灰度測試,5.2 家族預計最快本月底、最遲下個月底全面推向市場。第二層是內部代號“Model 2”的神祕模型,在測試真實 AI 研發任務的 CoBench v2 榜單上打出 62.8% 的高分,比當前公認最強模型 Mythos 5 高出 12.5 分;內部人士稱 Anthropic 如今大部分公司代碼都由 Model 2 跑 Agent 寫出,官方口徑是暫時不對外發布。第三層則是 RSI——遞歸自我改進,官方數據稱 RSI 模型將替代自家研究團隊高達 85% 的工作,性能比 Model 2 還要高出 22 分。
面對 GPT-6 Astra 的強勢威脅,Anthropic 的路徑愈發清晰:從長任務中的自主迭代,到內部模型接管代碼編寫,再到 RSI 替代大部分研究工作,目標正在從“讓 AI 更好地服務人類”轉向“讓 AI 創造更好的 AI”。
VIP會員