Anthropic 對外披露了內部研發自動化統計數據。截至今年 8 月,Claude 已主導公司 26% 的 AI 研發任務,而在 2 月這一佔比還不足 1%,增長速度十分驚人。

六級自動化框架:超 90% 達到人機協作,但沒有“完全自主”

Anthropic 採用六級自動化框架評估 AI 參與程度,其中 AL4 級別定義爲“AI 主導”:人類只給出高層目標指令,由 AI 完成任務的絕大部分流程,人負責監督審覈。目前超過 90% 的研發工作都達到人機協作及以上等級,但沒有任何研發任務實現完全無人自主(AL5),AI 始終不能脫離人類監管。

在公司內部,約 3 萬個由 Claude 驅動的 AI Agent 並行開展研究與工程工作,Agent 之間可以互相分配任務、交叉糾錯,8 月單月產生超 10 億次決策。

八成入庫代碼由 Claude 生成,參與下一代模型自我改進

爲防範風險,所有 AI 操作執行前都會經過在線安全檢查,少量異常決策會被直接攔截;後臺還會定期抽取對話記錄,高風險案例提交人工複覈。

代碼層面變化更爲明顯:目前 Anthropic 合併入庫的代碼中,超 80% 由 Claude 生成,工程師的產出效率相比過去提升數倍。這些 AI Agent 承擔模型實驗、代碼編寫、數據分析、結果校驗等大量底層研發工作,並參與下一代 Claude 模型的迭代,也就是行業所說的遞歸自我改進。