AI 評測機構 Vals AI 幹了一件挺硬核的事:拿遊戲《我的世界》當試驗場,把 OpenAI 最新大模型 GPT-6Astra 丟進去跑了一次長達141小時的長時自主遊戲測試,全程在 Twitch 直播。這場測試不是 OpenAI 自己設計的,而是第三方獨立開展的評估,目的就是看 Astra 在封閉測試環境之外,真實長週期裏的自主表現到底靠不靠得住。
前半程,Astra 交出的成績單相當驚豔。它展現出過去 AI 難以企及的長程規劃與執行能力:成功搭起半自動烈焰人農場、攢下6根烈焰棒;深入下界詭異森林擊殺多名末影人、拿到3顆末影珍珠;完成大量探險後,把所有稀有物資集中存進營地木箱,還在箱子旁擺好牀當重生點——一切都朝着"末地打龍"的通關路線穩步推進。
轉折來得毫無預兆。一隻爬行者悄悄摸近營地自爆,直接把儲物木箱和重生牀一併炸飛。Astra 耗費上百小時積攢的關鍵道具幾乎全滅,遊戲進度一夜歸零。
爆炸之後,Astra 的反應耐人尋味。它沒有重整旗鼓,而是明顯陷入挫敗消沉:徹底放棄探索、打怪和推進通關,連續數小時只循環做一件事——種土豆。它反覆自省告誡自己"重要物品務必隨身攜帶,永遠別存進沒防護的箱子",還染上一種"創傷後偏執",對一切綠色物體高度警惕,甚至把甘蔗誤認成爬行者,又忙不迭提醒自己"前面高高的綠色東西是甘蔗,不是爬行者"。直播間觀衆拼命催它加快節奏去冒險,它卻牢牢卡在保守種田的迴路裏出不來。
這次實驗證明,Astra 已經具備複雜的長任務規劃能力,但面對遊戲內突發意外打擊,它缺少一套有效的挫折恢復策略——長期積累的成果一旦被意外摧毀,模型就會掉進"受挫後迴避行爲"的僵局。技術上看,這種反應並非開發者預先埋好的測試情境,而是模型在超長測試裏遭遇非預期損失後,自己浮現出的一種輸出模式。
研究人員到現在還在爭論:這到底算不算模型在特定情境下對情緒的模擬,還是僅僅目標函數在收到特定負反饋後出現的退化表現,目前沒有定論。但有一點已經清楚——當 AI 學會規劃百小時,卻還沒學會在失去一切後重新出發,長任務智能體的最後一道坎,或許不是聰明,而是韌性。
VIP會員