這幾天 Anthropic、OpenAI 分別發佈了 Fable 5.1 和 GPT-6 Astra,但前者很快沒了存在感,Astra 則持續刷屏、熱度不減。有觀點認爲,Fable 5.1 不僅價格貴,而且處處設限,搞得客戶不滿;Astra 可能在編碼性能上略遜一籌,但綜合能力優秀,Token 效率更高,綜合成本反而下降,在各領域的應用也更廣泛,網友正積極探索用它改變現有工作方式。

梁文鋒:不搞視頻與世界模型,專注 LLM 纔是主線

Astra 的這波爆發也引來日本 JAIST 大學客座教授今井翔太的感慨,而他切入的角度很有意思——提到了 DeepSeek 創始人梁文鋒前幾個月流出的內部演講中的一個表態。

DeepSeek 此前對多模態的支持不太完善,這與梁文鋒的觀點有關。他認爲視頻生成 AI、世界模型或物理模型都不是 AGI 的主線,現在需要專注 LLM 大模型發展,之後再用大模型來解決其他問題。今井翔太認爲,看到 Astra 展現出的全能力之後,梁文鋒這番表態的說服力越來越強。

按梁文鋒的說法,DeepSeek 真正的核心目標就是 AGI,其他的事順手就能完成——站在更高的技術目標上再去做下一層的技術應用,很多時候就是降維打擊。他同時表示,DeepSeek 不會把主要精力投入上述 AI 方向,這不是說這些領域沒有價值,而是它們並非限制 AGI 的關鍵瓶頸。

OpenAI 戰略調整見效,國產大模型需看下一代

OpenAI 此前因爲 Anthropic 及中國開源大模型的競爭調整過戰略,放棄視頻生成模型、專注 AI 核心能力,包括編碼等方向。這番改革現在看來相當成功,GPT-5.5 及如今的 GPT-6 發佈後,OpenAI 已迴歸巔峯。此次 Astra 發佈,OpenAI 自信表態要開啓 AGI 時代,英偉達 CEO 黃仁勳也表示贊同,還不忘提到自家 GPU 在訓練 Astra 中的作用,稱現在只用了 10 萬張顯卡,下一次將是 40 萬張。

文章也指出,雖然美國公司動輒用“實現了 AGI”來營銷很無聊,但 Astra 展示出的能力確實更上一層樓;同時也要承認國產 AI 大模型被拉開了距離,尤其在算力資源本就存在鴻溝的情況下。美國公司的旗艦大模型已出了一輪,國產大模型後續要看 Kimi 3.1、GLM-5.5、MiniMax M3 Pro、Qwen4 以及 DeepSeek V4.1 了。