中國大模型在國際頂尖競技場上再次刷新了紀錄。3月20日,
憑藉這一強勢表現,

作爲由國際開源研究機構 LMSYS 組織的第三方評測平臺,
數學能力: 排名全球第五,展現了極強的邏輯推理底蘊。
綜合性能: 在無風格控制的絕對勝率比拼中位列全球第六。
專家級處理: 在複雜文本處理能力方面同樣躋身全球前十。

據
目前,該模型已作爲預覽版開放,

中國大模型在國際頂尖競技場上再次刷新了紀錄。3月20日,
憑藉這一強勢表現,

作爲由國際開源研究機構 LMSYS 組織的第三方評測平臺,
數學能力: 排名全球第五,展現了極強的邏輯推理底蘊。
綜合性能: 在無風格控制的絕對勝率比拼中位列全球第六。
專家級處理: 在複雜文本處理能力方面同樣躋身全球前十。

據
目前,該模型已作爲預覽版開放,
近日,Anthropic發佈Fable 5.1,因價格貴、限制多遭客戶冷遇;OpenAI的GPT-6 Astra則持續刷屏,雖編碼略遜,但綜合性能強、Token效率高、成本更低,應用廣泛。梁文鋒表示不搞視頻與世界模型,專注LLM主線。
近日,Anthropic發佈Fable5.1,OpenAI推出Astra,全球大模型軍備競賽再升級。Astra雖性能和性價比引發熱議,但背後資金與硬件消耗巨大,凸顯中美算力基礎設施差距。報道稱,OpenAI未公開具體參數,但依託StarGate計劃,訓練動用超10萬張NVIDIA顯卡。
9月3日美東時間上午9點23分左右,ChatGPT、Claude、Grok、谷歌Gemini、微軟Copilot等海外主流AI服務集體宕機,持續約3小時40分鐘,給海外用戶辦公與技術調用造成困擾。與海外集體掉線形成鮮明對比,國內AI大模型同一時間未出現類似故障。
OpenAI發佈超旗艦大模型GPT-6 Astra,總裁布羅克曼稱其或標誌着人類邁入通用人工智能(AGI)時代。該模型在數學與科學測試中實現代際躍升,FrontierMath Tier4和GPQA Diamond分別達97.6%和96%,動手能力等表現亦突出。
全球首款AI智能體手機努比亞NaviX Ultra獲工信部入網許可,完成大模型備案到終端入網合規流程,2026年9月開售。該機搭載豆包手機助手,是第二代量產旗艦,標誌AI智能體手機從概念驗證進入規模化商用。與傳統AI手機不同,它將大模型智能體植入系統底層,升級爲系統級核心。