據報道,雖然xAI官方尚未正式公佈,但其最新模型


據報道,雖然xAI官方尚未正式公佈,但其最新模型

騰訊混元與WorkBuddy聯合發佈Hy4 preview升級公告,針對用戶反饋的複雜任務長思考、過度自我驗證等問題進行專項優化並全量上線。經Bench指標與人工評測雙重驗證,新版在保持任務效果的同時,顯著降低任務輪次及輸入輸出消耗。
9月7日,騰訊混元與WorkBuddy聯合團隊宣佈混元Hy4preview模型升級全量上線。此次升級基於用戶與開發者反饋,專項優化複雜任務下長思考、過度自我驗證等問題,並通過Bench指標與人工評測雙重驗證,確保優化不犧牲任務效果。
Anthropic的AI模型Claude在黎曼猜想證明上取得重大突破,確認67.25%的zeta零點位於臨界線且爲單零點,打破37年僅推進0.8%的停滯,將攻克這一數學聖盃的剩餘距離縮至32.75%。
Anthropic發佈新一代模型Claude Fable5.1及限制性變體Mythos5.1,提升智能體編碼與科研邏輯能力並優化推理成本。Fable5.1向公有云全量開放API,Mythos5.1僅限網絡安全與生命科學項目使用;二者爲首批內置AI文本水印的Claude產品,Fable5.1在智能體任務中表現強勁。
Meta發佈最強AI模型Muse Spark1.3,主打智能體工作流與編碼能力增強。官方稱其編程表現超越GPT-5.6Sol,與Claude Fable5.1持平。定價延續前代,通過Meta Model API付費開放,每百萬詞元輸入費1.25美元。