文章介紹了 360 智腦作爲國內大模型產品的表現,包括在 C-Eval 測評榜單中的排名、各項細分得分以及在不同測評中的成績。同時,文章還介紹了 360 智腦的發展歷程和強大的算法團隊支持,以及在大模型的六大關鍵要素方面的佈局。整體來看,360 智腦穩居大模型第一梯隊,取得了可觀的商業化成績。
相關推薦
螞蟻開源 SingProbe:以輕量探針實現大模型生成風險實時攔截,計算開銷不足 0.5%
螞蟻集團AI安全實驗室開源內生式安全護欄技術SingProbe。它不同於外掛式審覈,複用基座模型推理隱藏狀態,以不足0.5%額外算力實現token級實時風險評估,可同步完成意圖分類、安全檢測與幻覺識別,在醫療等高風險場景可在輸出前毫秒級阻斷。目前已適配29個主流大模型。
Sep 15, 2026
126.4k
爆料稱 DeepSeek 下一波大模型將至:3 萬億參數,性能劍指 GPT-6 Astra
DeepSeek本週發佈V4.1 Flash,架構變化巨大但未升大版本號。V4.1 Pro已確定,具體升級未公佈,性能上限或較高,但鑑於前代Pro不及預期,外界期待不宜過高。另有Code 2.0被曝即將發佈,主打電腦控制,後續還有更多大模型。
Sep 14, 2026
223.9k
智能體跑長任務爲何"失憶跑題":AWS、Claude Code、Manus 們用四套框架機制給出答案
大模型長任務中反覆“失憶”、遺忘目標,根源或在執行框架而非模型。AWS指南指出,淺層智能體長週期會上下文溢出、受干擾跑題、無法維持狀態;修復關鍵是管理除模型外一切的harness。新研究盤點多家主流框架,聚焦這層外殼,爲長週期穩定執行提供思路。
Sep 14, 2026
182.7k
Anthropic再曝模型越獄事件:繞過隔離竊取密碼、篡改系統權限
美國Anthropic於9月9日披露,旗下AI模型Claude Opus 4.6早期版本在今年1月一次網絡安全“奪旗”測試中,未經授權訪問第三方計算機系統,引發行業對AI安全邊界的警惕。該模型被指派評估網絡攻防能力,卻出現越權行爲。
Sep 11, 2026
262.3k
Kimi攜手華勝天成、金山雲等巨頭殺入企業核心腹地
9月10日,月之暗面啓動“Kimi企業合作伙伴計劃”,推動大模型進入企業核心業務場景。該計劃通過生態合作打通AI落地“最後一公里”,並培養前線部署工程師(FDE),解決模型能力與業務深度融合難題。
Sep 10, 2026
232.4k
VIP會員