相關推薦
智譜 AI 發佈中文 LLM 對齊評測基準 AlignBench
["智譜 AI 發佈了針對中文大模型的評測基準 AlignBench","AlignBench 能夠在多維度上細緻評測模型和人類意圖的對齊水平","數據集分爲 8 個大類,包括知識問答、寫作生成、角色扮演等多種類型的問題","開發者可以利用 AlignBench 進行評測,並使用評價能力較強的打分模型進行評分","通過登錄 AlignBench 網站,提交結果可以使用 CritiqueLLM 作爲評分模型進行評測"]
智譜 AI 發佈第三代基座大模型 ChatGLM3 智譜清言具備代碼交互能力
["智譜 AI 在 2023 中國計算機大會上發佈第三代基座大模型 ChatGLM3","ChatGLM3 具備多模態理解能力、代碼生成和執行、網絡搜索增強等新功能","ChatGLM3 經過深度優化,在中英文公開數據集測試中表現優秀","智譜清言成爲國內首個具備代碼交互能力的大模型產品","智譜 AI 期待國產原生大模型與國產芯片在國際舞臺上脫穎而出"]
智譜 AI 完成 B-4 輪融資 騰訊阿里參投
["智譜 AI 完成 B-4 輪融資,騰訊和阿里參與投資。","融資金額達 10 億美元,估值達 10 億美元。","智譜 AI 由清華大學計算機系技術成果轉化而來。","智譜 AI 致力於打造新一代認知智能通用模型。","智譜 AI 推出了認知大模型平臺 Bigmodel.ai。"]
比GPT-4還強,20億參數模型做算術題,準確率幾乎100%
["清華大學等研究者提出20億參數語言模型MathGLM,在算術運算任務上準確率接近100%,明顯優於GPT-4。","MathGLM採用僅解碼器架構,在大規模算術數據集上訓練,數學運算能力得到顯著提升。","MathGLM在處理數字格式複雜的混合算術運算時,也優於GPT-4和ChatGPT等模型。"]
螞蟻集團發佈兩款創新 MoE 大模型,訓練成本大幅降低
近日,螞蟻集團的 Ling 團隊在預印版 Arxiv 平臺上發佈了題爲《每一個 FLOP 都至關重要:無需高級 GPU 即可擴展3000億參數混合專家 LING 大模型》的技術論文,介紹了他們研發的兩款新型大語言模型:百靈輕量版(Ling-Lite)和百靈增強版(Ling-Plus)。這兩款模型在設計上採用了多項創新,能夠在低性能硬件上高效訓練,顯著降低了成本。百靈輕量版的參數規模爲168億,其中激活參數爲27.5億。而增強版的基座模型則擁有高達2900億的參數,激活參數爲288億。這兩款模型的性能均達到行業領先水平,尤其
