近日,智譜正式上線並開源GLM-5系列首款原生多模態模型GLM-5.3-Flash(320B-A18B),以領先性能與極致定價,推動前沿人工智能技術走向普惠。

該模型實力躋身全球前沿梯隊,在Artificial Analysis Intelligence Index測評中獲得57分,與Claude Opus4.8持平,編程能力表現相當,綜合性能超越參數量更大的GLM-5.2。正式發佈前,模型以匿名身份“Ox-Alpha”開展公開測試,登頂OpenCode、OpenRouter平臺調用榜。

QQ20260827-095858.png

成本優勢是核心亮點。GLM-5.3-Flash定價僅爲同系列GLM-5.3的十分之一,限時折扣低至二十分之一,相當於Opus4.8價格的四十分之一,大幅降低前沿模型使用門檻。

架構層面,模型採用稀疏注意力與線性注意力混合架構,爲首個落地該方案的開源前沿模型,搭配流形約束超連接技術。相比前代,注意力計算量下降3.01倍,KV緩存縮減4.44倍,兼顧長上下文能力與推理成本。同時原生融合視覺能力,可自主利用視覺反饋完成前端開發、3D建模、文檔創作等任務,在金融研報、法律文書等專業場景表現突出。

QQ20260827-095913.png

值得關注的是,模型全量流量由國產芯片集羣承載。團隊自研推理引擎,依託EPD分離架構與多項內存優化方案,端到端推理性能提升3倍,硬件使用效率比肩英偉達主流GPU,印證國產算力支撐大規模前沿模型推理的可行性。

目前GLM-5.3-Flash已全面開源,開放API接口、在線體驗渠道,並上線ZCode、AutoClaw等智能Agent平臺,同步推出每日萬張體驗卡,面向全球開發者開放使用。

在線體驗

Z.ai:https://chat.z.ai

智譜清言App:https://chatglm.cn