大模型行業的“價格戰”與“能力天花板”在近期迎來了一次全新突破。此前在開源社區引發廣泛關注、被稱作“牛來”的神祕模型Ox-Alpha終於揭開面紗,它正是智譜AI最新發佈的GLM-5.3-Flash。作爲GLM- 5 系列的首個原生多模態模型,它不僅在性能上硬剛全球頂級旗艦,更以極具顛覆性的價格和全國產算力底座,重新改寫了行業競爭規則。

在覈心性能與價格定位上,GLM-5.3-Flash展現了跨越式的性價比。其Artificial Analysis Intelligence評分達到 57 分,不僅超越上一代旗艦GLM-5.2,也高於DeepSeek V4 Pro正式版的 53 分,遠超同類模型 18 分的中間值。而在價格方面,它打破了傳統大模型“參數越大、價格越貴”的定律,每百萬Token輸入僅需0. 8 元、輸出2. 8 元、緩存命中0. 23 元,成本約爲Claude Opus 4. 8 的四十分之一,讓前沿智能真正擺脫了“省着用”的窘境。

多模態視覺能力的全面原生集成,是該模型最大的技術亮點。傳統編程大模型依賴“人類充當裁判”的單向流程,而GLM-5.3-Flash則將視覺編碼能力融入Coding循環中。模型在編寫代碼、設計遊戲或搭建3D場景時,能夠主動“觀察”渲染結果和交互反饋,形成“生成-觀察-修正”的閉環。官方測試顯示,該模型甚至能在Blender中自主運行 16 個小時,從零搭建出一個約 400 平方米的專業主廚自宅與測試廚房,展現了強大的自主視覺判斷與迭代改進能力。

更爲關鍵的是,這款前沿大模型背後的算力支撐全面轉向了國產芯片。在OpenCode和OpenRouter等平臺上,由集羣承載的全球真實線上流量均由國產芯片提供算力支持,並藉助專用的SGLang推理引擎、ReplaySSM、混合緩存量化及EPD分離式架構等一系列激進優化技術,克服了內存與帶寬瓶頸。這一突破證明,國產芯片不僅能夠完美承載前沿大模型,還能在大規模真實流量下保持穩定與經濟。

目前,GLM-5.3-Flash的模型權重已通過MIT許可證在Hugging Face等平臺開源,API也同步向全球開發者開放,標誌着大模型在高性能、低成本與國產化適配的融合道路上邁出了歷史性的一步。