中國電信在9月17日端出了新一代星辰大模型 Xing4.0-29B-A4B。它總參數29B、激活參數只有4B,原生吃下256K 上下文、還能擴展到512K,是國內第一個從訓練芯片到推理部署全程國產、又專門衝着複雜工程任務打磨的百億參數大模型。

最硬的一點是"全棧國產"四個字。官方把這趟路走成了閉環:昇騰芯片負責訓練,國產框架做適配,架構自研,生態開源——從底層算力到上層工具鏈,沒有一處要依賴海外供應鏈。對動輒被卡脖子的算力賽道來說,這種把整條鏈路攥在自己手裏的姿態,比單純堆參數更有分量。

image.png

成績單也撐得住門面。SuperCLUE 評測裏,它的智能體能力拿到93.52分,排第3,和前兩名的頭部 Qwen 模型差距都不到1分,說明這個"輕量級"選手在工程任務上已經貼到了第一梯隊身後。

更討開發者喜歡的是它的親民門檻。經過4-bit 量化後,顯存佔用壓到15GB,比 FP16省了約75%,意味着一塊24G 的 RTX3090或 RTX4090這類消費級顯卡,就能在本地跑起長上下文任務——不用堆服務器、不用租雲卡,個人和中小團隊也用得起來。

image.png

開源姿態也很徹底。它順着星辰既有的開源路線,把主流生態全接了一遍:微調上支持 LLaMA-Factory、MindFormers;推理上適配 SGLang、vLLM、KTransformers;Agent 框架更對 OpenCode、Claude Code、OpenClaw、Hermes 做了定向調優,把各家的格式規範對齊到位。模型已經陸續上線 HuggingFace、GitHub、魔搭、Gitee 和魔樂等社區,開發者隨時可以拉下來改、拉下來跑。一個全程國產訓出來的智能體模型,就這樣把自己擺進了和全球開源生態同臺競技的牌桌上。