大模型下半场的入场券,不再仅仅是算力的堆砌,而是对底层逻辑的重构。
在3月18日举办的英伟达 GTC2026大会上,
Token 效率: 拒绝资源空转,追求更极致的计算能效比。
长上下文: 持续深化
智能体(Agent)集群: 智能形态正从单兵作战向动态生成的“数字集群”进化。
在
参考此前的发布信息,今年1月底推出的
随着

大模型下半场的入场券,不再仅仅是算力的堆砌,而是对底层逻辑的重构。
在3月18日举办的英伟达 GTC2026大会上,
Token 效率: 拒绝资源空转,追求更极致的计算能效比。
长上下文: 持续深化
智能体(Agent)集群: 智能形态正从单兵作战向动态生成的“数字集群”进化。
在
参考此前的发布信息,今年1月底推出的
随着
腾讯开源统训框架AngelSpec,通过多方案协同与工作负载异构适配,降低大模型自回归解码成本,提升推理吞吐量。针对不同场景文本特征采取差异化训练策略,如高熵多轮对话采用轻量稳定方案,实现真实场景下的高效推理。
月之暗面旗下 Kimi 完成超 35 亿美元 F 轮融资,投后估值达 350 亿美元。因认购规模超目标三倍,此轮提前关闭。原定 8 月的 G 轮(Pre-IPO)已提前启动,投前估值抬至 500 亿美元,两轮之间几乎无间隔,资本追逐正以月为单位加速。
月之暗面旗下AI产品Kimi完成F轮超35亿美元融资,投后估值达350亿美元。因认购金额超目标3倍多,融资提前关闭,同时G轮(Pre-IPO轮)提前开启,投前估值升至500亿美元。Kimi凭借长上下文处理等实用性能获市场认可,本轮超大规模融资反映出资本市场对其技术实力与增长潜力的高度追捧。
TaiXu-Admin V0.1.2 将大模型对话、检索增强生成(RAG)与智能体协同整合至同一后台。更新重点:新增 LLM Wiki 解析与搜索,强化文档处理;引入热编译替换机制,代码改动无需重启即可生效。该项目正试图理顺分散的大模型能力,构建统一的应用管理框架。
月之暗面将Kimi K3完整模型权重上传至Hugging Face,技术报告同步公开。该模型总参数2.8万亿、激活1040亿,支持100万token上下文,成为全球首个3万亿参数级开放权重模型。自7月16日API首发后仅11天,K3在Artificial Analysis智能指数中以57分位列全球第三,仅次于Claude Fable5和GPT-5.6 Sol。