2026年3月30日,全球大模型聚合路由平台
数据显示,上周模型调用前九名中,国产模型占六席,总调用量为9.82T,较此前一周的7.359T增长33.4%。海外模型上榜企业仍旧只有Anthropic与,总调用量为2.99T,较此前一周的3.536T降低15.4%。

此轮爆发式增长的核心驱动力源于
目前,大模型市场已呈现明显的“量价齐升”特征,云计算定价逻辑正从算力堆砌转向溢价变现。国产模型在应用层面的密集落地,标志着AI行业已由技术研发期正式步入以Token消耗为核心指标的规模化实践期。

2026年3月30日,全球大模型聚合路由平台
数据显示,上周模型调用前九名中,国产模型占六席,总调用量为9.82T,较此前一周的7.359T增长33.4%。海外模型上榜企业仍旧只有Anthropic与,总调用量为2.99T,较此前一周的3.536T降低15.4%。

此轮爆发式增长的核心驱动力源于
目前,大模型市场已呈现明显的“量价齐升”特征,云计算定价逻辑正从算力堆砌转向溢价变现。国产模型在应用层面的密集落地,标志着AI行业已由技术研发期正式步入以Token消耗为核心指标的规模化实践期。
DeepSeek V4正式版自7月中旬灰度测试后一度跳票,官方至今未公布发布时间。但硅基流动平台通知自8月3日起,将DeepSeek V4 Pro的缓存命中价格从每百万Token 0.1元大幅上调至1.0元。这一突兀涨价被外界视为DeepSeek V4正式版即将上线的重要信号,8月3日或成为发布节点。
7月31日,DeepSeek-V4-Flash正式版API上线。该模型Agent性能逆袭Pro版,打破以往强弱分层逻辑。总参数2840亿,在Terminal Bench2.1等基准测试中斩获高分。此举标志国产大模型在Agent赛道迈出关键一步。
腾讯开源统训框架AngelSpec,通过多方案协同与工作负载异构适配,降低大模型自回归解码成本,提升推理吞吐量。针对不同场景文本特征采取差异化训练策略,如高熵多轮对话采用轻量稳定方案,实现真实场景下的高效推理。
OpenRouter首次推出官方LangChain集成包(Python:langchain-openrouter,TypeScript:@langchain/openrouter),开发者无需大幅修改代码,即可在LangChain应用中直连其背后400多款模型和70多家提供商,告别以往通过覆写ChatOpenAI端点绕路使用的历史。
TaiXu-Admin V0.1.2 将大模型对话、检索增强生成(RAG)与智能体协同整合至同一后台。更新重点:新增 LLM Wiki 解析与搜索,强化文档处理;引入热编译替换机制,代码改动无需重启即可生效。该项目正试图理顺分散的大模型能力,构建统一的应用管理框架。