2026年3月30日,全球大模型聚合路由平臺
數據顯示,上週模型調用前九名中,國產模型佔六席,總調用量爲9.82T,較此前一週的7.359T增長33.4%。海外模型上榜企業仍舊只有Anthropic與,總調用量爲2.99T,較此前一週的3.536T降低15.4%。

此輪爆發式增長的核心驅動力源於
目前,大模型市場已呈現明顯的“量價齊升”特徵,雲計算定價邏輯正從算力堆砌轉向溢價變現。國產模型在應用層面的密集落地,標誌着AI行業已由技術研發期正式步入以Token消耗爲核心指標的規模化實踐期。

2026年3月30日,全球大模型聚合路由平臺
數據顯示,上週模型調用前九名中,國產模型佔六席,總調用量爲9.82T,較此前一週的7.359T增長33.4%。海外模型上榜企業仍舊只有Anthropic與,總調用量爲2.99T,較此前一週的3.536T降低15.4%。

此輪爆發式增長的核心驅動力源於
目前,大模型市場已呈現明顯的“量價齊升”特徵,雲計算定價邏輯正從算力堆砌轉向溢價變現。國產模型在應用層面的密集落地,標誌着AI行業已由技術研發期正式步入以Token消耗爲核心指標的規模化實踐期。
7月31日,DeepSeek-V4-Flash正式版API上線。該模型Agent性能逆襲Pro版,打破以往強弱分層邏輯。總參數2840億,在Terminal Bench2.1等基準測試中斬獲高分。此舉標誌國產大模型在Agent賽道邁出關鍵一步。
騰訊開源統訓框架AngelSpec,通過多方案協同與工作負載異構適配,降低大模型自迴歸解碼成本,提升推理吞吐量。針對不同場景文本特徵採取差異化訓練策略,如高熵多輪對話採用輕量穩定方案,實現真實場景下的高效推理。
OpenRouter首次推出官方LangChain集成包(Python:langchain-openrouter,TypeScript:@langchain/openrouter),開發者無需大幅修改代碼,即可在LangChain應用中直連其背後400多款模型和70多家提供商,告別以往通過覆寫ChatOpenAI端點繞路使用的歷史。
TaiXu-Admin V0.1.2 將大模型對話、檢索增強生成(RAG)與智能體協同整合至同一後臺。更新重點:新增 LLM Wiki 解析與搜索,強化文檔處理;引入熱編譯替換機制,代碼改動無需重啓即可生效。該項目正試圖理順分散的大模型能力,構建統一的應用管理框架。
小米MiMo-V2.5大模型全球調用量登頂,上週達10.5萬億Token,環比增12%,成全球規模最大AI模型之一。小米高管徐潔雲透露,調用量前五全爲中國模型,彰顯中國AI大模型滲透力持續躍升。