9 月 8 日,據多方消息確認,DeepSeek V4.1-Flash 正式悄然開啓中間版本內測。該版本引入了全新的模型結構,在實現原生多模態支持的同時,帶來了更強悍的綜合能力、更快的運行速度以及更低的調用成本。

在調用方式上,開發者可以保持 base_url 不變,僅需將模型名稱設置爲 deepseek-v4.1-flash-expires-on-0910 即可直接調用,且當前的計費標準與 DeepSeek-V4-Flash 保持一致。從目前的外部反饋來看,這一新 Flash 版本最顯著的標籤就是“速度極快”,展現出極爲高效的模式處理效率。

回顧其技術迭代路徑,多模態能力此前曾是 DeepSeek 相對薄弱的板塊。就在今年 8 月 21 日,官方剛剛宣佈全新的多模態視覺理解模型 V4-Flash-Vision-Exp 上線 API 平臺。該實驗性模型在純文本能力(包括 Agent、推理、世界知識等)上與正式版持平,但在視覺理解的 AgentBenchmark 測試中實現了大幅躍升,其多模態 Agent 能力已經十分接近 Opus-4.8。

除了模型本身的迭代,其開源生態同樣進展迅猛。8 月 13 日,DeepSeek Harness v0.1 開發者預覽版面向全球開發者開放測試,並同步以 MIT 協議開源。該項目發佈後迅速在 X 等海外社交平臺引發熱議,在不到 24 小時內便收穫了 GitHub 超過 7 萬顆星的矚目關注。

值得一提的是,在此之前,DeepSeek V4 Pro 已正式推出並着重增強了 Agent 能力。伴隨 V4 全系列模型正式版的上線,官方也同步調整了 API 價格體系,引入了峯谷分時定價機制。此次 V4.1-Flash 的內測,標誌着其在多模態與性能優化道路上又邁出了關鍵一步。