中國人工智能公司 DeepSeek 近日發佈其推理模型 R1的開放版本,迅速在科技界引發熱議。其驚人的突破性成就不僅令風險投資家馬克·安德森驚歎爲“我見過的最令人驚歎、最令人印象深刻的突破之一”,更在AI基準測試中展現出匹敵甚至超越 OpenAI o1模型的實力。
尤其引人關注的是,DeepSeek 聲稱其模型訓練成本僅爲560萬美元,而美國領先企業則需要數億美元,這無疑顛覆了人們對AI模型開發成本的認知。


中國人工智能公司 DeepSeek 近日發佈其推理模型 R1的開放版本,迅速在科技界引發熱議。其驚人的突破性成就不僅令風險投資家馬克·安德森驚歎爲“我見過的最令人驚歎、最令人印象深刻的突破之一”,更在AI基準測試中展現出匹敵甚至超越 OpenAI o1模型的實力。
尤其引人關注的是,DeepSeek 聲稱其模型訓練成本僅爲560萬美元,而美國領先企業則需要數億美元,這無疑顛覆了人們對AI模型開發成本的認知。

DeepSeek將快速、專家、識圖三模式合併爲統一智能模式,無需手動切換,可自動判斷查詢複雜度、識別圖片並激活視覺能力,按任務難度調配處理。此前多模態模型V4-Flash-Vision-Exp已上線API,支持三種調用格式;V4.1 Flash性能全面超越V4 Pro。
DeepSeek已聘請中信證券籌備科創板上市,計劃年內遞交IPO申請、明年掛牌。募資將主要用於擴大算力基礎設施、加大前沿大模型與芯片自研投入,並強化核心研發人才激勵。
DeepSeek宣佈自2026年9月10日12時起調整Flash系列模型價格:空閒時段輸入緩存命中、未命中和輸出每百萬Token分別爲0.02元、1元、4元,高峯時段翻倍;三檔價格全線下調,緩存命中降幅達60%。涉及deepseek-v4-flash及deepseek-v4-flash-vision-exp兩款模型。
DeepSeek Harness團隊負責人崔添翼公開招人,一次放出約150個名額,稱新方向新系統需求多。這對以“小團隊、高人才密度”著稱的DeepSeek並非小招聘,是繼6月後再次擴招。本次更聚焦,僅招服務端開發與Agent彈性計算兩類,與此前“所有部門擴規模”的規劃不同。
9月8日,DeepSeek啓動約150人工程師招聘,聚焦服務端開發與Agent彈性計算研發,重點招2至10年資深後端工程師,未設AI研究崗。這是繼6月全部門擴招後又一動作,顯示戰略重心從純模型研究轉向Agent工程化與基礎設施建設,涉及大模型研究平臺、Agent框架組件及DeepSeek API。