DeepSeekオープンソースウィーク初日:大規模モデル加速ツールFlashMLAのデコーディング性能が3000GB/sに達する


百度基盤モデル研究開発部(BMU)が人材配置を加速。北米Frontier Lab研究員の武欽氏を迎え文心大モデルの事前学習を強化、元DeepSeek研究員の魏浩然氏が文心マルチモーダルアルゴリズム責任者に就任。7月着任の孫天祥氏による文心大モデル升級推進の最中。....
DeepSeekは2回目の資金調達を進めている。2026年1~7月の売上は約4.75億元で2025年通年の10倍、純損失は9.35億から7.15億元に縮小。オープンソースモデルが高利益率を生み、急成長しIPO準備へ。6月に初回500億元調達後、2回目も500億元を計画。....
テンセントの新世代の大モデルHy4の内部テスト画面がリークされ、発表が目前に迫っている。画面にはテンセントが自社開発とオープンソースの両方の戦略を継続していることが示されており、3つの選択肢が提示されている:エキスパート向けの大モデルHy4、ほとんどのシナリオに適したアップグレードされたHy3、推論と理解に特化したDeepSeek。Hy4は今回のアップグレードの焦点となっている。
深度求索公司が「DeepSeek Harnessチーム」のWeChat公式アカウントを登録。Harness事業ライン初の独立公式発表チャネル開設で、製品正式リリースの明確なシグナルとみられる。Harnessは大規模モデルを実際に駆動する中核エンジニアリングシステムで、ツール呼び出しやタスク計画・実行スケジューリングを提供し、エージェント開発に不可欠な基盤である。....
最近、有名な投資家である段永平はソーシャルメディアでユーザーの質問に応じ、明確に大規模モデルへの投資をしていないことを表明し、師弟である梁文峰の成功を願った。段永平と梁文峰はともに浙江大学の同窓生であり、彼はこれまでに何度も梁文峰を称賛し、AI時代には株式投資も勝てない」と語ったことがある。