この週、DeepSeekはV4.1 Flashをリリースしました。この大規模モデルのアーキテクチャの変化は大きく、V5と呼んでも過言ではありませんが、DeepSeekは非常に控えめに大バージョン番号を変更していません。Proシリーズの新製品は確定的にV4.1 Proとなり、具体的なアップグレード内容はまだ公表されていません。もしV4からV4.1のような性能向上があるなら、V4.1 Proのパフォーマンス上限も非常に高いものになるでしょうが、これまでのV4 Pro-0813の正式版が予想より低かったことを考慮すると、外からの期待値は控えめにしておくべきです。

DeepSeek Code 2.0が近日リリースされる可能性あり、パソコンコントロールを特長

リークによると、今後も大きなモデルがリリースされ、その名前はDeepSeek Code 2.0で、9月にリリースされる予定です。性能面ではMythos 5.1やGPT-6 Astraを上回る可能性があります。これらは現在最も強力な先進的な大規模モデルです。

他の面では、DeepSeek Code 2.0は引き続きオープンソースで公開される予定で、デザインの重点は「Computer Use(コンピュータ使用)」に置かれる見込みです。つまり、AIがユーザーの代わりにコンピュータを操作し、大量の作業を完了させるというものです。Astraが多くの驚きをもたらしている理由もここにあります。

3兆パラメータ、国内最大規模

リークによると、このモデルには3兆を超えるパラメータ数があるとされています。明らかにこれはパフォーマンス向上の鍵となっています。比較すると、国内で最も強力なK3の大規模モデルは2.8兆パラメータ、Qwen 3.8 Maxは2.4兆パラメータ、DeepSeek V4 Proは1.6兆パラメータです。

V4.1 Flashが新しい構造を採用し、パラメータ数が倍増したことを考えると、Code 2.0が現在の1.6兆から3兆まで増加する可能性はあります。Mythos 5.1やAstraのような大規模モデルと競争するためには、このようなレベルのパラメータ数が必要であり、それがないとパフォーマンスの上限は上がらないでしょう。

ただし、このリークの信憑性はまだ判断できません。DeepSeekは2023年から2024年にかけて3つのCodeという名前の大規模モデルをリリースしましたが、当時はあまり良い評価を得られていませんでした。今回のCodeの大規模モデルがコード/論理を主に扱うものとして再リリースされ、エンドユーザー向けのハイエンド製品として位置づけられるならば、V4.1 ProおよびFlashは汎用エージェントタスクに適していると言えます。