7月31日、DeepSeek-V4-Flash APIの公式バージョンが公開ベータテストを開始し、この国内大規模モデル企業にとってエージェント分野での重要な一歩を示しています。以前の「プロは強力で、フラッシュは弱い」という階層論理とは異なり、今回のアップデート後、公式版のフラッシュは、いくつかのエージェントベンチマークテストにおいて、3か月前にリリースされたV4-Proのプレビュー版に近づいたり、甚至上回るようになりました。

公式データによると、V4-Flashの公式版はTerminal Bench 2.1で82.7、Cybergymで76.7、Toolathlonで70.3を記録しました。特に注目すべきは、このモデルが2840億パラメータを持ち、そのうち130億パラメータのみがアクティブ化されている点です。これは、V4-Pro(アクティブ化490億)と比べてほぼ1桁少ないものです。DeepSeekはこのアップデートが「再トレーニングのみ」だったと明確に述べており、モデル構造は完全に変わっていません。これは、トレーニング方法とデータ品質の最適化を通じて、軽量モデルが特定のタスクにおいてフラッグシップモデルとのギャップを縮めていることを意味します。

DeepSeek

このアップデートのもう一つの特徴は、DeepSeekが自社開発したエージェントフレームワーク「DeepSeek Harness」の初めての公式公開です。同時に、V4-FlashはOpenAIが推進するResponses API形式をネイティブにサポートしており、Codexに対して特別な調整が行われています。開発者は低コストでOpenAIエコシステムのエージェントアプリケーションをDeepSeekプラットフォームに移行できます。

戦略的な意図は明らかです:高コストパフォーマンスを持つ軽量モデルを使ってエージェントアプリケーション市場に参入することです。エージェントシナリオではインファレンス速度とコストに非常に敏感であり、Flashの価格優位性は繰り返しツールを呼び出すマルチターンタスクにおいて大きな競争優位性になります。

このリリースは、DeepSeekが500億元を超える資金調達を完了してからわずか2か月以内に起こりました。会社の評価額は約710億ドルに上昇しました。資金支援により、DeepSeekは「資金なし、上場なし」から商業化への加速を遂げています。プロの公式版が間もなくリリースされる中、エージェント戦争の幕はすでに上がっています。