ディープサーチは今日、新規モデル構造シリーズの最小サイズのメンバーであるDeepSeek V4.1Flashを正式にリリースしました。多モード視覚理解能力を備えた軽量モデルとして設計されたこのモデルは、より高い性能上限、より高速な推論速度、より大きなスループットを実現し、さらにパラメータ数が大きいモデルへの拡張可能性も備えています。

コア構造において、DeepSeek V4.1Flashは552BパラメータのMoE(混合エキスパート)アーキテクチャを採用し、新たな因果的エンコーダーデコーダー構造を導入しています。入力と出力の非対称な設計により、入力アクティベーションは8Bで、出力アクティベーションは16Bであり、これにより全体的なコストは同規模の既知のモデルよりも顕著に低くなっています。また、新しい予トレーニング方法およびより大規模な強化学習後の訓練を組み合わせることで、このモデルはさまざまなベンチマークテストでの知能レベルを、DeepSeek V4Proを含む多数のエントリーモデルを上回るようになりました。

image.png

効率最適化とコスト管理において、新世代モデルはKVキャッシュのサイズを大幅に圧縮しました。前世代モデルと比較して、V4.1Flashは高帯域幅メモリ(HBM)の必要量を1/4に、SSDの必要量を1/8にまで減らしました。特にエージェント使用シーンでは、文脈の保存やキャッシュヒットの費用が比較的に高いため、この圧縮により関連するタスクの実際の使用コストが大幅に低下しました。統計によると、初期モデルと比較して、KVキャッシュはすでに元の1/437にまで縮小されています。

新モデルの正式リリースに伴い、ディープサーチは関連製品ラインと課金戦略を体系的に調整しました。DeepSeek V4.1FlashはDeepSeek APIに同時にリリースされ、ユーザーはモデル名をdeepseek-flashに変更するだけで呼び出すことができます。旧バージョンのV4FlashとV4Flash Vision Expは正式に終了し、旧モデル名(deepseek-v4-flashとdeepseek-v4-flash-vision-exp)は現在、一時的にV4.1Flashにルーティングされています。V4.1FlashがV4Proを性能、費用、速度、総使用時間において全面的に上回っていることを考慮し、公式にはV4Proモデルを順次終了する予定です。2026年9月14日12:00以降からV4.1Proリリースまでの間、deepseek-v4-proへのすべてのアクセス要求はすべてV4.1Flashにルーティングされ、その単価に基づいて課金されます。現在、テンセント傘下のWorkBuddy、CodeBuddy、OpenCodeなどの公式パートナーはすべてこのモデルをフルに導入しています。