世界中のAI関係者がKimi K3の注目を集めている中、中国国内の大規模モデル開発企業であるDeepSeekから新たな動向が明らかにされた。最近、DeepSeek V4正式版のテスト動画と実機デモがSNSで突然公開され、複数の情報によるとこのモデルは来週月曜日(7月下旬の最初の月曜日)に最も早くリリースされる見込みで、タイミング的にK3の話題が落ち着いた後に重なっているため、業界内で大きな注目を浴びている。

DeepSeek

漏れ出したテスト情報や海外ブロガーからのフィードバックによると、DeepSeek V4正式版はいくつかの重要な指標において驚くべき性能を示している。実際のテストではClaude Opus4.8の水準に達したと初步的に確認されており、特に3D方向での生成能力ではOpus4.8を大きく上回っている。エージェント(Agent)の行動表現やコードの安定性にも顕著な改善が見られる。一部の過激な意見では、特定のテスト(例:ゲームコード生成)においてV4正式版はFable5やGPT-5.6を凌駕しているともされている。あるブロガーが紹介した「サメゲーム」のミニゲームコードテストでは、V4が3000行のコードを生成するコストがわずか0.12ドルにとどまり、その信じられないほどのコストパフォーマンスの優位性を示している。

V4はハードウェア的な性能向上に加え、インタラクティブな体験でも微調整が行われた。テスト者によると、その思考プロセス(CoT)スタイルがClaudeに近づき、コードの壁を積み上げるようなことはせず、「コア機能の記述」「主要シーンのコードの記述」などの要約的なステップで示されるようになったため、読みやすさが大幅に向上している。分析家の中には、V4がFableのコードスタイルを抽出し、より簡潔な出力が可能になったと考える人もいる。

DeepSeekの過去の展開を見れば、同社は「黙って働くこと」「価格戦略」という戦略で突破してきた。もしV4が現在の主流モデルのレベルに、1桁低い価格で近づけるのであれば、V3に続く「DeepSeekの時代2.0」を引き起こす可能性があるだろう。現時点では公式側が7月中旬のリリースを予告しており、今週の月曜日のスケジュールは予定通りである。最終的な日程は公式発表を待つ必要がある。