この数日、Anthropic と OpenAI はそれぞれ Fable 5.1 と GPT-6 Astra を発表しましたが、前者はすぐに存在感を失い、Astra は引き続き話題となり、注目度が衰えません。一部の見解では、Fable 5.1 は価格が高く、制限が多く、顧客に不満を抱かせたとされています。一方で、Astra はコード生成性能においてやや劣るものの、全体的な能力が優れ、トークン効率が高く、総合的なコストは逆に低下しています。また、さまざまな分野での応用も広がっており、ユーザーはその力を活かして既存の業務スタイルを変える試みを進めています。
梁文锋:ビデオや世界モデルではなく、LLMに集中することが主軸
Astra の今回の爆発的成長は、日本のJAIST大学の客員教授である今井翔太にも感嘆を誘いました。彼が切り口として挙げたのは、DeepSeekの創業者である梁文锋さんが数か月前に漏洩した社内スピーチの中で述べた一言でした。
DeepSeekはこれまでマルチモーダルへの対応が不完全だったのは、梁文锋さんの考えに起因しています。彼は、ビデオ生成AIや世界モデル、物理モデルはAGIの主軸ではないと考えており、現在はLLM大規模モデルの開発に集中すべきだと述べました。その後、他の問題を解決するためには大規模モデルを使うことになるだろうと語っています。今井翔太は、Astraが示した全般的な能力を見て、梁文锋さんのこの発言の説得力がますます強まっていると感じています。
梁文锋さんの見解によれば、DeepSeekの真の核心目標はAGIであり、他のことはそれほど難しくないと考えています。より高い技術目標に基づいて下位の技術応用を行うことで、多くの場合、次元を下げて打つような効果が得られます。彼は同時に、DeepSeekはこれらのAI分野に主な精力を傾けるつもりはないとも述べました。これはこれらの分野に価値がないという意味ではなく、AGIにとっての重要なブレーキではないからです。
OpenAIの戦略調整が功を奏し、国内の大規模モデルは次の世代を見据えるべき
OpenAIは以前、Anthropicや中国のオープンソース大規模モデルとの競争によって戦略を調整し、ビデオ生成モデルを放棄し、AIのコア能力、特にコード生成などに注力しました。この改革は今となっては非常に成功しており、GPT-5.5および現在のGPT-6のリリース後、OpenAIは再び頂点に戻りました。このAstraのリリースにより、OpenAIはAGI時代の始まりを宣言し、NVIDIA CEOの黄仁勲氏も賛同しており、自社のGPUがAstraの訓練に使われたことを指摘し、次回は40万枚のGPUを使用すると述べました。
VIP会員