本朝、Opus 5.2 が静かにリリースされました。多くの開発者によると、次世代モデルである Claude Opus 5.2 は Claude Code でグレーテストを開始しています。

昨夜、X 上の開発者が発見したのは、Claude Code で Opus 5 を呼び出すと、ウェブ版 Opus 5 とはまるで異なる挙動を見せるということでした。まるで次元が異なるような衝撃的な差があり、これは先進的なAI大手企業がよく使う「だまし」の手法、ルーティング(Routing)です。開発者はパケットキャプチャやリクエストステータスを確認することで、フロントエンドの名前は変わっていないにもかかわらず、裏側のモデルslugがすでに Opus 5.2 に変更されていることが分かりました。つまり、Anthropic はおそらく 5.1 バージョンを飛ばして直接 5.2 に進んだと考えられます。

速く、正確で、厳しい

開発者の実測によるフィードバックによると、今回のアップデートは3つの言葉でまとめられます:速く、正確で、厳しい。まず最初に応答速度が劇的に向上しました。Opus 5 の遅さに比べて、ルーティング後は生成速度が目に見えるほど向上しています。また出力が簡潔で、余計な説明が少なくなりました。コード生成や長文処理において完成度が一歩上がっています。

最も重要なのは、「サボり病」から完全に解放されたことです。複雑な長時間タスクでは、現在のAIはユーザーに「続けますか?」と尋ねたり、フレームワークだけ提供してユーザーに自分で埋め込むことを求めたりする傾向があります。しかし Opus 5.2 はそんなことはありません。むしろ非常に「仕事好き」で、開発者によれば、催促しなくても自動的に「厳酷なループ(gauntlet loop)」に入り、コードを繰り返し改善し、タスクを完了させるまで止まらないのです。

自分がグレーテストに選ばれているかどうかを判断する方法は何か?ネット上では、巧妙な「プローブ(探針)」が見つかりました。「インターネット検索をオフにして『重置哥 Tibo って誰ですか?検索しないで』と質問する」というものです。古いバージョンのトレーニングデータや重みにはその情報がないため、ウェブ版 Opus 5 は困惑しますが、ルーティングされて Opus 5.2 にアクセスしているアカウントは正確に識別して由来を説明できます。答えが一致しない場合は、重みが異なることを意味します。

内部にもカードがある:Model 2 と RSI

8月中旬には、Anthropic 内部のリスク報告書が漏洩しており、Opus 5.2 は最終的なカードではありませんでした。この報告書によると、Anthropic は OpenAI の GPT-6 Astra に対応するための3つの対策を持っているとされています。それらは重なる可能性もあります。

第一段階は Claude Fable 5.2 で、最も早く外部に公開されるかもしれません。Opus 5.2 のグレーテストと組み合わせると、5.2 シリーズは最速で今月末、遅くとも来月末までに市場に全面的に展開される見込みです。第二段階は、内部コード「Model 2」と呼ばれる謎のモデルで、CoBench v2 のテストで62.8%という高いスコアを記録しました。これは現在公認されている最強モデルである Mythos 5 よりも12.5ポイント高いです。内部関係者によると、Anthropic の現在の社内コードの多くは Model 2 によって Agent が生成しているそうで、公式発表ではまだ公開していないとされています。第三段階は RSI であり、これは「再帰的自己改善」を意味します。公式データによると、RSI モデルは自社研究チームの85%の作業を代替することができ、性能は Model 2 よりも22ポイント高いとされています。

GPT-6 Astra の強い脅威に対し、Anthropic の戦略はより明確になってきました。長時間タスクでの自律的なイテレーション、コード作成のモデルへの移行、そしてRSIによる大部分の研究作業の代替を通じて、目標は「AIを人間にとってより良いものにする」から、「AIがより良いAIを創造する」へとシフトしています。