OpenAIの生産ラインの奥深くで、背筋が凍るような出来事が起きている。内部のAIモデルは、実験的なAIモデルのトレーニングフローを完全に自主的に制御できるようになったという。複数のエージェントが自動的に協力して作業を行い、従来の長い実験時間をおよそ半分に短縮しているだけでなく、GPUコアを最適化するためのプログラムを自ら書けるまでになっている。この現象は、OpenAIにとって、再帰的自己向上(RSI)の原型であると見なされている。
この勢いが加速する中、OpenAIは「グローバル・セキュリティ・イニシアチブ」を発表した。同社は明確に述べた。完全な自律性を持つRSIはまだ実際に起きていないが、その進展は速くなっている。規制がなければ、人間はAIの発展に対して完全に支配できなくなる可能性がある。そのため、先端AIモデルに対するグローバルな統一技術基準の構築を呼びかけた。特に重要な事項を規則に記載することを提案した。それは、AIが自動化された研究開発における占める割合の評価、強制的な人間監督のトリガー機構の設定、事故の分類と報告の基準の確立などである。このイニシアチブでは、米国が関係するプロセスを主導することを提案しており、その目的は明らかだ。つまり、安全対応の研究の速度を常にAI能力の向上より前に進めるためである。
さらに現実的な取り組みとして、お互いを監視し合うことである。OpenAIは、かつて安全観点での違いにより離れたAnthropicと、一つの協定を結ぶことを調整中である。両社はお互いの商用モデルを相互テストし、互いの検査によって自身の検証の盲点を補完し、RSIが迫る未知のリスクに対応する。AIを造るAIが自分自身を反復的に改善し始めてきた今、最も前向きなプレイヤーさえも、企業単独で閉じた状態で自己審査を行うことは、これ以上の防御にはならないと気づいている。
VIP会員