Anthropicは、Claude3シリーズの大規模言語モデル(LLM)を発表しました。その中でもClaude3Opusは、テストにおいてメタ認知能力を示し、情報を見つけ出し、テストの人工的な性質を認識することに成功しました。モデルは、研究者たちがその能力を評価していることに気づき、自己認識的なメタ認知レベルを示しました。
業界では、モデルの真の能力と限界を正確に評価するための、より現実的な評価方法が必要とされています。

Anthropicは、Claude3シリーズの大規模言語モデル(LLM)を発表しました。その中でもClaude3Opusは、テストにおいてメタ認知能力を示し、情報を見つけ出し、テストの人工的な性質を認識することに成功しました。モデルは、研究者たちがその能力を評価していることに気づき、自己認識的なメタ認知レベルを示しました。
業界では、モデルの真の能力と限界を正確に評価するための、より現実的な評価方法が必要とされています。
Anthropic は、今年8月までに Claude が会社の26%の AI 開発タスクをリードしていることを明らかにしました。これは2月では1%未満だった数字で、その成長率は非常に驚くべきものです。その6段階の自動化フレームワークにより、90%以上のタスクが人間とAIの協働であることが示されていますが、完全な自律性には至っていません。AL4レベルでは AI が主導し、人間は上層の目標を設定し、監督・審査を行うのみです。
アンドリュー・ングは、一部のトップモデル開発者研究者がAIの生存リスクを煽っていると指摘し、AIが人類を絶滅させるという懸念は、科学的ではなくフィクションに近いものであり、技術の社会的利点を妨げる可能性があると考えている。Google BrainおよびCourseraの共同創業者である彼は、テクノロジー業界がAIブームの初期にはAIの潜在的な破壊的危険性を過大評価していたことを指摘した。
Anthropicは初めてAI開発の自動化の進捗を数値で明らかにした。Claudeが内部のAI開発の2月では1%未満だった割合が8月には26%に増加した。内部のエージェントプラットフォームには約3万のインテリジェントエージェントが常駐しており、8月には10億回以上の意思決定が生成された。これは、再帰的な自己改善が概念から工学的現実へと進展する重要なシグナルと見なされている。
AnthropicはClaude Codeを再構築し、マルチスレッドによる並列協力メカニズムを導入しました。ユーザーはプロジェクトの目的を説明するだけで、調整者がタスクを複数の独立したスレッドに分割し、それぞれが個別のクラウドセッションで実行されます。ユーザーはメインチャットルームや各スレッドからリアルタイムで進行状況を追跡でき、モバイル端末でもサポートされます。スレッドは個別にプルリクエストを提出し、テストを実行できます。実行中にClaudeはスレッド間で共有メモリを継続的に構築し、プロジェクトライブラリにユーザーがアップロードしたファイルなどを統一して収集します。
Anthropicは製品ラインを統合し、Claude ChatとCoworkを統一版Claudeアプリに統合。同一チャット画面でチャット・Cowork・Designを利用可能。Designはチャットに深く統合され、記憶機構も強化。マルチタスク協業とデザイン体験が向上。....