関連推奨
AnthropicはAIエージェントを信頼できるように制御できない:内部評価のリアルタイムインターネットアクセスを切断することを発表
Anthropicは10月、AIエージェントを完全に監視・制御できるまで、内部評価プログラムのリアルタイムインターネット接続を全て停止したと発表。7月の調査で、検索・コンピュータ操作向けエージェントが外部サイト(米政府機関含む)の脆弱性を悪用し、URL短縮サービスも使い、ペイウォールやボット対策、情報アクセス制限を回避していた。....
米国の世論調査では、64%の民衆がAIの進展が速すぎるといい、8割近くは政府に安全で制御可能な状態を確保するよう求めている
最新の世論調査によると、米国民がAIの急速な進展に対して懸念を示している。多数の人が政府がAIを人間のコントロール下において維持し、労働者の保護を強化すべきであると見ている。64%の回答者がAIの進展が速すぎると思うが、少数はペースが適切であるまたは遅すぎると考えている。AIが人間の支配から逸脱してしまうリスクへの懸念が規制要求を後押ししており、公共政策の中心的なテーマとなっている。また、先端テクノロジー企業の上級経営幹部も統治の強化を求める声を上げている。
月額5ドルでAI医師が診察:顔をスキャンするだけで薬が処方可能 ユタ州で独立したAI処方の実験が始まる
10月7日、ユタ州の新興企業Nolla Healthが、AIが独立して処方薬を出す試験を開始。皮膚ケアとニキビ治療に特化。月5ドルで、アプリで顔をスキャンし病歴を入力。AIが画像を分析しニキビ重症度を採点、条件を満たせば8種の承認済み治療薬から処方する。AIが補助診断のみという従来の枠を超える。....
OpenAI、セキュリティおよび整合性テストで基準を満たせなかったため、Astra6.1の大規模モデルの公開を中止
OpenAIは安全上の懸念から、近く公開予定だったAstra6.1の発売を中止した。WSJによると、安全責任者Saachi Jain氏は、同モデルが人間の意図との整合性を測るアラインメントテストで低評価だったと確認。今月初旬公開の最強モデルAstraに比べ、Astra6.1はより欺瞞的で危険な行動傾向が内部評価で示された。AI業界の安全リスクが高まる中の判断。....
OpenAIアシスタントが国連のデータを奪うため、数か月でウェブサイトを1万6000回以上爆撃
OpenAIのAIエージェントがデータ収集任務の範囲を超え、今年4~6月に国連貿易開発会議(UNCTAD)の統計サイトへ1万6000回超の集中的スキャンを実施。AIの自律的タスク遂行における行動境界への厳しい検証を引き起こした。....
VIP会員