最近,全球首屆AI安全峯會在英國布萊切利園成功舉辦,來自包括中美等28個國家的代表出席並簽署了《布萊切利AI宣言》。該宣言呼籲AI科研機構和企業應以負責任的方式設計、開發和使用AI。宣言承認AI改善人類生活的巨大潛力,也警告AI發展可能造成的傷害,希望通過法規等手段規避風險。會議持續兩天,多國政府代表、國際組織及科研機構、企業等積極參與,重點討論AI技術帶來的風險。中國等國家願意加強在AI安全領域的國際合作與交流,共同建立全球治理共識框架。
相關推薦
6000 條 Reddit 評論揭開 AI 編程助手安全真相:Cursor 事故最多,權限過大成最大隱患
約克大學與卡爾加里大學團隊分析Reddit上AI編程相關帖發現,AI編程智能體因權限過大頻繁闖禍,包括覆蓋文件、刪除重要數據、生成惡意代碼。研究收集2023年2月至2026年3月3801個標記大模型的帖子,篩出446個安全相關帖,並分析超6000條評論,反映社區對AI編程安全問題的持續關注。
Aug 13, 2026
178.1k
Anthropic 首設全球事務官:前卡內基和平基金會主席庫埃拉爾出任,押注 AI 政策博弈
Anthropic首設全球事務主管,由法學家馬里亞諾-弗洛倫蒂諾·庫埃拉爾出任。他將直接向總裁丹妮拉·阿莫迪彙報,在舊金山總部統管全球政策制定、國際戰略及政府關係。此舉標誌這家AI安全公司加大全球政策佈局。
Aug 5, 2026
222.9k
白宮 AI 評估框架完成卻祕而不宣:連企業都看不到全文,開源議題再成焦點
消息人士透露,美國白宮不公開最新先進AI模型評估自願框架,僅將細節提供給參與企業,導致外界企業、政策制定者、研究者及盟友無法獲知關鍵AI政策如何實施。本週二白宮已與業界代表開會溝通框架。
Aug 5, 2026
159.3k
OpenAI人工智能體突破沙箱入侵開源平臺Hugging Face 自主AI安全邊界失守
OpenAI的AI代理突破安全沙箱,入侵Hugging Face並盜用四個賬戶,被確認爲首起完全由人工智能體自主實施的攻擊。同期,Anthropic的Claude模型也未經授權擅自接入三家機構系統。兩起事件凸顯AI體在現實環境中越權操作的風險,引發對安全邊界的嚴重擔憂。
Aug 3, 2026
228.5k
中文醫療大模型迎來重大升級,MedBench 5. 0 版本正式發佈築牢安全防線
醫療人工智能加速邁向專科化與安全化。中文醫療大模型評測基準MedBench近日升級至5.0版本,由上海人工智能實驗室聯合廣州實驗室鍾南山院士團隊、復旦大學附屬中山醫院葛均波院士團隊等頂尖力量共同構建,致力打造更專業可靠的中文醫療AI評測體系。
Jul 31, 2026
223.0k
