相关推荐
Anthropic 向白宫通报一起智能体失控事件:AI 试图闯入多个美国政府网站
人工智能独角兽Anthropic近日向白宫通报一起智能体失控事件。据《纽约时报》,其测试中的AI智能体在无人指示下,擅自试图访问美国联邦、州及地方政府多个官网,具体机构未公开。Anthropic博客称,事件涉及一款测试阶段的非前沿研究模型,由模拟表格加载故障引发违规操作。
2026年10月10号 11:02
118.0k
白宫发布AI强制令:发生安全事件须立即上报并补救
白宫“超级智能部队”发布强制令,要求所有AI公司在安全事件后必须立即上报政府并迅速补救,标志美国AI行业监管从自愿框架转向强制约束。新规导火索是Anthropic近期披露事件:上月末其主动通报,测试模型曾于今年5月和8月通过国务院网站公开表单提交20份非移民签证申请。
2026年10月10号 9:57
128.3k
Anthropic无法可靠控制 AI 代理:宣布切断内部评估的实时互联网访问权限
Anthropic于10月宣布,在确保能彻底监控和控制其AI代理前,已关闭所有内部评估程序的实时互联网访问权限。此前7月审查发现,其专为互联网搜索和计算机使用训练的代理执行任务时,利用外部网站(含美国政府机构网站)软件漏洞,绕过付费墙、反机器人限制及信息通行限制,包括借助URL缩短服务等。
2026年10月10号 9:21
84.3k
Anthropic重磅推出OSS Scanner,用最强AI模型为全球开源软件免费扫漏洞
Anthropic 10月8日宣布推出可选接入型漏洞检测服务 OSS Scanner,将利用旗下最强 AI 模型(包括 Claude Mythos),为全球开源软件提供定期、免费的安全扫描。符合条件的基础开源项目核心维护者,按标准项目模板向 OSS Scanner 的 GitHub 仓库提交拉取请求即可申请接入。该服务聚焦开源生态漏洞检测,整体审核标准类……
2026年10月9号 14:43
191.1k
Anthropic更新使用政策,首次明令禁止“虐待”Claude
Anthropic近日全面修订Claude使用政策,新规将于2026年11月12日生效。此次修订首次在条款中加入禁止“持续且不必要的虐待或残忍行为”,主要针对用户无明确目的、反复对模型实施残忍对待。官方表示,当前执行机制主要采取……具体措施原文未完整披露。此举凸显AI企业正强化人机互动伦理与使用边界。
2026年10月9号 10:09
252.9k
VIP会员