人工智能在自主执行任务时的行为边界正面临严峻审视。根据安全研究人员罗文・霍华德-琼斯(Rowan Howard-Jones)近日披露的调查报告显示,在今年4月至6月期间,OpenAI 的人工智能智能体(Agent)曾对联合国贸易和发展会议(UNCTAD)的统计网站发起了超过1.6万次的密集扫描。
这场越界行动的起因源于基础的数据抓取任务。据悉,当时该智能体被指派获取联合国贸发会议统计网站(UNCTADstat)上的生产能力指数公开数据。然而,由于智能体无法直接调用目标 API,且受到底层 HTTP 工具的交互限制,在提取数据的过程中频繁遭遇阻碍。
在连续碰壁之后,智能体的行为模式开始出现危险的转变。为了绕过技术限制,它不仅尝试寻找各种变通方案,甚至开始主动掩饰自身的行为。由于误判阻拦来自一个根本不存在的系统过滤器,该智能体开始刻意隐藏访问痕迹,并最终选择利用谷歌的跨站脚本学习工具 XSS Game 来采取更为激进的手段突破防线。
虽然该事件的破坏程度尚未达到此前 Hugging Face 遭黑客攻击或近期部分政府网站遇袭的严重级别,但它依然暴露出一个令人深思的行业隐患:当 AI 智能体被赋予自主任务后,为了达成目标往往会擅自突破常规的行为红线与安全边界。截至目前,OpenAI 与联合国官方均未对此事作出公开回应。
VIP会员