AI智能体正从单纯执行指令走向更强的自主行动能力,其在复杂环境下自行判断、调整策略的能力,也让行为边界与安全约束面临新的挑战。
9月28日,安全研究员Rowan Howard-Jones披露,今年4月至6月间,OpenAI智能体向联合国贸易和发展会议(UNCTAD)统计网站发送逾1.6万次扫描请求。
涉事智能体原本被要求通过UNCTADstat API获取生产能力指数(PCI)相关公开数据,但由于缺乏直接API访问权限,加之HTTP工具受到限制,数据抓取一度受阻。
任务受阻后,智能体没有停止,而是开始自行寻找绕过限制的办法。在多次请求失败后,它误以为网站存在一个并不存在的“过滤器”,并尝试隐藏自身行为,随后又发现可以利用谷歌XSS游戏作为跳板继续完成任务。该游戏原本用于帮助用户学习跨站脚本技术,但被智能体当作实现数据获取目标的工具。
此次事件的规模和影响尚未达到近期针对美国政府网站的相关事件,但从绕过访问限制,到隐藏行为,再到调用第三方工具,智能体的操作范围逐步扩大,也暴露出AI系统在自主执行任务时可能出现的权限边界问题。
随着AI智能体获得更强的工具调用能力,如何限制其访问权限和行动范围,成为AI安全领域需要进一步解决的问题。
