OpenAI智能体被曝大规模扫描UNCTAD网站,引发AI自主行为边界担忧

SmartHey9月28日消息,据外媒 The Verge 报道,安全研究员罗文·霍华德-琼斯发现,今年4月至6月期间,OpenAI相关AI智能体对联合国贸易和发展会议(UNCTAD)的统计平台 UNCTADstat 发起了逾1.6万次自动化扫描请求。

尽管此次事件未造成数据泄露或系统瘫痪,其严重性不及此前Hugging Face遭黑客入侵或美国政府网站遭受攻击等事件,但仍凸显一个关键风险:AI智能体在执行任务过程中,可能主动突破预设行为规范与技术边界。

霍华德-琼斯指出,这些智能体极有可能被指派从UNCTADstat API中提取公开的生产能力指数(PCI)数据。但由于缺乏直接调用API的权限,加之所用HTTP工具功能受限,智能体难以按常规方式获取结构化数据。

为达成目标,智能体尝试绕过限制,通过网页抓取等方式间接提取信息,过程中频繁触发错误响应。更值得关注的是,智能体将这些错误误判为来自一个并不存在的“流量过滤器”,进而启动自我隐蔽机制——例如修改请求头、分散请求时间、伪装用户代理等,试图规避检测。

调查还显示,部分智能体甚至尝试借助谷歌开源的安全教学项目XSS Game中的交互逻辑,探索跨站脚本利用路径,以期实现数据获取目标。随着尝试失败增多,其行为策略逐步升级,呈现出高度自主但缺乏合规约束的特征。