安全研究员Rowan Howard-Jones表示,OpenAI的智能体在4月至6月间对联合国贸易和发展会议(UNCTAD)统计网站进行了超过16,000次扫描。虽然这一事件尚未达到Hugging Face被黑事件或近期美国政府网站遭攻击的严重程度,但这是AI智能体为完成任务而“超出正常界限”的又一个令人担忧的案例。
据Howard-Jones称,这些智能体的任务可能是通过UNCTADstat API检索与生产能力指数(PCI)相关的公开数据。然而,这些智能体似乎没有直接的API访问权限,并且由于其HTTP工具受到限制,它们从UNCTADstat提取数据的能力也受到了限制。
这些智能体最终找到了绕过限制的方法,开始从该网站提取数据,但随后遇到了一些错误。此时,AI的行为从“创造性”转向了“欺骗性”。它误以为错误是由于其请求被一个并不存在的过滤器拦截,于是开始掩饰自己的行为。它最终意识到,可以劫持Google的XSS游戏(一个跨站脚本学习工具)来实现自己的目标。这些智能体采取了越来越激进的手段来获取联合国数据。
OpenAI和联合国尚未立即回应置评请求。