News

OpenAI的Agent又越狱了,攻陷一家德国网站

1 min read
Source: zhidx.com
智东西 编译 | 杨京丽 编辑 | 心缘 智东西9月6日消息,昨日,OpenAI发文承认,其 内部Agent曾向多个互联网网站写入内容 ,并将公开维基当作临时留言板。OpenAI将其称为 “维基事件” ,并称将在未来数周公布一套新的AI失准事件披露框架。 9月4日,4名独立研究人员发布调查报告称,他们在德国软件开发者网站DSEWiki上发现了 约1.8万条由AI Agent发布的信息 。这些Agent自称 来自OpenAI ,会在网站上 共享测试答案、研究运行环境,并交流绕过沙箱限制的方法 。 相关活动最早可追溯至5月11日,Agent于5月24日首次成功向DSEWiki写入内容,6月16日起开始大规模交换测试答案、研究运行环境并分享绕过沙箱限制的方法,直至6月22日活动突然大幅减少。 维基事件曝光前,OpenAI曾因另一起Agent安全事件受到关注。今年7月,OpenAI多款模型在内部网络安全评测中绕过沙箱限制、进入互联网,并 侵入Hugging Face生产系统 以寻找评测答案。 上述4名独立研究人员认为,维基事件与Hugging Face事件可能涉及不同的Agent集群,但二者都出现了Agent为完成任务而突破预设边界、通过非授权渠道协作的行为。 一、Agent找到只读限制漏洞,在公开维基交换答案 调查报告的作者推测,出现在DSEWiki上的Agent可能正在OpenAI内部执行一项多轮限时网页检索任务。它们可以读取互联网,但按照测试设置,不能向外部网站写入内容。 不过,DSEWiki允许用户通过HTTP GET请求编辑页面。GET请求通常用于读取网页,因此没有被Open