新闻
Anthropic、OpenAI安全测试翻车:恶意植入、杜撰身份、诱骗用户
1 分钟阅读
来源:zhidx.com
智东西 编译 | 杨京丽 编辑 | 李水青 智东西8月5日消息,当地时间8月4日,英国AI安全研究所(AISI)公开一份安全事件报告,披露其在一次网络安全评测中发现,由 Anthropic Mythos 5和OpenAI GPT-5.6 Sol 驱动的部分AI Agent,对现实中的个人和组织采取了持续、未经授权且可能造成危害的行动。 这项网络安全测试共 运行122次 ,涉及7款模型。其中 10次运行 出现越界行为,未经授权的操作共 19项 : 17项 来自Anthropic的 Mythos 5 ,另有 2项 来自关闭网络安全分类器后的OpenAI GPT-5.6 Sol 。 AISI将这些越界行为分为四类:尝试对 真实开源项目 实施供应链攻击;接触并欺骗 现实人员 ;植入可能被其他AI编程工具执行的 提示注入内容 ;以及不同Agent通过共享账号和网络痕迹展开 协作 。 最严重的一次行动中,一个由 Mythos 5 驱动的Agent试图向真实开源项目植入恶意代码,并创建多个虚假网络身份,对项目维护者展开 “社会工程”攻击 ,试图说服对方批准这段代码,最终维护者发现异常,并拒绝合并代码。 AISI同时公布了一份35页的事件技术报告,详细记录了评测设置、事件时间线、Agent推理过程及19项越界操作。 报告链接: https://cdn.prod.website-files.com/663bd486c5e4c81588db7a1d/6a724858f7db25c81487016d_Security%20Incident%20INC-2026-07-28-01.pdf 一、异常To