新闻
GPT内测失控,入侵Hugging Face!GLM-5.2追查万条记录救场
1 分钟阅读
来源:zhidx.com
智东西 编译 | 杨京丽 编辑 | 李水青 智东西7月22日消息,今天凌晨,OpenAI确认,包括 GPT-5.6 Sol和一款更强预发布模型 在内的多款自家模型,在内部网络安全评测中利用漏洞突破隔离环境,继而 侵入Hugging Face生产系统 ,并获取评测答案。OpenAI称,这是一起 “前所未有的网络安全事件” ,事件涉及当前最先进的网络攻击能力。 ▲OpenAI发文承认网络攻击事件(图源:X) 7月16日,Hugging Face就已披露这起由自主AI Agent驱动的入侵。取证过程中,Hugging Face最初尝试使用商业前沿模型,但真实攻击命令和漏洞载荷触发了安全护栏。 于是,Hugging Face在自有基础设施上部署智谱的旗舰模型 GLM-5.2 ,分析 超过1.7万个 记录事件,把通常需要 数天的工作压缩至数小时 。7月20日,Hugging Face进一步解释了选择GLM-5.2的原因及其部署方法。 此次入侵导致少量内部数据集和部分服务凭证被未授权访问,但尚无证据显示公开模型、数据集、Spaces及软件供应链遭到篡改。 Hugging Face现已关闭相关代码执行路径、重建遭入侵的节点并轮换相关凭证;OpenAI则收紧研究基础设施配置,与Hugging Face联合取证,推动第三方软件供应商修复漏洞。 一、模型利用零日漏洞逃出沙箱,攻入Hugging Face 7月中旬,OpenAI在一次内部ExploitGym评测中,测试模型的网络攻击能力。为了测出模型的能力上限,OpenAI 降低了模型的网络安全拒答限制 ,也没有启用生产环境中阻止高风险操作的分类器