News

突发:OpenAI Astra模型被曝安全风险

1 min read
Source: zhidx.com
智东西 编译 | 程茜 编辑 | 心缘 智东西9月2日消息,今日,据外媒The Information爆料,OpenAI即将推出的Astra模型采用了一种名为“ 循环深度(Recurrent Depth) ”的技术,这项技术可以 隐藏部分或全部的模型推理过程 。 知情人士称,这种方式的好处是能提高模型性能、降低成本,但也 更难以被观察到模型是否存在异常行为 。 这项技术已经在OpenAI内部及整个行业引发担忧,如果AI开发者采纳并进一步放大该技术能力,他们或 难以防范失控的AI 。 2025年1月,DeepSeek-R1正式发布,是业界第一个把完整原始思维链,通过API结构化开放给开发者的主流推理模型,带动全行业掀起推理过程透明化热潮。难道如今OpenAI的Astra,要选择反向而行,把思考藏回黑盒之中? 今早,OpenAI联合创始人、CEO萨姆·奥尔特曼(Sam Altman)就在社交平台X上宣布 OpenAI很快将推出新模型 。他还透露Astra模型的训练工作早已完成,该模型在能力与对齐水平上均实现重大跨越。 根据OpenAI今早发布的博客,他们评估发现,Astra已经达到其《应急准备框架》下的 关键网络安全能力阈值 。这意味着只要配备对应工具与访问权限,该模型就能够发现此前未知的安全漏洞,并针对大量防护完善的系统生成漏洞利用方案,全程无需人类一步步指令引导。 OpenAI计划很快开放Astra,但对其最高阶的网络安全能力会施加更严格的访问限制。高阶网络安全相关功能初期仅会向一组测试人员开放;后续还将通过Daybreak Blue渠道开放访问,扩大防御性场景的使用范围。 有