新闻
突发!OpenAI下一代模型Astra项目生变
1 分钟阅读
来源:zhidx.com
智东西 编译 | 杨京丽 编辑 | 李水青 智东西8月19日消息,今天凌晨,OpenAI发布公告称,公司暂时 放慢包括Astra在内前沿模型的研发节奏 ,大量Astra训练和评估任务仍处于暂停状态。 OpenAI曾将面向部署的最新模型 强化学习(RL)训练暂停两周 ,在此期间进一步加固研究环境、开展红队测试,并扩大监控系统的覆盖范围。 ▲OpenAI暂时放慢前沿模型研发节奏 目前,OpenAI原计划开展的最大规模前沿模型强化学习训练仍未恢复,公司正通过较小规模的训练和评估观察模型行为、验证安全措施,并积累更多模型对齐证据。 OpenAI CEO萨姆·奥尔特曼随后发文称,暂停部分前沿模型强化学习训练,是为了确保模型对齐、安全和监控措施能够适应模型最新的能力水平。 他认为, 整个AI行业最终需要围绕统一的安全标准展开协作 。在形成统一标准前,OpenAI会先自行采取行动。未来,对模型安全性的信心将愈发决定AI发展的速度。 ▲奥尔特曼发文回应 8月2日, OpenAI曾官宣 下一代模型Astra ,并公布其内部版本取得的 10项数学与理论计算机科学新成果 。 但几周内,包括GPT-5.6 Sol和一款更强预发布模型在内的多款模型,在内部网络安全评测中利用漏洞突破隔离环境,继而 侵入Hugging Face系统 ,并从生产数据库中获取评测答案。另外,初步评估显示,Astra可能达到《准备框架》所定义的 “临界级”网络安全能力 ,因而暂停部分训练和评估任务。 所谓“临界级”网络安全能力,是指模型无需人工干预即可攻击经过加固的关键系统,或自主策划并执行端到端网络攻击。OpenAI目前尚未确