OpenAI:因网络安全风险,延缓Astra模型发布

发布时间:2026-08-08 08:43

  OpenAI 表示,内部与专家评估显示,即将发布的模型 Astra 在智能体编程和网络安全领域取得重大突破。根据其

  OpenAI 特别强调,Astra 是一款尚未发布的模型,并未参与此前针对 Hugging Face 的网络攻击事件。

  对高能力模型及相关研发活动实施更严格的安全控制,包括设置隔离测试环境、限制网络与工具访问权限、强化模型权重保护与加密、部署额外的监控与检测能力,以及实施沙箱化运行;并暂停内部所有尚未满足上述强化安全标准的 Astra 相关活动。

  对 Astra 的所有智能体应用实施了涵盖高风险行为与对齐失效的全局监控。通过评估模型思维链审查并拦截高风险操作。

  与相关政府机构以及指定的 AI 安全组织合作,共同测试该模型;向第三方测试合作伙伴提供推荐的安全控制规范,以确保更高风险的评估与工作负载能够在安全状态下运行。

  OpenAI 首席执行官萨姆 · 奥尔特曼随后表示,Astra 是一款性能强劲的模型,我们正在全力推进它的公开发布。

  我们始终认为,把顶尖模型局限在少数人手里并不是个好策略。 不过鉴于它在网络安全方面的强大能力,我们还需要一点时间来确保万无一失。希望大家不用等太久!

排行

精选