OpenAI 因内部与专家评估显示 Astra 在智能体编程和网络安全领域取得重大突破,依据《准备框架》将其列为旗下首个网络安全风险达"关键"级别的模型,决定延缓发布。
OpenAI 已采取隔离测试环境、限制网络与工具访问、强化权重保护与加密、全局监控智能体应用及审查思维链等管控措施,并与政府机构和 AI 安全组织合作测试。 CEO 萨姆·奥尔特曼表示 Astra 性能强劲,正全力推进公开发布。 🔗 阅读原文 via AIHOT · https://aihot.virxact.com/items/cmsjk6eiz0byoroo5cc4bcwg6
OpenAI:因网络安全风险,延缓 Astra 模型发布 这条更新来自 ithome.com,发布时间为 2026-08-07,Aioga 保留原文入口以便核验。
摘要:OpenAI 因内部与专家评估显示 Astra 在智能体编程和网络安全领域取得重大突破,依据《准备框架》将其列为旗下首个网络安全风险达"关键"级别的模型,决定延缓发布。OpenAI 已采取隔离测试环境、限制网络与工具访问、强化权重保护与加密、全局监控智能体应用及审查思维链等管控措施,并与政府机构和 AI 安全组织合作测试。CEO 萨姆·奥尔特曼表示 Astra 性能强劲,正全力推进公开发布。 🔗 阅读原文 via AIHOT · https://aihot.virxact.com/items/cmsjk6eiz0byoroo5cc4bcwg6
背景:背景分析:模型与研究类动态需要结合能力边界、开放方式、成本、可用性和真实任务表现判断,单项指标领先不等于已经形成稳定采用。
Aioga 观察:Aioga 判断:这条动态更适合作为行业观察信号,当前信息足以建立线索,但不足以推导长期结论。
影响与后续:影响分析:对相关团队而言,短期应先核对来源、可用范围和实际成本,再判断是否值得接入或跟进。 后续观察:继续观察官方文档、实际可用性、价格变化、开发者反馈和竞品回应。
IT之家:https://www.ithome.com/ 8 月 8 日消息,OpenAI 表示,内部与专家评估显示,即将发布的模型 Astra 在智能体编程和网络安全领域取得重大突破。根据其《准备框架》(Preparedness Framework), Astra 已被列为 OpenAI 旗下首个在网络安全领域达到“关键”(Critical)风险级别的模型 。
IT之家注:根据该框架,AI 模型满足以下任一条件即触及“关键”门槛:
无干预挖掘零日漏洞 :无需人类干预,即可在多个经过安全加固的真实关键系统中,识别并开发出涵盖各严重等级的有效零日漏洞利用程序。
自主发起端到端攻击 :仅需提供高层级战略目标,即可针对加固目标自主构想并实施全新的端到端网络攻击。
OpenAI 特别强调,Astra 是一款尚未发布的模型, 并未参与此前针对 Hugging Face 的网络攻击事件 。
对高能力模型及相关研发活动实施更严格的安全控制,包括设置隔离测试环境、限制网络与工具访问权限、强化模型权重保护与加密、部署额外的监控与检测能力,以及实施沙箱化运行;并暂停内部所有尚未满足上述强化安全标准的 Astra 相关活动。
对 Astra 的所有智能体应用(包括训练和评估阶段)实施了涵盖高风险行为与对齐失效的全局监控。通过评估模型思维链(CoT)审查并拦截高风险操作。
与相关政府机构以及指定的 AI 安全组织合作,共同测试该模型;向第三方测试合作伙伴提供推荐的安全控制规范,以确保更高风险的评估与工作负载能够在安全状态下运行。
OpenAI 首席执行官萨姆 · 奥尔特曼(Sam Altman)随后表示,Astra 是一款性能强劲的模型,我们正在全力推进它的公开发布。
不过鉴于它在网络安全方面的强大能力, 我们还需要一点时间来确保万无一失 。希望大家不用等太久!