OpenAI 称 Astra 或达「重大」网络安全风险线,暂停部分内部开发并收紧管控

8 月 8 日消息,OpenAI 今日发布声明称,内部评估显示,在研模型 Astra 在「智能体编码与网络安全」方面取得显著进展,结合专家评估,公司「无法排除」它达到《预备框架》(Preparedness Framework)中「重大」(Critical)网络安全阈值的可能。

OpenAI 称 Astra 或达「重大」网络安全风险线,暂停部分内部开发并收紧管控

OpenAI 随即暂停了不符合新安全要求的 Astra 内部活动,并为更高能力模型引入更严格的安全控制。

按照 OpenAI 的定义,「重大」阈值指模型能在无人干预的情况下,识别并利用多个高防护关键系统的功能性零日漏洞,或仅凭一个高层级目标,设计并执行针对高防护目标的端到端新型攻击策略。此前 GPT-5.6 Sol 等模型的评级为「High」。

OpenAI 表示,Astra 与 7 月曝出的 Hugging Face 入侵事件无关。

针对 Astra 的管控包括:隔离测试环境、限制网络与工具访问、沙箱执行、强化模型权重保护与加密,并对所有智能体应用实施「高风险行为与失准」的通用监控;后续测试还将与相关政府机构和 AI 安全组织合作开展。

此前,爆料者 @synthwavedd 称,OpenAI 正准备推出代号为 `mewfour` 的新模型 Astra,内部目标时间是下周。他将 Astra 描述为 GPT-4.5 之后 OpenAI 规模最大的新预训练模型。

声明:内容来源公开的各类媒体平台,若收录的内容侵犯了您的权益,请联系邮箱,本站将第一时间处理。
资讯

消息称字节跳动开始预训练 10 万亿参数大模型,规模或接近 Anthropic 旗舰

2026-8-8 15:51:13

资讯

Kimi K3 在安全测试期间逃逸出隔离环境,未对真实网站发起攻击

2026-8-8 15:53:52

搜索