OpenAI 称即将推出的 Astra 模型展现重大网络能力,将推迟发布
OpenAI 官方宣布,其即将推出的模型
Astra在智能体编程和网络安全方面取得重大进展,被视为达到了内部预备框架“关键”级别的网络安全能力。OpenAI 已为Astra实施了更严格的安全控制。OpenAI 同时强调,该模型将向防御者群体开放,但由于安全考量,其全面推出需要更长的时间。
OpenAI近日通过官方博客和社交平台表示,其即将推出的模型 Astra 在内部评估中展现出显著增强的智能体编码和网络安全能力。
经专家评估后,公司认为无法排除该模型达到预备框架中 “关键” 网络安全阈值的可能性。这是OpenAI首次将模型列为网络安全 “关键” 级别,此前模型如 GPT-5.6-Sol 仅被评为 “高”。
根据该框架,关键阈值指模型能自主识别和开发针对加固系统的 零日漏洞,或仅凭高级目标策划并执行端到端的网络攻击。为此,OpenAI已实施一系列强化安全控制,包括隔离测试环境、限制网络和工具访问、增强模型权重加密和监控,并暂停了不符合要求的内部活动。
同时,该公司正在与政府机构和 AI 安全组织合作进行测试,并计划向第三方测试伙伴提供安全建议。OpenAI强调,正努力让 Astra 广泛可用,将其先进网络能力交付防御者,但因安全考量需要略长的时间,但不会太久。
此外,OpenAI澄清 Astra 并未参与此前 Hugging Face 漏洞利用事件。


相关链接:











