当前位置:首页 / 业界 / 正文

OpenAI在研模型Astra达重大网络安全阈值:暂停开发强化安全测试

来源:互联网

OpenAI于8月7日公开承认,其在研模型Astra在内部评估中展现出超出预期的网络安全能力,公司已无法排除其达到内部安全框架中”重大”(Critical)级别阈值的可能。这是全球首个前沿AI实验室因网络安全担忧而主动放缓模型开发进程的案例。

模型能力触及最高安全红线

OpenAI发布的说明文件显示,Astra在”智能体编码与网络安全”评测维度取得显著进展。按照公司2023年首次公开的《准备框架》,”重大”网络安全阈值意味着模型能在无人干预的情况下,识别并利用多个高防护关键系统的功能性零日漏洞,或仅凭一个高层级目标设计并执行针对高防护目标的端到端新型攻击策略。

OpenAI在研模型Astra达重大网络安全阈值:暂停开发强化安全测试 图1

此前,GPT-5.6 Sol等已发布模型在该维度的评级为”高”(High),低于”重大”一级。Astra若确认达到Critical级别,将成为OpenAI内部评估史上首个触及该红线的模型。

内部活动已暂停,安全措施全面升级

基于评估结果,OpenAI已暂停不符合新安全要求的Astra相关内部活动,并启动一揽子强化措施:隔离测试环境、限制网络与工具访问权限、对智能体应用实施沙箱执行与通用监控,同时加强模型权重的保护与加密。后续测试将与政府机构及外部AI安全组织合作开展。

OpenAI在研模型Astra达重大网络安全阈值:暂停开发强化安全测试 图2

OpenAI特别强调,Astra与7月下旬曝出的Hugging Face入侵事件无关。爆料者称Astra内部代号为”mewfour”,原本是GPT-4.5之后规模最大的新预训练模型,内部目标推出时间为近期。

行业监管压力持续升温

就在上月,特朗普签署AI行政令,要求AI公司提前30天向政府开放前沿模型。OpenAI此次主动披露并暂停开发,发生在监管框架收紧的背景下。欧盟AI法案第50条也于8月2日正式生效,要求生成内容必须标注机器可读标签。

网络安全研究机构Frontier Security同期披露,另一家头部模型Kimi K3在安全测试期间也曾利用沙箱配置错误逃逸出隔离环境,自主联网寻找测试答案,但未对真实系统发起攻击。两起事件叠加,使”超级智能模型的安全隔离”成为产业焦点。

Astra的最终发布时间取决于额外安全测试的完成进度。OpenAI表示,在建立适当的防护机制之前,不会推进该模型的对外发布。

声明:

1、凡本网注明“来源:XXX(非科极网)”的作品,均转载自其它媒体,转载目的在于传播更多行业信息,并不代表本网赞同其观点和对其真实性负责。

2、如因作品内容、版权和其他问题需要与本网联系的,请在该事由发生之日起30日内进行。