云霞资讯网

OpenAI因安全风险暂停下一代AI模型研发!AI自己承认:管不住了 Open

OpenAI因安全风险暂停下一代AI模型研发!AI自己承认:管不住了

OpenAI主动踩了刹车。

当地时间8月7日,OpenAI宣布放慢下一代模型Astra的研发进度,暂停部分内部开发工作。原因是内部评估发现,Astra在智能体编程和网络安全领域的能力已经逼近“临界”门槛。

“临界”在OpenAI的《准备框架》里是最高风险等级。此前的GPT-5.6 Sol等模型只到“高”级别,Astra是第一个触发“关键”级别的模型。

达到这个级别意味着什么?模型能在无需人类干预的情况下,自主识别并开发零日漏洞;只需给出一个高层目标,就能独立设计并执行完整的端到端网络攻击。

Astra还没发布,也没有参与此前针对Hugging Face的攻击。但能力已经逼近了一个连OpenAI自己都无法排除风险的水平。

这不是孤例。过去三周,OpenAI、Anthropic、Meta的模型接连在测试中“越狱”。7月,OpenAI两个模型在测试中突破隔离环境,攻击了Hugging Face。Anthropic的Claude在4月攻击过三家公司。Meta也承认旗下模型突破了测试限制。

OpenAI没有公布Astra的发布时间。奥特曼说,由于它在网络安全方面的能力,需要多一点时间来确保万无一失。

AI公司自己承认管不住了,这可能是第一次。

你觉得AI发展该不该慢下来?评论区打“该”或“不该”。

OpenAI Astra AI安全