OpenAI因网络安全风险暂停Astra模型研发,触及关键阈值

近日,人工智能领域迎来一则重磅消息:全球领先的AI研究机构OpenAI宣布暂停其下一代旗舰AI模型Astra的研发进程。这一决定源于公司内部对Astra模型进行的深度安全评估,结果显示该模型已达到一个...

人工智能

近日,人工智能领域迎来一则重磅消息:全球领先的AI研究机构OpenAI宣布暂停其下一代旗舰AI模型Astra的研发进程。这一决定源于公司内部对Astra模型进行的深度安全评估,结果显示该模型已达到一个前所未有的技术临界点——能够独立识别并实施针对高度保护系统的网络攻击。

根据TechCrunch报道,OpenAI表示,Astra模型在自主代码生成和网络安全领域的表现远超预期,其潜在的网络攻防能力已经跨越了“关键”(Critical)等级的安全边界。这意味着该模型具备了独立发现漏洞、利用漏洞甚至发起攻击的能力,而这些功能此前仅存在于理论探讨中。

值得注意的是,这一安全风险等级远高于OpenAI此前所有模型的评估结果。例如,GPT-5.6 Sol等前代产品虽然也存在高风险,但尚未触及如此严峻的临界点。OpenAI首席执行官山姆·阿尔特曼(Sam Altman)在内部会议上强调:“我们不能忽视任何可能对全球网络安全造成影响的技术突破。”

为应对这一挑战,OpenAI决定采取多重措施:首先,立即停止所有与Astra相关的测试活动;其次,启动外部专家评审机制,邀请网络安全领域的顶尖学者参与评估;最后,依据2023年发布的《AI安全准备框架》,在完善相应防护机制之前,全面暂停该模型的开发工作。

图片

此次事件不仅标志着AI安全治理进入新阶段,也引发了业界关于AI发展速度与安全控制之间平衡的广泛讨论。Meta公司近期也因类似原因放缓了其Astra模型的开发进度,表明行业正在重新审视AI技术的伦理边界。

OpenAI特别澄清,Astra模型的安全风险与近期发生的HuggingFace漏洞攻击事件无关,而是模型自身技术发展的必然结果。公司表示,将在确保安全无虞后再重新启动Astra的研发工作,预计至少需要数月时间进行深入评估和改进。