OpenAI示警新模型恐具关键资安能力 收紧研发管控
28分钟前
OpenAI无法排除即将推出的人工智能(AI)模型「Astra」具备的「关键」网络安全能力,已暂停部分内部开发作业。(路透)
OpenAI今天表示,由于无法排除即将推出的人工智能(AI)模型「Astra」具备的「关键」网络安全能力,因此已暂停部分内部开发作业,并启动安全防护机制。
华尔街日报(The Wall Street Journal)报导,上述声明是AI开发商首度公开因安全疑虑暂缓模型研发的案例之一。此前一连串失控事件已引起网络防御专家及AI安全研究人员的警觉。
根据OpenAI的安全准则,AI模型若能自行辨识并利用实际环境中的严重软件漏洞,也就是所谓的「零时差漏洞利用」(zero-day exploit),或在无须人为介入的情况下对高度安全目标发动复杂网络攻击,即达到「关键」能力门槛。
路透报导指出,OpenAI扩大调查7月引发全球关注的科技公司Hugging Face遭骇事件之际,又发现更多AI代理程序自主突破隔离环境的案例。
过去几周,OpenAI、Anthropic及Meta Platforms均披露,其AI模型在网络安全测试期间曾入侵其他公司系统,凸显AI能力持续提升,使开发商越来越难将系统控制在安全范围内。
OpenAI表示,过去数日进行的初步评估以及外部专家意见显示,Astra可能具备日益复杂的网络任务自主运行能力。
OpenAI表示:「我们仍在持续对这个模型进行基准测试与评估,但初步评估显示其表现已足够强大,目前无法排除达到关键能力的可能性。」
OpenAI指出,针对初步评估结果,公司已加强安全管控,并暂停不符合强化后安全标准的Astra内部活动。
接下来,Astra研发工作将转移至隔离测试环境,限制网络访问,并在受控的「沙盒」(sandbox)环境中进行。
OpenAI首席执行官奥特曼(Sam Altman)在社群平台X发文表示,公司正努力推动Astra广泛开放,因为公司相信「仅供少数人使用强大模型并非良策」。
OpenAI也澄清,Astra并未参与针对Hugging Face的黑客攻击。该公司将与政府机构及特定AI安全组织合作,持续测试Astra的能力。

Comments