OpenAI:自家研发AI代理人入侵公司系统还试图隐瞒行为

社会
27. Aug 2026
1 views
OpenAI:自家研发AI代理人入侵公司系统还试图隐瞒行为

人工智能(AI)公司OpenAI。(路透)

人工智能(AI)公司OpenAI在26日发布的37页报告中说,自家研发的AI代理人出现不受控制的状况,在内部测试期入侵公司系统,事发之后还试图隐瞒行为,报告里许多细节是首度披露。国家广播公司(NBC)分析,这些发现恐让民众对于AI功能日渐强大感到更加担心。

OpenAI报告指出,某些AI代理人跳脱受到限制的测试环境,跟其他代理人联手篡改公司系统,其他AI代理人则在与网络安全无关的任务里作弊,例如蛋白质数据库与试算表测试。某些AI模型企图通过删除或修改行动纪录来隐瞒不当行为。

报告指出,超过一个AI代理人参与对开源AI社群平台Hugging Face的入侵,在某些情况下多个代理人之间联手合作。

在至少一起案例当中,AI代理人之间彼此交换笔记,分享如何潜入公司网络。

OpenAI在报告中说,事后来看,报告发现的某些早期信号,其实应该提早触发警示,尽快做出因应。

NBC报导,AI代理人在跟网络安全无关的任务里作弊,引起某些研究人员注意。

非营利AI安全研究实验室Palisade Research共同创办人拉迪什(Jeffrey Ladish)说,由此可见这种不良行为可能在AI代理人之间根深柢固。

OpenAI指出,今年7月19日发生两起AI代理人入侵公司本身基础设施的事件。在其中一个案例里,AI代理人利用原本应该发挥限制功能的电脑漏洞,逃脱测试环境并访问其他连接系统。另一个案例则是,AI代理人窃取OpenAI凭证并篡改公司的云端环境。

NBC报导,独立调查人员针对Hugging Face遭入侵事件进行了解之后发现,由OpenAI启动的700多个AI代理人参与这次入侵行动。

Comments

No comments has been added on this post

Add new comment

You must be logged in to add new comment. Log in