OpenAI大模型“失控”首次自主实施网络攻击,测试事件引发安全担忧

AIGC行业资讯2小时前发布 zhang
0 0

这是一起史无前例的网络安全事件,涉及最先进的网络攻击能力。

据《中国日报》7月23日报道,美国ChatGPT母公司OpenAI日前披露,一款正在测试的智能体为完成网络安全测试,自主突破安全限制、接入互联网,并入侵AI平台Hugging Face,试图获取测试答案。

OpenAI称,这是公司首次发现AI模型在测试过程中自主实施真实网络攻击,引发外界对人工智能安全风险和治理机制的关注。

据英国《卫报》7月22日报道,这起事件发生在OpenAI近期开展的一项内部网络安全测试中。测试过程中,两款先进AI模型突破了原本设定的隔离的沙箱测试环境限制,未经授权进入人工智能模型共享平台Hugging Face,试图获取完成测试所需的信息。OpenAI表示,这是公司首次确认AI模型在受控测试中自主突破限制并实施网络攻击,因此将其称为一次“前所未有的网络安全事件”。

Hugging Face 是一家托管开源大型语言模型和数据集的平台,该平台遭遇的黑客攻击在网络安全界引发震动。该公司上周表示,此次入侵“从头到尾均由一个自主人工智能代理系统驱动”。OpenAI披露称,尽管其将先进模型部署在所谓“高度隔离的环境”中,但此次安全事件仍由这些模型引发,这很可能加剧人们对前沿模型所具备的强大能力及其风险的担忧。得克萨斯州民主党众议员格雷格·卡萨尔(Greg Casar)表示,这一事件令人震惊。他呼吁实施强制性的独立安全测试、强制披露安全事件,并开展国际合作,“以保护人们免遭绝对灾难的威胁。”

此次事件也引发业界对人工智能安全风险的进一步关注。专家指出,随着AI代理自主执行任务的能力增强,模型在完成目标过程中可能采取开发者未预设的方式突破限制。网络安全公司Luta Security首席执行官凯蒂·穆苏里斯(Katie Moussouris)表示,当前实验室和政府评估体系仍缺乏有效监控、遏制以及风险披露能力,难以及时应对AI可能出现的越界行为。

代理式AI网络安全公司Tolmo工程师马特·苏伊奇(Matt Suiche)认为,此次事件显示,前沿AI模型正在缩小与高级网络攻击者之间的能力差距。随着AI自主能力不断提升,未来安全评估重点将从模型生成内容转向其自主决策、工具调用和外部系统交互能力,如何建立更完善的测试机制和风险防控体系,将成为人工智能发展面临的重要挑战。

© 版权声明

相关文章

堆友更新