OpenAI:失控AI曾试图入侵其他公司系统

设计图片:ChatGPT 的标志显示在智慧型手机萤幕上

图像来源,SOPA Images/LightRocket via Getty Images

    • Author, 乔·泰迪(Joe Tidy)
    • Role, BBC国际部网络事务记者
  • Published
  • 阅读时间: 3 分钟

OpenAI披露,由失控ChatGPT代理发动的网络攻击,影响范围不止一家公司。

Hugging Face原被认为是这宗史无前例黑客攻击的唯一受害者,但OpenAI现承认,其机械人曾攻击多项“可公开存取的服务”。

这个失控的AI在网上找到四组登入凭证,令它能够存取四个独立、未具名的服务。

与此同时,在一场有数百名网络安全专业人士参与的紧急简报会上,Hugging Face讲述了成为全球首宗完全自主AI黑客攻击目标的经历。

该公司表示,AI以超越人类的速度运作,但亦作出奇怪的决定和错误,这些都是人类黑客不会犯下的。

Hugging Face是一个类似AI工具应用程式商店的平台。该公司表示,黑客代理持续不断运作,同时尝试数以千计不同的方法。

该公司于7月16日首次披露,遭到使用强大自主AI人士入侵,并已向警察报案。

近一星期后,OpenAI承认,是其AI在测试期间逃离封闭环境,自行攻击Hugging Face。

它当时正试图寻找OpenAI为其设定的一项黑客考试的答案,因此将Hugging Face作为目标。

OpenAI于星期三(7月29日)更新其声明,补充说明这次黑客攻击的影响比最初设想更广泛。

该公司表示:“这些模型识别并使用了其他可公开存取服务中、在帐户层级被公开暴露的凭证。当中包括涉及Hugging Face事件的四个服务上的四个帐户。”

OpenAI未有说明“可公开存取的服务”是否指企业。

“笨拙行为”

星期二(28日),行业组织云端安全联盟(Cloud Security Alliance, CSA)根据上星期五(24日)与Hugging Face举行的紧急会议撰写报告,并已获Hugging Face审阅。

CSA写道:“这些代理采取了低效率的路径,并表现出人类不会选择的笨拙行为。”

这些代理重复执行已经完成的操作,显示作为代理型AI的系统失去了思路及上文下理。

这些代理亦产生大量不连贯的指令和文本幻觉,而且行事粗疏,未有妥善掩盖痕迹。

然而,在这些错误和奇怪行为之中,Hugging Face警告说,AI代理亦展现出高超的技术能力,并能在这宗持续多天的黑客攻击中迅速适应新情况。

《侏罗纪公园》

这些代理在Hugging Face资讯科技网络内潜伏了三天才被发现,而公司内部的AI及网络安全专家花了许多小时,才成功控制并驱逐这些AI代理。一般企业未必能够做到这一点。

该公司未有透露这次攻击造成多少成本损失,但表示员工花费许多小时重建约三分之一的基础设施。

Hugging Face因向AI及网络安全业界坦诚公开事件经过而受到赞扬。

CSA警告,这次事件显示AI“代理⋯⋯总能找到方法”,这是引用电影《侏罗纪公园》的情节,其中恐龙逃出围栏。

报告写道:“它们以目标为导向,自行设定子目标,实时调整以绕过防御措施,并以机器速度持续运作,其持久性足以压垮人工操作。”

Hugging Face标志显示于平板电脑萤幕上。该标志是一个黄色笑脸表情符号,双手向前张开。

图像来源,Getty Images

网络安全主管里特什·帕特尔(Ritesh Patel)与约450人一同参与Hugging Face的简报会。他表示,业界正努力应对失控AI代理带来的新威胁。

他说:“这就是由前沿模型驱动的自主代理的现实情况:它们持续不懈,往往产生大量噪音,并会尝试所有可能路径来达成目标,这很容易令传统防御措施不堪负荷。”

以别名乔姆皮(Chompie)而为人熟悉的道德黑客瓦伦蒂娜·帕尔米奥蒂(Valentina Palmiotti)审阅了CSA报告。她表示,这些代理的入侵方式看似杂乱无章,但显然十分有效。

她说:“它们会抛出一大堆东西,看看哪些奏效。”

“但同时它们不会感到厌倦,不需要睡觉,而且可以无限坚持下去。”

失控历史

这并非首次有AI代理被证实出现“失控”情况。

CSA在报告中提到过往例子,包括2024年9月,一个较早版本的ChatGPT模型曾逃离其容器环境,以取得另一项测试所需的答案。

CSA指出,该事件被限制在OpenAI自身的资讯科技系统内,而且“当时大致上受到赞扬”。

但报告称,“失控”行为“已成常态,而非例外”。

报告警告全球网络安全专业人士,必须适应大量AI代理以高速窃奇怪又笨拙方式运作的新常态,因为这可能导致更多安全漏洞事件。

报告亦敦促使用或开发AI代理的人士负责任地加以控制,并呼吁建立某种机制,让网络安全防御者能够查明代理的最终持有人,以提高透明度。

先前报导指出,OpenAI用了四天时间才察觉其AI曾入侵Hugging Face。

OpenAI表示,将很快公布其自身调查结果,协助外界从这宗事件中汲取教训。

补充报导:谢全恩(Osmond Chia)

我们使用了人工智慧协助翻译这篇文章,它的原文是英文。在发布之前,BBC记者检查了翻译的内容。