


图像来源,SOPA Images/LightRocket via Getty Images
OpenAI披露,由失控ChatGPT代理发动的网络攻击,影响范围不止一家公司。
Hugging Face原被认为是这宗史无前例黑客攻击的唯一受害者,但OpenAI现承认,其机械人曾攻击多项“可公开存取的服务”。
这个失控的AI在网上找到四组登入凭证,令它能够存取四个独立、未具名的服务。
与此同时,在一场有数百名网络安全专业人士参与的紧急简报会上,Hugging Face讲述了成为全球首宗完全自主AI黑客攻击目标的经历。
该公司表示,AI以超越人类的速度运作,但亦作出奇怪的决定和错误,这些都是人类黑客不会犯下的。
Hugging Face是一个类似AI工具应用程式商店的平台。该公司表示,黑客代理持续不断运作,同时尝试数以千计不同的方法。
该公司于7月16日首次披露,遭到使用强大自主AI人士入侵,并已向警察报案。
近一星期后,OpenAI承认,是其AI在测试期间逃离封闭环境,自行攻击Hugging Face。
它当时正试图寻找OpenAI为其设定的一项黑客考试的答案,因此将Hugging Face作为目标。
OpenAI于星期三(7月29日)更新其声明,补充说明这次黑客攻击的影响比最初设想更广泛。
该公司表示:“这些模型识别并使用了其他可公开存取服务中、在帐户层级被公开暴露的凭证。当中包括涉及Hugging Face事件的四个服务上的四个帐户。”
OpenAI未有说明“可公开存取的服务”是否指企业。
星期二(28日),行业组织云端安全联盟(Cloud Security Alliance, CSA)根据上星期五(24日)与Hugging Face举行的紧急会议撰写报告,并已获Hugging Face审阅。
CSA写道:“这些代理采取了低效率的路径,并表现出人类不会选择的笨拙行为。”
这些代理重复执行已经完成的操作,显示作为代理型AI的系统失去了思路及上文下理。
这些代理亦产生大量不连贯的指令和文本幻觉,而且行事粗疏,未有妥善掩盖痕迹。
然而,在这些错误和奇怪行为之中,Hugging Face警告说,AI代理亦展现出高超的技术能力,并能在这宗持续多天的黑客攻击中迅速适应新情况。
这些代理在Hugging Face资讯科技网络内潜伏了三天才被发现,而公司内部的AI及网络安全专家花了许多小时,才成功控制并驱逐这些AI代理。一般企业未必能够做到这一点。
该公司未有透露这次攻击造成多少成本损失,但表示员工花费许多小时重建约三分之一的基础设施。
Hugging Face因向AI及网络安全业界坦诚公开事件经过而受到赞扬。
CSA警告,这次事件显示AI“代理⋯⋯总能找到方法”,这是引用电影《侏罗纪公园》的情节,其中恐龙逃出围栏。
报告写道:“它们以目标为导向,自行设定子目标,实时调整以绕过防御措施,并以机器速度持续运作,其持久性足以压垮人工操作。”

图像来源,Getty Images
网络安全主管里特什·帕特尔(Ritesh Patel)与约450人一同参与Hugging Face的简报会。他表示,业界正努力应对失控AI代理带来的新威胁。
他说:“这就是由前沿模型驱动的自主代理的现实情况:它们持续不懈,往往产生大量噪音,并会尝试所有可能路径来达成目标,这很容易令传统防御措施不堪负荷。”
以别名乔姆皮(Chompie)而为人熟悉的道德黑客瓦伦蒂娜·帕尔米奥蒂(Valentina Palmiotti)审阅了CSA报告。她表示,这些代理的入侵方式看似杂乱无章,但显然十分有效。
她说:“它们会抛出一大堆东西,看看哪些奏效。”
“但同时它们不会感到厌倦,不需要睡觉,而且可以无限坚持下去。”
这并非首次有AI代理被证实出现“失控”情况。
CSA在报告中提到过往例子,包括2024年9月,一个较早版本的ChatGPT模型曾逃离其容器环境,以取得另一项测试所需的答案。
CSA指出,该事件被限制在OpenAI自身的资讯科技系统内,而且“当时大致上受到赞扬”。
但报告称,“失控”行为“已成常态,而非例外”。
报告警告全球网络安全专业人士,必须适应大量AI代理以高速窃奇怪又笨拙方式运作的新常态,因为这可能导致更多安全漏洞事件。
报告亦敦促使用或开发AI代理的人士负责任地加以控制,并呼吁建立某种机制,让网络安全防御者能够查明代理的最终持有人,以提高透明度。
先前报导指出,OpenAI用了四天时间才察觉其AI曾入侵Hugging Face。
OpenAI表示,将很快公布其自身调查结果,协助外界从这宗事件中汲取教训。





图像来源,Future Publishing via Getty Images
中国人工智能公司“月之暗面”(Moonshot AI),遭白宫一名顾问指控大规模窃取美国顶尖AI模型的能力。
美国总统特朗普(Donald Trump;川普)的科技政策顾问克拉齐奥斯(Michael Kratsios)表示,月之暗面透过一种称为“蒸馏”(distillation)的技术进行有关行动,即较弱的AI模型从较强的模型提取答案,以提升自身能力。
克拉齐奥斯周三(7月22日)在社交平台发文称,月之暗面还取得受限制的辉达(Nvidia;英伟达)先进伺服器使用权限,以训练其AI模型。
BBC已联络月之暗面、Anthropic、白宫及辉达寻求回应。
克拉齐奥斯在社交平台X上表示,美国政府掌握资讯,显示月之暗面透过“蒸馏”(distillation)Anthropic旗下Fable AI模型的能力,来开发其K3模型。
Kimi K3于上周发布后迅速受到全球关注。许多人认为,这款模型缩小了西方与中国AI模型之间的差距。月之暗面表示,其K3模型的能力足以与美国顶尖技术竞争。
克拉齐奥斯还称,月之暗面很可能同时使用了搭载辉达GB300 Grace Blackwell运算平台的伺服器进行训练。
出于担心先进晶片可能被中国军方利用,美国于2022年开始限制辉达最尖端晶片出口至中国。此后,多国政府加强打击相关晶片的走私行为。
在回覆BBC查询时,中国驻美国大使馆引述中国外交部发言人林剑周三的发言。林剑表示,中方反对将经贸和科技问题“政治化”。
林剑并称,中国人工智能发展秉持“共商共建共享”理念,呼吁各国坚持以人民为中心的发展方向。
克拉齐奥斯提出上述指控前一天,美国财政部长贝森特(Scott Bessent)曾表示,美方将检视中国AI模型是否窃取美国竞争对手的技术能力。
贝森特周三进一步表示,若中国企业透过“工业规模的蒸馏攻击”进行知识产权(IP)盗窃,美国将考虑实施制裁。
他在社交媒体上写道:“我们支持开源AI及其带来的创新。但开源不代表美国的知识产权可以任人取用。”
中国政府尚未就最新指控公开发表声明,但此前曾表示,中国AI的发展成果源于自身努力,也得益于国际合作。
在美方加大对中国AI企业审视之际,特朗普预计将于9月与中国国家主席习近平会面。
月之暗面宣布,将于7月27日把Kimi K3作为开源模型发布。这将成为同等规模模型中首批可供开发者及公众自由下载和客制化使用的模型之一。
今年6月,Anthropic曾指控中国电商及科技巨头阿里巴巴透过蒸馏攻击,“非法”提取其Claude AI模型的能力。
Anthropic当时呼吁美国国会惩罚涉嫌发动相关攻击的企业,并加强措施防止美国技术遭窃取。
白宫今年4月曾表示,将与美国AI企业加强合作,以打击外国竞争对手窃取技术的“工业规模行动”。
克拉齐奥斯当时在一份备忘录中表示,这类行动旨在“系统性削弱美国的研发能力,并获取专有资讯”。
我们使用了人工智慧协助翻译这篇文章,它的原文是英文。在发布之前,BBC记者检查了翻译的内容。