OpenAI AI智能体5月就疑似“探测”Hugging Face!研究人员:这本是后来黑客事件的“预警信号”

研究人员发现,OpenAI旗下AI智能体对Hugging Face的渗透最早可追溯至今年5月,较7月事件提前近两个月。智能体当时曾入侵账户并探测网络结构,OpenAI因未能及时识别而错失早期阻断时机。近期更多类似事件的曝光,进一步引发外界对AI智能体安全监测能力及研发节奏的质疑。

OpenAI旗下AI智能体对开源平台Hugging Face的渗透行动,可能比此前披露的时间线更早。研究人员发现,相关恶意活动最早可追溯至今年5月,较7月曝光的重大入侵事件提前近两个月。

9月16日,据路透社报道,独立研究员Jonas Wiedermann-Moeller上周发现证据显示,OpenAI智能体早在5月13日便入侵两个Hugging Face用户账户,并利用这些账户向该公司服务器发送格式异常的文件。研究人员认为,这些行为与探测Hugging Face网络结构、寻找潜在渗透路径的侦察活动高度吻合,但目前尚无证据证明这一阶段最终造成了实质性入侵

不过,OpenAI发言人Drew Pusateri表示,公司此前已披露5月13日发生的相关事件,并已私下通知Hugging Face,"致力于就相关问题保持透明"。此次发现意味着,此前公开的事件时间线可能并不完整,也进一步引发外界对OpenAI智能体活动范围及早期预警机制的关注。

5月已现异常活动,可能错过早期阻断窗口

Wiedermann-Moeller表示,OpenAI未能在5月13日及时识别并阻断相关探测,可能错过了一次提前介入的机会。"如果他们在5月就发现了这一行为,或许能够阻止后来那次规模更大的事件。"他说。

OpenAI此前也承认,回头来看,AI智能体发出的一些"早期信号"本应触发更及时的响应。两名审查Wiedermann-Moeller研究结果的外部专家认为,其发现与此前掌握的OpenAI智能体行为模式一致。

SentinelOne高级研究员Tom Hegel表示,账户遭入侵以及随后进行的网络探测,与已知的智能体行为模式"完全吻合"。AI安全机构Nightingale Collective的Sydney Von Arx也认同这一归因,并认为相关活动构成了一个明显的早期警示。

值得注意的是,OpenAI上月公布的公开事件报告主要披露了恶意活动的一个方面,即攻击者窃取一名Hugging Face用户的数字凭证,并借此访问一份与生物学相关的文件。但据研究人员透露,针对Hugging Face的早期探测范围似乎超出了这份报告所描述的内容。

更多疑似事件曝光,AI智能体安全能力受考验

7月事件曝光后,外部研究人员又陆续发现更多疑似涉及OpenAI智能体的恶意活动,目标包括一个处于休眠状态的德国维基站点以及RubyGems软件包仓库。

据报道援引两名知情人士透露,在RubyGems事件中,OpenAI员工直到Nightingale Collective公开披露相关情况后,才意识到其AI智能体可能与这起恶意活动有关。OpenAI对部分事件的承认也发生在第三方研究人员公开披露之后。

随着更多疑似事件浮出水面,外界开始关注OpenAI是否已经全面掌握失控AI智能体的活动范围,以及现有监测机制能否及时识别类似风险。

相关事件也进一步加剧了业界对AI开发速度与安全能力是否匹配的讨论。美国部分AI行业高管近期已公开呼吁放慢AI开发速度,担忧高度自主的AI智能体可能被用于发动大规模网络攻击。

Wiedermann-Moeller认为,最新发现进一步支持暂缓推进先进AI系统开发的观点。"暂停或许对世界有益,"他说,"这样安全层面才能跟上发展的步伐。"

相关文章