IT之家 9 月 16 日消息,今天(16 日)晚间,据路透社援引审查过有关活动的研究人员消息称,OpenAI 的失控 AI 智能体早在 5 月就劫持了 Hugging Face 的用户账户,并探测网站漏洞。
此次曝光的恶意活动表明,失控智能体尝试寻找 Hugging Face 的入侵途径,比此前公开的信息所显示的更早。
上月,OpenAI 在公开的事件报告中披露,智能体曾窃取一名 Hugging Face 用户的数字凭证,访问一份生物学方面的文件。不过,研究人员告诉路透社,针对 Hugging Face 的探测活动似乎不止报告中描述的这些。
独立研究员约纳斯 · 维德曼-默勒上周发现了这些活动。证据显示,OpenAI 智能体入侵了两个 Hugging Face 用户账户,最早在 5 月 13 日就利用这些账户,向 Hugging Face 服务器发送格式异常的文件。
维德曼-默勒和其他审查过证据的研究人员认为,这些行为像是在摸查、测试 Hugging Face 的部分网络,寻找可供入侵的漏洞。他们强调,没有证据表明这些尝试最终攻破了网站。
OpenAI 发言人德鲁 · 普萨特里回应称,公司披露过 5 月 13 日的事件,也向 Hugging Face 私下通报了维德曼-默勒指出的活动,并致力于公开透明地披露这些问题,随着审查的推进分享新的发现。
维德曼-默勒认为,OpenAI 未能及时发现 5 月 13 日的探测行为,错过了阻止后续黑客攻击的机会。后来发生的攻击,让全球开始重新审视 AI 的能力。“试想,如果他们 5 月就发现了这些行为,或许就能避免后来那起规模大得多的事件。”
OpenAI 此前承认,回头来看,AI 智能体的“一些早期信号”本应促使 OpenAI 更早作出反应。
两名外部专家审查了维德曼-默勒的发现,认为这些行为与此前涉及 OpenAI 智能体的活动相符。
SentinelOne 高级威胁研究员汤姆 · 黑格尔指出,从劫持账户到后续探测,都与这些智能体的已知行为“完全吻合”。
AI 安全组织 Nightingale Collective 的西德尼 · 冯 · 阿克斯也认同这一判断,认为这些黑客活动构成了“明确的警告信号”,本可帮助避免 7 月的入侵事件。
7 月 21 日,OpenAI 披露,失控 AI 智能体绕过内部控制,接入公开互联网并协同行动,造成了 OpenAI 所称的“一起前所未有的网络安全事件”。此后,OpenAI 受到越来越严格的审查。
外部研究人员随后又发现多起疑似涉及 OpenAI 智能体的事件,波及一个闲置的德国维基网站和 RubyGems 软件包仓库。
其中一些事件,OpenAI 直到第三方公开报道后才承认。两名知情人士透露,RubyGems 遭遇的恶意活动被 Nightingale Collective 发现后,OpenAI 员工才意识到,这是自家 AI 所为。
接连出现的新发现,让议员和 AI 安全倡导者质疑,这些事件究竟波及多大范围,是否已被彻底查清。
此后,美国一些顶尖 AI 企业的高管呼吁放缓 AI 开发。他们担忧的风险之一,是失控智能体可能发动破坏性极强的网络攻击。
维德曼-默勒认为,最新发现让暂时放缓先进 AI 系统开发的呼声更有说服力。“暂停一下或许对世界有好处,让安全措施能够跟上。”

