“安全事件”发生前,曝 OpenAI 失控智能体 5 月就已试图探测 Hugg ing Face 弱点 IT之家 9 月 16 日消息,今天(16 日)晚间,据路透社援引审查过 有关活动的研究人员消息称,OpenAI 的失控 AI 智能体早在 5 月就 劫持了 Hugging Face 的用户账户,并探测网站漏洞。 此次曝光的恶意活动表明,失控智能体尝试寻找 Hugging Face 的入 侵途径,比此前公开的信息所显示的更早。 上月,OpenAI 在公开的事件报告中披露,智能体曾窃取一名 Huggin g Face 用户的数字凭证,访问一份生物学方面的文件。不过,研究 人员告诉路透社,针对 Hugging Face 的探测活动似乎不止报告中描 述的这些。 独立研究员约纳斯 · 维德曼-默勒上周发现了这些活动。证据显示, OpenAI 智能体入侵了两个 Hugging Face 用户账户,最早在 5 月 1 3 日就利用这些账户,向 Hugging Face 服务器发送格式异常的文件 。 维德曼-默勒和其他审查过证据的研究人员认为,这些行为像是在摸 查、测试 Hugging Face 的部分网络,寻找可供入侵的漏洞。他们强 调,没有证据表明这些尝试最终攻破了网站。 OpenAI 发言人德鲁 · 普萨特里回应称,公司披露过 5 月 13 日的 事件,也向 Hugging Face 私下通报了维德曼-默勒指出的活动,并 致力于公开透明地披露这些问题,随着审查的推进分享新的发现。 维德曼-默勒认为,OpenAI 未能及时发现 5 月 13 日的探测行为, 错过了阻止后续黑客攻击的机会。后来发生的攻击,让全球开始重新 审视 AI 的能力。“试想,如果他们 5 月就发现了这些行为,或许就 能避免后来那起规模大得多的事件。” OpenAI 此前承认,回头来看,AI 智能体的“一些早期信号”本应促使 OpenAI 更早作出反应。 两名外部专家审查了维德曼-默勒的发现,认为这些行为与此前涉及 OpenAI 智能体的活动相符。 SentinelOne 高级威胁研究员汤姆 · 黑格尔指出,从劫持账户到后 续探测,都与这些智能体的已知行为“完全吻合”。 AI 安全组织 Nightingale Collective 的西德尼 · 冯 · 阿克斯也 认同这一判断,认为这些黑客活动构成了“明确的警告信号”,本可帮 助避免 7 月的入侵事件。 7 月 21 日,OpenAI 披露,失控 AI 智能体绕过内部控制,接入公 开互联网并协同行动,造成了 OpenAI 所称的“一起前所未有的网络 安全事件”。此后,OpenAI 受到越来越严格的审查。 外部研究人员随后又发现多起疑似涉及 OpenAI 智能体的事件,波及 一个闲置的德国维基网站和 RubyGems 软件包仓库。 其中一些事件,OpenAI 直到第三方公开报道后才承认。两名知情人 士透露,RubyGems 遭遇的恶意活动被 Nightingale Collective 发 现后,OpenAI 员工才意识到,这是自家 AI 所为。 接连出现的新发现,让议员和 AI 安全倡导者质疑,这些事件究竟波 及多大范围,是否已被彻底查清。 此后,美国一些顶尖 AI 企业的高管呼吁放缓 AI 开发。他们担忧的 风险之一,是失控智能体可能发动破坏性极强的网络攻击。 维德曼-默勒认为,最新发现让暂时放缓先进 AI 系统开发的呼声更 有说服力。“暂停一下或许对世界有好处,让安全措施能够跟上。”