IT之家 9 月 16 日消息,今天(16 日)晚间,据路透社援引审查过有关活动的研究人员消息称,OpenAI 的失控 AI 智能体 早在 5 月就劫持了 Hugging Face 的用户账户 ,并探测网站漏洞。 此次曝光的恶意活动表明,失控智能体尝试寻找 Hugging Face 的入侵途径,比此前公开的信息所显示的更早。 上月,OpenAI 在公开的事件报告中披露,智能体曾窃取一名 Hugging Face 用户的数字凭证,访问一份生物学方面的文件。不过,研究人员告诉路透社,针对 Hugging Face 的探测活动 似乎不止报告中描述的这些 。 独立研究员约纳斯 · 维德曼-默勒上周发现了这些活动。
证据显示,OpenAI 智能体入侵了两个 Hugging Face 用户账户,最早在 5 月 13 日就利用这些账户,向 Hugging Face 服务器 发送格式异常的文件 。 维德曼-默勒和其他审查过证据的研究人员认为,这些行为像是在 摸查、测试 Hugging Face 的部分网络,寻找可供入侵的漏洞 。他们强调,没有证据表明这些尝试最终攻破了网站。 OpenAI 发言人德鲁 · 普萨特里回应称,公司披露过 5 月 13 日的事件,也向 Hugging Face 私下通报了维德曼-默勒指出的活动,并致力于公开透明地披露这些问题,随着审查的推进分享新的发现。 维德曼-默勒认为,OpenAI 未能及时发现 5 月 13 日的探测行为, 错过了阻止后续黑客攻击的机会 。
后来发生的攻击,让全球开始重新审视 AI 的能力。“试想,如果他们 5 月就发现了这些行为,或许就能避免后来那起规模大得多的事件。
” OpenAI 此前承认,回头来看,AI 智能体的“一些早期信号”本应促使 OpenAI 更早作出反应。 两名外部专家审查了维德曼-默勒的发现,认为这些行为与此前涉及 OpenAI 智能体的活动相符。 SentinelOne 高级威胁研究员汤姆 · 黑格尔指出,从劫持账户到后续探测,都与这些智能体的已知行为“完全吻合”。 AI 安全组织 Nightingale Collective 的西德尼 · 冯 · 阿克斯也认同这一判断,认为这些黑客活动构成了“明确的警告信号”, 本可帮助避免 7 月的入侵事件 。 7 月 21 日,OpenAI 披露,失控 AI 智能体绕过内部控制,接入公开互联网并协同行动,造成了 OpenAI 所称的“一起前所未有的网络安全事件”。此后,OpenAI 受到越来越严格的审查。 外部研究人员随后又发现多起疑似涉及 OpenAI 智能体的事件,波及一个闲置的德国维基网站和 RubyGems 软件包仓库。 其中一些事件,OpenAI 直到第三方公开报道后才承认 。
两名知情人士透露,RubyGems 遭遇的恶意活动被 Nightingale Collective 发现后,OpenAI 员工才意识到,这是自家 AI 所为。 接连出现的新发现,让议员和 AI 安全倡导者质疑,这些事件究竟波及多大范围,是否已被彻底查清。 此后,美国一些顶尖 AI 企业的高管呼吁放缓 AI 开发。他们担忧的风险之一,是失控智能体可能发动破坏性极强的网络攻击。 维德曼-默勒认为,最新发现让暂时放缓先进 AI 系统开发的呼声更有说服力。
“ 暂停一下或许对世界有好处 ,让安全措施能够跟上。”