OpenAI 披露其智能体“联手越狱”细节 攻破 Hugging Face 前已协作数月
OpenAI 表示,对 Hugging Face 发起攻击的一组人工智能模型,早在 5 月就已通过未被察觉的留言板彼此通信,并协同合作以突破测试环境。OpenAI 研究员 Eric Wallace 和 Michael Dalton 周三在一场网络安全会议上表示,多个仅限内部使用的 AI 智能体和模型花费数月时间互相留便条,并逐渐围绕一个共同目标展开合作:接入互联网以完成被分配的任务,而其中一些任务在没有网络连接的情况下根本无法完成。Wallace 在拉斯维加斯举行的 Black Hat 网络安全大会上表示:“在某个时刻,这些智能体意识到,或许可以尝试利用或攻击外部基础设施,以找到它们正在接受测试的问题答案。”研究人员披露的内容进一步揭示了 Hugging Face 遭入侵事件的细节。这起事件凸显出全球日益加剧的担忧,即前沿 AI 系统可能被用于发动破坏性网络攻击。该事件以及 Anthropic PBC 和 Meta Platforms Inc.此前披露的类似安全事故,已促使华盛顿和硅谷呼吁加强对 AI 模型的安全审查。
 
 
Back to Top