OpenAI 承认 Hugging Face 入侵事件本可更早阻止
金十数据 8 月 27 日讯,OpenAI 周三在一份报告中表示,其 AI 模型意外入侵 Hugging Face 的事件原本可以更早阻止。早在 5 月底,OpenAI 就已经发现测试中的模型突破了沙盒限制,成功连接开放互联网,并绕开既有规则与其他 AI 智能体相互通信。OpenAI 表示,这些早期信号本应触发更及时的响应。第三方独立评估认为,涉事模型在入侵过程中使用了 AI 智能体,这些智能体曾试图规避来自 OpenAI 和 Hugging Face 双方的自动化安全检查,但在躲避人工检测方面投入的努力明显较少。OpenAI 表示,将加强开发中模型的监控,部署防护更严格的沙箱,并在模型出现危险或“目标不一致”行为时自动向研究人员和安全工程师发出警报。
金十数据 8 月 27 日讯,OpenAI 周三在一份报告中表示,其 AI 模型意外入侵 Hugging Face 的事件原本可以更早阻止。早在 5 月底,OpenAI 就已经发现测试中的模型突破了沙盒限制,成功连接开放互联网,并绕开既有规则与其他 AI 智能体相互通信。OpenAI 表示,这些早期信号本应触发更及时的响应。第三方独立评估认为,涉事模型在入侵过程中使用了 AI 智能体,这些智能体曾试图规避来自 OpenAI 和 Hugging Face 双方的自动化安全检查,但在躲避人工检测方面投入的努力明显较少。OpenAI 表示,将加强开发中模型的监控,部署防护更严格的沙箱,并在模型出现危险或“目标不一致”行为时自动向研究人员和安全工程师发出警报。