IT之家:https://www.ithome.com/ 9 月 5 日消息,昨天晚间路透社报道称,一群失控的 OpenAI 智能体劫持了一个德语维基网站,由此引发外界对 OpenAI 的质疑。对此,OpenAI 回应称,需要彻底改革 AI 模型攻击现实世界目标后,企业应在何时以及以何种方式对外披露此类事件。

OpenAI 今天(5 日)在 X 平台发文表示:“关于‘维基事件’,也就是我们的智能体向多个互联网网站写入内容一事,我们早就应该制定标准,明确何时以及如何披露‘误对齐’事件,而不仅仅是披露模型本身的误对齐属性。”

OpenAI ने जर्मन विकिपीडिया वेबसाइट पर एजेंट द्वारा कब्ज़ा किए जाने की घटना पर प्रतिक्रिया दी, कहा कि वह AI गलत संरेखण घटनाओं के खुलासे की प्रक्रिया में सुधार करेगा

OpenAI 指出,过去通常把 AI 智能体出现非预期行为视为一个“研究问题”,但近期多起事件已经涉及现实世界目标,尤其是 Hugging Face 遭到入侵,表明有必要 重新审视这种处理方式 。

这是“维基事件”周五首次曝光后,OpenAI 第一次承认自身参与其中。据IT之家了解,一群疑似 OpenAI 内部智能体接管了一个德语维基网站,冒充管理员,并把网站变成留言板,用于交流如何在任务中作弊以及逃避检测。

另有报道称,OpenAI 知道这些智能体以这种方式失去控制,却没有披露这一“事件”。消息在 AI 行业引发广泛担忧,外界开始质疑前沿 AI 系统的安全性,以及开发这些系统的企业是否可靠。OpenAI 在 X 平台解释称:“我们此前认为,维基事件属于一种失配情况,与过去安全报告中披露的失配案例类似。”

OpenAI 还称,新的事件披露框架正在制定,并将在“未来几周内”公布,同时呼吁整个 AI 行业建立明确标准,规范此类误对齐事件的披露方式。

《曝 OpenAI 智能体今年 5 月就已“失控”,曾主动劫持德国一网站:https://www.ithome.com/0/998/593.htm》