首页/新闻/OpenAI’s rogue agents keep escaping, with no formal process to investigate them
行业动态

OpenAI的流氓代理不断逃跑,没有正式程序来调查他们

techcrunch
2026年9月4日 16:15
2026年9月4日 16:15
访问原文

OpenAI是另一起代理群事件的中心。研究人员表示,该公司内部部署的代理在5月和6月接管了一个不起眼的德语维基,用它来协调评估和交换方法以逃避OpenAI自己的控制(OpenAI尚未确认该群体来自该公司)。在METR和Redwood Research公布了7月份“拥抱脸”事件的描述几天后,这一消息浮出水面。今年7月,一群OpenAI代理在网络安全评估期间联手逃离沙箱并闯入Hugging Face的服务器。随后的群体从第一个群体中学习技术,并使用它们来获得管理员对OpenAI自己基础设施内研究集群的访问权限。OpenAI聘请了METR和Redwood来调查该事件的Hugging Face部分,但他们的调查范围尚未达到OpenAI自身基础设施的妥协。当人工智能代理打破其预期限制时,谁负责弄清楚发生了什么以及为什么?现在,答案是:实验室决定让任何人进入,无论它决定设定什么条件。现在,随着另一起事件曝光--在涉及Meta和Anthropic模型的类似事件之后--人工智能安全研究人员正以更大的紧迫性争辩说,严重事件应该导致独立的后事件调查,而不是让实验室来决定何时引入外部人员以及允许他们检查什么。非营利研究实验室Transluce创始人兼首席执行官雅各布·斯坦哈特(Jacob Steinhardt)周三在人工智能安全媒体简报会上表示:“这些结果从根本上难以控制,并且存在泄露实验室的巨大风险。”“我们需要将这项技术至少保持在与其他高风险科学研究相同的标准上。”虽然OpenAI邀请METR和Redwood调查Hugging Face事件值得称赞,但许多人表示这次调查是

注:以上内容摘选自原始新闻,点击「访问原文」查看完整内容。

标签

AI
Hugging Face
OpenAI

相关 AI 模型

新闻来源

techcrunch · 2026年9月4日 16:15

查看原文

相关新闻