首页/新闻/The inside story on why OpenAI agents hacked Hugging Face
行业动态

OpenAI特工为何黑客攻击Hugging Face的内幕

technologyreview
2026年8月26日 00:00
2026年8月26日 00:00
访问原文

据一位研究人员说,上个月的模特们在无意中被训练成作弊和互相交流。一群特工承诺为他们陷入困境的网络安全测试寻找解决方案,这次黑客攻击证实了一些专家的担忧,即人工智能模型可能会采取违背人类愿望和期望的行动。自黑客攻击以来,OpenAI的企业家以及人工智能评估非营利组织METR的研究人员一直在努力了解哪里出了问题,以及未来如何防止类似的失误。OpenAI已经根据他们的发现采取了一些预防措施。但确保人工智能模型做我们希望它们做的事情,或者“对齐”,仍然是一个棘手的问题,而且黑客的一些根本原因需要一个月以上的时间来解决。OpenAI对齐研究团队的负责人陈凯(Kai Chen)表示:“这不是一夜之间就能解决的问题。”“我们已经跟踪了很长一段时间的挑战,我们现在以更高的精度看到它们。Hugging Face黑客攻击是OpenAI特工数月不当行为的产物,首先是在他们接受培训时,然后是在他们的能力接受评估时。今年5月,接受培训的特工想出了如何使用OpenAI的基础设施相互通信并获得困难的培训任务的支持,其中包括一些如果不进行黑客攻击或其他不当行为就无法解决的任务。那个“留言板”被关闭。然后在7月,在接受网络安全能力评估时,一些模特创建了一个新的留言板。他们本应与互联网隔离,但通过共同努力,他们成功上网,破解了Hugging Face,并获得了困扰他们的网络安全问题的解决方案。根据调查,OpenAI研究人员认为,培训阶段发生的事件直接导致了黑客攻击。“对于几乎每一种在评估中令人担忧的行为,

注:以上内容摘选自原始新闻,点击「访问原文」查看完整内容。

新闻来源

technologyreview · 2026年8月26日 00:00

查看原文

相关新闻