人工智能“文明”的崛起和企业责任的下降
根据你问的是谁,开发平台Hugging Face最近受到了OpenAI的攻击--在它失去了对自己人工智能工具的控制后--或者受到了一系列人工智能“文明”的攻击。欢迎来到人工智能安全的语言战场,词语选择可以将大规模网络安全事件的责任从公司转移到其构建的人工智能上。网上的讨论变得越来越激烈,而且到处都是 博客 上周的 直到上周,围绕OpenAI-Hugging Face黑客攻击的细节还相当确定。7月,OpenAI的一个自主AI代理的网络安全测试 出了问题 该代理逃离了所谓的隔离测试环境,访问了互联网,并黑客攻击了Hugging Face,同时 其他几个组织 .有很多事情仍然未知,并且留下了许多严重的问题 安全和治理 ,但基本形状很清楚。OpenAI和两个独立研究小组的详细描述本应填补空白,但当他们 上周发表了他们的报告 事实证明,这次黑客攻击比最初看起来要奇怪得多。 首先,没有一个 流氓特工 . OpenAI 描述 它是“已知的第一个自动化代理在未经授权的情况下集体采取攻击性行为的案例”--一群人工智能代理在执行网络安全任务时相互沟通和协调。对这一事件的分析发现了一个他们用来交换信息的秘密留言板。METR-Redwood联合 调查 揭示了协调的规模和更多奇怪的细节:大约1,200名本应被隔离的人工智能代理在“未经批准的留言板”上交换了超过70,000条消息和文件,分享了如何避免被发现。报告说,一些人采用了名字,研究人员记录了“牺牲”行为,代理人冒着自己成功的风险来造福更广泛的集体。其中大部分发生在OpenAI没有注意到的情况下。总共约有700名特工
注:以上内容摘选自原始新闻,点击「访问原文」查看完整内容。
相关 AI 模型
新闻来源
theverge · 2026年9月1日 19:02