首页/新闻/The fix for rogue AI agents could be more AI
行业动态

对流氓AI代理的修复可能是更多的AI

techcrunch
3天前
2026年9月17日 13:34
访问原文

随着公司将更长、更复杂的任务移交给人工智能代理,他们遇到了一个监督问题:代理的行动速度可以比人类实际审查的速度更快、更长时间和更大的数量。随着“拥抱脸”事件,这个问题达到了顶峰,近12,000名特工的协调速度超出了人类的追踪速度。如何跟踪如此大的特工群?人工智能实验室和初创公司正在出现的答案既简单又令人疯狂:让另一个人工智能加入循环。依赖人工智能对于独立调查OpenAI Hugging Face事件是必要的。红杉研究中心的首席科学家、三名审计师之一瑞安·格林布拉特(Ryan Greenblatt)开玩笑地将他们的努力称为“草率调查”,并指出数据量“使得不依赖人工智能”就“不可能”了解正在发生的事情。一些人对使用人工智能监控人工智能持怀疑态度。“如果你有一个人工智能正在做恶意事情,并且它怀疑另一个人工智能正在监视它,它可能会尝试欺骗那个人工智能,”有影响力的科技博主西蒙·威廉姆森(Simon Willison)说,他追踪了一系列人工智能代理事件今年。“你几乎可能会陷入这样的境地:你的恶意人工智能试图智胜监视它的人工智能。”他指出,比人工智能更聪明并不是假设的,并回顾了OpenAI事件。“我们在OpenAI的拥抱脸事件中看到了一些这样的情况,他们的模型都密谋欺骗分级人工智能,以便他们可以通过事情得到非法答案。所以他们正在考虑这个问题,对吧?”这些担忧并没有阻止一大群初创公司追求这一想法。据TechCrunch统计,Y Combinator近年来已资助了106家与人工智能可观察性相关的公司。Braintrust、LangChain和Judgment Labs等许多其他初创公司也筹集了数亿美元,而Arize和Galileo等五到六年前成立的更成熟的公司已经退出。在某种程度上,这是一种回应

注:以上内容摘选自原始新闻,点击「访问原文」查看完整内容。

标签

AI
ai safety

新闻来源

techcrunch · 2026年9月17日 13:34

查看原文

相关新闻