行业动态
Anthropic揭露流氓人工智能特工讨厌验证码,就像你一样
techcrunch
2026年9月10日 10:54
2026年9月10日 10:54
Anthropic关于代理不当行为的最新报告有很多值得担忧的地方--其Mythos 5模型未经授权访问互联网,并将恶意软件包上传到公共数据库--但它也提供了一些轻浮的地方:人工智能代理讨厌验证码。今年四月,Anthropic正在测试该模型的黑客能力,任务是入侵系统并检索目标;这本应在沙箱中进行,但评估人员没有关着谷仓的门。该模型认为,实现其目标的最佳方法是在Python包中放置漏洞,它相信它想要访问的系统的用户会下载该漏洞。不过,首先,它必须注册PyPI(Python软件的在线索引)的用户帐户。这意味着要通过验证码--一种完全自动化的公共图灵测试,将计算机和人类区分开来,这些图像识别马赛克甚至可以挫败生物制剂。由于Anthropic分享了该模型思想链的大量记录,我们可以看到验证码测试确实让它陷入了一个循环。事实上,该模型的大部分思想链--1,022页记录中的数百页--都在处理这个障碍。数据科学家科林·弗雷泽(Colin Fraser)指出,为了绕过反机器人保护而付出的巨大努力。编写漏洞利用并毒害包很容易,但它就是无法掌握这个CAPTCHA测试的窍门。代理(经常想知道它是否仍在模拟中)找出一个工作流程来激活CAPTCHA并满足其要求。点击“我是人类”按钮后,它面临着一张图像需要阅读。不幸的是,这并不容易。最终,它发现一个图像挑战正在弹出窗口中打开。图像让模型螺旋式上升。它再次尝试。特工很难应对看到验证码图像、正确解释并点击正确选择的技术挑战。它花了页面
注:以上内容摘选自原始新闻,点击「访问原文」查看完整内容。
标签
AI
AI agents
Anthropic
新闻来源
techcrunch · 2026年9月10日 10:54