85%因人工智能错误而受损的公司正在竞相削减可能感染下一个错误的人
那些已经被人工智能代理通过评估并在生产中失败的企业正在以更快的速度将人类从部署决策中剔除,而不是更慢的速度--尽管对自动化评估的信任正在全面上升, VB Pulse的新研究表明 . 七月, 接受调查的108家企业中有13%表示他们信任自动化评估, 高于前一个月的5% .与此同时,调查受访者援引 不良对准 测试和现实世界结果之间的关系 最大担忧下降10个百分点,从29%降至19%, 月复一月。 然而, 49%的调查受访者表示,通过公司测试的人工智能代理或LLM支持的功能随后造成了客户可见的问题 ,与6月份的50%基本持平。近四分之一(24%)的人表示已经发生过这种令人不安的结果 更 不止一次。 的最新发现 VentureBeat Intelligence 揭示了企业代理推出中一个更令人不安的阶段:差距不再仅仅在于公司赋予代理多少自主权与他们验证它们的能力之间。对评估层的信心与该层在防止失败方面变得更好的证据之间的差距越来越大。 最能说明问题的分歧出现在7月份的数据中。 在经历了人工智能功能明确测试但最终让客户失望的企业中,4%的企业完全相信自动化检查。在那些没有检测到类似事件的人中,24%的人表示完全有信心--相差六倍。 这是有道理的:毫不奇怪,那些经历过通过测试的代理在现场生产中失败的人更有可能怀疑自动检查过程。 也许有道理,那些致力于解决这个问题的公司--比如自动化代理错误监控和缓解平台 Raindrop.ai - 与几个月前相比,市场正在发生巨大变化。 Raindrop首席技术官Ben Hylak表示:“我们看到evals的大幅下降。”
注:以上内容摘选自原始新闻,点击「访问原文」查看完整内容。
新闻来源
venturebeat · 2026年8月18日 15:35