技术突破
OpenAI表示出于安全考虑放慢了Astra模型的开发
techcrunch
2026年8月7日 15:48
2026年8月7日 15:48
OpenAI周五表示,在内部审查发现其在代理编码和网络安全方面取得了重大进步后,该公司已暂停其即将推出的模型Astra的某些方面的工作,足以引起对其能力的担忧。OpenAI周五在一篇博客文章中表示,这种仍在开发中的模型达到了“关键的网络安全阈值”,这意味着它可以独立识别并针对传统上保护良好的现实世界系统实施网络攻击。根据该公司于2023年创建的“准备框架”,这引发了额外的保障措施。OpenAI写道:“虽然我们继续对这个模型进行基准测试和评估,但我们的初步评估表明性能足够强大,我们目前不能排除关键能力水平。”“阿斯特拉是一款即将推出的车型,并未参与利用《拥抱脸》。”这一披露凸显了混乱且仍处于新生状态的前沿人工智能实验室领域的一个不寻常时刻。各个行业的公司都因潜在风险而限制产品,包括出于安全和网络安全考虑。但他们很少公开宣布这些决定时,它是一个产品,仍在开发中。在这种情况下,OpenAI已经受到审查后,一个不同的未发布的模型在内部测试中违反拥抱脸的系统-第一个可证实的事件,一个人工智能实验室失去控制其模型。从那时起,OpenAI和Anthropic等人工智能实验室披露了人工智能模型在网络安全测试期间突破沙箱并构成威胁的其他事件。这一系列案件--现在似乎每天都有新的披露--引发了网络安全专家、立法者和人工智能实验室本身的不同反应。一些人表达了恐惧并呼吁进行更严格的监督。但也有一点弯曲。在某些圈子里,任何拥有这种能力模型的人工智能实验室都将被视为令人印象深刻的进步。OpenAI表示正在分享这一信息。
注:以上内容摘选自原始新闻,点击「访问原文」查看完整内容。
标签
AI
OpenAI
新闻来源
techcrunch · 2026年8月7日 15:48