首页/新闻/Jalapeño’s first results show industry-leading speed and efficiency in AI inference
技术突破

Jalapeño的首批结果显示了AI推理的行业领先速度和效率

openai
2026年8月25日 00:00
2026年8月25日 00:00
访问原文

自从宣布OpenAI的第一款定制推理芯片Jalapeño以来,我们一直在测试该芯片和围绕它构建的系统。结果显示,性能有了显着的进步:Jalapeño每单位功率可以满足更多的人工智能工作,同时还可以更快地返回响应。Jalapeño通过一种架构提供更高的吞吐量和更低的延迟,而现有的硬件系统通常必须在两者之间做出权衡。 对于客户来说,随着需求的增长,这可能意味着更快的响应、更响应的代理以及更可靠的访问。我们的使命是确保通用人工智能造福全人类。这些成果将有助于使功能日益强大的人工智能变得更实惠、更广泛地可用。 OpenAI模型也加速了Jalapeño的发展。早期几代人帮助团队设计和推出芯片,而我们的最新型号正在加速我们对芯片进行优化和编程。Jalapeño的性能扩展到GPT-OSS 120 B、DeepSeek R1和Kimi K2.5 1 T,表明该架构适用于OpenAI内部和外部开发的模型。在这三个系统中,Jalapeño在峰值吞吐量下每瓦的人工智能工作量是比较系统的1.5至1.9倍,端到端延迟则是比较系统的1.7至3.6倍。对于高度互动的工作负载,它的性能提高了2.1至4.1倍。 墨西哥辣椒也是更广泛的全栈优势的证据。OpenAI可以设计模型、产品、服务软件、芯片、内存、网络和系统,利用我们从真实工作负载中学到的知识来改进堆栈的每一层。Jalapeño正在使用第一方硅,并取得了可衡量的结果,这是一个多代平台的开始。在未来的几个月里,我们将提升Jalapeño,为我们的客户提供更快、更强大、更高效的产品。 我们在匹配的用户体验下评估性能,衡量每个系统在满足延迟要求的同时每单位功率可以完成多少有用的人工智能工作

注:以上内容摘选自原始新闻,点击「访问原文」查看完整内容。

新闻来源

openai · 2026年8月25日 00:00

查看原文

相关新闻