技术突破
丰富情报背后的完整堆栈
openai
2026年8月25日 00:00
2026年8月25日 00:00
当整个系统共同改进时,人工智能的进步最快。这就是我对OpenAI计算策略的看法:一个涵盖数据中心和芯片、前沿模型、我们的开发人员平台、消费者和企业产品以及人工智能原生设备的集成系统,每一层都加强下一层。 更好的软件使硬件更有效率。专为我们的工作负载设计的硬件提高了速度和效率。功能更强的模型可以释放更好的产品,从而产生更多的需求、使用和学习。这些信号通过系统回流并帮助我们再次改进它。 今天, 我们分享 第一个测量的性能结果来自OpenAI的第一个定制推理芯片Jalapeño。在使用GPT-OSS 120 B的公共基准InferceX上,Jalapeño比商业系统提供了更高的每千瓦峰值吞吐量和更低的令牌延迟。它在DeepSeek R1和Kimi K2上的表现也很强劲,表明它的收益延伸到了各个模型家族。 Jalapeño让我们更好地控制模型的运行方式以及为其服务的经济性。通过开发模型,共同为软件、芯片、存储器和网络提供服务,我们可以作为一个系统提高吞吐量、延迟、能源效率和成本。它与我们从其他合作伙伴使用的加速器一起创建了一条可靠的第一方路径,扩大了我们将每项工作负载与经济状况良好的最强系统相匹配的能力。我们现在已经拥有了具有测量结果的第一方硅,并且子孙后代已经在进行中。 不同的工作负载对系统提出不同的要求。前沿训练、大容量推理和永远在线代理在芯片、软件、网络、功耗和延迟方面有不同的要求。 我们的目标是保持帕累托前沿:不断为每个工作负载寻求能力、速度、可靠性、效率和成本的最佳组合。不同芯片和提供商引领不同维度,前沿不断移动
注:以上内容摘选自原始新闻,点击「访问原文」查看完整内容。
新闻来源
openai · 2026年8月25日 00:00