OpenAI发布了其自主设计的AI推理处理器芯片Jalapeño,并公布最新测试结果显示该芯片在速度和能效方面均优于英伟达现有的GB300和即将推出的Blackwell芯片 [1, 2, 3]。

Jalapeño芯片采用台积电N3P工艺,设计峰值性能达到13.4 PFLOPs,功耗为700瓦特热设计功率,这使其在保证高性能的同时实现了较低电力消耗,有助于降低OpenAI数据中心的运营成本 [1, 3]。OpenAI芯片负责人Richard Ho称,“这是一款非常出色的芯片——它将大幅降低成本。”他还表示,Jalapeño在高吞吐量和低延迟两方面都表现出色 [1]。

该芯片支持15.4 TB/s的HBM4内存带宽,并能实现每用户每秒约700个推理Token的基础吞吐率。OpenAI称其芯片在单位功率的AI工作负载处理和响应速度方面优于英伟达的Rubin芯片,尽管后者在更广泛的训练任务中仍保持优势 [3, 2]。

今年6月,OpenAI正式公开宣布Jalapeño项目,芯片开发始于2024年中,历时约16个月完成流片。该设计与Broadcom合作完成,OpenAI计划年底前将在其计算基础设施中部署首代Jalapeño芯片,2027年开始量产第二、第三代新版本 [1, 2, 3]。

分析师Adrien Sanchez表示:“现在一家超大规模云服务商设计的芯片可以在推理效率上匹配甚至超过英伟达Blackwell级GPU。”Omdia高级分析师Alexander Harrowell称该芯片的能效表现令人印象深刻。TrendForce分析师Fion Chiu指出,英伟达GPU凭借其广泛的可编程性和软件生态,仍将在更复杂的计算任务中占据重要地位 [2]。

OpenAI正在利用其AI编码工具Codex和定制编程语言Gluon辅助芯片及软件开发,计划通过Jalapeño减少对英伟达推理芯片的依赖,实现更高效的AI推理部署 [3, 2]。

据悉,OpenAI将在今年年底前完成Jalapeño芯片的初步部署,并在2027年加速推动该芯片的全面量产。