OpenAI 公布自研推理芯片 Jalapeno 性能数据
OpenAI 发布 Jalapeno Intelligence Processor 的 InferenceX 测试数据,与 NVIDIA Blackwell 作对比。该芯片计划于 2026 年底开始部署。
测试条件
- 对比对象为上一代 NVIDIA Blackwell
- 测试模型:GPT-OSS-120B、DeepSeek-R1、Kimi K2.5 1T
- 固定 8K 输入 / 1K 输出 序列长度,未包含 agentic 负载轨迹
公布的数据
| 指标 | 相对 Blackwell |
| 交互性 Interactivity | 2.1 – 4.1× 更高 |
| 端到端延迟 | 1.7 – 3.6× 更低 |
| 性能/瓦(峰值吞吐) | 1.5 – 1.9× 更高 |
| 性能/瓦(最佳 TBT 点) | 8.6 – 104.3× 更高 |
其他信息
- OpenAI 称在自家前沿模型上优势更大,未公布数据
- 从设计启动到流片历时 9 个月
- SemiAnalysis 称其每兆瓦 token 吞吐高于 CoreWeave 公布的 Vera Rubin NVL72 数据
背景
- OpenAI 表示将继续大规模部署 NVIDIA GPU 用于训练与推理;双方近期宣布 OpenAI 将成为 PORTS-Pike 客户,规模最高 8 GW
- NVIDIA Vera Rubin 与 Groq 3 LPX 均已进入全面量产
评论