Greg Brockman · @gdb · X·2026-08-25 23:31·9小时前
AI 导读

OpenAI 公布首款自研推理芯片 Jalapeño 的实测性能:在基于 GPT-OSS 120B 的公开基准 InferenceX 上,其每千瓦峰值吞吐量更高、token 延迟更低,并在 DeepSeek R1 和 Kimi K2 上表现强劲。AI 参与设计使其从初始设计到流片仅用九个月,计划年底前部署,Gen 2 和 Gen 3 已在开发中。

Greg Brockman@gdb
41AI 编辑部评分,满分 100
2026-08-25 23:31· 9小时前
AI 导读

OpenAI 公布首款自研推理芯片 Jalapeño 的实测性能:在基于 GPT-OSS 120B 的公开基准 InferenceX 上,其每千瓦峰值吞吐量更高、token 延迟更低,并在 DeepSeek R1 和 Kimi K2 上表现强劲。AI 参与设计使其从初始设计到流片仅用九个月,计划年底前部署,Gen 2 和 Gen 3 已在开发中。

inference numbers published for jalapeno, team did an amazing job https://openai.com/index/jalapeno-first-results/

tae kimOpenAI: "Today, we shared the first measured performance results from Jalapeño, OpenAI’s first custom inference chip. On InferenceX, a public benchmark using GP...