发生了什么

多篇来自 Hot Chips 相关报道的资讯称,OpenAI 展示了自研推理芯片 Jalapeño 的测试结果。报道将其定位为模型上线后的推理硬件,而非训练芯片:一篇报道给出 550W 功耗,并称其在 GPT-OSS、DeepSeek R1 等模型上展示了相对 GB200/GB300 的每瓦性能和延迟优势;另一篇称其采用台积电 N3P 工艺、以更简化的内存层级减少数据搬运。计划部署时间被报道为 2026 年底。

可回溯的证据
  • 报道将比较指标放在每千瓦峰值吞吐量、Token 延迟和每用户 Token 数,而不只是峰值算力。
  • 其中一则报道明确称:550W;另一则称设计重点是数据移动与通信延迟。
  • 关于具体合作方的报道彼此不一致,因此本文不据此作判断。
发生了什么 | AI 趋势