OpenAI 公布首款自研推理芯片 Jalapeño 的实测:同一架构同时提高吞吐、降低延迟,并提升每瓦智能。产品侧效果是 ChatGPT 回复更快、Codex 会话与代理更跟手,并在需求上涨时保持可用。计划年底前写入 OpenAI 算力基础设施;第二代已在深度开发,第三代在规划中。

核心要点速览 (Key Takeaways)

  • 编码体验的下一跳不只是更大模型,而是自研推理芯片把 Codex/代理延迟压下去。
  • Jalapeño 的卖点是吞吐与延迟同时改善,而不是用效率换速度。
  • 年底入集群后,ChatGPT Work 与 Codex 高峰时段可用性有望更稳。
ADSponsored