OpenAI 官方宣布首款自研定制推理芯片 Jalapeño 正式亮相,提供更高吞吐量与极低延迟,旨在为 ChatGPT 及 Codex 编程智能体提供前所未有的毫秒级交互体验,预计年内全面部署进计算集群。

核心要点速览 (Key Takeaways)

  • 专为大模型推理深度优化:大幅降低首字响应时间 (TTFT) 并提升长上下文并发处理能力
  • 直接赋能 Codex 智能体:多文件重构与终端实时调试交互响应速度显著跃升
  • 计划于 2026 年底前完成全量数据中心与计算集群部署