OpenAI 正式披露其首款自研推理芯片 Jalapeño 的实测数据(InferenceX)。在 GPT-OSS 120B、DeepSeek R1 与 Kimi K2.5 1T 模型上,峰值吞吐下每瓦算力提升 1.5–1.9 倍,端到端延迟降低 1.7–3.6 倍,计划年底前全面部署于自有算力集群。
核心要点速览 (Key Takeaways)
- ✓OpenAI 从纯大模型公司正式跨入自研硬件芯片阵营,并在跨模型上给出公开客观基准数据;
- ✓芯片专为 Agent 推理架构定制,同一套芯片架构同时兼顾 Prefill 阶段与 Decode 阶段的高并发处理;
- ✓硬件开发周期被 AI 研发大幅压缩:仅 9 个月完成 Tapeout,并在 2 个月内通过 Codex 完成对三款开源大模型的全速适配。