OpenAI 公布首款自研推理芯片 Jalapeño 的实测:同一架构同时提升吞吐并降低延迟,单位功耗输出更多智能。公司计划年底前将其部署到自有算力集群,以加速 ChatGPT 响应与 Codex/智能体会话,并已启动第二代、第三代芯片路线图。
核心要点速览 (Key Takeaways)
- ✓首款自研推理芯片在实测中同时做到更高吞吐与更低延迟
- ✓将优先惠及 ChatGPT 响应速度以及 Codex 会话与智能体
- ✓年底开始部署,并已规划多代芯片路线以持续压低推理成本
OpenAI 公布首款自研推理芯片 Jalapeño 的实测:同一架构同时提升吞吐并降低延迟,单位功耗输出更多智能。公司计划年底前将其部署到自有算力集群,以加速 ChatGPT 响应与 Codex/智能体会话,并已启动第二代、第三代芯片路线图。
OpenAI 为 GPT-5.6 Sol 推出 Ultrafast 模式,由 Cerebras 提供推理算力,最高约 750 tokens/秒、速度提升最高 14 倍。该模式首先通过 OpenAI API 向部分客户开放,面向实时语音客服、电商、编程设计、金融研究与安全响应等对延迟极其敏感的场景。
OpenAI 宣布因 Cursor 被 SpaceX 收购而结束合作,提议于 11 月 12 日切断 Cursor 对 OpenAI 模型的直连。声明称将重点保障依赖 GPT 的开发者过渡体验,此事迅速成为编程智能体生态中最受关注的行业地震。
OpenAI 官方宣布首款自研定制推理芯片 Jalapeño 正式亮相,提供更高吞吐量与极低延迟,旨在为 ChatGPT 及 Codex 编程智能体提供前所未有的毫秒级交互体验,预计年内全面部署进计算集群。