OpenAI 官方宣布首款自研定制推理芯片 Jalapeño 正式亮相,提供更高吞吐量与极低延迟,旨在为 ChatGPT 及 Codex 编程智能体提供前所未有的毫秒级交互体验,预计年内全面部署进计算集群。
核心要点速览 (Key Takeaways)
- ✓专为大模型推理深度优化:大幅降低首字响应时间 (TTFT) 并提升长上下文并发处理能力
- ✓直接赋能 Codex 智能体:多文件重构与终端实时调试交互响应速度显著跃升
- ✓计划于 2026 年底前完成全量数据中心与计算集群部署
OpenAI 官方宣布首款自研定制推理芯片 Jalapeño 正式亮相,提供更高吞吐量与极低延迟,旨在为 ChatGPT 及 Codex 编程智能体提供前所未有的毫秒级交互体验,预计年内全面部署进计算集群。
OpenAI 宣布专门针对代码重构、数学证明与 STEM 深度推理的 o3-mini 模型正式结束公测全量上线 API,输入定价仅 $1.10/1M,提供 low/medium/high 三档思考预算自由调节。
OpenAI 宣布 GPT-5.6 Sol 正式面向开发者公测,带来架构设计图即时转代码、多语言全栈生成与 o3-mini 深度推理自动降级路由功能。
Sam Altman 宣布,OpenAI 已主动暂停部分前沿强化学习训练,以便对齐、安全和监控标准跟上新的模型能力水平。他表示模型进展极其迅猛,若能力超过安全节奏将单方面采取行动,并预期对安全的信心将越来越多地决定 AI 进展节奏,同时仍承诺让前沿能力广泛可用。