OpenAI API 更新日志显示,2026-10-06 Decisions API 以 gpt-6-luna 进入公测:独立端点 POST /v1/decisions 接收文本/图片与一组问题,返回带概率的 predicate、choice、score 三种类型化答案,官方称比 Responses API 快约 10 倍;只收输入费 $0.10/1M token,无输出与缓存费,支持 ZDR 与 HIPAA,预计数周内 GA。
核心要点速览
- ✓速度:官方称返回类型化答案比 Responses API 快约 10 倍(Decisions 指南)
- ✓价格:仅收输入 $0.10/1M token,无输出、缓存读/写费用;同模型走常规接口为输入 $0.10、输出 $0.50/1M
- ✓3 种问题类型:predicate 返回 0–1 概率;choice 返回选项 + probabilities + confidence;score 返回有序等级的概率加权分
- ✓合规:支持 ZDR 与 HIPAA,数据驻留覆盖美国与欧洲(EEA + 瑞士),预计数周内 GA
- ✓限制:目前仅 gpt-6-luna;图片必须内联 base64,不支持 HTTPS 图片 URL 与 file_id

开发者 3 秒速决决策指标
把技术选型换算成你的开发预算
40 款主流编程套餐横向比价,支持输入/输出 Token 真实账单模拟
相关资源与官方项目出处
免代理直达深度技术解析与实战评估
核心背景与行业痛点
很多 Agent 和业务系统里,最常见的 LLM 调用并不是写长文,而是回答“这条该分给谁”“图里有没有损坏”“严重程度几级”这类问题。以往的做法是用 Responses API 加 JSON Schema 来拼:输出 token 贵、延迟高,概率也拿不到,阈值只能靠猜。Decisions API 在 DevDay 上首次亮相,按更新日志,10 月 6 日起转入公测。
架构亮点与底层机制
它是独立端点 POST /v1/decisions,请求由 model、input(文本,或文本+图片消息)和 questions 三部分组成。问题分三种:predicate 返回条件成立的概率;choice 从给定选项里选一个,同时附上 probabilities 和 confidence;score 按有序等级计算概率加权分。同一份输入可以一次问多个独立问题,有前后依赖的问题则要分开请求。
权威 Benchmark 与实测跑分对比
官方没有公布准确率跑分,只说比 Responses API 快约 10 倍。计价只收输入,每百万 token $0.10,不收输出和缓存费用;同一个模型走常规接口时,输出价是每百万 $0.50。
开发者实战落地与开箱指南
可以先在 Playground 里调试问题。官方指南建议用自己的标注样本来定阈值,并给 choice 加一个 other 兜底选项。图片必须用 base64 内联。要接语音场景,可参考 Live API 委托。目前只支持 gpt-6-luna,GA 前接口可能还会调整。
即刻查看该技术对应模型与主流工具的实测差异,或一键测算团队 API 调用与 $20/月套餐盈亏平衡点。
讨论与评论
0登录后即可参与深度讨论
与广大 AI 开发者、工程师交流评测心得与前沿洞察