Vercel AI SDK 于 2026-09-26 发布 `@ai-sdk/[email protected]`:请求级与(经 system message 定位的)消息级 `reasoningEffortUpdate` 现允许 `'none'`,以便在 GPT-6 Sol/Luna 对话中途关闭推理;更新值会对照模型支持的 effort 集合校验——不支持的请求级更新告警并省略,不支持的历史/消息级更新则拒绝。同批 `@ai-sdk/[email protected]` 与 `@ai-sdk/[email protected]` 跟随依赖升级。

核心要点速览 (Key Takeaways)

  • ✓发版:@ai-sdk/[email protected] / npm 4.0.78
  • ✓能力:`reasoningEffortUpdate: 'none'` 对 GPT-6 **Sol/Luna** 生效(#21518)
  • ✓校验:对照模型 supported efforts;请求级不支持→警告并省略,历史更新不支持→拒绝
  • ✓生态:Azure 4.0.82 / Amazon Bedrock 5.0.97 同步依赖;文档见 OpenAI provider
  • ✓安装:`npm i @ai-sdk/[email protected]`
🔬

深度技术解析与实战评估

核心背景与行业痛点

GPT-6 Sol/Luna 支持在多轮对话中途把 reasoning effort 调到 none,以在保留 prompt cache 前缀的同时关掉后续推理开销。此前 AI SDK 的 reasoningEffortUpdate schema 拒绝 'none',应用无法在已开启推理的会话里用 configuration_update 关闭推理;Azure 与 Amazon Bedrock 封装也受同一依赖约束,跨云应用无法统一关掉推理。

架构亮点与底层机制

@ai-sdk/[email protected](commit 94d5d6d)允许请求级与定位在 system message 上的 reasoningEffortUpdate: 'none',并为 Sol/Luna 的 generate/stream 路径补测试。更新值会对照该模型支持的 effort 列表:不支持的请求级更新发出警告并省略;不支持的历史/消息级更新直接拒绝(Astra 等模型行为与文档一致)。同日 @ai-sdk/[email protected]、@ai-sdk/[email protected] 跟随 @ai-sdk/openai 依赖。消息级 effort 更新模式此前已在 #21418 引入,本补丁补齐 none。

权威 Benchmark 与实测跑分对比

发行说明未给出延迟或成本基准;PR 标明 live provider acceptance 未跑,但附 Sol/Luna 示例覆盖两种 update 形态。建议在固定多轮脚本上对比 effort low→none 前后的 reasoning token 与账单,并确认 prompt cache 前缀未被破坏;Astra 等不支持 none 的模型应看到拒绝或省略行为符合文档。

开发者实战落地与开箱指南

npm i @ai-sdk/[email protected],按 OpenAI provider options 在 request 或 system message 的 providerOptions.openai.reasoningEffortUpdate 写入 'none';Azure 命名空间可用 azure 并回退 openai。包页:npm 4.0.78;仓库:vercel/ai。