Anthropic 于 2026-09-28 发布 Claude Sonnet 5.5(API:claude-sonnet-5-5),Claude 5.5 家族第二款模型。相对 Sonnet 5:Terminal-Bench 4.0 从 10.3% 跃至 70.6%,CursorBench 4.0 55.5%,GDPval-AA 逼近 Opus 5.5;输出快 30%+,同价 $2/$10 但多数任务成本可低约 30%。原生 1M 上下文,自适应 thinking 默认开,关闭前置思考需 between_tools。
核心要点速览 (Key Takeaways)
- ✓官宣:Claude Sonnet 5.5(2026-09-28);API ID
claude-sonnet-5-5,Bedrockanthropic.claude-sonnet-5-5 - ✓跑分:Terminal-Bench 4.0 70.6%(Sonnet 5:10.3%);CursorBench 4.0 55.5%;GDPval-AA v2.1 1844(Opus 5.5:1846)
- ✓性价比:定价仍 $2/$10 per MTok,缓存读 $0.20;宣称输出快 30%+、多数任务成本可低约 30%
- ✓规格:原生 1M 上下文 / 最大输出 128K;thinking 默认自适应,关前置思考用
between_tools - ✓落地:见 Migration;SDK 升 anthropic≥1.9.0;Claude Code≥2.1.284
sonnet→5.5
阅读完核心要点?进一步了解模型实力与实际开销
7 大权威镜像天梯跑分与 29+ 款主流编程套餐横向比价测算
相关资源与官方项目出处
免代理直达深度技术解析与实战评估
核心背景与行业痛点
日常编码、修 bug、做幻灯片与表格这类「范围清晰」的任务,团队既要接近 Opus 级质量,又要压住延迟与账单。上一代 Sonnet 5 在 agent 编码与长时知识工作上的差距明显,且 token 浪费偏高,迭代反馈环偏慢。Anthropic 于 2026-09-28 发布 Claude Sonnet 5.5,作为 Claude 5.5 家族第二款模型,定位为 Opus 5.5 的高速低成本互补档:复杂开放式判断仍交给 Opus,日常落地交给 Sonnet 5.5。
架构亮点与底层机制
API 模型 ID 为 claude-sonnet-5-5(Bedrock:anthropic.claude-sonnet-5-5;亦上线 Google Cloud / Microsoft Foundry)。原生 1M 上下文、最大输出 128K(Message Batches 可到 300K)。定价与 Sonnet 5 同为 $2/$10 per MTok,缓存读 $0.20。自适应 thinking 默认开启;关闭前置思考须改用 between_tools。Effort 可调 low–max,Claude API 默认 high。它是首款搭载与高能力模型同级 cyber 护栏与防蒸馏分类器的 Sonnet。详见 Overview 与 Migration。
权威 Benchmark 与实测跑分对比
官方数字(相对 Sonnet 5):Terminal-Bench 4.0 70.6% vs 10.3%;CursorBench 4.0 55.5% vs 34.1%(仅次 Opus 5.5 的 57.8%);GDPval-AA v2.1 1844 vs 1449(逼近 Opus 5.5 的 1846);OSWorld 2.1 partial 80.1% vs 57.0%;Chartography(无工具)61.6% vs 15.6%。宣称输出生成快 30%+,多数任务成本可低至约 30%(同价但更少 token)。更细评测见 System Card;勿把单一榜分外推为全场景 Opus 替代。
开发者实战落地与开箱指南
model="claude-sonnet-5-5" 即可调用;原 thinking off 需迁到 between_tools(见 What's new)。Claude Code ≥2.1.284 的 sonnet 别名已指向 5.5。Python 侧请升至 anthropic≥1.9.0。强制 tool use、旧版 computer_20251124、thinking 块与会话绑定等有破坏性变更,上线前按迁移指南做回归。

讨论与评论
0登录后即可参与深度讨论
与广大 AI 开发者、工程师交流评测心得与前沿洞察