Anthropic 正式推出 Claude Fable 5.1,并同步发布面向网络防御与生命科学的 Mythos 5.1。Fable 5.1 在 Terminal-Bench 4.0 上达到 55.8%(上代 42.0%),科学终端基准翻倍至 52.6%,并在 CursorBench 3.2 以 73.4% 成为 Cursor 实测最强模型;缓存读取成本下降 75%,高代理工作负载最高可省约 45%。
核心要点速览 (Key Takeaways)
- ✓Fable 5.1 即日起全面可用,定位全球最强编程与知识工作模型
- ✓Terminal-Bench 4.0 达 55.8%,科学基准 52.6%,长程任务与科研能力显著跃升
- ✓Mythos 5.1 走受信访问;企业级前沿安全护栏(EFS)将于秋季分阶段上线
讨论与评论
0登录后即可参与深度讨论
与广大 AI 开发者、工程师交流评测心得与前沿洞察