Anthropic 正式推出 Claude Fable 5.1 与面向网防和生命科学的 Mythos 5.1,宣称其为全球最强编程与知识工作模型。Fable 5.1 在 Terminal-Bench 4.0 上达到 55.8%(Fable 5 为 42.0%),科学终端基准翻倍至 52.6%;缓存读取降价 75%,典型负载成本约降 25%,高智能体负载最高可降 45%。该模型已登陆 Cursor(CursorBench 3.2 最高 73.4%)和 GitHub Copilot。
核心要点速览 (Key Takeaways)
- ✓Fable 5.1 专长长程编程、深度代码库研究与复杂智能体工作流,并显著降低误拒率
- ✓缓存降价使智能体场景成本最多下降 45%,低 effort 档即可接近前代高峰表现
- ✓Mythos 5.1 走受信访问,同时推出企业级 EFS(零保留 + 对抗监控)
讨论与评论
0登录后即可参与深度讨论
与广大 AI 开发者、工程师交流评测心得与前沿洞察