GitHub 发布 Project HydraFusion 研究预览:按任务编排多模型与工作流,在受控离线评测中相对 Claude Opus 5 于 Terminal-Bench 2.1 取得更高已验证任务质量与更低预估成本。可在 GitHub Copilot 中像普通模型一样选用,并通过 Copilot CLI 的 /experimental 试用。
核心要点速览 (Key Takeaways)
- ✓评测:相对 Claude Opus 5,Terminal-Bench 2.1 已验证任务质量高约 4.9 个百分点。
- ✓成本:预估工作流成本约降 67%。
- ✓落地:GitHub Copilot 研究预览;Copilot CLI 可用 /experimental 选用 HydraFusion。
讨论与评论
0登录后即可参与深度讨论
与广大 AI 开发者、工程师交流评测心得与前沿洞察