Command Code CEO Ahmad Awais 发布 Composio 基准结果称,Command Code 在开放模型上的 Agent harness 对比中解决 30 项任务中的 18 项,并以 375 秒平均用时领先;该贴引用了 Composio 在 GPT-6 Astra 上对六种编码 Agent harness 的测试。
核心要点速览 (Key Takeaways)
- ✓Command Code 在 30 项任务中解决 18 项,贴文称其准确率领先其他 harness。
- ✓平均任务用时 375 秒,贴文称其速度也领先并超过 DeepSeek 自有 harness。
- ✓引用的 Composio 测试覆盖 Codex、Claude Code、OpenCode、Hermes Agent、Pi Agent 与 Command Code 六种 harness。
讨论与评论
0登录后即可参与深度讨论
与广大 AI 开发者、工程师交流评测心得与前沿洞察