Command Code CEO Ahmad Awais 发布 Composio 基准结果称,Command Code 在开放模型上的 Agent harness 对比中解决 30 项任务中的 18 项,并以 375 秒平均用时领先;该贴引用了 Composio 在 GPT-6 Astra 上对六种编码 Agent harness 的测试。

核心要点速览 (Key Takeaways)

  • Command Code 在 30 项任务中解决 18 项,贴文称其准确率领先其他 harness。
  • 平均任务用时 375 秒,贴文称其速度也领先并超过 DeepSeek 自有 harness。
  • 引用的 Composio 测试覆盖 Codex、Claude Code、OpenCode、Hermes Agent、Pi Agent 与 Command Code 六种 harness。
ADSponsored