@ArtificialAnlys 发布 AA-Briefcase 评测:Grok 4.7 仅次于 Anthropic 模型,排在 Opus 5 之后且每任务成本约为其一半。相对 Grok 4.6,公开尽调场景 AA-Briefcase-Lite 上 Analytical Quality Elo 从 1698 升至 1994,Presentation Elo 从 1531 略降至 1499;示例 deck API 成本约 Grok 4.7 (xhigh) $8 vs Grok 4.6 (xhigh) $4.40。
核心要点速览 (Key Takeaways)
- ✓AA-Briefcase:Grok 4.7 仅次于 Anthropic,排在 Opus 5 之后,任务成本约为一半。
- ✓相对 4.6:Analytical Quality Elo 1698→1994,Presentation Elo 1531→1499。
- ✓示例 deck:Grok 4.7 (xhigh) 约 $8,Grok 4.6 (xhigh) 约 $4.40。

讨论与评论
0登录后即可参与深度讨论
与广大 AI 开发者、工程师交流评测心得与前沿洞察