跳到正文
北京时间
原文
Artificial Analysis· @ArtificialAnlys · X·· 9 小时前精选AI 评分73
AI 导读

Artificial Analysis 发布 Coding Agent Index 榜单,Claude Sonnet 5.5 (max) 在 Claude Code 以 68 分居首,但每任务成本最高达 $14.19。

推荐理由

原文对比了三个新模型在 Coding Agent Index 的成绩和每任务成本,读者可据此权衡性能与价格的组合。

正文 · AI 翻译

本周 Claude Sonnet 5.5、GPT-6.1 Sol 和 Gemini 4 Argon 都发布并接近 Coding Agent Index 排行榜榜首,但各自在性能与成本上的平衡不同

Artificial Analysis Coding Agent Index 通过三项智能体编程评估来衡量智能体(模型与 harness 的组合)。

➤ Claude Code 中的 Claude Sonnet 5.5(max)以 68 分位居榜首,但每任务实测成本也最高:$14.19

➤ Antigravity CLI 中的 Gemini 4 Argon(high)以每任务 $5.84 得分 64——不到 Sonnet 5.5 成本的一半。注意,这使用的是 Google 的促销定价,且 Argon 尚未公开可用

➤ Codex 中的 GPT-6.1 Sol(xhigh)以 $1.04 得分 63,约为 Argon 成本的六分之一

来源:Artificial Analysis · x.com