跳到正文
北京时间
原文
Arena.ai· @arena · X·· 5 天前精选AI 评分79
AI 导读

Arena 宣布 Claude Opus 5.5 (Max) 以 1818 分登顶 Code Arena: WebDev,领先第二名 GPT-6 Astra (Max) 26 分,比 Opus 5 (Max) 的 1692 分高出 126 分。

推荐理由

原文给出了 Code Arena: WebDev 具体分数和领先幅度,读者可以据此比较 Opus 5.5 与其他模型的表现和性价比。

正文 · AI 翻译

重磅消息:@AnthropicAI 的 Claude Opus 5.5 (Max) 刚刚在 Code Arena: WebDev 中以 1818 分登顶第一,并重塑了帕累托前沿!这比排名第二的 GPT-6 Astra (Max) 领先了整整 +26 分,相比此前 1692 分的 Opus 5 (Max) 更是大幅提升了 +126 分。

纵观各分类,我们可以看到 Opus 5.5 (Max) 在以下领域均跻身榜首:
- 在品牌与营销、基于参考的设计、数据与分析、仿真与游戏领域排名 #1!
- 在消费产品领域排名 #2

随着更多投票的涌入,敬请期待更多领域和分类的洞察结果。

恭喜 @AnthropicAI 发布!

引用Claude@claudeai
隆重推出 Claude Opus 5.5,这是我们全新的 Claude 5.5 系列中的首个模型。 在大多数任务上,它的表现达到了 Claude Fable 5.1 的水平,而运行成本比 Opus 5 低 40%。
原文

Introducing Claude Opus 5.5, the first model in our new Claude 5.5 family. It performs at the level of Claude Fable 5.1 for most tasks, and costs 40% less to run than Opus 5.

在 X 查看被引用的帖子

来源:Arena.ai · x.com