跳到正文
北京时间
返回综合榜

Claude Opus 4.7

Anthropic · 2026-04-16 发布 · 09/29 08:58 更新

综合共识指数71.6综合榜第 19 名
分类成绩3/ 4 项分类
已有成绩18项评测
上下文窗口100万Token
API 输入 / 输出 · 每百万 Token¥33.55 / ¥167.76缓存 ¥3.36原价 $5 / $25厂商官方价格
CAPABILITY PROFILE

各有所长,看得更清楚。

每项能力单独计算。没有足够的实测,就留空。

不同分类的分数反映各自参照组中的排序支持,不能直接相加或用来比较不同能力的绝对高低。

UNDERSTANDING THE RANK

综合名次,有多稳定?

依次移除一项评测或一家机构、调整单项权重与误差处理,观察排名怎样变化。

重新检查资格后的名次14—19 名证据敏感

已完成的对照中均具备参评资格。保持原候选不变时为 16—19 名。这个范围不是置信区间,也不包含从未公开的成绩。

BEHIND THE SCORE

每一项成绩,都有来处。

下面是该模型的公开汇总成绩。展开可查看运行配置与采用方式。

综合评测与体验7 项

编程1 项

推理5 项

知识2 项

专业办公2 项

视觉理解1 项

没有测到的计分评测

这些评测没有公开该模型的成绩,缺测不记零分。

还有一些未知

缺失的评测不会记成零分。模型的名次会随新证据变化,分数相近时不宜过度解读细小差距。

了解计算方法 →