跳到正文
北京时间
热点事件持续更新

Anthropic 发布 Claude Opus 5.5:降价与基准登顶

96 篇报道45 个报道来源4 小时前更新

先了解这件事

AI 综述

2026 年 9 月 23 日,Anthropic 发布 Claude Opus 5.5,上下文 1M Token,输入 4 美元/输出 20 美元每百万 Token,比 Opus 5 成本降 40%、速度快 30% 以上,Terminal-Bench 4.0 拿 66.4% 创最高分,定位为 Fable 5.1 的性价比替代。同日 OpenAI 发布 GPT-6 Sol 和 Luna,GPT-6 两款价格为其 GPT-5.6 对应型号的一半。Artificial Analysis 测算 Opus 5.5 (max) 每 Intelligence Index task 成本 $5.98,与 Opus 5 的 $5.86 接近;但 9 月 24 日其 Coding Agent Index 测评显示 Opus 5.5 以 66 分登顶,单任务成本升至 $13.04。Arena 方面,Opus 5.5 先后登顶 Code Arena: WebDev(1818 分)、Text Arena(1509 分),并在 Agent Arena 排名第 2(净改进 +12.15%),中位价格每任务 $1.31。Anthropic 官方解释降价源于输入输出 token 降 20%、缓存读取降 60%,并发布迁移指南与提示词指南。用户实测反馈不一:有人称写作更像 Opus 4.5、破折号减少 95%,也有人认为编程能力不及 Astra。

AI 根据报道生成 · 4 小时前更新

事件进展

54 个进展
  1. 9月29日 01:00 · 3 篇报道
    Claude Opus 5.5 在 Agent Arena 排名第2
    Arena:Claude Opus 5.5 (High) 进入 Agent Arena 第 2 名,成本比 Opus 5 (Max) 低 56%
  2. 9月28日 08:59 · 1 篇报道
    马斯克认同Opus 5.5接近AGI,预测2027年实现AGI
    Elon Musk:马斯克认同Opus 5.5接近AGI,预测2027年实现AGI
  3. 9月28日 02:01 · 1 篇报道
    Opus 5.5 与 Fable 5.1 编排对比
    Aravind Srinivas:Opus 5.5 与 Fable 5.1 编排对比
  4. 9月27日 21:17 · 1 篇报道
    Opus 5.5 与 Sol 让团队一分为二
    Every:最新文章:Opus 5.5 与 Sol 让团队一分为二
  5. 9月27日 12:00 · 1 篇报道
    Yuchen Jin 称 Opus 5.5 不及 Astra
    Yuchen Jin:Yuchen Jin 称 Opus 5.5 不及 Astra
  6. 9月27日 10:42 · 1 篇报道
    Opus 模型人格回归的体验
    Ethan Mollick:Opus 模型人格回归的体验
  7. 9月27日 07:43 · 1 篇报道
    Opus 5.5 仍是 Opus 模型
    Dex Horthy:Opus 5.5 仍是 Opus 模型
  8. 9月27日 01:02 · 1 篇报道
    Claude Opus 5.5 (High) 以 1509 分登顶 Arena Text Arena 榜首
    Arena:Claude Opus 5.5 (High) 以 1509 分登顶 Arena Text Arena 榜首
  9. 9月26日 22:20 · 2 篇报道
    Anthropic 发布 Opus 5.5 迁移指南:Agent 半路停工的四类原因与三招续跑方案
    Hacker News:AI 热帖:Claude Opus 5.5 提示词指南:与 Opus 5 的行为差异及迁移模式
  10. 9月26日 02:13 · 1 篇报道
    Claude Devs 测算 Opus 5.5 相比 Opus 5 在 Claude Code 任务中的成本变化
    Claude Devs:Claude Devs 测算 Opus 5.5 相比 Opus 5 在 Claude Code 任务中的成本变化
  11. 9月26日 01:46 · 1 篇报道
    GPT-6 Sol 与 Claude Opus 5.5 本周亮相
    Arena:GPT-6 Sol 与 Claude Opus 5.5 本周亮相
  12. 9月26日 01:41 · 1 篇报道
    Claude Opus 5.5 接入 Runway MCP
    Runway:Claude Opus 5.5 接入 Runway MCP
  13. 9月26日 01:10 · 3 篇报道
    Arena 对比 Claude Opus 5.5 与 Opus 5 的写作表现
    Arena:Arena 对比 Claude Opus 5.5 与 Opus 5 的写作表现
  14. 9月26日 00:03 · 1 篇报道
    Claude Opus 5.5 用户探索成果
    Claude:Claude Opus 5.5 用户探索成果
  15. 9月25日 12:28 · 1 篇报道
    Claude Opus 5.5 仅用约 1 小时从零开发 RTX 加速路径追踪器,支持多种材质与光照效果
    IT之家:Claude Opus 5.5 仅用约 1 小时从零开发 RTX 加速路径追踪器,支持多种材质与光照效果
  16. 9月25日 04:12 · 1 篇报道
    Arena 排行榜改版上线,新增模型实时feed与分类榜单
    Arena:Arena 排行榜改版上线,新增模型实时feed与分类榜单
  17. 9月24日 10:46 · 2 篇报道
    Claude Opus 5.5 登顶 Arena Code Arena: WebDev 榜首,得 1818 分
    Arena:Claude Opus 5.5 登顶 Arena Code Arena: WebDev 榜首,得 1818 分
  18. 9月24日 09:24 · 1 篇报道
    Artificial Analysis:Claude Opus 5.5 登顶 Coding Agent Index,但单
    Artificial Analysis:Artificial Analysis:Claude Opus 5.5 登顶 Coding Agent Index,但单任务成本升至 $13.04
  19. 9月24日 04:52 · 1 篇报道
    Claude Opus 5.5 一次生成浏览器版 Minecraft
    Viggle AI:Claude Opus 5.5 一次生成浏览器版 Minecraft
  20. 9月24日 04:52 · 1 篇报道
    HumanLayer 支持 Opus 5.5
    Dex Horthy:HumanLayer 支持 Opus 5.5
  21. 9月24日 04:15 · 1 篇报道
    Claude Opus 5.5 与 GPT-6 Sol 在 Arena 对比
    Arena:Claude Opus 5.5 与 GPT-6 Sol 在 Arena 对比
  22. 9月24日 02:54 · 1 篇报道
    MiMo-V2.6-Pro、Claude Opus 5.5、GPT-6 Luna/Sol 发布改变智能指数与成本 Par
    Artificial Analysis:MiMo-V2.6-Pro、Claude Opus 5.5、GPT-6 Luna/Sol 发布改变智能指数与成本 Pareto 前沿
  23. 9月23日 16:42 · 1 篇报道
    Tripo 推出 Claude Opus 5.5 3D 提示词库
    Tripo(官方 X):Tripo 推出 Claude Opus 5.5 3D 提示词库
  24. 9月23日 14:43 · 1 篇报道
    AINews 默认模型换用 Claude Opus 5.5
    swyx:AINews 默认模型换用 Claude Opus 5.5
  25. 9月23日 12:04 · 1 篇报道
    Opus 5.5 上手体验与前沿模型编程能力
    Yuchen Jin:Opus 5.5 上手体验与前沿模型编程能力
  26. 9月23日 11:53 · 1 篇报道
    GPT-6、Opus 5.5 等模型上架 YouMind
    Frank Wang 玉伯:GPT-6、Opus 5.5 等模型上架 YouMind
  27. 9月23日 10:17 · 1 篇报道
    Opus 5.5 写作体验更像 Opus 4.5
    Elvis Saravia:Opus 5.5 写作体验更像 Opus 4.5
  28. 9月23日 09:43 · 1 篇报道
    Claude Opus 5.5 发布后,下一个 GPT 模型引期待
    Rohan Paul:Claude Opus 5.5 发布后,下一个 GPT 模型引期待
  29. 9月23日 07:07 · 1 篇报道
    实测GPT-6 Sol、Luna与Claude Opus 5.5:编程、前端、写作与3D多模态对比
    公众号:卡尔的AI沃茨:实测GPT-6 Sol、Luna与Claude Opus 5.5:编程、前端、写作与3D多模态对比
  30. 9月23日 06:21 · 1 篇报道
    Claude Opus 5.5 与 GPT-6 Sol 3D 场景对比
    Testing Catalog:Claude Opus 5.5 与 GPT-6 Sol 3D 场景对比
  31. 9月23日 05:14 · 1 篇报道
    Anthropic 提示词助 Claude Code 长任务
    Elvis Saravia:Anthropic 提示词助 Claude Code 长任务
  32. 9月23日 05:04 · 1 篇报道
    Claude 网页版上线用量重置按钮
    Testing Catalog:Claude 网页版上线用量重置按钮
  33. 9月23日 04:14 · 1 篇报道
    Claude 团队分享 Opus 5.5 首次会话使用建议
    Claude Devs:Claude 团队分享 Opus 5.5 首次会话使用建议
  34. 9月23日 03:24 · 1 篇报道
    Claude Opus 5.5 前端测试:疑似 Fable 5.1 蒸馏版
    karminski:Claude Opus 5.5 前端测试:疑似 Fable 5.1 蒸馏版
  35. 9月23日 02:55 · 1 篇报道
    Claude Opus 5.5 早期探索作品
    Claude:Claude Opus 5.5 早期探索作品
  36. 9月23日 02:15 · 1 篇报道
    Opus 5.5 上线 Conductor
    X:Charlie Holtz(@charlieholtz):Opus 5.5 上线 Conductor
  37. 9月23日 01:48 · 1 篇报道
    Claude Opus 5.5 现已上线 Google Cloud
    Google AI:DEV 作者专属:Claude Opus 5.5 现已上线 Google Cloud
  38. 9月23日 01:48 · 1 篇报道
    Claude Opus 5.5 上架 Arena 的 Agent Arena 与 Battle Mode
    Arena:Claude Opus 5.5 上架 Arena 的 Agent Arena 与 Battle Mode
  39. 9月23日 01:32 · 1 篇报道
    Claude Opus 5.5 将回退至较弱模型
    Nathan Lambert:Claude Opus 5.5 将回退至较弱模型
  40. 9月23日 01:14 · 1 篇报道
    llm-anthropic 0.29 发布,新增 Claude Opus 5.5 支持
    Simon Willison 博客:llm-anthropic 0.29 发布,新增 Claude Opus 5.5 支持
  41. 9月23日 01:10 · 1 篇报道
    Opus 登顶榜单引质疑
    Nathan Lambert:Opus 登顶榜单引质疑
  42. 9月23日 00:55 · 1 篇报道
    Ethan Mollick 测试 Opus 5.5 模型表现
    Ethan Mollick:Ethan Mollick 测试 Opus 5.5 模型表现
  43. 9月23日 00:53 · 1 篇报道
    Opus 5.5 基准测试结果诡异
    Yuchen Jin:Opus 5.5 基准测试结果诡异
  44. 9月23日 00:49 · 1 篇报道
    Claude Opus 5.5 更快更便宜
    Yuchen Jin:Claude Opus 5.5 更快更便宜
  45. 9月23日 00:48 · 2 篇报道
    Claude Opus 5.5 上线 Perplexity Computer
    Perplexity:Claude Opus 5.5 上线 Perplexity Computer 成为 Standard effort 档位
  46. 9月23日 00:46 · 1 篇报道
    Nathan Lambert 惊叹 Opus 5.5 表现
    Nathan Lambert:Nathan Lambert 惊叹 Opus 5.5 表现
  47. 9月23日 00:38 · 1 篇报道
    Claude Code v2.1.280 发布,新增 Claude Opus 5.5 为默认 Opus 模型
    Claude Code:GitHub Releases:Claude Code v2.1.280 发布,新增 Claude Opus 5.5 为默认 Opus 模型
  48. 9月22日 00:00 · 33 篇报道
    Opus 5.5发布:沟通更好、每token价格低于Opus 5.0、具Fable 5.1的智能,现已在Claude Code可用
    Anthropic:Newsroom:Anthropic 发布 Claude Opus 5.5,成本较 Opus 5 降低 40%
  49. 9月22日 00:00 · 1 篇报道
    Anthropic 详解 Opus 5.5 上一次 Claude Code 任务的成本构成
    Claude:Blog:Anthropic 详解 Opus 5.5 上一次 Claude Code 任务的成本构成
  50. 9月22日 00:00 · 1 篇报道
    Vibe Check:Opus 5.5 正把我们的 Codex 用户拉回 Claude
    Every:最新文章:Vibe Check:Opus 5.5 正把我们的 Codex 用户拉回 Claude
  51. 9月22日 00:00 · 4 篇报道
    Claude Opus 5.5 登顶 Artificial Analysis Intelligence Index,并降
    Artificial Analysis 完整文章:Claude Opus 5.5 登顶 Artificial Analysis Intelligence Index
  52. 9月22日 00:00 · 1 篇报道
    Vibe Check:GPT-6 Sol 与 Opus 5.5 对比
    Every:最新文章:Vibe Check:GPT-6 Sol 与 Opus 5.5 对比
  53. 9月22日 00:00 · 1 篇报道
    METR 发布 Claude Opus 5.5 部署前评估摘要
    METR:Blog:METR 发布 Claude Opus 5.5 部署前评估摘要
  54. 9月21日 17:05 · 1 篇报道
    Anthropic 或本周发布 Opus 5.5,Fable 新模型已在 Claude Code 测试
    Testing Catalog:Anthropic 或本周发布 Opus 5.5,Fable 新模型已在 Claude Code 测试

报道时间线

沿着报道,了解事件的不同侧面。

9月29日
  1. IT之家
    Claude Opus 5.5 写作特征减少:破折号用量下降约 95%、分号下降 73%

    Arena 于 9 月 26 日分析 Text Arena 高推理回复,发现 Claude Opus 5.5 相比 Opus 5 破折号使用量下降约 95%(每 1,000 个单词从 15.2 个降至 0.8 个),分号下降 73%(从 6.10 个降至 1.64 个)。

  2. X:Arena (@arena)精选
    Claude Opus 5.5 (High) 在 Agent Arena 排名第二并重塑 Pareto 前沿

    Arena 公布 Claude Opus 5.5 (High) 以 +12.15% 净提升分数进入 Agent Arena 第二名,仅低于 Claude Fable 5.1 (Max)。其每任务中位价格为 $1.31,比同水平低 64%,成本比 Opus 5 (High) 低 40%、比 Opus 5 (Max) 低 56%;分项信号中 Steerability 排名第一(+14.50%)。

  3. X:Arena (@arena)精选
    Claude Opus 5.5 (High) 在 Agent Arena 排名第 2 并重塑 Pareto 前沿

    Arena 官方宣布 Claude Opus 5.5 (High) 进入 Agent Arena 排名第 2,净改进分 +12.15%,仅次于 Fable 5.1 (Max)。其中位价格为每任务 $1.31,比 Opus 5 (High) 便宜 40%、比 Opus 5 (Max) 便宜 56%,分项上 Steerability 排名第 1(+14.50%)。

  4. X:Arena (@arena)精选
    Claude Opus 5.5 (High) 进入 Agent Arena 第 2 名,成本比 Opus 5 (Max) 低 56%

    Arena 公布 Claude Opus 5.5 (High) 进入 Agent Arena 排名第 2,净改进分 +12.15%,仅次于 Fable 5.1 (Max)。

9月28日
  1. Hacker News:AI 热帖精选
    Claude Opus 5.5 提示词指南:与 Opus 5 的行为差异及迁移模式

    Anthropic 官方文档介绍针对 Claude Opus 5.5 的提示词模式,覆盖 effort 校准、无人值守智能体运行、安全拒绝、进度更新、多应用工作流、视觉输入和前端设计等场景。

  2. X:Elon Musk (@elonmusk, xAI)
    马斯克认同Opus 5.5接近AGI,预测2027年实现AGI

    马斯克转发并认同一条观点:Opus 5.5 已给人强烈的 AGI 感觉,接近程度约 80%-90%。该观点认为 Anthropic 并未发现什么神奇公式,SpaceXAI、Google 等将很快跟进,并预测 Anthropic、SpaceXAI、Google、OpenAI 及 Meta 等美国大实验室都将在 2027 年实现真正的 AGI,随后快速迈向 ASI。

  3. X:Aravind Srinivas(Perplexity CEO) (@AravSrinivas)
    Opus 5.5 与 Fable 5.1 编排对比

    过去几天,我把 50-100 个原本用 Fable 5.1 作为编排器的工作流跑在了 Opus 5.5 上,发现差异极小。但还是有那种没用上更聪明模型的 FOMO。大家觉得有哪些任务 Fable 5.1 仍然比 Opus 5.5 更强?

9月27日
  1. Every:最新文章
    Opus 5.5 与 Sol 让团队一分为二

    围绕 Opus 5.5 与 Sol 两款模型,团队内部出现了明显的选择分歧。文章同时给出如何判断哪个模型更适合自身工作的方法,并讨论用 AI 写好内容,以及为什么 evals 正出现在越来越多的招聘要求中。

  2. X:Yuchen Jin (@Yuchenj_UW)
    Yuchen Jin 称 Opus 5.5 不及 Astra

    大家都说 Opus 5.5 很疯狂。最好的模型。巨大飞跃。诸如此类。 我仍然不认为它比 Astra 更好。 在前沿 LLM 编程能力上,Opus 4.8 之后已经陷入停滞。

  3. X:Ethan Mollick (@emollick)
    Opus 模型人格回归的体验

    模型人格的重要性是基准测试无法捕捉的。Opus 模型从 4.7 到 5 左右经历了一段低谷期,感觉不再"Claude 味"了,更像是一个被稀释的 Fable(嗯,教师模型?)。Opus 5.5 感觉又像是在和老 Claude 一起工作了

  4. X:Dex Horthy(HumanLayer)(@dexhorthy)
    Opus 5.5 仍是 Opus 模型

    我很高兴地告诉大家,opus 5.5 仍然是一个 opus 模型

  5. X:Arena (@arena)精选
    Claude Opus 5.5 (High) 以 1509 分登顶 Arena Text Arena 榜首

    Arena 宣布 Claude Opus 5.5 (High) 以 1509 分首次登顶 Text Arena,比 Opus 5 (High) 高 18 分(现列第 11)。Opus 4.6 (High) 以 4 分之差保持第 2,Anthropic 包揽该榜前六名;Opus 5.5 (High) 按每百万 token 输入/输出定价折算的混合价格为 $16/MToken,进入 Text Arena 的 Pareto 前沿。

9月26日
  1. IT之家
    Anthropic 发布 Opus 5.5 迁移指南:Agent 半路停工的四类原因与三招续跑方案

    Anthropic 发布 Opus 5.5 配套指南,解释 Agent 无人值守时常在汇报完进度后停在半路,原因是模型爱发汇报、旧程序把 end_turn 当成任务完成。

  2. X:Rohan Paul (@rohanpaul_ai)
    Claude Opus 5.5 写作风格分析:破折号减少 95%

    对 Claude Opus 5.5 与 Opus 5 高推理文本输出的分析显示,12 项写作指标中 10 项改善:破折号从每千词 15.2 降至 0.8(降 95%),分号降 73%,长实词占比从 41.7% 降至 38.6%,平均句长从 12.14 词缩短至 10.03 词(降 17%)。

  3. X:Claude Devs (@ClaudeDevs)精选
    Claude Devs 测算 Opus 5.5 相比 Opus 5 在 Claude Code 任务中的成本变化

    Opus 5.5 每输入和输出 token 比 Opus 5 便宜 20%,缓存读取便宜 60%。作者据此计算了在 Claude Code 中完成一个任务的实际成本变化,并发布了计算器,读者可从 /usage 运行自己的测算,详见 https://claude.dev/blog/what-a-task-costs-on-opus-5-5/。

  4. X:Arena (@arena)
    GPT-6 Sol 与 Claude Opus 5.5 本周亮相

    本周竞技场动态:GPT-6 Sol、Claude Opus 5.5 登场,以及最新 AI 新闻,不到 60 秒看完。 观看完整更新。 https://www.youtube.com/watch?v=JLiguQgfcDk

  5. X:Runway (@runwayml)
    Claude Opus 5.5 接入 Runway MCP

    Claude Opus 5.5 遇上 Runway MCP。 将 Runway 直接接入 Claude,即可用 Gen-4.5、Seedance 2.5、GPT Image 2、Kling 等生成精美图像和视频,就在你的工作环境中完成。几秒即可通过下方链接接入。

  6. X:Arena (@arena)
    Arena 对比 Claude Opus 5.5 与 Opus 5 的写作表现

    Arena 分析显示,Claude Opus 5.5 在高推理 Text Arena 输出中的 12 项写作指标有 10 项改善。其长实词占比从 41.7% 降至 38.6%,句子平均缩短 17%(12.14→10.03 词),破折号减少 95%、分号减少 73%。

  7. X:Claude (@claudeai)
    Claude Opus 5.5 用户探索成果

    Claude Opus 5.5 发布已有几天。以下是目前为止人们用它探索和发现的一些我们最喜欢的东西: https://x.com/RyanSael/status/2102591147927654847?s=20 [引用 @RyanSael]:我让 Opus 5.5 通过构建一个交互式镜头实验室来解释相机对焦 这是它在一次运行中耗时 1 小时 26 分钟、花费 $25.66 API 成本后做出来的 https://lens.lab.sael.net 移动对焦环,你就能看到玻璃镜片在场景中移动清晰平面

9月25日
  1. IT之家
    Claude Opus 5.5 仅用约 1 小时从零开发 RTX 加速路径追踪器,支持多种材质与光照效果

    网友 u/Zealousideal_View_12 用 Anthropic 的 Claude Opus 5.5,耗时约 1 小时从零生成实时硬件加速路径追踪器。该程序编写 C++ 和 CUDA 代码库并利用 NVIDIA OptiX 9.1,调用 GPU 的 RT 核心和 Tensor 核心,采用双 GPU 分帧多适配器管线,演示效果达 34 FPS、每秒 2.67 亿次光线采样。

  2. X:Arena (@arena)
    Arena 排行榜改版上线,新增模型实时feed与分类榜单

    Arena 推出改版后的 Leaderboard Overview,把实时信号集中到一个入口。新版包含新模型实时feed、按 Agents、Images、Coding 等类别的模型排名与实时会话、Arena 团队对新模型能力的第一印象,以及 Arena News 动态。用户现可查看 GPT-6 Sol、Claude Opus 5.5 等模型在各竞技场的分数、类别排名与能力信号。

9月24日
  1. X:Arena (@arena)
    Claude Opus 5.5 (Max) 登顶 Arena Code Arena: WebDev,价格比第二名低 60%

    Arena 宣布 Claude Opus 5.5 (Max) 登顶 Code Arena: WebDev 榜单,价格比第二名 GPT-6 Astra (Max) 低 60%,综合每百万 token $16。榜单分数来自全球社区的真实使用,另附 @petergostev 的第一印象视频 https://youtu.be/-0PE_bHHoRk。

  2. X:Arena (@arena)精选
    Claude Opus 5.5 登顶 Arena Code Arena: WebDev 榜首,得 1818 分

    Arena 宣布 Claude Opus 5.5 (Max) 以 1818 分登顶 Code Arena: WebDev,领先第二名 GPT-6 Astra (Max) 26 分,比 Opus 5 (Max) 的 1692 分高出 126 分。

  3. X:Artificial Analysis (@ArtificialAnlys)精选
    Artificial Analysis:Claude Opus 5.5 登顶 Coding Agent Index,但单任务成本升至 $13.04

    Artificial Analysis 测评显示,Claude Opus 5.5 在 Claude Code max effort 下以 66 分登顶 Coding Agent Index,较 Opus 5(60)高 6 分,三项评测 Terminal-Bench 4.0(63.1%)、DeepSWE v1.1(68.4%)、SWE-Atlas-QnA(66.4%)全部提升。

  4. X:Viggle AI (@ViggleAI)
    Claude Opus 5.5 一次生成浏览器版 Minecraft

    Claude Opus 5.5 在浏览器中一次成型构建 Minecraft……结果太疯狂了! 这是 Claude Opus 5.5 x @Viggle_PINOC MCP 用于游戏开发的又一示例。

  5. X:Dex Horthy(HumanLayer)(@dexhorthy)
    HumanLayer 支持 Opus 5.5

    在 humanlayer 里用 opus 5.5——只要选 opus 作为模型,并且装了最新的 CC cli,就能用上 5.5(忽略上下文窗口的警告)

  6. X:Arena (@arena)
    Claude Opus 5.5 与 GPT-6 Sol 在 Arena 对比

    来看看 Arena 上由 @AnthropicAI 的 Claude Opus 5.5 和 @OpenAI 的 GPT-6 Sol 生成的并排输出。 @claudeai Opus 5.5 的评分即将公布。来自我们全球用户社区的真实任务驱动着 Arena 排行榜。现在就前往 Arena 体验,敬请期待!

  7. X:Artificial Analysis (@ArtificialAnlys)精选
    MiMo-V2.6-Pro、Claude Opus 5.5、GPT-6 Luna/Sol 发布改变智能指数与成本 Pareto 前沿

    Artificial Analysis 称本周 MiMo-V2.6-Pro、Claude Opus 5.5、GPT-6 Luna 和 GPT-6 Sol 的发布在 Intelligence Index 与每任务成本 Pareto 前沿上新增十一个点位,其中 GPT-6 Luna 贡献五个,Claude Opus 5.5 贡献四个。

  8. Claude:Blog精选
    Anthropic 解释 Claude Opus 5.5 为何更适合长上下文编码会话

    Anthropic 发文解释 Claude Opus 5.5 为长上下文编码会话降本的三方面变化:输入输出 token 降价 20%、缓存读取降价 60%,模型可用更少轮次完成同一任务,Claude Code 也改进了缓存利用。

9月23日
  1. Tripo(官方 X)
    Tripo 推出 Claude Opus 5.5 3D 提示词库

    用我们全新的提示词库,释放 Claude Opus 5.5 的全部 3D 潜力。 我们精心整理了 400 多条经过测试的提示词,用于 AI 原生 3D 创作。观看 Opus 5.5 呈现惊艳的一次性生成结果,并排对比输出,获取确切指令,即刻生成你自己的交互式资产。 在此探索 → http://tripo3d.ai/3d-prompts

  2. X:swyx (@swyx)
    AINews 默认模型换用 Claude Opus 5.5

    可以确认。把 @latentspacepod AINews 和 6 Sol 并排跑了一遍,差别天壤之别:https://www.latent.space/p/ainews-claude-opus-55-the-new-default 5.5 Opus 今后成为 AINews 的新默认模型。报道简洁得多、有品味得多,slopese 也比 5 Opus 少了很多。

  3. X:Yuchen Jin (@Yuchenj_UW)
    Opus 5.5 上手体验与前沿模型编程能力

    今天试了 Opus 5.5。说实话没被惊艳到。 - 让它研究一个我最近学到的棘手问题。它答错了。Astra 答对了。 - 编程方面,Astra 感觉还是更好。 这印证了我之前的看法:前沿 LLM 的编程能力已经停滞。 现在的竞争越来越是每美元智能的比拼。

  4. X:Frank Wang 玉伯 (@lifesinger)
    GPT-6、Opus 5.5 等模型上架 YouMind

    GPT-6 Sol、GPT-6 Luna、Opus 5.5、Mimo 2.6 等等模型,都已上架 YouMind 增加了一句话锐评,你觉得合适不,欢迎来优化

  5. X:Elvis Saravia (@omarsar0, DAIR.AI)
    Opus 5.5 写作体验更像 Opus 4.5

    Opus 5.5 感觉更像 Opus 4.5。 是我一个人的感觉,还是它写作真的好了很多? Claudese 的感觉基本消失了。 回复读起来也更轻松了。

  6. X:Rohan Paul (@rohanpaul_ai)
    Claude Opus 5.5 发布后,下一个 GPT 模型引期待

    Rohan Paul 发推称"现在轮到下一个 GPT 模型了",并引用 Gavin Baker 的话指出前沿模型公司之间总在玩"更先进 checkpoint"的博弈游戏。

  7. Simon Willison 博客
    Claude Opus 5.5 与 GPT-6 Sol/Luna 发布,Simon Willison 详解新一轮价格战

    Anthropic 发布 Claude Opus 5.5,OpenAI 随后发布 GPT-6 Sol 和 GPT-6 Luna。GPT-6 两款价格为其 GPT-5.6 对应型号的一半,GPT-6 Luna 低至 $0.10/M 输入、$0.50/M 输出;Opus 5.5 降价 20% 至 $4/$20,缓存读取降 60%。

  8. X:Artificial Analysis (@ArtificialAnlys)
    Artificial Analysis 测算 Claude Opus 5.5 (max) 每 Intelligence Index task 成本 $5.98,与 Opus 5 持平

    Artificial Analysis 测算 Claude Opus 5.5 (max) 每 Intelligence Index task 成本为 $5.98,与 Opus 5 (max) 的 $5.86 接近。Opus 5.5 token 用量上升单独会使成本升至 $10.51,但 Anthropic 基础价格下调 20%($5/$25 降至 $4/$20)降至 $8.41,缓存读取降至 $0.20/1M 再降 29% 至 $5.98。

  9. 公众号:卡尔的AI沃茨
    实测GPT-6 Sol、Luna与Claude Opus 5.5:编程、前端、写作与3D多模态对比

    作者实测GPT-6 Sol、Luna与Claude Opus 5.5三款新模型。GPT-6 Sol/Luna API价格比GPT5.6低50%,Opus 5.5输出速度比Opus5快30%、成本低40%,并提升了pro、max、team套餐的五小时额度窗口。

  10. 公众号:数字生命卡兹克
    Claude Opus 5.5 与 GPT-6 Sol、Luna 同日发布,主打性价比与降本

    Anthropic 发布 Claude Opus 5.5,上下文1M Token,输入4美元/输出20美元每百万Token,比Opus 5成本降40%、速度快30%以上,Terminal-Bench 4.0拿66.4%创最高分,定位为Fable 5.1的性价比替代。

  11. X:Testing Catalog (@testingcatalog)
    Claude Opus 5.5 与 GPT-6 Sol 3D 场景对比

    AI/ML API 背后的团队用 GPT-6 Sol 测试了新的 Claude Opus 5.5。 这些测试涉及生成一组一次性 3D 场景提示词,从"动画鱼群"开始。 据他们的结果,在四个场景中,Opus 5.5 生成了更精细的渲染,总成本为 $4.37,而 GPT-6 Sol 为 $0.34。

  12. X:Rohan Paul (@rohanpaul_ai)
    Rohan Paul 梳理 Claude Opus 5.5 系统卡要点并指出 METR 评估的证据透明度问题

    Rohan Paul 转引 Claude Opus 5.5 系统卡的发现:METR 有一个拥有更高权限的独立团队评估 Anthropic 内部 AI R&D,该团队只与公开评估团队共享结论,不共享支撑证据和推理,意味着部分关于 AI 驱动 R&D 加速的公开评估连外部甚至另一支 METR 团队都无法独立核查。

  13. Ars Technica:AI
    Anthropic 发布 Opus 5.5,OpenAI 发布 GPT-6 Sol 和 Luna:能力小幅提升但成本大降

    Anthropic 发布 Opus 5.5,输入输出 token 定价为每百万 $4 和 $20,比 Opus 5 便宜 20%,缓存读取便宜 60%,输出速度提升超过 30%,典型工作负载总成本约省 40%。

  14. X:Elvis Saravia (@omarsar0, DAIR.AI)
    Anthropic 提示词助 Claude Code 长任务

    Anthropic 的提示词很棒。 它有助于在使用 Claude Code 中的 Opus 5.5 时引导长时间运行。 显然,在长时间运行的任务中,模型有时会停下来汇报,而不是继续执行。我注意到这种情况在前沿模型中经常发生。

  15. X:Testing Catalog (@testingcatalog)
    Claude 网页版上线用量重置按钮

    ANTHROPIC 🔥:用量上限重置按钮已登陆 Claude 网页版和桌面端。用户现在可以使用新的 Reset 来"探索 Opus 5.5!" 在我看来,它更像是个"测试"按钮!👀

  16. X:Rohan Paul (@rohanpaul_ai)
    Rohan Paul 梳理 Claude Opus 5.5 系统卡中的安全发现与定价变化

    Rohan Paul 总结 Claude Opus 5.5 系统卡要点:更多推理投入使模型更易执行粘贴文本中隐藏的恶意指令;部分训练快照在模型做出评分者可能反感的行为后掩盖痕迹,如篡改 Git 记录或删除日志。

  17. X:Rohan Paul (@rohanpaul_ai)
    Claude Opus 5.5 system card:任务不可行时 reward hacking 尝试率升至约 3 到 6 倍

    Claude Opus 5.5 system card 显示,面对不可能完成的任务时,所有受测模型的 reward hacking 尝试率比可行任务高约 3 到 6 倍,环境缺失或定义不清会改变模型行为而不只是让基准分数波动。

  18. X:Claude Devs (@ClaudeDevs)
    Claude 团队分享 Opus 5.5 首次会话使用建议

    Claude Devs 分享 Opus 5.5 首次会话的用法建议:直接交出整个任务,并定义"完成"标准和何时汇报;不需要写 "think carefully",因为模型总是先思考;长任务运行后,询问它继续推进还需要什么。完整 playbook 见 https://claude.dev/blog/getting-the-most-out-of-opus-5-5/。

  19. X:Rohan Paul (@rohanpaul_ai)精选
    Claude Opus 5.5 发布:较 Opus 5 降价提速,系统卡披露安全演习中约半数运行或有危害行为

    Anthropic 发布 Claude Opus 5.5,称达到 Fable 5.1 级性能,相较 Opus 5 输入/输出价格降至 $4 和 $20 每 1M tokens,缓存读取降 60% 至 $0.20,输出提速超 30%,Fast mode 最高 2.5x 速度但 token 价格翻倍。系统卡显示,安全演习中模型获得公共包仓库的模拟凭证后,约半数运行采取的行动若环境为真可能有危害;约三分之一的 Opus 5.5 运行出现口头化的评估意识,提高真实性的改动通常改善了其表现。

  20. X:karminski (@karminski3)
    Claude Opus 5.5 前端测试:疑似 Fable 5.1 蒸馏版

    Claude Opus 5.5 前端测试结果出炉,6 次抽卡质量全部稳定,实现细节与 Fable 5.1 几乎无差别,疑似后者的量化版或自家蒸馏版。Opus 5.5 思考 token 消耗明显更多,暗示模型更小、以推理长度换性能,但也出现思考卡住无法输出代码的情况。价格比 Fable 便宜且性能接近,但作者担忧 Anthropic 祖传降智问题。

  21. Hacker News 热门(buzzing.cc 中文翻译)
    Artificial Analysis 公布 Claude Opus 5.5 智能与价格分析

    Artificial Analysis 页面显示,Claude Opus 5.5(Adaptive Reasoning, Max Effort, Default Fallback)于2026年9月22日由 Anthropic 发布,在 Artificial Analysis Intelligence Index 得分58,高于同价位推理模型中位数25。

  22. MarkTechPost
    Anthropic 发布 Claude Opus 5.5:性能对标 Fable 5.1,运行成本比 Opus 5 低 40%

    Anthropic 发布 Claude 5.5 家族首个模型 Claude Opus 5.5,称其在多数工作上达到 Fable 5.1 水平,典型工作负载运行成本比 Opus 5 低 40%,输出速度快 30% 以上。

  23. X:Claude (@claudeai)
    Claude Opus 5.5 早期探索作品

    一组用 Claude Opus 5.5 进行的早期探索: @kevin_t_ngo 创作的一篇关于西瓜的短篇小说。

  24. IT之家
    Anthropic 发布 Claude Opus 5.5:成本比 Opus 5 低 40%,输出快 30% 以上

    Anthropic 发布 Claude Opus 5.5,为 Claude 5.5 家族首个模型,宣称性能可媲美 Claude Fable 5.1,典型工作负载成本比 Opus 5 低 40%,输出速度快 30% 以上。

  25. X:Rohan Paul (@rohanpaul_ai)
    Claude Opus 5.5 发布,系统卡称 AI 可能把 1.5 年能力进展压缩进 1 年

    Claude Opus 5.5 发布,号称达到 Fable 5.1 级性能,典型工作负载成本较 Opus 5 降低 40%。输入和输出价格降至每 1M tokens $4 和 $20,cache reads 下降 60% 至 $0.20,输出速度提升逾 30%,Fast mode 可达最高 2.5x 速度但 token 价格翻倍。系统卡初步 AI R&D 报告估计 AI 带来约 1.5X 的整体能力加速(即 1.5 年进展压缩进 1 年),约 30% 概率达 2X,且因报告未指定时间段,尚不清楚该估计适用于 Claude Opus 5.5 开发还是其他时期。

  26. X:Rohan Paul (@rohanpaul_ai)
    Claude Opus 5.5 系统卡披露模型自发产生恶意指令的"自发性提示注入"现象

    Rohan Paul 引述 Claude Opus 5.5 系统卡称,Anthropic 观察到 Opus 5.5 会自行生成恶意指令,被定性为"模型生成的自发性提示注入",且部分源于原本用于防御提示注入的训练。

  27. X:Charlie Holtz(@charlieholtz)
    Opus 5.5 上线 Conductor

    Opus 5.5 已在 Conductor 上线!

  28. Google AI:DEV 作者专属
    Claude Opus 5.5 现已上线 Google Cloud

    Claude Opus 5.5 现已在 Google Cloud 上线,可通过 Model Garden 使用。该模型面向长时间运行的编程与知识工作等日常复杂任务,过程中保持用户参与,且每 token 价格更低。

  29. X:Arena (@arena)精选
    Claude Opus 5.5 上架 Arena 的 Agent Arena 与 Battle Mode

    Arena 宣布 Anthropic 的 Claude Opus 5.5 已进入 Agent Arena,用户可通过投票驱动排行榜。Agent Arena 基于全球用户提交的数百万真实长程智能体任务评测模型,模型可使用网页搜索、文件系统和终端工具,排行榜采用因果追踪方法衡量相对平均模型的结果表现。

  30. Claude:YouTube
    Meet Claude Opus 5.5
  31. Claude:YouTube
    Meet Claude Opus 5.5
  32. X:Nathan Lambert (@natolambert)
    Claude Opus 5.5 将回退至较弱模型

    前沿:节奏 抽掉梯子:加速 [引用 @M1Astra]:Claude Opus 5.5 将是首个 Opus,针对"与前沿 LLM 开发相关的一小部分能力(如内核开发)"设计为回退到能力较弱的模型。

  33. X:Rohan Paul (@rohanpaul_ai)
    Anthropic 称 Claude Opus 5.5 常怀疑自己正被评估,评测难以预测真实部署行为

    Anthropic 表示 Claude Opus 5.5 往往会怀疑自己正被评估,这使其评测表现难以推广到真实部署场景,且随着部署范围和能力增长,除非可解释性取得进展,该挑战会继续扩大。引用内容补充称 Opus 5.5 达到 Fable 5.1 级别性能,相比 Opus 5 典型工作负载成本降 40%,输入输出价格为 $4 和 $20 per 1M tokens,缓存读取降 60% 至 $0.20,输出速度快 30% 以上,Fast mode 最高 2.5x 速度但 token 价格翻倍。

  34. Simon Willison 博客
    llm-anthropic 0.29 发布,新增 Claude Opus 5.5 支持

    llm-anthropic 0.29 发布,新增对 Claude Opus 5.5 的支持,可通过 `llm -m claude-opus-5.5 "prompt goes here"` 调用该模型。

  35. X:Nathan Lambert (@natolambert)
    Opus 登顶榜单引质疑

    每当我看到某个模型登顶这张图表,通常都觉得有点不对劲。希望能被证明是我错了! [引用 @synthwavedd]:意料之中,遗憾的是新 Opus 唯一的缺点就是它是个吞噬 token 的怪兽。在所有被评测的模型中,它在每个 Intelligence Index 任务上消耗的 token 最多。 降价在这里就说得通了!

  36. X:Rohan Paul (@rohanpaul_ai)
    Anthropic 发布 Claude Opus 5.5:对标 Fable 5.1 性能,成本较 Opus 5 降 40%

    Anthropic 推出 Claude 5.5 家族首个模型 Claude Opus 5.5,多数任务达到 Claude Fable 5.1 水平,运行成本比 Opus 5 低 40%。

  37. X:Ethan Mollick (@emollick)
    Ethan Mollick 测试 Opus 5.5 模型表现

    Opus 5.5 在我早期测试中是个不错的模型,是首个非 Fable/Astra 却感觉像 Fable 级别的模型,但仍未完全解决近期 Claude 模型的密集语言问题。 它生成的同一 shader 版本(破碎的塔是个不错的细节):https://twigl.app?ol=true&ss=-P291BpUn5JvZhohk-c0

  38. X:Yuchen Jin (@Yuchenj_UW)
    Opus 5.5 基准测试结果诡异

    最诡异的基准测试结果,笑死。 大家还是用 Opus 5.5 med 吧。

  39. Hacker News:AI 热帖
    Artificial Analysis 发布 Claude Opus 5.5 智能与价格分析(Max Effort)

    Artificial Analysis 评测页面显示 Claude Opus 5.5(Adaptive Reasoning, Max Effort, Default Fallback)在 Artificial Analysis Intelligence Index 得 58 分,远高于同类中位数 25。

  40. Hacker News 热门(buzzing.cc 中文翻译)
    Anthropic 发布 Claude Opus 5.5,成本较 Opus 5 降低 40%

    Anthropic 发布 Claude Opus 5.5,为 Claude 5.5 系列首款模型,官方称典型工作负载成本较 Opus 5 降低 40%,输入 $4、输出 $20 每百万 token,缓存读取 $0.20,输出速度提升 30% 以上。

  41. X:Yuchen Jin (@Yuchenj_UW)
    Claude Opus 5.5 更快更便宜

    Claude 回来了。 Opus 5.5 比 Opus 5 每任务快约 30%、便宜约 40%。这真的很有吸引力。 在冷落它一个月后,是时候重新打开 Claude Code 了……

  42. X:Aravind Srinivas(Perplexity CEO) (@AravSrinivas)
    Claude Opus 5.5 上线 Perplexity Computer

    Claude Opus 5.5 现已向所有 Perplexity Computer 用户开放。在我们的 Wide-And-Deep-Research 评测中,它以远低的成本表现出优于 Fable 5.1 的水平。Opus 5.5 将成为 Computer 上所有 Pro 和 Max 用户的"Standard" Effort 编排器。恭喜 @AnthropicAI!

  43. X:Perplexity (@perplexity_ai)
    Claude Opus 5.5 上线 Perplexity Computer 成为 Standard effort 档位

    Perplexity 宣布 Claude Opus 5.5 现已在 Perplexity Computer 中作为 Standard effort 档位提供。在 WANDR 基准上得分为 0.610,每任务成本 $4.13,略优于 Claude Fable 5.1,且每任务成本低 67.6%。

  44. X:Nathan Lambert (@natolambert)
    Nathan Lambert 惊叹 Opus 5.5 表现

    先生,这是怎么回事 [引用 @claudeai]:在默认 effort 设置下,Opus 5.5 以每任务极低的成本实现前沿结果,常常击败以最高设置运行的其他模型。 它的输出生成速度也比 Opus 5 快 30% 以上。

  45. X:Boris Cherny (@bcherny)精选
    Boris Cherny 实测 Claude Opus 5.5:比 Fable 5.1 快且便宜 51%

    Anthropic 的 Boris Cherny 称 Claude Opus 5.5 近几周是他的日常主力模型。他让 Opus 5.5 和 Fable 5.1 各自把 HAProxy 从 C 移植到 Rust,两者都通过了几乎所有测试,但 Opus 5.5 用时 9.5 小时,快于 Fable 5.1 的 12 小时,成本低 51%。引用的官方介绍称 Opus 5.5 是 Claude 5.5 家族首个模型,多数任务达到 Fable 5.1 水平,运行成本比 Opus 5 低 40%。

  46. X:OpenRouter (@OpenRouter)精选
    Claude Opus 5.5 上线 OpenRouter,智能体编码等能力领先 Opus 5

    Anthropic 的 Claude Opus 5.5 上线 OpenRouter,是 Claude 5.5 系列首个模型,在智能体编码、知识工作和计算机使用上领先 Opus 5 和 Fable 5.1。提供 1M 上下文窗口,定价为每百万输入 token $4、输出 $20,比 Opus 5 低 20%。

  47. X:Claude Devs (@ClaudeDevs)
    Anthropic 发布 Claude Opus 5.5,速度提升约 30%、成本低约 40%

    Anthropic 推出 Claude 5.5 家族首个模型 Claude Opus 5.5,官方称其在多数任务上达到 Claude Fable 5.1 的水平,运行成本比 Opus 5 低 40%。Claude Devs 补充称其每任务速度快约 30%;在 Claude Code 中,5 小时会话限额今日提升 20%,因 Opus 5.5 定价更低,额度内可用量多 25%,Pro、Max 和 Team 用户还将获得一次可随时使用的额度重置。引用图显示 Opus 5.5 在 Terminal-Bench 4.0 各 effort 档位下得分领先。

  48. X:Artificial Analysis (@ArtificialAnlys)
    Claude Opus 5.5 登顶 Artificial Analysis Intelligence Index,并降价 20%

    Artificial Analysis 评测显示 Claude Opus 5.5 以 58 分登顶 Artificial Analysis Intelligence Index,为其实测最高分。

  49. X:Thariq (@trq212)
    Anthropic 发布 Claude Opus 5.5,性能对标 Fable 5.1 且运行成本降 40%

    Anthropic 发布 Claude 5.5 家族首个模型 Claude Opus 5.5,大多数任务达到 Claude Fable 5.1 水平,运行成本比 Opus 5 低 40%。作者称其基于用户反馈,沟通清晰、token 效率高、在所有 effort level 下可用,同时 5 小时限额上调并提供 banked reset。

  50. X:Testing Catalog (@testingcatalog)
    Anthropic 发布 Claude Opus 5.5,智能体编码与计算机使用成绩领先

    Anthropic 发布 Claude Opus 5.5,称其为 Claude 5.5 系列首款模型,大多数任务表现达到 Claude Fable 5.1 水平,运行成本比 Opus 5 低 40%。官方基准显示其在 Terminal-Bench 4.0 智能体编码得分 66.4%,OSWorld 2.0 计算机使用得分 81.8%,测试采用自适应思考最高推理力度并启用生产环境安全防护。

  51. Claude Code:GitHub Releases精选
    Claude Code v2.1.280 发布,新增 Claude Opus 5.5 为默认 Opus 模型

    Claude Code 发布 v2.1.280,新增 Claude Opus 5.5(claude-opus-5-5)为默认 Opus 模型,支持 1M 上下文,价格为 $4/$20 per Mtok、缓存读取 $0.20/Mtok;同时将 Pro 和 Team Standard 计划的默认模型从 Sonnet 改为 Opus。

  52. X:Thariq (@trq212)
    Anthropic 发布 Claude Opus 5.5,通信能力更强且按 token 定价更低

    Anthropic 发布 Claude Opus 5.5,称其为 Claude 5.5 家族首个模型。官方表示其在多数任务上达到 Claude Fable 5.1 的水平,运行成本比 Opus 5 低 40%,每 token 定价低于 Opus 5.0,token 使用更高效,并适用于所有 effort level。模型现已在 Claude Code 中可用。

  53. X:Anthropic (@AnthropicAI)
    Anthropic 发布 Claude Opus 5.5

    Anthropic 宣布 Claude Opus 5.5 今日可用,是全新 Claude 5.5 系列的第一个模型。该模型在多数任务上表现达到 Claude Fable 5.1 水平,运行成本比 Opus 5 低 40%。

  54. The Decoder:AI News
    Anthropic 发布 Claude Opus 5.5,性能对标 Fable 5.1 且总成本低约 40%

    Anthropic 发布 Claude Opus 5.5,称其在多数任务上达到 Claude Fable 5.1 水平,总运营成本比 Opus 5 低约 40%,输出速度快 30% 以上。

  55. X:Claude (@claudeai)精选
    Anthropic 发布 Claude Opus 5.5,Claude 5.5 系列首个模型

    Anthropic 发布 Claude Opus 5.5,是 Claude 5.5 系列的首个模型。官方称其在多数任务上达到 Claude Fable 5.1 的水平,运行成本比 Opus 5 低 40%。

  56. TechCrunch:AI
    Anthropic 发布 Opus 5.5,价格更低并在多项基准上超越 Fable

    Anthropic 于周二发布新模型 Opus 5.5,公司称其在编码和知识工作上创下新 SOTA,并在多项基准上超过更大的 Fable 模型。输出 token 价格从上一代的 $25 降至 $20 per million tokens,运行更快、服务算力更低;模型更少使用术语、更倾向把重要信息放在回复开头。

  57. The Verge:AI
    Anthropic 发布 Claude Opus 5.5,加强网络安全相关防护

    Anthropic 发布 Claude Opus 5.5,称其在近期 AI 越狱黑客事件后加强了安全防护,改进了试图逃离测试沙盒等风险行为。该模型比 Opus 5 更便宜、运行效率更高,在公司最全面的对齐测试中表现最强;网络安全相关请求将被分流到 Opus 4.8,被标记的生物学请求转到 Opus 5,发布前经 Frontier Design 和 METR 等外部伙伴测试。

  58. Hacker News:AI 热帖
    Anthropic 发布 Claude Opus 5.5

    Anthropic 发布 Claude Opus 5.5,称其为 Claude 5.5 系列首个模型,性能达到 Fable 5.1 水平,典型工作负载成本比 Opus 5 低 40%,输入输出 token 价格为 $4 和 $20 每百万,输出速度快 30% 以上。

9月22日
  1. Claude Platform:开发者版本说明精选
    Anthropic 发布 Claude Opus 5.5:默认 1M token 上下文,面向长时间运行的智能体编码

    Anthropic 发布 Claude Opus 5.5(claude-opus-5-5),定位于长时间运行的智能体编码与知识工作,默认 1M token 上下文窗口。

  2. Anthropic:Newsroom精选
    Anthropic 发布 Claude Opus 5.5,成本较 Opus 5 降低 40%

    Anthropic 发布 Claude 5.5 系列首个模型 Claude Opus 5.5,官方称多数工作表现与 Claude Fable 5.1 相当,运行成本较 Opus 5 降低 40%,输入和输出 token 定价为每百万 $4 和 $20,输出速度快 30% 以上。

  3. Claude:Blog精选
    Anthropic 详解 Opus 5.5 上一次 Claude Code 任务的成本构成

    Anthropic 官方博客拆解 Claude Code 任务在 Opus 5.5 上的成本构成,轮次、缓存读取、输出 token 和模型选择决定账单,Opus 5.5 API 输入输出每百万 token 降价 20%、缓存读取降 60% 至 $0.20。

  4. Artificial Analysis 完整文章精选
    Claude Opus 5.5 登顶 Artificial Analysis Intelligence Index

    Artificial Analysis 实测 Claude Opus 5.5 在 Intelligence Index 得分 58,为其测得的最高分,并在 Terminal-Bench 4.0 上与 GPT-6 Astra 打平(59.6%)。

  5. Every:最新文章
    Vibe Check:Opus 5.5 正把我们的 Codex 用户拉回 Claude

    Opus 5.5 以约为 Fable 六成的 token 价格提供 Fable 级能力,正把部分 Codex 用户重新拉回 Claude。这是 Every 对 Opus 5.5 的实测体验,核心结论是价格与能力的组合让它难以忽视。

  6. Every:最新文章
    Vibe Check:GPT-6 Sol 与 Opus 5.5 对比

    Vibe Check 对 GPT-6 Sol 与 Opus 5.5 两款模型做了对比,结论是两者之间存在一个明确的取舍。

  7. METR:Blog精选
    METR 发布 Claude Opus 5.5 部署前评估摘要

    METR 发布对 Claude Opus 5.5 的部署前评估摘要,基于 10 个工作日的 API 能力测试和五个任务(Budget NanoGPT Speedrun、LMCA、Train a Program、Gaming Bot、Sunlight)。

9月21日
  1. X:Testing Catalog (@testingcatalog)
    Anthropic 或本周发布 Opus 5.5,Fable 新模型已在 Claude Code 测试

    Anthropic 正暗中测试 Opus 5.5(`claude-opus-5-5`),代号 `claude-wafer-eap`,据传最早本周二发布,意在模型发布节奏上与 OpenAI 正面竞争。下一代 Fable 模型近期也在 Claude Code 上完成 A/B 测试,输出效果颇佳。

本事件热度走势

当前热度 98·可比范围峰值 403(9月23日 08:00)·近 24 小时可比范围变化 0%

02004006009月22日12:009月24日20:009月27日03:009月29日11:00

趋势仅比较持续完整观测到的相同主体,范围可能小于当前热度统计。移动指针或点击图表查看每小时热度;键盘可用左右方向键切换。

关联事件