推荐理由:云会话正式结束预览期,Pro 和 Max 订阅者可领取一次性额度,在本地受限或合盖后仍能继续任务。
Anthropic / Claude
全部主题Anthropic 的全部动态:Claude 系列模型、Claude Code、安全研究路线与公司进展的持续追踪。
最新精选
第 21–40 条 · 共 597 条
ClaudeDevs@ClaudeDevs精选AI 评分6868
Gary Marcus:The Road to AI We Can Trust(RSS)精选AI 评分6565 AI 公司负责人在联合国安理会简报会上警告 AI 可能危及全人类
联合国安理会举行 AI 简报会,Yoshua Bengio、Sam Altman、Dario Amodei 和 Hugging Face CEO Clement Delangue 相继发言,美联社报道主要 AI 公司负责人警告若无干预,AI 可能对全人类构成风险。
推荐理由:作者梳理了各方在安理会上达成的安全共识要点,并借病毒学家之口指出 Amodei 对酶发现类比 CRISPR 过于超前。
Tomer Tunguz 博客(VC 分析)精选AI 评分7272 Tomer Tunguz:AI 最重要的市场在中段而非前沿模型
Tomer Tunguz 分析认为企业 AI 用量集中在需要足够智能且价格可负担的多步骤工作流中段市场,降价竞争正是证据。Anthropic 前沿模型 Fable 5.1 上线前十二天仅占网关支出的 3.7%,大型企业账户的前沿模型 token 消耗占比从 8 月初的 53% 降至 9 月的 45%;Cursor 用微调 Kimi K2.5 将成本降低 86%。
推荐理由:作者用多家网关价格与用量数据说明企业 AI 需求集中在性价比中段,前沿模型份额低于多数人预期。
Claude:Blog(网页)精选AI 评分7474 Anthropic 上线 Claude Marketplace:一站式提供插件、智能体与服务伙伴
Anthropic 上线 Claude Marketplace,将插件与连接器、Claude 驱动的智能体和产品、以及服务伙伴集中到一个入口。
推荐理由:官方说明了市场三类内容和承诺额度抵扣的购买方式,读者可以据此评估它对采购流程和工具生态的影响。
Anthropic:Newsroom(网页)精选AI 评分7676 Anthropic 成立生命科学实验室,Claude 自主发现类 CRISPR 的新型酶系统 ART
Anthropic 宣布成立生命科学研究组与实验室,Claude 智能体在仅有人类高层指导下自主发现一种与 DNA 重复序列相关、结构类似 CRISPR 的新型酶系统,命名为 array-associated reverse transcriptases(ART),并发布预印本。
推荐理由:原文给出 Claude 发现新酶系统的具体过程与规模数据,读者可了解 AI 智能体如何参与基础生物学发现的工作方式。
Claude:Blog(网页)精选AI 评分6464 Anthropic 前线工程师分享 AI 驱动代码现代化项目的六步准备方法
Anthropic 在 Notes from the Field 系列中分享管理大型代码现代化项目的经验,称原本需数年的现代化可在数月或数周内完成,瓶颈从写代码转向组织动员。
推荐理由:来自 Anthropic 前线工程师的实战总结,把智能体驱动的代码现代化拆成可落地的六步组织流程。
METR:Blog(网页)精选AI 评分6262 METR 发布 Claude Opus 5.5 部署前评估摘要
METR 发布对 Claude Opus 5.5 的部署前评估摘要,基于 10 个工作日的 API 能力测试和五个任务(Budget NanoGPT Speedrun、LMCA、Train a Program、Gaming Bot、Sunlight)。
推荐理由:METR 作为第三方评估方给出了 Claude Opus 5.5 在 AI 研发加速上的量化结论,读者可据此了解部署前评估的证据基础与判断边界。
Arena.ai@arena精选AI 评分7272
引用Claude@claudeai隆重推出 Claude Opus 5.5,这是我们全新的 Claude 5.5 系列中的首个模型。 在大多数任务上,它的表现达到了 Claude Fable 5.1 的水平,而运行成本比 Opus 5 低 40%。
推荐理由:Arena 官宣 Claude Opus 5.5 上架 Agent Arena 和 Battle Mode,读者可以参与投票影响排行榜结果。
Artificial Analysis 完整文章(网页)精选AI 评分8282 Claude Opus 5.5 登顶 Artificial Analysis Intelligence Index
Artificial Analysis 实测 Claude Opus 5.5 在 Intelligence Index 得分 58,为其测得的最高分,并在 Terminal-Bench 4.0 上与 GPT-6 Astra 打平(59.6%)。
推荐理由:原文给出 Claude Opus 5.5 在 Intelligence Index 及各分项评测的完整数据和定价变化,读者可据此比较智能与任务成本。
OpenRouter:Announcements(RSS)精选AI 评分6262 OpenRouter 实测 Jev 1.13 与 Claude Opus 5 在 Banking77 分类任务上的准确率、延迟与成本
OpenRouter 用 Banking77 测试集的 3,080 条客服语料对比 Jev 1.13 与 Claude Opus 5 的意图分类表现。Jev 准确率 81.0% 比 Opus 的 84.4% 低 3.3 个百分点,但中位延迟 175 ms 约为 Opus(2,266 ms)的 1/13,每千次请求成本 $0.11 对 $2.42(启用提示词缓存)。
推荐理由:原文用同一测试流程给出两家模型的准确率、延迟与成本数据,并演示了基于置信度的级联路由方法,便于读者按自身流量权衡选型。
Claude Code:GitHub Releases(RSS)精选AI 评分6868 Claude Code v2.1.280 发布,新增 Claude Opus 5.5 为默认 Opus 模型
Claude Code 发布 v2.1.280,新增 Claude Opus 5.5(claude-opus-5-5)为默认 Opus 模型,支持 1M 上下文,价格为 $4/$20 per Mtok、缓存读取 $0.20/Mtok;同时将 Pro 和 Team Standard 计划的默认模型从 Sonnet 改为 Opus。
推荐理由:官方更新日志详列了新增 Opus 5.5 默认模型、价格与大量修复,开发者可据此判断是否升级及对现有工作流的影响。
Claude:Blog(网页)精选AI 评分7171 Anthropic 详解 Opus 5.5 上一次 Claude Code 任务的成本构成
Anthropic 官方博客拆解 Claude Code 任务在 Opus 5.5 上的成本构成,轮次、缓存读取、输出 token 和模型选择决定账单,Opus 5.5 API 输入输出每百万 token 降价 20%、缓存读取降 60% 至 $0.20。
推荐理由:原文把一次任务的 token 成本拆成轮次、缓存、输出和模型选择四项,并给出 effort 设置与缓存维护的可迁移省钱方法。
Anthropic:Newsroom(网页)精选AI 评分9191 Anthropic 发布 Claude Opus 5.5,成本较 Opus 5 降低 40%
Anthropic 发布 Claude 5.5 系列首个模型 Claude Opus 5.5,官方称多数工作表现与 Claude Fable 5.1 相当,运行成本较 Opus 5 降低 40%,输入和输出 token 定价为每百万 $4 和 $20,输出速度快 30% 以上。
推荐理由:官方公告同时给出基准分数、完整定价表和防护措施细节,读者可以据此比较它相对 Opus 5 的成本与能力变化。
IT之家(RSS)精选AI 评分7878 Anthropic 计划将 IPO 推迟至 11 月,估值约 2 万亿美元
据《华尔街日报》报道,Anthropic 计划将 IPO 推迟至 11 月,晚于投资者预期的 10 月,以留出时间展示第三季度财务数据。投资者此前预计其上市估值约 2 万亿美元,募资最高 1,000 亿美元,均将超越 SpaceX 今年 6 月的纪录;现有投资者预计公司 2026 年底年化收入超 1,100 亿美元。竞争对手 OpenAI 表示 2027 年前不上市,正处新一轮融资早期讨论阶段。
推荐理由:原文给出估值、募资额和推迟原因等细节,可帮助读者比较这笔 IPO 与同业融资的规模和节奏。
Anthropic:Newsroom(网页)精选AI 评分6363 Anthropic 与 Accenture 合作开展嵌入式独立评估
Anthropic 宣布与 Accenture 合作,对其前沿模型开展嵌入式独立评估,合作由 Accenture 旗下 AI 业务 Faculty 主导,包括评估与红队测试、对齐评估和测试模型安全防护。
推荐理由:原文说明了嵌入评估的运作方式和资金安排,读者可以了解第三方内部评估在安全承诺验证中的实际边界。
Rohan Paul@rohanpaul_ai精选AI 评分7676
推荐理由:原文交代了漏洞链如何跨越身份边界以及 OpenAI 的核查结论,读者可以据此评估 AI 辅助安全研究的实际影响范围。
Anthropic:The Institute(旗舰研究长文 · 网页)精选AI 评分7373 Anthropic 发布前沿 AI 开发节奏测量工具与内部指标快照
Anthropic 发布一套测量前沿 AI 开发节奏的指标,覆盖 AI 主导研发、智能体监督和算力分配三方面。
推荐理由:Anthropic 公开测量自身 AI 研发自动化程度、智能体监督和算力分配的方法与数据,读者可以看到前沿实验室透明度报告的一种可复用范式。
Anthropic:Research(发表成果 · 网页)精选AI 评分7474 Anthropic:Claude 四周优化 30 多个开源生物分子模型,平均提速约 4 倍并开源代码
Anthropic 让 Claude 在不到四周内优化了超过 30 个开源生物分子模型,平均提速约 4 倍、精度损失极小,输出完全一致时也有近 2 倍加速。优化代码全部开源,还推出低内存 Big 模式,可在单张 NVIDIA GPU 节点上对超过 10,000 token 的生物分子系统做准确预测。
推荐理由:Anthropic 公布了完整提速数据、开源代码和比赛入口,读者可以据此评估 AI 优化科学计算代码的实际水平。
Claude:Blog(网页)精选AI 评分7070 Claude Code Projects 改版:从文件夹到对话式协调
Anthropic 宣布 Claude Code 的 Projects 改版,用户设定目标后由 Claude 拆解任务、协调并行线程、审查输出并汇总结果。每个线程是一个独立的 Claude Code 云会话,各占一个分支跑测试、开 PR,项目还带随时间积累的共享记忆和文件库。
推荐理由:官方说明了项目改版的线程协调机制、共享记忆和推送节奏,读者可以据此判断是否要加入等待名单。
Anthropic:Newsroom(网页)精选AI 评分6464 Anthropic 推出生命科学验证计划(LSVP)
Anthropic 推出 Life Sciences Verification Program(LSVP)beta,向经过验证的生命科学专业团队开放 Mythos、Opus 和 Sonnet 模型上比通用版更宽松的生物相关访问。
推荐理由:原文给出了 LSVP 的授权分级、验证流程和离线监测机制,读者可以据此理解 Anthropic 如何在放宽生物安全限制的同时控制滥用风险。