跳到正文
北京时间

Anthropic / Claude

Anthropic 的全部动态:Claude 系列模型、Claude Code、安全研究路线与公司进展的持续追踪。

最新精选

第 141–160 条 · 共 597 条
7月25日周六
  1. 公众号:数字生命卡兹克64

    Claude Opus 5 发布,以一半价格逼近 Fable 5

    Anthropic 发布 Claude Opus 5,已全量上线,支持 100 万上下文,知识截止至 2026 年 5 月。在 ARC-AGI-3 上得分 30.2%,接近 GPT-5.6 Sol(7.8%)的四倍;输入每百万 Token 5 美元、输出每百万 Token 25 美元,价格与 Opus 4.8 相同,仅为 Fable 5 的一半。

    推荐理由:卡兹克第一时间上手 Claude Opus 5,用实测撕开官方跑分的伪装,发现它在实际工程中的漏洞,并点出 Anthropic 删掉 80% 系统提示的趋势——模型变聪明了,过去那些繁琐的 Skill 该扔了。

  2. 公众号:数字生命卡兹克75

    Claude Opus 5深夜发布,以一半价格逼近Fable 5

    Anthropic发布Claude Opus 5,全量上线并全线可用,上下文100万,知识截止至2026年5月。其ARC-AGI-3得分30.2%,约为第二名GPT-5.6 Sol(7.8%)的四倍,输入每百万Token 5美元、输出每百万Token 25美元,价格与Opus 4.8相同,另有速度提升约2.5倍的Fast Mode。

    推荐理由:与Fable 5的跑分对比展示Opus 5更适合作为执行型Agent,系统提示精简80%的实践提示可简化智能体工作流设计。

  3. Claude:Blog(网页)65

    Claude 5 代模型上下文工程新规则:Claude Code 系统提示词精简超 80%

    Anthropic 为 Claude Opus 5 和 Claude Fable 5 等新一代模型删除了 Claude Code 超过 80% 的系统提示词,且编码评测无显著损失。

    推荐理由:Anthropic 官方首次分享他们为 Claude 5 代模型移除了 Claude Code 80% 系统提示的实践,五条新规则颠覆了旧有的提示工程常识,每个用 Claude Code 或自建 agent 的开发者都该对照看看自己的系统提示是否在「过度约束」模型。

  4. Anthropic:Newsroom(网页)92

    Anthropic 发布 Claude Opus 5

    Anthropic 发布 Claude Opus 5,其智能水平接近 Claude Fable 5,但价格减半。该模型在 Frontier-Bench v0.1 上性能超过 Opus 4.8 两倍以上,在 ARC-AGI 3 上得分是次优模型的三倍。Opus 5 即日起成为 Claude Max 的默认模型和 Claude Pro 的最强模型。

    推荐理由:Anthropic 这次把 Opus 的性价比条拉满了,性能翻倍价格减半,实际编码和知识工作基准已经超越所有模型。最打动我的是它自查自纠的严谨,写代码像真开发者一样审自己的页面,这种责任心以前只在人身上见过。

7月24日周五
  1. Anthropic:Research(发表成果 · 网页)73

    Anthropic 联合 Andon Labs 发布 Drone-Bench,评估 AI 模型自主操控无人机执行定位追踪任务的能力

    Anthropic 与 Andon Labs 合作推出 Drone-Bench,用于测试 AI 模型自主操控四旋翼无人机在室内环境中定位并追踪指定人员的能力。该基准将任务分解为 3D 地图重建、定位、导航、目标检测与跟随五个子任务,并通过软件复现实现快速评估。实验表明,该任务链的难度足以区分不同智能水平的模型,并揭示 AI 在物理世界操控能力上的进步轨迹。

    推荐理由:Anthropic首次公开AI端到端控制无人机执行监视任务,Fable 5仅因3D重建瑕疵未能全通。六个月内模型一致性突飞猛进,安全压力比技术潜力更紧迫。

  2. Hacker News 热门(buzzing.cc 中文翻译)79

    Claude-thermos:保持 Claude 会话缓存热度,避免重新编码费用

    Claude-thermos 通过本地反向代理监控 Claude Code 会话,在主智能体因等待子智能体而空闲超过 5 分钟时,自动发送预热请求刷新提示缓存。实测约 185 次本地会话中,缓存过期导致的重新编码占账单约 22%。工具以 uvx 运行,支持自定义空闲阈值和预热间隔。

    推荐理由:一个小工具解决了一个被忽视的成本黑洞,Claude Code 的缓存过期,作者自己测了 185 个会话,省下 22% 费用,对于把 Claude 当开发助手的团队来说是个必装工具。

  3. Claude:Blog(网页)75

    Claude 语音模式现已支持 Opus、Sonnet 及连接工具与多语言

    即日起,Claude 语音模式在 Opus、Sonnet 和 Haiku 上运行,并支持连接 Gmail、Slack 等工具及更多语言。用户可在对话中切换模型,语音模式默认沿用上次文本聊天使用的模型。该功能面向所有用户开放 beta 测试,免费版可使用 Haiku 及一个连接工具,付费版可访问更多模型和全部连接工具。

    推荐理由:Claude 语音模式终于能调用最强模型了,深度思考不再受限于轻量版,加上工具集成和多语言,移动端从随口问答升级为实时脑力伙伴,值得立即上手。

7月23日周四
  1. The Decoder:AI News(RSS)86

    Anthropic 因盗版书籍支付 15 亿美元和解金,创下集体诉讼版权赔偿纪录

    Anthropic 向图书作者支付 15 亿美元版权和解金,联邦法院已批准。约 482460 部作品中 91.3% 被索赔,每部约获 3000 美元。法官此前裁定,在合法获取的书籍上训练 AI 属于“变革性”合理使用,但大规模抓取网络内容是否合法仍悬而未决。

    推荐理由:15亿美元的天价和解只针对盗版获取行为,法官此前已裁决合法图书训练AI属合理使用,这起案件反而成了AI实验室至今最大的法律背书。

  2. Anthropic:Newsroom(网页)70

    Claude 新增 Anthropic Economic Index 连接器,可直接查询 AI 对经济与职业的影响数据

    Anthropic 为 Claude 推出 Anthropic Economic Index 连接器,用户可在 claude.ai 中直接向 Claude 提问“哪些职业使用 AI 最多”等问题,答案基于 Index 的真实数据。该连接器无需安装,适用于任何 Claude 模型,并会引导用户查看原始数据及其局限性。完整数据集仍免费开放。

    推荐理由:Anthropic把自家经济指数直接接入了Claude对话,用自然语言就能挖出AI影响就业的真实数据,对关注职业变化的研究者和产品人来说是个顺手的小工具。

7月22日周三
  1. SemiAnalysis76

    AMD 刚刚宣布与 Anthropic 达成协议,将投资高达 50 亿美元,换取 Anthropic 采购 2GW 的 AMD MI455 UALOE72 及未来 GPU。🚨 这与我们三天前关于 Anthropic 的说法一致。

    引用SemiAnalysis@SemiAnalysis_

    根据 AMD 人工智能高级总监的公开 GitHub,ANTHROPIC 将成为 AMD 的客户 🚨🚨 我们在下面解释 GitHub 代码和细节👇️ 1/4🧵

    推荐理由:AMD 用 50 亿美金投资换来 Anthropic 的巨量 GPU 订单,这是非 NVIDIA 生态一次真正有分量的突破,做硬件和云服务的值得深挖。

  2. Hacker News 热门(buzzing.cc 中文翻译)79

    法官批准Anthropic就盗版书籍训练Claude一案达成15亿美元和解协议

    美国联邦法官批准Anthropic支付15亿美元,和解其使用盗版书籍训练Claude聊天机器人的集体诉讼。约91%的48.2万本涉案书籍已被作者或出版商认领,每本书赔偿约3000美元。原告律师称这是“历史上已知最大的版权追偿”,Anthropic则强调法院此前已裁定AI训练书籍属于合理使用。

    推荐理由:这是 AI 训练数据版权案中第一个重大和解,每个作者赔三千,看似不多但总额达 15 亿,给仍在诉讼中的 OpenAI、Meta 等案打了个样,做版权内容的该认真看看。

  3. Claude:Blog(网页)67

    Anthropic 如何保障AI原生软件开发生命周期的安全

    Anthropic副首席信息安全官Jason Clinton披露,其软件工程师每季度交付的代码量是2021-2025年平均水平的8倍,Claude编写了约80%合并入库的代码。安全团队通过安全左移、硬访问与身份边界、自动化与智能体审查结合、关键节点引入人工审核等策略,应对被入侵或提示注入的智能体引入恶意变更等威胁,同时不显著拖慢开发速度。

    推荐理由:Anthropic首次详细拆解自己的AI原生安全流程,用80%AI代码的事实倒逼安全左移和代理审查,对正在思考如何保障AI编码安全的团队是一份难得的内部地图。

  4. Hacker News 热门(buzzing.cc 中文翻译)71

    Claude 不是编译器——它比编译器更好

    Claude 等大语言模型能跨越战略、产品、架构、代码到机器码的整个技术栈垂直工作,无需安排会议或请求许可,因此比传统编译器更强大。以 exe.dev 为例,团队用 LLM 研究分布式 DNS 系统设计、历史安全缺陷和替代实现策略,并通过多智能体循环构建了完整系统。LLM 虽在单项任务上不及资深人类,但能同时处理所有层级,实现跨层协作。

    推荐理由:一篇值得软件工程师读的观点文章,用真实案例说明 LLM 不是编译器而是垂直跨层工具,vibe-engineering 理念可能重塑开发实践。

  5. Claude71

    Claude Cowork 新功能:教 Claude 一项技能。 录制你执行任务时的屏幕操作,边做边讲解,Claude 会将其转化为可重复运行的技能。在 Claude 桌面应用的 + 菜单中找到“录制技能”即可使用。 适用于 Pro、Max 和 Team 套餐。

    推荐理由:Claude 现在能通过录屏学会你的操作流程,这是从「回答问题」到「执行任务」的关键步。如果你有重复性操作,把它教给 Claude 的成本几乎为零,Pro 用户值得立刻试试。

7月21日周二
  1. Simon Willison 博客75

    Anthropic 团队透露 Claude Tag 承担 65% 产品工程 PR,系统提示词缩减 80%

    Anthropic 的 Cat Wu 和 Thariq Shihipar 在炉边对话中透露,Claude Tag 现已承担 Claude Code 团队 65% 的产品工程 PR。Claude Code 系统提示词最近缩减了 80%,团队越来越多地依赖自动化代码审查处理产品“外层”变更。Fable 已能一次性完成大量功能实现,Thariq 还用它编辑了自己的产品发布视频。

    推荐理由:Anthropic Claude Code团队首次公开内部工作流和评估细节,系统提示精简80%、自动审查取代人工,对每个用编码代理的团队都有直接参考价值。

  2. Fireworks AI(网页)63

    Fireworks AI 实测 Kimi K3 对标 Fable 5,两模型路由可达 93% 准确率

    Fireworks AI 在约 1,030 个真实 agent 任务上对比开源的 Kimi K3 与闭源的 Fable 5,两者总体水平接近(SWE 分别为 92.4% 与 92.6%),但各自擅长不同任务类型。

    推荐理由:原文用约 1,030 个真实 agent 任务对比 K3 与 Fable 5,给出按任务路由可同时提升质量并降低成本的量化依据。

7月18日周六
  1. Claude:Blog(网页)64

    Cursor 评估负责人确认 Claude Fable 5 在 CursorBench 达 72.9% 新高

    Cursor 的模型评估负责人 Nate Schmidt 发现,Claude Fable 5 在其内部基准 CursorBench 上以 Max effort 模式达到 72.9%,创下新高。该模型在模糊的真实编程任务中表现出全局推理能力,例如在航天模拟器中仅凭一句提示自主规划并成功登月,而此前 Claude Opus 运行 12 小时以上仍无结果。

    推荐理由:Cursor 工程师用自家基准和太空模拟器实打实测试了 Claude Fable 5,从全局推理到自主规划路径的能力跃迁很具体,做编码 agent 的可以看看这个‘p99 问题’解法。

7月17日周五
  1. Claude:Blog(网页)65

    Anthropic 用 Claude Code 大规模迁移代码:Bun 百万行 Zig 转 Rust,两周完成

    Anthropic 工程师用 Claude Code 在两周内将 Bun 的百万行 Zig 代码迁移至 Rust,100% 现有测试通过,合并后出现 19 个回归问题已全部修复。另一工程师用周末将 Python 代码库迁移至 16.5 万行 TypeScript。迁移消耗约 16.5 万美元 API 成本,但编译时间从八分钟降至两秒,二进制启动快 6 倍。

    推荐理由:Anthropic 用自家 Claude Code 把百万行 Zig 代码迁到 Rust,两周搞定,这不仅是案例展示,更是开发者如何用 AI 重构代码库的实操指南,尤其适合那些被遗留代码拖累的团队。