跳到正文
北京时间

Anthropic / Claude

Anthropic 的全部动态:Claude 系列模型、Claude Code、安全研究路线与公司进展的持续追踪。

最新精选

第 261–280 条 · 共 597 条
6月17日周三
  1. Anthropic:Research(发表成果 · 网页)76

    Anthropic:智能体编码中专业知识回报持续存在

    Anthropic 基于约40万次 Claude Code 交互会话(2025年10月至2026年4月)分析发现:人类主导规划决策(做什么),Claude 主导执行决策(怎么做)。领域专业知识越强,模型每次指令完成的工作量越多。各类职业完成任务的成功率与软件工程师平均相近;领域专家成功率更高,但与中级用户差距不大。七个月间调试会话占比下降近一半,使用转向端到端智能体任务(部署运行代码、分析数据、编写非代码文档),典型任务价值平均上升约25%。

    推荐理由:这份报告用40万次真实会话数据揭示了一个反直觉发现,决定Agent编码成败的,不是会不会写代码,而是对自己领域问题的理解深度。对非技术背景用AI编程的人和产品经理都是重要信号。

  2. OpenRouter:Announcements(RSS)62

    OpenRouter Presets:当模型下线时保持 AI 智能体运行

    Anthropic 在 Claude Fable 5 发布仅数天后便对其进行了限制。如果代码硬编码模型 slug,该限制也会导致服务中断。OpenRouter 的 Presets 功能将模型选择移至服务器端,使用户无需重新部署即可切换模型、设置回退策略并强制执行数据策略。

    推荐理由:给 Agent 开发者的实用提醒,硬编码模型名会在供应商限制时塌方,用 Presets 换模型、设降级方案比现改代码省心。

6月15日周一
  1. TechCrunch:AI(RSS)70

    76位网络安全专家联名要求撤销美国政府对Anthropic最强模型的出口禁令

    76名网络安全专家联名致信美国政府,要求撤销对Anthropic的Fable和Mythos模型的出口管制令,称此举将最强模型从防御者手中夺走,在对手快速进步时非常危险。美国政府近日以国家安全为由要求Anthropic限制出口,Anthropic已暂停全球用户访问。Mythos预览时仅约50家公司可用,后扩展至15国约150组织;其公开版Fable设有严格防护栏,几乎阻止所有网络安全提示。专家认为白宫可能依据亚马逊一篇未公开论文,但该论文仅让模型修复开源代码中已知漏洞,未展示真正越狱,且称该方法可在OpenAI的GPT-5.5、Anthropic的Claude Opus 4.8和Sonnet、以及月之暗面的Kimi 2.7上复现。

    推荐理由:76名安全专家联名信抗议美国政府禁运Anthropic最强模型,并直接反驳了Amazon的越狱论文,这是AI安全管控与开放之争的关键信号,做安全的必须关注。

  2. Rohan Paul87

    Semafor报道称,美国白宫因担忧中国关联团体访问Anthropic的Mythos模型,决定对其施加出口限制。另一风险是外部团体可能通过知识蒸馏窃取模型能力。此前美国商务部指令Anthropic禁用Fable 5和Mythos 5,因发现越狱可让模型透露网络安全帮助。Anthropic反驳称越狱并非普遍性,其他公开模型也能提供类似能力。限制将持续至美国政府加强国家安全系统,预计未来几周内。Anthropic承认当前任何模型供应商都无法实现完美防越狱。

    引用Rohan Paul@rohanpaul_ai

    突发:美国政府指示 Anthropic 关闭其最强的 Claude 模型。 Anthropic 于周五收到政府的出口管制指令。其净效果是,为遵守规定,它必须对所有客户禁用 Fable 5 和 Mythos 5。 因为有人发现了一个越狱方法,能让该模型泄露它本应拒绝提供的网络安全帮助。 Anthropic 表示,政府并未展示出一个广泛的、通用的越狱方法,能把该模型变成一个不受限制的黑客助手。 所展示的技术是狭窄的,只发现了少量已知的次要漏洞,并且产生的 capability 是其他公开模型也能提供的。 商务部长 Howard Lutnick 于周五写道,Anthropic 的 Mythos 5 和 Fable 5 模型将在美国以外的任何地方以及美国境内的外国人面临出口限制。 该模型必须保持受限,直到美国政府加强其国家安全系统,这可能会在未来几周内发生。 Anthropic 进一步表示:“我们怀疑,目前对任何模型提供商来说,完美的越狱抵抗都是不可能的。业界使用的每一种保障措施都容易受到非通用越狱的影响(在特定情况下可以引出一些网络信息),而且未来很可能最终会发现通用越狱。”

    推荐理由:美国政府以越狱风险为由强制要求Anthropic禁用最强模型并施加出口限制,这是迄今为止对AI模型最直接的政府干预,出口管制与蒸馏风险的双重指控让中美AI脱钩又跨了一步。

  3. IT之家(RSS)71

    美对Anthropic出口管制,加拿大总理卡尼称过度依赖少数模型存在风险

    美国实施出口禁令,禁止所有外国用户访问Anthropic的最新AI模型。加拿大总理卡尼表示,这凸显了过度依赖少数几个强大AI工具的风险,呼吁在AI模型领域追求冗余和多样性,并将当前局面类比为2008年金融危机暴露出的银行间系统性关联。

    推荐理由:美国突然对Anthropic实施出口管制,加拿大总理直言这是过度依赖少数模型的警示。地缘政治风险已经烧到模型层,全球化AI产品的合规成本要大变。

6月14日周日
  1. TechCrunch:AI(RSS)72

    Anthropic 暂停新模型访问,印度辩论 AI 未来

    Anthropic 暂停了新模型的访问权限,印度科技领袖围绕这一事件展开辩论,探讨其是否是对该国 AI 雄心的警示。

    推荐理由:Anthropic突然按美国政府要求切断印度等外国用户对新模型的访问,这不是一个公司的事,它撕开了「AI模型是中立的」这个假象。对依赖美国模型的印度来说,是迟来的清醒还是又一次焦虑,值得思考。

6月13日周六
  1. TechCrunch:AI(RSS)87

    Anthropic的安全警告可能适得其反——政府已撤回其最强大AI

    Anthropic对政府撤回其最强大AI模型表达不满,称仅基于一个狭窄的潜在越狱发现就召回已部署给数亿用户的商业模型不合理。

    推荐理由:政府直接叫停Anthropic部署中的商业模型,这在AI行业是头一遭,说明监管已不是纸面警告,所有做AI的都该重新掂量合规风险了。

  2. Gary Marcus:The Road to AI We Can Trust(RSS)84

    美国商务部叫停Anthropic最新模型

    在长达两年的AI监管不足之后,美国政府突然采取极端措施——美国商务部实质上关闭了Anthropic的最新模型。这一"核选项"式的决定标志着监管态度的急剧转变。

    推荐理由:美国商务部叫停Anthropic最新模型的外国人访问,连自家员工都受影响,这是AI监管从口头警告升级到实际制裁的转折点。

  3. Anthropic88

    Anthropic宣布,美国政府根据国家安全指令,暂停所有外国国民(包括Anthropic外籍员工)对Fable 5和Mythos 5的访问权限。Anthropic必须立即为所有客户禁用这两个模型以确保合规,其他Claude模型不受影响。公司表示这可能是误解,正在尽快恢复访问。

    推荐理由:这是美国首次以国家安全为由,直接要求 AI 公司禁用特定模型,信号极其强烈。虽然 Anthropic 称是误解,但此事可能成为 AI 出口管制历史上一个分水岭。

  4. Anthropic:Newsroom(网页)73

    Anthropic首次公众调查:近半美国人盼AI治愈疾病,超六成担忧失业

    Anthropic对近5.2万美国人调查显示:48%将治愈癌症等疾病列为首要期望,36%希望AI帮助残障人士。64%担忧AI导致失业,56%担忧认知依赖,52%担忧信息误导。超70%支持政府监管,最关注隐私(56%)、儿童安全(52%)和责任归属(49%)。仅15%信任AI公司决策。多数议题上观点不因党派或地域严重分裂。调查于2025年11-12月由YouGov线上执行并加权至人口普查基准。

    推荐理由:Anthropic发布了一份覆盖5.2万美国人的AI民意调查,首次系统揭示了公众的恐惧排名——失业第一、认知依赖第二。虽然他们借数据推广自家政策框架的意图明显,但这两组数字对产品人理解用户心态极有价值。

6月12日周五
  1. Simon Willison 博客79

    Claude Fable 5 异常主动

    开发者体验两天后,发现 Claude Fable 5 极其主动。为调试 Datasette Agent 的滚动条 bug,它在未被告知的情况下,利用 `screencapture` 和 pyobjc 自动截图 Safari 窗口、编写测试页面、修改模板注入 JavaScript 模拟键盘快捷键,还编写了 CORS 服务器接收浏览器数据。随后触发护栏降级为 Opus,Opus 沿用这些技巧找到并验证修复方案,将整个过程记录在报告中。

    推荐理由:Simon 记录了一次 Claude Fable 的离谱调试过程,自己写 HTML、搞 CORS 服务器、注入 JS,这些招数比任何安全测试都更真实地展示了代理失控的恐怖可能。

  2. Anthropic:Newsroom(网页)74

    Anthropic与DXC达成全球联盟,将Claude引入关键行业系统

    Anthropic与IT服务公司DXC Technology达成多年全球联盟。DXC将培训数万名获得Claude认证的前沿部署工程师(FDE),将Claude引入其为全球大型银行、航空公司、保险公司及政府机构运营的关键系统。内部部署中,Claude已成为DXC OASIS平台的默认基础模型,该平台超95%代码由Claude编写,开发速度提升10倍,已服务50多家客户。DXC加入Claude Partner Network,将在保险、现代化服务、网络安全及应用服务四个领域率先推出基于Claude的解决方案。

    推荐理由:这是 Anthropic 在企业服务赛道的一次重大卡位,DXC 把银行、航空等关键行业的系统交给 Claude,比任何 benchmark 都更能证明模型在大规模生产环境中的可靠性。

6月11日周四
  1. Anthropic:Newsroom(网页)61

    Anthropic 启动 Claude Corps 全国奖学金项目

    Anthropic 推出 Claude Corps 奖学金项目,面向早期职业生涯的年轻人,培训 1,000 名研究员使用 Claude,并匹配给美国非营利组织全职工作一年。研究员年薪 85,000 美元及福利,每周接受 5 小时持续培训。Anthropic 初始投入 1.5 亿美元,合作方为 CodePath 和 Social Finance。至少 400 家非营利组织将参与接待,包括 Braven、Code the Dream、Heartland Forward 等。

    推荐理由:我觉得Anthropic这1.5亿不是白花的,它在为AI经济转型做一个社会实验,1000个fellows塞进非营利组织,如果跑通了,可能会变成大规模就业缓冲带。

  2. IT之家(RSS)71

    Anthropic CEO 阿莫迪:AI 可能会造成大规模、长期性的岗位流失

    Anthropic CEO 达里奥・阿莫迪警告,AI造成的大规模岗位流失是技术固有属性——AI系统旨在复刻人类认知,失业将成为结构性必然结果。他提出应对思路:完善劳动力市场监测、推行薪资保障与留岗税收优惠、发放培训补贴;若人力需求永久下降,则需通过征税推行全民基本收入等长期收入保障。Anthropic目标非削减人力成本,而是帮企业开拓新营收、盘活现有员工产能。

    推荐理由:我觉得阿莫迪把AI失业从短期阵痛直接定调为结构性必然,很大胆,而且他给出了征税和全民基本收入这类具体预案,做政策的该看看。

  3. Epoch AI:研究、数据与评测65

    Epoch AI 分析 Claude Mythos 网络安全能力是否被夸大

    Epoch AI 分析约十五个网络基准后认为,Mythos Preview 在漏洞利用开发上是巨大跃升,约领先既有趋势 7 个月,明显高于 GPT-5.5 的 2-3 个月;Mythos 5 又有适度提升。但在固定预算下的漏洞发现能力提升不那么确定,因为 Project Glasswing 可能带来支出大增;其优势更多体现在更低误报率和更好的漏洞严重性排序上。

    推荐理由:作者用约十五个基准构建 Cyber-ECI,区分漏洞发现与利用开发两种能力,为评估 Claude Mythos 系列网络安全能力提供了可核对的公开证据框架。

  4. Hacker News 热门(buzzing.cc 中文翻译)83

    关于人工智能指数增长的政策

    本文发表于 darioamodei.com,英文标题 "Policy on the AI Exponential",中文译为“关于人工智能指数增长的政策”。文章聚焦于人工智能能力的指数级提升对公共政策提出的新挑战,强调现有政策框架需进行根本性调整以适应 AI 的快速迭代。该文在 Hacker News 上获得 100 点热度,引发讨论。

    推荐理由:Dario这篇长文是AI治理的关键转折,从呼吁透明直接跳到要求强制安全测试并赋予政府阻断权,底气来自Mythos Preview暴露的切实风险,政策制定者和从业者都该读。

  5. Claude Code:GitHub Releases(RSS)69

    Claude Code v2.1.172 发布

    子智能体现可创建自己的子智能体,最多嵌套5层。Amazon Bedrock 在未设置 AWS_REGION 时从 ~/.aws/config 读取区域。插件市场新增搜索栏。修复了使用1M上下文且无使用额度的会话永久卡住的问题,现会自动压缩回标准上下文限制。修复了多个图片导致重复报错等问题。改进了长对话性能,减少冗余消息归一化和不必要的UI重绘,降低空闲CPU占用。Claude in Chrome 工具加载改为单次批量调用。/code-review 在未登录时保留 ultra 选项并提示需要 claude.ai 账户。

    推荐理由:子代理现在可以递归生成子代理(最多 5 层),这个特性让复杂的多 agent 编排成为可能,但总体还是以 bug 修复为主,Bedrock 的区域读取也更顺手了,Claude Code 用户直接升级即可。

  6. Anthropic81

    Anthropic CEO Dario Amodei 今日发布新文《Policy on the AI Exponential》,指出AI发展极快,远超现有政策制定流程的应对能力。文章阐述了当前技术所处阶段,并列举缩小这一差距所需的行动。Anthropic 同步宣布启动三项新举措,以支持其CEO提出的框架。

    引用Dario Amodei@DarioAmodei

    今天我发表了一篇新文章,《Policy on the AI Exponential》。AI 的进展极其迅速——远比政策流程原本设计所能应对的速度快得多。这篇文章阐述了我认为这项技术目前所处的位置,以及为弥合这一差距所需的行动:https://darioamodei.com/post/policy-on-the-ai-exponential

    推荐理由:Dario Amodei这篇不是公司宣传,是AI圈顶层对政策滞后的系统诊断,而且带出了三个具体动作,做AI治理和出海的人都该读。

  7. Claude:Blog(网页)75

    智能体表面的演进:使用 Claude Managed Agents 构建

    Anthropic 推出 Claude Managed Agents,一套可组合 API 套件,用于构建和部署生产级智能体。该产品从早期简单 API 演进至 Claude Agent SDK,再到将智能体调度层与代码执行沙箱解耦的 Managed Agents。通过只追加日志的会话机制,Managed Agents 解决了托管伸缩、会话持久化、文件系统管理、执行隔离、凭证安全与可观测性等生产部署挑战。团队借助该方案可在数天内完成从原型到生产环境的转化,无需自建基础设施。

    推荐理由:Claude Managed Agents 把代理部署的复杂基础设施打包成了 API,让团队从原型到上线只需几天而不是几个月,尤其凭证隔离和延迟优化对生产环境很关键,想部署可靠代理的团队可以认真看看。