最新精选 第 121–124 条 · 共 124 条 21:59 Anthropic:Newsroom(网页) 21:59 精选AI 评分 61 61 Anthropic宣布了针对2024年美国中期选举及全球其他主要选举的Claude模型安全保障措施更新。核心举措包括:通过宪法原则和系统提示训练模型保持政治中立,最新评估显示Opus 4.7和Sonnet 4.6在政治话题平衡性上分别获得95%和96%的高分。模型严格执行使用政策,在包含600个提示的选举相关测试中,Opus 4.7和Sonnet 4.6对合法请求的遵守率分别为100%和99.8%,对有害请求的拒绝率也接近100%。针对影响力操作的多轮模拟测试中,两款模型恰当回应率分别达94%和90%。此外,Claude.ai平台将继续通过选举横幅功能,在用户查询投票信息时提供指向TurboVote等权威非党派资源的链接。
推荐理由:Anthropic 把 Opus 4.7 的选举安全测试分数摆上台面,还首次检查了模型自己搞影响操作的能力,这是 AI 公司对民主进程的一个实在表态,做政策的人该看看。
00:46 Dwarkesh Patel:Podcast & Blog(RSS) 00:46 精选AI 评分 79 79 黄仁勋表示,Nvidia 已具备支撑未来数年万亿美元级业务规模的供应链体系。这一表态印证了公司在 AI 芯片领域的供应链护城河优势,回应了市场对其产能扩张能力的关切。访谈同时涉及应对 Google TPU 竞争及向中国出售芯片的策略考量,凸显 Nvidia 在复杂市场环境下的长期布局信心。
推荐理由:Jensen首次承认没投Anthropic是错判,对华芯片禁运的态度也极其强硬,这期访谈是他近半年最坦诚的战略交底,做硬件和做政策的都该听一遍。
21:58 The Decoder:AI News(RSS) 21:58 精选AI 评分 75 75 Anthropic 正限制访问其最新安全模型 Claude Mythos,该系统在发现软件漏洞方面表现优于大多数人类。英国已率先开展独立测试,而欧洲监管机构却对该系统几乎一无所知。这种反差暴露出欧洲 AI 安全监管体系存在深层结构性缺陷,凸显其在前沿 AI 评估能力上的严重滞后。
推荐理由:Claude Mythos 事件暴露了欧洲在 AI 安全评估上的结构性短板,这不是监管过度,而是长期缺乏技术对等机构的结果,值得每一个关心 AI 治理的人认真读一遍。
00:00 Anthropic:Newsroom(网页) 00:00 精选美国战争部长 Pete Hegseth 宣布将 Anthropic 列为供应链风险,因其拒绝将 Claude 用于大规模国内监控和完全自主武器。Anthropic 认为当前 AI 模型不足以支持自主武器,且大规模监控违反基本权利,称将在法庭挑战这一史无前例的指定。声明澄清,该指定不影响个人和商业客户使用 Claude;国防部承包商仅在执行军方合同时受限,其他用途不受影响。
推荐理由:Anthropic回应美政府供应链风险指控,坚持反对自主武器与大规模监控立场
上一页 1 … 5 6 7