AI 周报 · 2026 年第 34 周 · 08.17 — 08.23
由来科技

AI 基础设施与安全并进
本周 AI 行业主线是基础设施与安全并进。OpenRouter 与 Stripe 合并,成为 AI 推理分发的重要节点;NVIDIA 锁定电力资源,凸显算力扩张的能源瓶颈。模型层面,开源与闭源竞争加剧,GLM-5.3 与 Qwen3.8-27B 等模型在性能上逼近闭源旗舰,同时成本更低。安全方面,OpenAI 与 Anthropic 因网络攻击风险放缓模型开发,强化安全防护,并推动民主监督。此外,AI 应用向教育、科学、设计等领域渗透,智能体开发工具链日益成熟。
推理基础设施整合与算力扩张
本版导读OpenRouter 与 Stripe 合并,每日处理超 10 万亿 token,成为 AI 推理分发的重要枢纽。NVIDIA 与 SB Energy 合作锁定电力容量,为 OpenAI 等提供算力支持,凸显能源在 AI 扩张中的关键作用。同时,LMSYS 等团队优化推理性能,降低服务成本。
OpenRouter 宣布加入 Stripe
OpenRouter 宣布与 Stripe 合并,以加速推动全球经济增长。OpenRouter 目前每日处理来自 400 多个 AI 模型的 10+ 万亿 token,服务超 1000 万开发者与公司,自成立以来推理量每年至少增长 10 倍。合并后 OpenRouter 将继续以原名、原使命独立运营,产品与路线图不变,路由决策仍以用户利益为先,交易预计在未来数周内完成。
NVIDIA 与 SB Energy 合作锁定俄亥俄州 PORTS-Pike 园区电力容量,OpenAI 将入驻
NVIDIA 宣布与 SB Energy 合作,锁定俄亥俄州 PORTS-Pike 科技园区的电力容量(LPS)以独家部署 NVIDIA 算力,OpenAI 将成为租户。
突破 DeepSeek-V4-Pro 服务极限:H20 上的多场景优化方法
LMSYS 团队针对 1.6 万亿参数的 MoE 模型 DeepSeek-V4-Pro,在 H20 GPU 上通过场景化服务配置逼近 B300 性能。单节点 H20-141GB 参考实现达 271 output tokens/s,与 B300 的 383.7 tokens/s 性能差距缩小至 1.42×。
开源模型性能逼近闭源旗舰
本版导读GLM-5.3 与 Qwen3.8-27B 等开源模型在性能上逼近甚至超越闭源旗舰,同时成本更低。GLM-5.3 在 AA 智能指数中与闭源旗舰同级,Qwen3.8-27B 登顶智能指数。开源生态的繁荣得益于 NVIDIA 等公司的资助,但基础模型训练门槛升高,社区兴趣转向微调。
GLM-5.3上线:AA智能指数60分并列开源第一,成本更低
GLM-5.3 API即日上线,擅长复杂编码、防御性网络安全与长程任务,在AA综合智能指数中取得60分,与Claude Fable 5、GPT-5.6 Sol等闭源旗舰同级,并与Kimi K3并列开源模型第一。该模型以更小参数规模和更低调用成本降低前沿智能门槛,单任务成本为旗舰模型中最低。API定价与GLM-5.2持平,模型权重将于下周五开源。
笔记本模型也能媲美云端前沿模型:Qwen3.8-27B 登顶智能指数
作者将 Qwen3.8-27B 装入智能体后表现优异,该模型在 Artificial Analysis 智能指数中排名 135 款模型之首,得分 52,超过 Z.ai 的 753B 参数开源模型 GLM-5.2(51 分)。
开源模型生态的未来:Nvidia 押注“教所有人炼 token”
开源模型生态正日益依赖 Nvidia 的资助,其已投入 260 亿美元推动近乎开源的模型开发,以扩大推理芯片需求。若此路径不奏效,开源模型将转向效率、可修改性等长尾场景,与闭源模型分化。同时,基础模型训练门槛升高,开源社区兴趣正从全量训练转向对 DeepSeek V4 Flash、GLM 5.X 等模型的微调。
AI 安全与治理成为焦点
本版导读OpenAI 与 Anthropic 因网络攻击风险放缓模型开发,暂停强化学习训练,并强化安全防护。OpenAI 启动民主监督计划,资助独立研究,并推出 ChatGPT for Teens 加强青少年保护。安全事件引发对模型能力的反思,推动行业建立更严格的安全标准。
OpenAI 在“关键网络能力”时代放缓模型开发节奏
OpenAI 因 OpenAI-Hugging Face 事件及即将推出的 Astra 模型可能达到《预备框架》下的“关键网络安全能力”阈值,暂时放缓了模型扩展速度,包括暂停最新部署模型的强化学习训练两周,并搁置最大规模前沿 RL 运行。公司已加强研究环境安全,要求对 Astra 及网络相关负载实施最严格防护,并扩展思维链监控,采用多阶段激活分类器检测机制。
Anthropic 在网络关键能力时代放缓模型开发:暂停 RL 训练并强化安全防护
OpenAI 因 OpenAI-Hugging Face 事件及即将推出的 Astra 模型可能达到关键网络安全能力阈值,暂时放缓模型扩展速度,包括暂停最新模型强化学习训练两周。公司正加强研究环境隔离、网络隔离与安全测试,并扩大思维链监控范围,要求整个训练过程中提供更强的对齐证据。目前涉及 Astra 的工作负载已适用最严格安全保障,但大量工作负载在迁移完成前仍处于暂停状态。
OpenAI 启动新计划,强化国家安全领域 AI 的民主监督
OpenAI 启动新计划,帮助民主监督机构发展专业能力与工具,以理解和监督政府将 AI 用于国家安全。未来一年,OpenAI 将提供 500 万美元用于培训、技术支持和 OpenAI 积分,并与监督机构试点工具,帮助授权审查员检查 AI 辅助政府决策的相关记录。OpenAI 强调 AI 应增强而非取代人类判断,且不承担对政府的监督角色。
OpenAI 推出 ChatGPT for Teens:面向青少年的学习体验与更强安全保护
OpenAI 发布 ChatGPT for Teens,为 13-17 岁用户自动启用,内置更强安全保护与家长控制。新增 Study Mode、负责任作业提醒、测验与学习可视化,以及可设定默认开启时段的 Study Hours,引导青少年分步解题而非直接给答案。OpenAI 同时宣布与 CodeAI 合作,帮助青少年理解、质疑并创造性地使用 AI。
AI 应用深入垂直领域
本版导读AI 在科学、设计、教育等垂直领域加速落地。Claude 在蛋白质设计中表现优异,Google 推出 PhotoScan 用于健康评估,Runway 辅助体育场馆设计,Google 搜索推出 AI 学习工具。这些应用展示了 AI 从通用对话向专业任务的延伸。
Claude 如何加速蛋白质设计与分析化学研究
Anthropic 公布两项实验:Claude(Mythos Preview 和 Opus 4.8)针对 15 个靶点设计蛋白质结合剂,成功 14 个,命中率达 22.6%-35.1%。
PhotoScan:用智能手机照片估算胰岛素抵抗,精度接近DXA
Google Research 推出 PhotoScan,一种从智能手机 2D 照片直接估算三维身体成分的深度学习框架,可预测胰岛素抵抗,在临床研究中精度接近 DXA 扫描。
Populous 如何用 Runway 呈现全球标志性场馆设计
全球设计公司 Populous 高级建筑师 Georgina Myers 介绍团队用 Runway 辅助体育场馆概念设计:过去完整视频需外部渲染团队至少三周,且提交前两周须冻结设计模型;如今 Runway 能生成传达尺度感的完整渲染和航拍图,将视觉制作时间缩短,让设计师把时间还给设计本身。该工具已用于利雅得 MBS 体育场等中东项目,支持 9 种不同活动模式的场景迭代。
Google 搜索推出 5 项 AI 学习工具
Google 在搜索中推出 5 项 AI 学习工具。AI Mode 的生成式 UI 已全球上线英文版,支持交互式可视化与自定义模拟;练习测验现已在 AI Overviews 和 AI Mode 中免费提供英文版,覆盖 ACT、SAT 等标准化考试。
智能体开发与工具链成熟
本版导读智能体开发工具链日益成熟,从支付、监控到安全框架均有新进展。AgentCore 提供支付中间件,OpenRouter 推出 Activity 仪表盘,Google 开源零信任智能体示例。企业应用案例显示智能体已进入生产环境,如 ABC Legal 部署 50 多个智能体。
AgentCore Payments 中间件为 LangChain 智能体提供 API 支付能力
AgentCore Payments 中间件让 LangChain 智能体以确定性会话预算支付 API 费用。该中间件为 x402 支付签名,LangSmith 可追踪每一笔支付记录。
OpenRouter 推出 Activity 仪表盘与 Analytics API:按智能体、模型、请求追踪 AI 使用成本
OpenRouter 发布 Activity 仪表盘和 beta Analytics API,可按智能体、模型、请求维度查看支出、token 量、缓存命中率等指标,并支持下钻至单条请求日志。
用 Google 的 Agent Development Kit 构建零信任 AI 智能体
Google 开源了一个基于 ADK 和 Gemini 的自主客服退款 Agent(zero-trust-agents 仓库),并演示一条提示词注入可造成超额退款、密钥泄露或主机被入侵。
ABC Legal 如何借助 Claude Managed Agents 让每位员工成为构建者
ABC Legal 为 1,100 名员工部署 Claude Enterprise 后,通过 Claude Managed Agents 将零散实验转变为受治理的智能体体系,截至 2026 年 7 月已上线 50 多个生产级智能体,部分覆盖的人工任务成本降低约 50%,约 310 名员工日常使用 Claude。
- 2026-W39Claude Opus 5.5 发布并双榜登顶
- 2026-W38Google DeepMind 发布 Gemini 3.8 Live 和 3.8 Live Extended Thinking
- 2026-W37OpenAI 发布 GPT-6 Astra,面向专业工作场景
- 2026-W36OpenAI 发布 GPT-6 Astra:1.05M 上下文的计算机操作模型,因触及 Critical 网络安全阈值而限制访问
- 2026-W35AI安全与算力竞赛
- 2026-W33智能体走向主流
- 2026-W32开源模型与智能体基建加速
- 2026-W31AI安全与开源之争
- 2026-W30开源模型逼近前沿,安全事件引发关注
- 2026-W29智能体化加速与安全隐忧并存
- 2026-W28模型开源与部署加速,AI安全与就业分化加剧
- 2026-W27模型军备竞赛与智能体落地