跳到正文
北京时间
2026 年第 33 周 · 08.10 — 08.16每周一出刊

AI 周报 · 2026 年第 33 周 · 08.10 — 08.16

由来科技

第 15 期332026 年第 33 周08.10 — 08.16
27件大事82条精选7期日报约 12 分钟读完
本期导读

智能体走向主流

本周AI行业主线是智能体(Agent)的全面主流化:从模型、基础设施到应用与安全,各环节均围绕智能体展开。模型层面,Meta、NVIDIA、xAI、微软等密集发布面向智能体工作流的开源或专用模型,如Muse Glimmer、Nemotron 3.5 Lightning、Grok 4.6、MAI-Thinking-1;基础设施层面,SGLang、OpenRouter、Databricks等优化推理与工具链;应用层面,Claude Code默认开启自动模式、千问开放平台上线、ChatGPT桌面端导入其他智能体数据;安全层面,提示注入攻击基本解决、上下文策略阻断组合攻击、API漏洞曝光。同时,Gemini月活破10亿、Anthropic拟IPO等标志性事件,显示AI正加速渗透日常与商业。

图 · Meta 发布开源模型 Muse Glimmer
01

智能体模型密集发布

本版导读本周多家机构发布面向智能体工作流的新模型,强调本地运行、长上下文与工具调用能力。Meta开源Muse Glimmer(30B,消费级硬件可跑),NVIDIA推出Nemotron 3.5 Lightning(30B MoE,速度提升4倍),xAI发布Grok 4.6强化长时运行智能体,微软首发自研推理模型MAI-Thinking-1,阿里开源Qwen3.8-2.4T-A95B(2.4T MoE)。这些模型均针对智能体场景优化,显示行业竞争焦点正从通用对话转向智能体执行能力。

AI at Meta一手08.10

Meta 发布开源模型 Muse Glimmer

推出 Muse Glimmer,一款开放权重、300 亿参数的模型,专为本地、常驻运行的智能体工作流优化。 与同尺寸领先模型相比,Muse Glimmer 在关键智能体用例和基准测试中表现出色,并设计为完全在消费级硬件(如 Mac 或配备高性能 GPU 的 PC)上运行。 秉承我们长期分享基础 AI 研究的传统,我们以宽松的 Apache 2.0 许可证发布模型权重。

NVIDIA Blog一手08.11

NVIDIA 推出 Nemotron 3.5 Lightning,加速本地智能体任务

NVIDIA 发布 Nemotron 3.5 Lightning,一款可定制的开源 30B 混合专家(MoE)模型,专为常驻智能体设计。相比同类开源模型,其 token 生成速度最高提升 4 倍,任务完成时间缩短 30%。该模型采用开放权重,支持用户微调以匹配特定任务,并可在 RTX PC、DGX Spark 及 Jetson 等设备上运行。

xAI:News一手08.12

xAI 发布 Grok 4.6,强化长时运行智能体能力

xAI 今日发布 Grok 4.6,在 Grok 4.5 基础上重点强化长时运行智能体及更复杂的交互式与视觉工作能力。该模型在多项智能体编码与知识工作基准上达到前沿水平,在 Artificial Analysis Intelligence Index(九项基准综合分)上追平 GPT-5.6 Sol。

02

智能体基础设施与工具链升级

本版导读智能体的普及带动基础设施优化。SGLang为Muse Glimmer和Nemotron 3.5 Lightning提供Day-0支持,OpenRouter推出新版Auto路由器与实时网页搜索基准,Databricks开源Metals v2并引入WASM Postgres沙箱,OpenChamber提供跨平台代理开发环境。这些工具旨在提升智能体的推理效率、开发体验与可靠性,降低构建复杂智能体的门槛。

OpenRouter:Announcements一手08.10

OpenRouter 推出由市场智慧驱动的新版 Auto 路由器

OpenRouter 基于每周超 55T token 的社区消费数据,推出新版 Auto 路由器(openrouter/auto),其模型选择在多数任务和成本档位上优于旧版。新路由器按约 30 种任务类型匹配近 7 天社区实际消费的模型,支持 cost_tier 参数(low 至 max)并遵循账户隐私设置。在 MMLU Pro 等基准上,新默认档位在多数领域以更低成本达到旧版同等性能。

Databricks:Blog一手08.11

Electric 加入 Databricks,将 WASM Postgres 引入 AI 智能体沙箱

Databricks 宣布 Electric 团队加入,将 WASM Postgres 引入 AI 智能体沙箱。该技术让智能体在隔离环境中运行本地数据库,支持实时数据同步与离线操作,提升构建可靠、可验证智能体应用的效率。Electric 的加入将强化 Databricks 在智能体基础设施领域的布局。

Hacker News 热门(buzzing.cc 中文翻译)08.10

OpenChamber:一个基于代理的开发环境

OpenChamber 是一个基于代理的开发环境,可跨桌面、浏览器、手机和 VS Code 使用,支持会话目标、多模型并行运行与融合、变更走查、从 issue 到 PR 的完整流程及定时任务。该工具基于 OpenCode SDK,完全开源且免费,代码和会话内容均保存在本地,远程访问可通过 UI 密码和端到端加密的 Private Relay 保护。

03

智能体应用与产品落地

本版导读智能体正从技术走向实际应用。Claude Code自动模式默认开启,ChatGPT桌面端支持导入其他智能体数据,千问开放平台上线覆盖十余领域服务,Zapier用ChatGPT Work改造营销流程,Linear Agent通过系统提示词与工具设计划定边界。这些产品展示了智能体在编程、办公、生活服务等场景的实用价值,也引发对AI内容侵蚀社交人味的讨论。

Claude Devs一手08.10

Claude Code 自动模式默认开启原理

我们最近将自动模式设为 Claude Code 的默认选项,这意味着你不再需要批准每一个操作。 但什么决定某个操作是否可以安全运行?看看它是如何工作的:

OpenAI Developers一手08.12

ChatGPT 桌面端支持导入其他智能体工作数据

你现在可以将其他智能体的工作内容与 ChatGPT Work 和 Codex 保持同步。 可导入项目、聊天记录、技能和插件,查看导入历史,并可在设置中选择开启自动更新。 现已在 ChatGPT 桌面应用中提供。

公众号:千问APP(阿里)一手08.10

千问开放平台上线:租房、寄快递、查理财等十余领域服务可对话办理

千问开放平台今日上线,面向生态伙伴和开发者开放手机、PC和AI眼镜三类终端的服务接入,首批覆盖物流运输、房产居住、本地生活、理财、汽车等十多个领域。用户可在对话中@相关服务或点击“圆点角标”进入智能体,完成从咨询、推荐到下单的完整流程。平台支持标准化协议接入、一键授权与端到端调测,并提供账号、AI支付、订单接入等基础设施。

OpenAI:官网动态(RSS · 排除企业/客户案例)一手08.10

Zapier 如何用 ChatGPT Work 改造核心营销流程

Zapier 企业营销团队用 ChatGPT Work 自动化线索漏斗优化、营销素材搭建和报告生成,每月可对数千条线索执行 QA/QC,单人查看一条流失线索原本需 35 至 45 分钟。该系统每月为销售团队带来七位数管道价值,并生成高管仪表盘展示线索管道中的重复问题与每周趋势。团队得以将更多时间投入策略与创意工作,并计划未来设置常驻自动化循环。

Linear:Now一手08.10

Linear 如何构建 Linear Agent:在系统提示词、工具设计与系统技能中划定边界

Linear Agent 的价值在于完成未预设的工作,因此团队未为其编写固定路径,而是通过系统提示词、工具设计、产品模型、运行范围及底层自定义 harness 划定边界。系统提示词聚焦沟通风格、硬性边界与产品概念解释;工具设计将约束编码进参数,使无效操作难以执行。团队还引入系统技能作为组合单元,按需渐进加载,避免一次性暴露过多上下文。

公众号:数字生命卡兹克08.11

微信小微AI帮写与AI点评内测:朋友圈最后一点人味正在消失

微信基于小微推出朋友圈AI帮写与AI点评内测功能,前者可根据图片和已写文字生成3条朋友圈文案,后者可长按文字生成评价或快捷评论。作者认为这两个功能将AI置于社交核心位置,可能鼓励AI内容、破坏朋友圈自2012年确立的“记录美好生活”基调。公众号端小微还常驻首位,自动总结常看公众号文章,作者担忧这会反向影响创作者内容生产。

04

智能体安全与风险

本版导读随着智能体能力增强,安全问题凸显。Anthropic称已基本解决提示注入攻击,Databricks提出上下文策略阻断组合攻击,但研究人员发现API漏洞可读取加密推理过程,tl;dv会议记录泄露暴露租户隔离缺失。这些事件表明,智能体的安全防护需从模型训练、系统设计到数据管理多层面协同,任何环节的疏漏都可能导致严重风险。

Boris Cherny08.10

Anthropic 称已基本解决提示注入攻击

Anthropic 的 Boris Cherny 表示,通过模型训练已基本解决 Claude 模型在实际使用中的提示注入威胁。独立研究者的基准测试显示,叠加模型训练、输入探测和意图分类器等多层防御后,未见过的间接提示注入攻击成功率可降至约 0。Claude Code 的 auto 模式将于下周默认开启。

Databricks:Blog一手08.11

Omnigent 上下文策略如何阻断“致命三重奏”组合攻击

Omnigent 的上下文策略(Contextual Policies)可阻断“致命三重奏”组合攻击——即多个看似无害的请求叠加后形成的恶意行为。该机制在单个请求层面不设防,而是在组合上下文中识别并拦截风险,从而在不牺牲正常功能的前提下提升安全性。

The Decoder:AI News08.12

研究人员发现可读取ChatGPT等模型加密推理过程的API漏洞

Alexander Panfilov团队发现OpenAI、Anthropic、Google等主要AI提供商API存在漏洞,可读取推理模型的加密思考过程。扫描约7000条公开会话发现62个API密钥、33个邮箱和33个密码。通过越狱,Anthropic的Haiku 4.5可逐字转写Opus 4.8的原始推理;解码10000条推理轨迹的API成本约720美元。

Hacker News 热门(buzzing.cc 中文翻译)08.10

tl;dv 逾18.1万段AI会议录音被公开暴露,可实时闯入他人通话

AI会议记录平台tl;dv的Firestore数据库因缺乏租户隔离,任何已认证用户可查询全部18.1万段会议记录,涉及84,312名用户、35,003个域名,含23国政府及多所高校会议。处于录制状态的约1,000场会议会暴露可加入的会议ID,研究者借此闯入马来西亚教育部及美国某大学创业团队的实时通话。该漏洞自2026年1月报告后6个月仍未修复,另有超1,000段会议内容为公开状态。

05

行业格局与资本动向

本版导读AI行业资本与市场格局加速演变。英伟达联合六大机构融资5000亿美元建AI工厂,Anthropic最快9月IPO估值9650亿美元,Gemini月活破10亿成谷歌增长最快产品,SaaS龙头因AI获得估值溢价。同时,英伟达开发万亿参数开源模型Nemotron 4,可能冲击现有闭源模型格局。这些事件显示AI投资热度不减,但循环融资与估值泡沫的担忧也开始浮现。

Sundar Pichai08.12

Gemini月活破10亿,成谷歌增长最快产品

每月已有超过 10 亿人使用 @Geminiapp 激发新想法、完成工作。这是我们有史以来增长最快的产品,也是第 14 个达到 10 亿用户里程碑的产品。 感谢 @JoshWoodward 和整个 Gemini 团队,也感谢每一位与我们同行的伙伴——未来还有更多精彩!

IT之家08.11

消息称英伟达开发万亿参数开源 AI 模型 Nemotron 4,目标挑战全球顶级

英伟达正在研发新一代开源 AI 模型系列 Nemotron 4,规模最大的模型预计至少拥有 1 万亿个参数,旨在与全球最先进的开源模型竞争。英伟达尚未确定发布日期,最终训练也未完成,员工认为该模型最早可能在今年秋末准备就绪。此举意在通过开放模型生态扩大 AI 应用范围,并推动市场对其 GPU 算力的需求。

Gary Marcus:The Road to AI We Can Trust一手08.11

英伟达循环融资达到新高度,黄仁勋是否过度出牌?

英伟达股价在相关消息公布后小幅下滑,收盘报217.55美元,盘前略有回升。金融记者Holger Zschaepitz和曾预测安然倒闭的Jim Chanos均对英伟达的循环融资做法表示担忧。此外,英伟达将发布真正开源(非仅开放权重)的Nemotron模型新版本,这可能最终削弱其合作伙伴OpenAI和Anthropic的地位。

往期 AI 周报
(本期完)

由来科技 周报由编辑系统根据公开来源自动综合,每条均附原文 · 往期周报