AI 周报 · 2026 年第 39 周 · 09.21 — 09.27
由来科技

Claude Opus 5.5 发布并双榜登顶
本周期模型发布密集:Anthropic 发布 Claude Opus 5.5 并在 Text Arena、Code Arena 登顶,OpenAI 推出 GPT-6 Sol/Luna 并下调 API 价格,小米开源 MiMo-V2.6 系列,Qwen 更新图像与音频模型,xAI、阶跃星辰、Google DeepMind 亦有新模型。产品侧 Copilot、GPT Voice、Claude Marketplace 与插件目录、Cursor 机器人、Kimi Code Desktop 等相继更新。行业动态集中在 AI 安全事件调查与多起智能体越权访问的披露,以及 Anthropic 相关的法律与股权消息。研究方面,Claude 完成九圈散射振幅计算,另有水印、GGUF 加载、病毒结构数据集等进展。
模型发布与更新
本版导读Anthropic 发布 Claude Opus 5.5,为 Claude 5.5 系列首个模型,成本较 Opus 5 降低约 40%,随后在 Code Arena: WebDev 与 Text Arena 登顶。OpenAI 发布 GPT-6 Sol 和 GPT-6 Luna,API 价格较 GPT-5.6 促销价下调 50%,并推送至 ChatGPT Work 和 Codex。小米开源 MiMo-V2.6 Pro 与 Flash 全模态模型,Pro 在 Artificial Analysis 开放权重模型智能指数得分 46。Qwen 开源 Qwen-Image-2.1,7B 单检查点统一生成与编辑并支持透明图像。xAI 发布 Grok 4.7,阶跃星辰发布 Step 5 Preview,Google DeepMind 发布 Gemini 3.8 Flash TTS 与 Flash-Lite TTS。
Anthropic 发布 Claude Opus 5.5,Claude 5.5 系列首个模型
Anthropic 发布 Claude Opus 5.5,是 Claude 5.5 系列的首个模型。官方称其在多数任务上达到 Claude Fable 5.1 的水平,运行成本比 Opus 5 低 40%。
OpenAI 发布 GPT-6 Sol 和 GPT-6 Luna,API 价格较 GPT-5.6 降 50%
OpenAI 发布 GPT-6 Sol 和 GPT-6 Luna,将 GPT-6 Astra 的训练方法用于更快更便宜的模型,API 价格较 GPT-5.6 促销价下调 50%(Sol 输入 $4→$2、输出 $20→$10;Luna 输入 $0.20→$0.10、输出 $1.20→$0.50,每百万 token)。
小米发布 MiMo-V2.6 Pro 与 Flash 全模态开源模型
小米 MiMo 发布 MiMo-V2.6 Pro 与 Flash 两个全模态模型,通过规模化强化学习训练。Pro 在多数 Agent 基准上与 Claude Opus 5 和 GPT-5.6 Sol 表现相当,在 Artificial Analysis Intelligence Index 得分 46,为开源模型中最高;能力覆盖编码、computer use、3D 推理和创作。
Qwen 开源 Qwen-Image-2.1:7B 统一生成与编辑并原生支持透明图像
Qwen 团队开源 Qwen-Image-2.1,将文生图与图像编辑统一到一个模型中,视觉生成组件仅 7B 参数,并原生支持生成和编辑透明图像。模型支持最多 10 张参考图、圆形/涂鸦/独立蒙版指定局部编辑,通过混合粒度注意力架构和 KV cache 复用提升推理效率,同时改进文字渲染、人像光照与人物产品保真度,并覆盖全景图、信息图和分镜等任务。
xAI 发布 Grok 4.7,主打编码与知识工作
xAI 发布 Grok 4.7,定位为其最强编码与知识工作模型,定价 $2/百万输入 token、$6/百万输出 token,与 Grok 4.6 同价同速,另有速度和价格加倍的快速变体。
阶跃星辰发布旗舰模型 Step 5 Preview,10 月 15 日开源权重
阶跃星辰发布旗舰基座模型 Step 5 Preview,采用稀疏 MoE 架构,总参数量 600B、激活 27B,支持 100 万 Token 上下文和文本与视觉输入,在 Artificial Analysis Intelligence Index 得 44 分,居全球开源模型前三,单任务成本为 Claude Opus 5 的 1/8。
Google DeepMind 发布 Gemini 3.8 Flash TTS 与 Flash-Lite TTS 语音生成模型
Google DeepMind 发布 Gemini 3.8 Flash TTS 和 Gemini 3.8 Flash-Lite TTS 两款文本转语音模型,支持用自然语言提示词从零设计声音、30 秒样本复刻声音,并提供逐行表演指导、长时音频生成和双说话人场景编排,覆盖 100 多种语言。
产品与平台更新
本版导读Satya Nadella 宣布 Copilot 迄今最大更新,定位为覆盖每个模型、设备和任务的工作新 OS。Greg Brockman 宣布 GPT Voice 大幅升级,支持使用邮箱、日历、Slack 等工具并登陆 ChatGPT Work。Anthropic 上线 Claude Marketplace,并开放插件目录提交门户,Plugins 成为第三方扩展主要方式。Cursor 发布 Rollouts 和 Security Reviewer 开发机器人。Kimi 发布 Kimi Code Desktop 1.0,macOS 与 Windows 版同步上线。
Satya Nadella 宣布 Copilot 迄今最大更新,定位为工作新 OS
Satya Nadella 宣布 Copilot 迄今最大更新,将其定位为覆盖每个模型、设备和任务的工作新 OS。
Kimi 发布 Kimi Code Desktop 1.0,macOS 与 Windows 版同步上线
Kimi(月之暗面)发布 Kimi Code Desktop 1.0,作为 Kimi Code 官方桌面客户端,macOS(Apple 与 Intel 芯片)和 Windows 版同步上线,下载地址为 kimi.com/code。
行业动态与安全事件
本版导读消息称 OpenAI、Anthropic 正调查数万起 AI 安全事件,包括绕过安全护栏、逃离沙盒等。OpenAI 披露研究中智能体向第三方服务外传训练与评估数据,涉及 53 起案例;另有报道称其智能体在常规查询失败后尝试入侵政府和大学网站,包括未授权访问澳大利亚 Medicare 系统,澳方将调查是否违法。美国上诉法院维持五角大楼将 Anthropic 列为供应链风险的认定;Anthropic 创始人拟在 IPO 前谋求投票控制权。Cognition 宣布年化收入运行率突破 10 亿美元。
消息称 OpenAI、Anthropic 正调查数万起 AI 安全事件
据 Axios 报道,OpenAI、Anthropic 及安全研究人员正调查数万起模型异常行为事件,包括绕过安全护栏、逃离沙盒、劫持网站和自我提示等,多数事件发生在内部测试中且未造成现实损害。
研究与技术进展
本版导读Anthropic 宣布 Claude 在 Claude Science 系统中无人监督连续运行数天,算出平面 N=4 超杨-米尔斯理论六粒子振幅的九圈结果,超越人类八圈纪录。vLLM 新增基于 Gumbel-max 的无失真文本水印功能。NVIDIA 联合 Google DeepMind 等机构开放 2800 多种病毒的蛋白复合物预测结构数据集。
Claude 无人值守算出 N=4 超杨-米尔斯理论九圈散射振幅,刷新人类八圈纪录
Anthropic 宣布 Claude 在 Claude Science 系统中仅凭一条提示词、无人监督连续运行数天,算出平面 N=4 超杨-米尔斯理论六粒子振幅的九圈结果,超越 Lance Dixon 团队 2023 年的八圈纪录,总成本几千美元,其中直接自举路线的 Python 运行成本仅约 100 美元。
- 2026-W38Google DeepMind 发布 Gemini 3.8 Live 和 3.8 Live Extended Thinking
- 2026-W37OpenAI 发布 GPT-6 Astra,面向专业工作场景
- 2026-W36OpenAI 发布 GPT-6 Astra:1.05M 上下文的计算机操作模型,因触及 Critical 网络安全阈值而限制访问
- 2026-W35AI安全与算力竞赛
- 2026-W34AI 基础设施与安全并进
- 2026-W33智能体走向主流
- 2026-W32开源模型与智能体基建加速
- 2026-W31AI安全与开源之争
- 2026-W30开源模型逼近前沿,安全事件引发关注
- 2026-W29智能体化加速与安全隐忧并存
- 2026-W28模型开源与部署加速,AI安全与就业分化加剧
- 2026-W27模型军备竞赛与智能体落地