AI 日报 · 2026 年 10 月 7 日 · 星期三
由来科技
Mistral 发布 Mistral Large 4,Artificial Analysis 评测称其为美中之外最智能模型
Mistral 发布 Mistral Large 4(Research Public Preview),在 Artificial Analysis Intelligence Index 得分 38,与 GPT-6 Luna(max, 38)相当,为美中之外最智能模型,计划 10 月底开源 1T 参数(49B 激活)权重。
模型发布/更新
Mistral 发布 Mistral Large 4,Artificial Analysis 评测称其为美中之外最智能模型
Mistral 发布 Mistral Large 4(Research Public Preview),在 Artificial Analysis Intelligence Index 得分 38,与 GPT-6 Luna(max, 38)相当,为美中之外最智能模型,计划 10 月底开源 1T 参数(49B 激活)权重。
Gemini Nano Banana 2.1 正式发布,gemini-3.1-flash-image 将于 2026 年 10 月 29 日停用
Google 发布 Gemini Nano Banana 2.1(gemini-nano-banana-2.1),定位为高效图像生成与对话式编辑模型,是 Nano Banana 2(gemini-3.1-flash-image)的更新版。
Google DeepMind 发布开源轻量多模态嵌入模型 EmbeddingGemma 2
Google DeepMind 发布 EmbeddingGemma 2,基于 Gemma 4 架构,以 Apache 2.0 许可开源,将文本、代码、图像、视频和音频映射到统一嵌入空间。
产品发布/更新
Claude for Google Workspace 开启 beta,可直接在 Docs、Sheets、Slides 中编辑
Claude 宣布推出 Claude for Google Workspace(beta),一次安装即可覆盖 Google Docs、Sheets 和 Slides。
Mistral Large 4 上线 OpenRouter 公测:1T 参数、512K 上下文
Mistral Large 4 现已在 OpenRouter 开放公测,规格为 1T 参数(49B 激活)、原生多模态、512K 上下文、最高 256K 输出。前两周五折:每 1M tokens 输入 $0.68、输出 $2.09,缓存 $0.07。
Anthropic 扩展 Cyber Verification Program,推出三档网络安全访问层级
Anthropic 启动扩展版 Cyber Verification Program(CVP),整合 Project Glasswing 和原 CVP,为合格安全专业人员提供三档访问。
行业动态
DeepSeek 据报道接近完成至少 800 亿元融资,腾讯与宁德时代参与
据 Bloomberg 援引知情人士报道,DeepSeek 接近完成至少 800 亿元(约 120 亿美元)融资,高于原定约 500 亿元的目标。腾讯和电池厂商宁德时代是本轮最大投资方之一,融资预计很快完成,DeepSeek 还计划 2027 年初 IPO,细节仍可能变化。
亚利桑那州法院裁定AI生成受害者视频带有不当情感分量,凶手须重新量刑
亚利桑那州上诉法院裁定,Gabriel Horcasitas过失杀人案量刑中使用的受害者Christopher Pelkey AI生成视频带有不当情感重量,罪名维持但刑期须重新考虑。
Anthropic 5180亿美元计算力支出中约4137亿美元无论使用与否都需支付
Anthropic 计划未来数年在云计算和计算力上支出 5180 亿美元,其中约 4137 亿美元为不可撤销承诺,即使容量闲置也需支付,平均每年约 410 亿美元。
论文研究
OpenAI 发布内部前沿模型产出的数学研究成果
OpenAI 发布一批由内部前沿模型产出的新数学成果,成果以 GitHub 仓库形式公开,并附论文修订与引用协议,其中许多证明已用 Lean 形式化以便计算机验证。
技巧与观点
Claude Code 云端会话实战指南:每个任务独占一台 VM,可并行跑任务并以分支收尾
Claude Code 推出云端会话:每个任务在独立 VM 上运行,仓库克隆到新分支,可从 claude.ai/code、手机、Desktop、终端和 Slack 启动并跟踪,完成后产出可转 PR 的分支,Pro、Max、Team、Enterprise 计划不额外收费。
卡兹克解读 A16Z 两份 AI 报告:AI 使用很广但用得还浅,头部 1% 用户月均花 903 美元
作者解读 A16Z 第七版《Top 100 消费级 AI 应用》和 90 多页的《市场状况 II》报告,指出反常识数据。美国近一半人用过 AI 但只有 25% 每天在用,截至 2026 年 8 月仅 4.5% 有 ChatGPT、Gemini 或 Claude 个人付费订阅;付费用户中头部 1% 月均消费 903 美元、贡献 19.5% 的全部消费。
快讯
- Sierra 与 Meta 联合多家企业发布 Personal Agent Protocol 开放协议Sierra:Blog
- GitHub 重建 Git 基础设施,应对智能体规模开发GitHub Blog
- ChatGPT 推出 Meetings 插件,可自动记会议纪要并跟进待办Tibo
- METR 演示 AI 智能体如何篡改 Inspect 评估记录以掩盖不当行为METR:Blog
- 卡兹克解读A16Z两份AI报告,AI使用广但付费和深度仍小众公众号:数字生命卡兹克
- Mistral Large 4 上线 Arena 的 Agent Arena 与 Code Arena 评测Arena
- DeepSeek V4.1 Flash 在 ARC-AGI (Verified) 评测中的成绩公布ARC Prize
- Cursor iOS 应用支持远程控制本地智能体Cursor:Changelog
- Reflection 发布 501B-A23B 开源编码模型 BeamLatent Space
- Anthropic Cowork 改为云端运行模型推理与 VMSimon Willison 博客