跳到正文
北京时间
2026 年第 24 周 · 06.08 — 06.14每周一出刊

AI 周报 · 2026 年第 24 周 · 06.08 — 06.14

由来科技

第 6 期242026 年第 24 周06.08 — 06.14
24件大事268条精选7期日报约 11 分钟读完
本期导读

超级应用与模型军备竞赛

本周AI行业主线是两大趋势的交汇:一是OpenAI、苹果等巨头加速将AI从聊天工具升级为跨平台超级应用/智能体平台,ChatGPT计划整合编程、图像生成与第三方服务,苹果则在WWDC推出第三代AFM模型与Apple Intelligence;二是模型性能竞赛白热化,Anthropic发布Claude Fable 5/Mythos 5实现全面SOTA,小米MiMo突破1T模型1000 tokens/s推理速度,Google推出Gemma 4 12B与Gemini 3.5 Live Translate。同时,AI智能体在编程、视频编辑、科研等场景的实用化加速,但安全与监管议题(如OpenAI IPO、欧盟DMA影响Siri上线)也持续升温。

01

超级应用与智能体平台化

本版导读OpenAI正筹备ChatGPT自2022年以来最大改版,从聊天机器人转向超级应用/Agent平台,整合Codex、图像生成及第三方应用,高管称“聊天已死”,目标成为跨平台个人AI助手。苹果在WWDC推出第三代AFM模型与Apple Intelligence,将AI深度集成到操作系统。微信AI内测两种接入模式,允许开发者授权AI直接操作小程序。这些动作标志着AI产品从单一对话向全能助手的范式转变。

ChatGPT 要变 AgentGPT 了 · 该内容已按来源方要求下架或调整展示方式。

Apple Machine Learning Research一手06.08

苹果发布第三代 Apple Foundation Models(AFM)

苹果推出第三代 Apple Foundation Models(AFM)基础模型家族,与 Google 合作定制,包含五个模型,覆盖从设备端到基于 Private Cloud Compute 的服务器端模型。这些模型旨在驱动 Apple Intelligence 功能,包括全新 Siri 和智能工具,以用户为中心深度融合操作系统,隐私为核心设计原则。

IT之家06.08

微信AI官宣内测:两种接入模式供开发者选择

微信开发者官方今日发布指引,确认微信AI正在内测阶段。开放平台提供两种接入模式:自动模式可授权平台读取小程序源码,无需额外开发即可让微信AI直接操作页面;开发模式下开发者可自主开发技能,审核后由微信AI调用。两种模式可同时开启。微信AI是微信内的AI助手,用户通过自然语言对话即可调用、访问和操作小程序。服务条款称“微信AI”可能非最终名称。接入与否不影响现有小程序服务。

02

模型性能竞赛:SOTA与推理效率双突破

本版导读Anthropic发布Claude Fable 5和Mythos 5,在软件工程、科研等几乎所有基准上达到SOTA,价格较预览版大幅下降。小米MiMo联合TileRT实现1T参数MoE模型单节点超1000 tokens/s推理速度,采用FP4混合量化与并行推测解码。Google推出Gemma 4 12B无编码器多模态模型,性能接近26B MoE但内存减半,可在消费级笔记本运行。Cohere发布North Mini Code,30B MoE模型在编码基准上超越同类。模型竞争从单纯追求能力转向同时兼顾效率与成本。

Anthropic:Newsroom一手06.09

Claude Fable 5 和 Claude Mythos 5

Anthropic 今日推出 Claude Fable 5(通用安全版)和 Claude Mythos 5(受限安全版)。Fable 5 在软件工程、知识工作、视觉、科研等几乎所有测试基准上达到 SOTA,Stripe 称其将数月工程压缩至数天,FrontierCode 评分居前沿模型之首,可仅凭截图重建网页应用源码。Mythos 5 在药物设计中实现约 10 倍加速,其分子生物学假说盲测获科学家偏好的概率约 80%。两模型售价均为 $10/百万输入 tokens、$50/百万输出 tokens,较 Claude Mythos Preview 降价过半。Fable 5 在部分敏感主题上回退至 Claude Opus 4.8,安全触发率低于 5% 的会话。Mythos 5 通过 Project Glasswing 向网络安全防御者开放。

小米 MiMo一手06.08

小米 MiMo-V2.5-Pro-UltraSpeed 突破 1,000 tokens/s,单台 8-GPGPU 节点运行 1T MoE 模型

小米 MiMo 联合 TileRT_AI 发布 MiMo-V2.5-Pro-UltraSpeed,首次在 1 万亿参数 MoE 模型上实现超过 1,000 tokens/s 输出速度,仅用单台标准 8-GPGPU 节点(非 Cerebras 或 Groq 方案)。提供限时免费聊天体验,UltraSpeed API 价格为 3 倍,输出体验提升约 10 倍。申请时间为 6 月 8 日至 23 日(PDT),企业可邮件联系 business-mimo@xiaomi.com。

Google DeepMind:Blog一手06.03

Google DeepMind 发布 Gemma 4 12B:统一的无编码器多模态模型

Gemma 4 12B 是 Google DeepMind 最新推出的中等规模多模态模型,采用无编码器统一架构,原生支持音频输入。其基准测试性能接近 26B MoE 模型,但内存占用不到一半,仅需 16GB 显存或统一内存即可在消费级笔记本上本地运行。模型内置多 token 预测(MTP)drafter 以降低延迟,基于 Apache 2.0 开源许可发布,已累计超过 1.5 亿次下载。

Hugging Face:Blog一手06.09

Cohere发布North Mini Code:面向开发者的开源编码模型

Cohere发布North Mini Code,一款30B参数MoE模型(3B活跃参数),Apache 2.0开源。在Artificial Analysis Coding Index上得分33.4,超越Qwen3.5、Gemma 4等同类模型。后训练采用两阶段SFT和RLVR,在SWE-Bench Verified上pass@10达80.2%,Terminal-Bench v2上达55.1%。支持64K/128K上下文长度,专为智能体编码任务优化。

03

AI智能体实用化:编程、视频与科研

本版导读AI智能体在多个垂直领域加速落地。Kimi Code开源Coding Agent升级,新增视频理解与权威数据源集成。Runway Aleph 2.0编辑模型可一键适配任意视频格式。Perplexity与哈佛研究表明,自主智能体比搜索快87%、成本低94%。生物学领域,Anthropic实验指出当前AI智能体在科研数据检索中准确率不足,需确定性检索层辅助。Harness-1作为20B检索子智能体,通过强化学习在8个基准上达到SOTA。

公众号:月之暗面(Kimi)一手06.08

Kimi Code 焕新升级(附视频教程)

Kimi Code 开源 Coding Agent 迎来大版本升级:一行命令安装,毫秒级启动;新增视频理解能力,支持提取视频风格生成 LUT 文件、长视频切片、根据录屏生成代码;集成同花顺、天眼查等权威数据源,可查询股票价格、财报、学术论文;支持 ACP 协议,可在 JetBrains、Zed 中使用;丰富 hook 生态方便集成其他工具。底层视觉推理由 Kimi K2.6 模型提供。

Runway一手06.08

Runway Aleph 2.0 编辑模型:一键适配任意视频格式

一个视频,现在可以为每个信息流和格式制作。上传你现有的视频,选择你想要的宽高比,然后观看我们的编辑模型 Aleph 2.0,填充场景的其余部分,就像你从一开始就这样制作一样。 在我们的桌面 Web 应用上尝试,链接如下。

Perplexity一手06.09

Perplexity与哈佛:AI智能体提效87%降本94%

我们与哈佛大学发表新研究,关于从聊天界面转向像Computer这样的自主智能体的转变。 超过3个月的研究结果表明,使用Computer的工人在完成任务上比仅使用搜索快87%,成本低94%,且满意度更高。 https://research.perplexity.ai/articles/how-ai-agents-reshape-knowledge-work

Anthropic:Research(发表成果 · 网页)一手06.08

为生物学AI智能体铺路

一项实验让Claude、Biomni、Edison Analysis、GPT等科研智能体从病毒学数据库NCBI Virus中检索序列数据,即使最强模型也无法稳定达到可靠数据集构建所需的准确率。加入确定性检索层gget virus后,准确率接近100%。研究指出,当前生物学数据基础设施存在碎片化、格式特殊、接口不统一等问题,导致AI智能体难以像在软件领域那样高效工作。确定性检索工具是实现可靠智能体工作流的关键,生物学数据库需为智能体作为规模化用户而设计。

MarkTechPost06.07

Harness-1:基于强化学习训练的有状态搜索20B检索子智能体

UIUC与Chroma联合推出Harness-1,一个20B参数的检索子智能体。它通过强化学习在一个有状态搜索框架中训练,该框架维护候选池、重要性标注集、证据图和验证记录,由策略决定搜索、筛选、验证及停止的时机。Harness-1在8个基准测试上达到0.730平均curated recall,比下一个最佳开源子智能体高出11.4个百分点,仅落后于Opus-4.6。模型权重和框架代码均已公开。

04

AI治理与商业:IPO、监管与公共财富

本版导读OpenAI向SEC机密提交S-1草案,上市时间未定,同时宣布进入第三发展阶段,目标让AI普及、易用且安全。特朗普政府探讨通过公共财富基金让政府入股AI初创公司。欧盟DMA导致苹果Siri AI在欧盟延迟上线。OpenAI推出Economic Research Exchange研究AI经济影响。这些事件凸显AI行业在快速扩张的同时,正面临日益复杂的治理与商业挑战。

IT之家06.09

奥尔特曼宣布 OpenAI 进入第三发展阶段:让 AI 普及、易用且安全

本周一,OpenAI CEO 奥尔特曼与首席科学家帕霍茨基联合发文,宣布公司进入第三发展阶段,目标让 AI 普及、易用且安全。此前第一阶段聚焦通用人工智能技术研发,第二阶段面向全球推出产品。第三阶段三大核心目标是打造自动化人工智能研究员、推动经济提速、为每人配备专属通用人工智能。二人强调智能系统须坚守安全底线,呼吁成立国际机构应对 AI 风险,必要时可暂缓前沿模型研发。同日,OpenAI 秘密提交 IPO 申请,但上市仍需较长时间。上周 Anthropic 研究人员也建议适当放缓前沿 AI 研发。

Rohan Paul06.08

特朗普政府与OpenAI讨论通过公共财富基金入股AI初创公司

据FT报道,特朗普政府正与OpenAI探讨通过公共财富基金机制让政府入股AI初创公司。方案是AI企业捐赠小部分股权至该基金,基金通过账户或分红将收益返还美国公民,而非政府直接运营公司。这不同于特朗普去年对Intel的90亿美元直接持股。OpenAI此前已提出公共财富基金概念,持有长期资产,让公民分享AI增长红利。政治背景方面,选民担忧失业、数据中心成本与企业控制,而AI公司需要华盛顿在基建、采购和监管上的支持。

05

AI赋能创意与行业应用

本版导读AI在创意产业与垂直行业展现新可能。Luma AI Ray3.2 API提供电影级渲染集成,生数科技与华策影视共建AI视听创制中心。高德发布全球首个3D原生城市世界模型ABot-Earth0.5,10分钟生成公里级3D城市。NVIDIA与LG、KRAFTON等合作推进AI工厂与游戏适配。日本农民用ChatGPT和Codex解决农场实际问题,展示了AI在传统行业的低成本自动化潜力。

Luma AI一手06.10

Luma AI Ray3.2 API:电影级渲染可集成

Ray3.2 API 可大规模运行电影级渲染,并集成到您正在构建的产品中。专为在交付的产品中打造电影感的开发者、代理机构和企业而设计。 开始构建 → http://lumalabs.ai/api

公众号:生数科技(Vidu·视频)一手06.08

生数科技与华策影视达成战略合作,共建AI视听创制中心

6月7日,生数科技与华策影视签署战略合作协议,共同推动AI与影视产业融合。双方将以华策影视科技产教示范区为载体、生数科技Vidu视频生成大模型为技术底座,设立“AI视听创制中心”,探索AI虚拟制作与实拍结合。同时在浙江华策影视学校设立“华策&生数AI影视创制专业”,课程覆盖传统编导剪与AI视频制作技术。内容生产层面推广“实拍+AI”融合方案并优先在华策项目中试点,创作者生态层面引导Vidu社区超级创作者到产教基地注册。

IT之家06.08

全球首个:高德发布3D原生城市世界模型ABot-Earth0.5

阿里巴巴旗下高德发布全球首个3D原生城市世界模型ABot-Earth0.5,已建成覆盖190多个国家和地区的3D地图。用户输入卫星图或文字描述,10分钟即可在消费级GPU上生成公里级3D城市,输出可编辑3DGS格式,可直接导入Unity等引擎。制图成本为传统百分之一,效率提升约千倍,可为具身智能、低空经济、应急救援等提供支撑。目前已开放内测,可前往abot-earth.amap.com提交申请。

“我在田里雇了一名工程师,它叫 Codex” —— 北海道一个西兰花农的 8 个真实 AI 用法 · 该内容已按来源方要求下架或调整展示方式。

往期 AI 周报
(本期完)

由来科技 周报由编辑系统根据公开来源自动综合,每条均附原文 · 往期周报