AI 周报 · 2026 年第 24 周 · 06.08 — 06.14
由来科技
超级应用与模型军备竞赛
本周AI行业主线是两大趋势的交汇:一是OpenAI、苹果等巨头加速将AI从聊天工具升级为跨平台超级应用/智能体平台,ChatGPT计划整合编程、图像生成与第三方服务,苹果则在WWDC推出第三代AFM模型与Apple Intelligence;二是模型性能竞赛白热化,Anthropic发布Claude Fable 5/Mythos 5实现全面SOTA,小米MiMo突破1T模型1000 tokens/s推理速度,Google推出Gemma 4 12B与Gemini 3.5 Live Translate。同时,AI智能体在编程、视频编辑、科研等场景的实用化加速,但安全与监管议题(如OpenAI IPO、欧盟DMA影响Siri上线)也持续升温。
超级应用与智能体平台化
本版导读OpenAI正筹备ChatGPT自2022年以来最大改版,从聊天机器人转向超级应用/Agent平台,整合Codex、图像生成及第三方应用,高管称“聊天已死”,目标成为跨平台个人AI助手。苹果在WWDC推出第三代AFM模型与Apple Intelligence,将AI深度集成到操作系统。微信AI内测两种接入模式,允许开发者授权AI直接操作小程序。这些动作标志着AI产品从单一对话向全能助手的范式转变。
ChatGPT 要变 AgentGPT 了 · 该内容已按来源方要求下架或调整展示方式。
OpenAI 仍推进超级应用计划
OpenAI 一位高级员工表示“聊天已死”,同时公司仍在继续推进超级应用计划。
苹果发布第三代 Apple Foundation Models(AFM)
苹果推出第三代 Apple Foundation Models(AFM)基础模型家族,与 Google 合作定制,包含五个模型,覆盖从设备端到基于 Private Cloud Compute 的服务器端模型。这些模型旨在驱动 Apple Intelligence 功能,包括全新 Siri 和智能工具,以用户为中心深度融合操作系统,隐私为核心设计原则。
Apple Intelligence 将强大 AI 能力融入日常体验
Apple 发布下一代 Apple Intelligence,将 AI 能力集成到 iPhone、iPad 和 Mac 中,带来更个性化和有帮助的日常体验。
微信AI官宣内测:两种接入模式供开发者选择
微信开发者官方今日发布指引,确认微信AI正在内测阶段。开放平台提供两种接入模式:自动模式可授权平台读取小程序源码,无需额外开发即可让微信AI直接操作页面;开发模式下开发者可自主开发技能,审核后由微信AI调用。两种模式可同时开启。微信AI是微信内的AI助手,用户通过自然语言对话即可调用、访问和操作小程序。服务条款称“微信AI”可能非最终名称。接入与否不影响现有小程序服务。
模型性能竞赛:SOTA与推理效率双突破
本版导读Anthropic发布Claude Fable 5和Mythos 5,在软件工程、科研等几乎所有基准上达到SOTA,价格较预览版大幅下降。小米MiMo联合TileRT实现1T参数MoE模型单节点超1000 tokens/s推理速度,采用FP4混合量化与并行推测解码。Google推出Gemma 4 12B无编码器多模态模型,性能接近26B MoE但内存减半,可在消费级笔记本运行。Cohere发布North Mini Code,30B MoE模型在编码基准上超越同类。模型竞争从单纯追求能力转向同时兼顾效率与成本。
Claude Fable 5 和 Claude Mythos 5
Anthropic 今日推出 Claude Fable 5(通用安全版)和 Claude Mythos 5(受限安全版)。Fable 5 在软件工程、知识工作、视觉、科研等几乎所有测试基准上达到 SOTA,Stripe 称其将数月工程压缩至数天,FrontierCode 评分居前沿模型之首,可仅凭截图重建网页应用源码。Mythos 5 在药物设计中实现约 10 倍加速,其分子生物学假说盲测获科学家偏好的概率约 80%。两模型售价均为 $10/百万输入 tokens、$50/百万输出 tokens,较 Claude Mythos Preview 降价过半。Fable 5 在部分敏感主题上回退至 Claude Opus 4.8,安全触发率低于 5% 的会话。Mythos 5 通过 Project Glasswing 向网络安全防御者开放。
小米 MiMo-V2.5-Pro-UltraSpeed 突破 1,000 tokens/s,单台 8-GPGPU 节点运行 1T MoE 模型
小米 MiMo 联合 TileRT_AI 发布 MiMo-V2.5-Pro-UltraSpeed,首次在 1 万亿参数 MoE 模型上实现超过 1,000 tokens/s 输出速度,仅用单台标准 8-GPGPU 节点(非 Cerebras 或 Groq 方案)。提供限时免费聊天体验,UltraSpeed API 价格为 3 倍,输出体验提升约 10 倍。申请时间为 6 月 8 日至 23 日(PDT),企业可邮件联系 business-mimo@xiaomi.com。
Google DeepMind 发布 Gemma 4 12B:统一的无编码器多模态模型
Gemma 4 12B 是 Google DeepMind 最新推出的中等规模多模态模型,采用无编码器统一架构,原生支持音频输入。其基准测试性能接近 26B MoE 模型,但内存占用不到一半,仅需 16GB 显存或统一内存即可在消费级笔记本上本地运行。模型内置多 token 预测(MTP)drafter 以降低延迟,基于 Apache 2.0 开源许可发布,已累计超过 1.5 亿次下载。
Cohere发布North Mini Code:面向开发者的开源编码模型
Cohere发布North Mini Code,一款30B参数MoE模型(3B活跃参数),Apache 2.0开源。在Artificial Analysis Coding Index上得分33.4,超越Qwen3.5、Gemma 4等同类模型。后训练采用两阶段SFT和RLVR,在SWE-Bench Verified上pass@10达80.2%,Terminal-Bench v2上达55.1%。支持64K/128K上下文长度,专为智能体编码任务优化。
AI智能体实用化:编程、视频与科研
本版导读AI智能体在多个垂直领域加速落地。Kimi Code开源Coding Agent升级,新增视频理解与权威数据源集成。Runway Aleph 2.0编辑模型可一键适配任意视频格式。Perplexity与哈佛研究表明,自主智能体比搜索快87%、成本低94%。生物学领域,Anthropic实验指出当前AI智能体在科研数据检索中准确率不足,需确定性检索层辅助。Harness-1作为20B检索子智能体,通过强化学习在8个基准上达到SOTA。
Kimi Code 焕新升级(附视频教程)
Kimi Code 开源 Coding Agent 迎来大版本升级:一行命令安装,毫秒级启动;新增视频理解能力,支持提取视频风格生成 LUT 文件、长视频切片、根据录屏生成代码;集成同花顺、天眼查等权威数据源,可查询股票价格、财报、学术论文;支持 ACP 协议,可在 JetBrains、Zed 中使用;丰富 hook 生态方便集成其他工具。底层视觉推理由 Kimi K2.6 模型提供。
Runway Aleph 2.0 编辑模型:一键适配任意视频格式
一个视频,现在可以为每个信息流和格式制作。上传你现有的视频,选择你想要的宽高比,然后观看我们的编辑模型 Aleph 2.0,填充场景的其余部分,就像你从一开始就这样制作一样。 在我们的桌面 Web 应用上尝试,链接如下。
Perplexity与哈佛:AI智能体提效87%降本94%
我们与哈佛大学发表新研究,关于从聊天界面转向像Computer这样的自主智能体的转变。 超过3个月的研究结果表明,使用Computer的工人在完成任务上比仅使用搜索快87%,成本低94%,且满意度更高。 https://research.perplexity.ai/articles/how-ai-agents-reshape-knowledge-work
为生物学AI智能体铺路
一项实验让Claude、Biomni、Edison Analysis、GPT等科研智能体从病毒学数据库NCBI Virus中检索序列数据,即使最强模型也无法稳定达到可靠数据集构建所需的准确率。加入确定性检索层gget virus后,准确率接近100%。研究指出,当前生物学数据基础设施存在碎片化、格式特殊、接口不统一等问题,导致AI智能体难以像在软件领域那样高效工作。确定性检索工具是实现可靠智能体工作流的关键,生物学数据库需为智能体作为规模化用户而设计。
Harness-1:基于强化学习训练的有状态搜索20B检索子智能体
UIUC与Chroma联合推出Harness-1,一个20B参数的检索子智能体。它通过强化学习在一个有状态搜索框架中训练,该框架维护候选池、重要性标注集、证据图和验证记录,由策略决定搜索、筛选、验证及停止的时机。Harness-1在8个基准测试上达到0.730平均curated recall,比下一个最佳开源子智能体高出11.4个百分点,仅落后于Opus-4.6。模型权重和框架代码均已公开。
AI治理与商业:IPO、监管与公共财富
本版导读OpenAI向SEC机密提交S-1草案,上市时间未定,同时宣布进入第三发展阶段,目标让AI普及、易用且安全。特朗普政府探讨通过公共财富基金让政府入股AI初创公司。欧盟DMA导致苹果Siri AI在欧盟延迟上线。OpenAI推出Economic Research Exchange研究AI经济影响。这些事件凸显AI行业在快速扩张的同时,正面临日益复杂的治理与商业挑战。
OpenAI 向 SEC 机密提交 S-1 草案,上市时间未定
OpenAI 近日向 SEC 机密提交了 S-1 草案(即首次公开募股注册声明),目前尚未决定上市时间。
奥尔特曼宣布 OpenAI 进入第三发展阶段:让 AI 普及、易用且安全
本周一,OpenAI CEO 奥尔特曼与首席科学家帕霍茨基联合发文,宣布公司进入第三发展阶段,目标让 AI 普及、易用且安全。此前第一阶段聚焦通用人工智能技术研发,第二阶段面向全球推出产品。第三阶段三大核心目标是打造自动化人工智能研究员、推动经济提速、为每人配备专属通用人工智能。二人强调智能系统须坚守安全底线,呼吁成立国际机构应对 AI 风险,必要时可暂缓前沿模型研发。同日,OpenAI 秘密提交 IPO 申请,但上市仍需较长时间。上周 Anthropic 研究人员也建议适当放缓前沿 AI 研发。
特朗普政府与OpenAI讨论通过公共财富基金入股AI初创公司
据FT报道,特朗普政府正与OpenAI探讨通过公共财富基金机制让政府入股AI初创公司。方案是AI企业捐赠小部分股权至该基金,基金通过账户或分红将收益返还美国公民,而非政府直接运营公司。这不同于特朗普去年对Intel的90亿美元直接持股。OpenAI此前已提出公共财富基金概念,持有长期资产,让公民分享AI增长红利。政治背景方面,选民担忧失业、数据中心成本与企业控制,而AI公司需要华盛顿在基建、采购和监管上的支持。
受 DMA 影响,Siri AI 在欧盟将随 iOS 27 和 iPadOS 27 延迟上线
由于欧盟《数字市场法案》(DMA),Apple 无法在 iOS 27 和 iPadOS 27 发布时于欧盟地区推出 Siri AI。该功能在欧盟的上线时间将晚于其他地区,具体时间未公布。
OpenAI 推出 Economic Research Exchange 经济研究交流平台
OpenAI 启动 Economic Research Exchange,研究 AI 对就业、生产力和经济的影响。该项目现已开放研究项目申请。
AI赋能创意与行业应用
本版导读AI在创意产业与垂直行业展现新可能。Luma AI Ray3.2 API提供电影级渲染集成,生数科技与华策影视共建AI视听创制中心。高德发布全球首个3D原生城市世界模型ABot-Earth0.5,10分钟生成公里级3D城市。NVIDIA与LG、KRAFTON等合作推进AI工厂与游戏适配。日本农民用ChatGPT和Codex解决农场实际问题,展示了AI在传统行业的低成本自动化潜力。
Luma AI Ray3.2 API:电影级渲染可集成
Ray3.2 API 可大规模运行电影级渲染,并集成到您正在构建的产品中。专为在交付的产品中打造电影感的开发者、代理机构和企业而设计。 开始构建 → http://lumalabs.ai/api
生数科技与华策影视达成战略合作,共建AI视听创制中心
6月7日,生数科技与华策影视签署战略合作协议,共同推动AI与影视产业融合。双方将以华策影视科技产教示范区为载体、生数科技Vidu视频生成大模型为技术底座,设立“AI视听创制中心”,探索AI虚拟制作与实拍结合。同时在浙江华策影视学校设立“华策&生数AI影视创制专业”,课程覆盖传统编导剪与AI视频制作技术。内容生产层面推广“实拍+AI”融合方案并优先在华策项目中试点,创作者生态层面引导Vidu社区超级创作者到产教基地注册。
全球首个:高德发布3D原生城市世界模型ABot-Earth0.5
阿里巴巴旗下高德发布全球首个3D原生城市世界模型ABot-Earth0.5,已建成覆盖190多个国家和地区的3D地图。用户输入卫星图或文字描述,10分钟即可在消费级GPU上生成公里级3D城市,输出可编辑3DGS格式,可直接导入Unity等引擎。制图成本为传统百分之一,效率提升约千倍,可为具身智能、低空经济、应急救援等提供支撑。目前已开放内测,可前往abot-earth.amap.com提交申请。
NVIDIA 与 KRAFTON、NC、T1 在韩国 PC 房庆祝 RTX Spark 发布
“我在田里雇了一名工程师,它叫 Codex” —— 北海道一个西兰花农的 8 个真实 AI 用法 · 该内容已按来源方要求下架或调整展示方式。
- 2026-W39Claude Opus 5.5 发布并双榜登顶
- 2026-W38Google DeepMind 发布 Gemini 3.8 Live 和 3.8 Live Extended Thinking
- 2026-W37OpenAI 发布 GPT-6 Astra,面向专业工作场景
- 2026-W36OpenAI 发布 GPT-6 Astra:1.05M 上下文的计算机操作模型,因触及 Critical 网络安全阈值而限制访问
- 2026-W35AI安全与算力竞赛
- 2026-W34AI 基础设施与安全并进
- 2026-W33智能体走向主流
- 2026-W32开源模型与智能体基建加速
- 2026-W31AI安全与开源之争
- 2026-W30开源模型逼近前沿,安全事件引发关注
- 2026-W29智能体化加速与安全隐忧并存
- 2026-W28模型开源与部署加速,AI安全与就业分化加剧