跳到正文
北京时间
2026 年 6 月每月 1 日出刊

AI 月报 · 2026 年 6 月

由来科技

第 2 期062026 年6 月
26件大事919条精选30期日报约 10 分钟读完
本期导读

AI基础设施与智能体生态加速

2026年6月,AI行业主线清晰指向基础设施大规模扩张与智能体生态的深化落地。Alphabet、Anthropic、OpenAI等巨头通过融资、IPO和超大规模数据中心建设(如Stargate)为AI算力铺路;同时,模型发布聚焦于推理效率与多模态能力,如MiniMax M3、微软MAI-Thinking-1等。智能体应用从编程(Claude Code、Codex SDK)扩展到工厂管理(NVIDIA FOX)、文件整理(Google并行子智能体)和科学发现(DeepMind工具包),而安全与治理问题(如Meta AI劫持账号、佛罗里达州诉讼)也引发关注。开源与闭源模型分化加剧,但共同推动AI向更实用、更可控的方向演进。

01

基础设施军备竞赛:融资、IPO与数据中心

本版导读本月,AI基础设施投资达到新高度。Alphabet计划通过发行股票筹集800亿美元用于AI支出,Anthropic秘密提交IPO申请,OpenAI在密歇根启动1GW Stargate数据中心。这些动作表明,头部公司正为长期算力需求做巨额资本储备,竞争从模型能力延伸到基础设施规模。

Anthropic:Newsroom一手06.01

Anthropic 保密向 SEC 提交 S-1 草案

Anthropic, PBC 今日保密向美国证券交易委员会提交了 S-1 表格草案,计划进行普通股的首次公开发行。这使其在 SEC 完成审核后拥有上市的选择权。IPO 的具体发行股数和价格尚未确定,将取决于市场条件等因素。公司近期刚完成由 Altimeter Capital 等领投的 650 亿美元 H 轮融资,估值达 9650 亿美元,并发布了 Claude Opus 4.8 模型。

OpenAI:官网动态(RSS · 排除企业/客户案例)一手06.01

OpenAI在密歇根州启动Stargate 1GW数据中心建设

OpenAI在密歇根州启动了名为Stargate的1GW数据中心项目。作为AI基础设施建设的一部分,该项目旨在扩大人工智能技术的可及性、为当地创造就业机会并支持社区发展。

IT之家06.02

SK会长崔泰源:SK海力士计划未来五年内晶圆产能翻倍

SK海力士会长崔泰源宣布,计划在未来五年内将整体晶圆产能提高一倍,以应对AI普及带来的持续存储供应短缺。他预测AI数据中心和AI PC的普及将持续拉动存储需求,供需紧张局面可能延续至2030年。SK海力士将投入大规模资金用于设备、建设等扩张,尽管面临前置时间长(新建晶圆厂至少三年)和资源成本上涨等挑战。目前,SK海力士市值已首次突破1万亿美元。

02

模型竞赛:推理效率与多模态成为焦点

本版导读本月多款新模型强调推理效率与多模态能力。MiniMax M3以稀疏注意力架构实现百万token上下文且成本大幅降低;微软MAI-Thinking-1定位中等规模但达到领先推理水平;阶跃星辰Step 3.7 Flash通过注意力机制优化KV-cache成本。同时,xAI Composer 2.5、Qwen3.7-Plus等模型聚焦编程与多模态智能体,SenseNova-U1专攻图表生成。开源模型(如Holo3.1)在本地部署上取得进展,闭源模型则通过API和云服务扩大覆盖。

MiniMax:Blog一手06.01

MiniMax M3:前沿编码、100万token上下文与原生多模态一体模型

MiniMax M3 是一个开源前沿模型,具备先进的编码与AI智能体能力。它支持100万token的超长上下文窗口,并采用名为MSA(MiniMax Sparse Attention)的新型稀疏注意力架构。该架构使模型在100万token上下文下的每token计算成本降至前代的1/20,预填充速度提升9倍以上,解码速度提升15倍以上。在SWE-Bench Pro编码基准上,MiniMax M3得分59.0%,超越GPT-5.5和Gemini 3.1 Pro,性能接近Opus 4.7。该模型可通过MiniMax Code、Token Plan和API服务使用。

The Verge:AI06.03

微软首款高级推理AI模型MAI-Thinking-1发布

微软在Build 2026上发布了其首款高级推理AI模型MAI-Thinking-1。该模型被定位为“中等规模”,能在“关键”软件工程基准测试中达到领先模型的水平。微软称其完全从头使用干净数据进行训练,未涉及从第三方模型进行知识蒸馏。这标志着微软在自研AI模型上迈出重要一步,此前其主要依赖OpenAI。近期两家公司已重新协商合作协议,关系有所松绑。

阶跃星辰 StepFun一手06.02

阶跃星辰Step 3.7 Flash发布,专为高效推理设计

阶跃星辰发布其推理优化型模型Step 3.7 Flash。该模型为196B MoE架构,从设计之初就专注于推理效率。其采用多矩阵分解注意力机制,使KV-cache成本仅为DeepSeek模型的约22%;同时通过注意力与FFN解耦技术,实现了硬件优化的高效服务。该模型已通过Fireworks AI提供,采用Apache 2.0许可,并可用于构建智能体应用。

xAI:News一手06.01

xAI发布Composer 2.5

xAI的最新编程模型Composer 2.5现已在Grok Build中可用,用户可通过`/models`菜单选择使用。这是一款快速、先进的模型,擅长处理长时间运行的任务和复杂指令。该模型面向SuperGrok和X Premium+用户开放。

商汤 SenseTime一手06.01

SenseNova新模型解决AI图表生成难题

大多数AI模型在生成图表时存在数值错误(如负值显示为正)、柱状图位置偏移、元素关系混乱等问题。SenseNova-U1-8B-MoT-Infographic(SenseNova-U1)专为解决此类图表生成问题而设计,能够生成准确的图表,并支持实时调整设计和布局。项目在Hugging Face提供了模型,并在GitHub展示了效果案例。

Hugging Face:Blog一手06.02

Holo3.1:快速本地计算机使用智能体

Holo3.1 是基于 Qwen 模型家族的计算机使用智能体系列,旨在提升在桌面、网页和移动环境中的鲁棒性。新模型提供 0.8B、4B、9B 和 35B-A3B 四种尺寸,并首次发布量化检查点,包括 FP8、Q4 GGUF 和 NVFP4,以优化本地推理。在 AndroidWorld 基准测试中,35B-A3B 模型得分从 67% 提升至 79.3%。在 DGX Spark 上,NVFP4 量化相比 BF16 实现 1.74 倍 token 吞吐量提升,并将平均步骤时间从 6.8 秒缩短至 3.3 秒。模型支持函数调用协议,可在第三方智能体框架中部署。

03

智能体生态:从编程到工厂的全面渗透

本版导读智能体应用本月显著扩展至更多领域。编程方面,Claude Code新增动态工作流,OpenAI Codex发布Python SDK,GitHub Copilot定位为智能体原生桌面体验。工业领域,NVIDIA发布工厂运营蓝图,富士康等采用后预计根源分析时间缩短80%。此外,Google DeepMind开源科学智能体工具包,腾讯混元发布长期记忆插件Hy-Memory,Perplexity推出Search as Code架构。智能体正从单一任务向复杂工作流和行业解决方案演进。

Claude:Blog一手06.02

Claude Code 新增动态工作流功能

Claude Code 新增动态工作流功能,允许模型在运行时即兴创建和协调多智能体框架来处理复杂任务。该功能通过执行特定的 JavaScript 文件来生成和协调拥有独立上下文窗口的子代理,可解决单一上下文窗口中长时间执行任务可能出现的智能惰性等问题。工作流适用于研究、安全分析、代码审查等场景,通常消耗更多 token,更适合高价值复杂任务,其最佳实践仍在发展中。

OpenAI Codex 发布 Python SDK,可直接嵌入应用 · 该内容已按来源方要求下架或调整展示方式。

GitHub Blog一手06.03

GitHub Copilot应用:智能体原生的桌面体验

在微软 Build 2026 大会上,GitHub 发布了新的工具和更新,并将 Copilot 应用定位为“智能体原生的桌面体验”。其核心目标是让 AI 智能体能够以用户已经习惯的方式进行工作。

Google AI for Developers一手06.03

Google DeepMind 开源科学智能体工具包

构建用于科学发现的自主智能体?🧬🤖 @GoogleDeepMind Science Skills 现已在 GitHub 上发布。我们已开源这个专用工具包,以科学基础和更高的 token 效率加速您的智能体工作流。 立即下载 ↓ https://github.com/google-deepmind/science-skills

腾讯混元一手06.01

腾讯混元发布智能体长期记忆插件Hy-Memory

腾讯混元正式发布专为OpenClaw等长期协作智能体(Agent)设计的记忆插件 Hy-Memory。它基于6层记忆框架、System1/System2双系统与三层进化链构建,旨在成为智能体的“第二大脑”。该插件解决了记忆碎片化问题,实现了显著性能提升:记忆数量减少70%以上,单条记忆信息密度提升45%以上,在超长上下文场景中token消耗降低35%,记忆更新速度提升20%。

Perplexity一手06.02

Perplexity发布Search as Code搜索架构

推出Search as Code,我们为AI智能体打造的全新搜索架构。 它直接编写Python代码调用我们的搜索栈,而非逐个循环函数调用。 现已在Perplexity Agent API中提供,并成为Computer的默认选项。 https://research.perplexity.ai/articles/rethinking-search-as-code-generation

04

安全与治理:风险与监管并行

本版导读AI安全与治理成为本月重要议题。佛罗里达州起诉OpenAI,指控其与多起ChatGPT相关谋杀案有关;Meta AI被利用劫持Instagram账号,暴露智能体权限风险。正面行动包括:Anthropic扩展Project Glasswing计划,利用AI扫描关键基础设施代码漏洞;OpenAI呼吁设立AI安全研究所保护青少年;Anthropic支持美国AI行政令。这些事件表明,随着AI能力增强,安全与监管框架的建立愈发紧迫。

Anthropic:Newsroom一手06.02

Anthropic扩展Project Glasswing计划

Anthropic正将其Project Glasswing计划扩展至约150个新组织,此前首批约50个合作伙伴。新伙伴分布于十五个多国家,覆盖电力、水务、医疗、通信和硬件等关键基础设施行业。这些合作伙伴的共同点在于,其代码库若遭成功攻击,后果可能极其严重,影响或超1亿人。项目旨在利用Claude Mythos Preview等前沿模型扫描漏洞并协助修复,以应对AI驱动的网络安全挑战。同时,Anthropic推出了基于Claude Opus 4.8等公开模型的Claude Security产品,用于扫描代码并建议补丁。

Anthropic一手06.03

Anthropic支持美国AI行政令实施

这项行政令是加强美国AI领导地位的重要一步。 我们期待与白宫合作,支持其实施。 https://www.whitehouse.gov/presidential-actions/2026/06/promoting-advanced-artificial-intelligence-innovation-and-security/

05

开源与闭源分化:不同路径的竞争

本版导读开源与闭源模型本月展现出差异化发展路径。闭源模型如OpenAI、Anthropic通过API和云服务(如AWS集成)扩大商业覆盖,而开源模型如MiniMax M3、Qwen3.7-Plus、Holo3.1等在本地部署和特定场景中寻求突破。Nathan Lambert指出,闭源模型通过边际智能提升创造价值,开源模型则在其他维度竞争。微软MAI-Thinking-1强调从头训练,JetBrains发布Mellum2,OpenBMB发布UltraData数据集,均显示开源生态的活力。

Nathan Lambert:Interconnects一手06.01

开源与闭源模型在不同的增长曲线上

当模型智能的微小提升能直接转化为实际价值时,开源与闭源模型正沿着不同的增长路径发展。闭源模型通过在特定场景下提供更高的边际智能来创造价值,而开源模型则在其他维度寻找增长点,两者形成了差异化的竞争格局。

面壁智能 OpenBMB一手06.01

OpenBMB发布UltraData两大开源数据集,登顶HuggingFace趋势榜

OpenBMB联合清华NLP与Modelbest发布两个开源数据集:Ultra-FineWeb-L3(预训练合成数据)包含600B+ tokens(超400B英文、200B+中文),是迄今最大开源中文预训练合成数据集;UltraData-SFT-2605(后训练SFT数据)包含15M+样本,是中国首个开源且包含思考与非思考标注的大规模SFT数据集,覆盖数学、代码、知识和指令遵循。两者均基于UltraData L0-L4框架构建,并在MiniCPM5-1B训练中完成验证。数据集已在HuggingFace免费开放。

Hugging Face:Blog一手06.01

介绍 Mellum2:JetBrains 推出的 12B 混合专家模型

Mellum2 是 JetBrains 从头训练的 12B 参数混合专家(MoE)模型,专注于自然语言与代码。每个 token 仅激活 2.5B 参数,推理速度可达同类模型的 2 倍以上,适合高吞吐、低延迟场景。该模型支持路由、RAG、摘要、子智能体及私有部署,以 Apache 2.0 许可证开源。在代码生成、推理、科学和数学基准测试中,Mellum2 与同等规模的开放模型竞争力相当。

OpenAI:官网动态(RSS · 排除企业/客户案例)一手06.01

OpenAI前沿模型与Codex现可在AWS上使用

OpenAI的前沿模型与Codex现已在AWS上全面可用。企业客户可通过其现有的AWS环境、控制与采购流程来使用OpenAI的AI技术,从而加速从评估到生产部署的过程。

往期 AI 月报
(本期完)

由来科技 月报由编辑系统根据公开来源自动综合,每条均附原文 · 往期月报