跳到正文
北京时间
2026 年第 21 周 · 05.18 — 05.24每周一出刊

AI 周报 · 2026 年第 21 周 · 05.18 — 05.24

由来科技

第 3 期212026 年第 21 周05.18 — 05.24
26件大事233条精选7期日报约 9 分钟读完
本期导读
图 · I/O 2026: 欢迎来到自主的 Gemini 时代

AI进入自主代理与多模态时代

本周AI行业主线是AI从辅助工具向自主代理的全面进化,以及多模态生成能力的重大突破。Google I/O 2026上发布的Gemini Omni模型,能够从任意输入生成任意输出,并具备物理推理能力,被视为迈向AGI的重要一步。同时,Anthropic的Claude在安全研究上取得惊人成果——5天内攻破Apple M5内核防护,凸显AI驱动的安全研究已改变攻防平衡。此外,多位行业领袖预测软件免费化与白领工作自动化,AI代理的可靠性问题也引发关注。开源社区则涌现出GBrain、Forge等提升AI记忆与工具调用能力的创新方案。

01

Google I/O 2026:Gemini Omni与自主代理时代

本版导读Google I/O 2026成为本周焦点,Gemini Omni模型发布标志着多模态生成能力的飞跃,它结合物理推理与知识,能从任何输入生成任何输出。同时,Gemini Spark作为全天候个人AI代理,以及智能搜索框的多模态交互,共同宣告AI进入自主代理时代。Google还披露了月处理3200万亿Token、Gemini月活超9亿等关键数据,显示AI规模化应用加速。

Google Blog:AI一手05.20

I/O 2026: 欢迎来到自主的 Gemini 时代

Google 在 I/O 2026 大会上宣布 Gemini 进入自主代理时代,新功能使其能够自动执行复杂任务,显著提升用户工作效率。大会展示了 Gemini 如何通过代理操作简化工作流程,实现自动化处理,例如自动管理邮件、安排日程或生成报告,帮助用户从重复性工作中解放出来,专注于创造性任务。这一更新基于先进机器学习模型,强调准确性与效率,标志着 AI 助手向更智能、更自主的方向发展。

Gemini一手05.20

谷歌发布Gemini Omni多模态生成模型

介绍Gemini Omni,我们的新模型,可以从任何输入创建任何内容,首先从视频开始。 借助Gemini Omni,您可以将图像、视频和文本作为输入组合,并生成基于Gemini现实世界知识的高质量视频。#GoogleIO

Sundar Pichai05.20

Gemini Omni发布:物理推理与多模态生成新突破

Gemini Omni不仅能构建逼真的场景,还能推理接下来应该发生什么。它结合了对物理的直观理解与Gemini在历史、科学和文化背景方面的知识。 今日起,通过@Geminiapp + Google Flow和@YouTube Shorts,向全球Google AI Plus、Pro和Ultra订阅用户推出视频生成功能。

IT之家05.20

谷歌 Gemini Omni 全能模型发布:可从任意输入生成任意输出,一句话让 AI 修改视频

在2026年谷歌I/O开发者大会上,谷歌正式推出Gemini Omni模型。该模型代表了Gemini家族迄今最全面的能力,“Omni”意为全能,能够无缝处理文本、图像、音频和视频等多种信息模态,实现“从任何输入生成任何输出”。其核心亮点在于支持对话式编辑,用户可通过自然语言指令轻松修改视频元素。同时,谷歌发布了首款衍生模型Gemini Omni Flash,现已在Gemini App、Google Flow和YouTube Shorts中可用,后续将提供API服务。

Gemini一手05.20

Gemini Spark:全天候个人AI代理

Gemini Spark 是您的全天候个人AI代理,帮助您驾驭数字生活。 它将 Gemini 从一个回答您问题的助手,转变为一个在您的指导下、代表您完成工作的助手。#GoogleIO

Google AI一手05.20

谷歌推出全新AI智能搜索框,支持多模态交互

谷歌宣布推出基于Gemini 3.5模型的全新智能搜索框。该更新将AI Overviews与AI Mode整合为统一的AI搜索体验,支持对文本、图像、文件及视频进行跨模态推理查询。用户可进行多轮对话,搜索将结合上下文提供更个性化、定制化的回答。该新功能已在全球桌面和移动设备端同步上线。

IT之家05.20

谷歌每月处理超 3200 万亿 Token,同比增长 7 倍

在2026年谷歌I/O开发者大会上,谷歌宣布其AI业务关键指标大幅增长。2026年5月,谷歌每月处理的Token数量超过3200万亿,同比增长达7倍。其Gemini App月度活跃用户已突破9亿,同比增长超过一倍,每日请求量增长超7倍。此外,Nano Banana模型已累计生成超过500亿张图片。

02

AI安全攻防加速:Claude攻破M5与Karpathy加盟Anthropic

本版导读Anthropic的Claude在5天内攻破Apple M5芯片的macOS内核防护,绕过了苹果耗时5年、投入数十亿美元的硬件级安全机制,标志着AI驱动的安全研究已能极速突破顶尖防护。同时,前OpenAI核心成员Andrej Karpathy加入Anthropic,引发行业对AI安全与对齐研究的关注。Anthropic还与教皇共同发布AI通谕,并推出自托管沙箱等企业安全功能,显示其在安全与伦理领域的持续布局。

Anthropic Claude 5天攻破Apple M5 macOS内核漏洞:5年数十亿防线,被AI一举击穿 · 该内容已按来源方要求下架或调整展示方式。

Hacker News 热门(buzzing.cc 中文翻译)05.19

安德烈·卡帕西加入Anthropic

AI领域知名专家安德烈·卡帕西于2026年5月19日宣布加入人工智能安全公司Anthropic。卡帕西此前曾是特斯拉自动驾驶AI负责人及OpenAI联合创始人,此次加盟标志着顶尖人才向AI安全与对齐研究领域的新一轮流动,进一步提升了Anthropic在行业内的研发实力与关注度。该消息发布后迅速引发广泛讨论,在技术社区获得高关注度。

The Decoder:AI News05.19

前OpenAI核心成员Andrej Karpathy选择Anthropic重返前沿LLM研究

著名AI研究人员Andrej Karpathy已加入Anthropic。这位前OpenAI核心团队成员兼特斯拉Autopilot架构师表示,他希望重返研发一线,称未来几年在大语言模型(LLM)前沿的研究“尤其具有塑造性”。他选择Anthropic而非回归前东家OpenAI,这对后者而言是一个明显的损失。

Hacker News 热门(buzzing.cc 中文翻译)05.19

Anthropic联合创始人将与教皇利奥十四世共同发布人工智能通谕

Anthropic联合创始人将于2026年5月与教皇利奥十四世共同发布首个人工智能通谕“magnifica humanitas”。这是教皇利奥十四世的首次通谕,聚焦人工智能技术与伦理,标志着科技企业与宗教领袖在AI议题上的合作。通谕由梵蒂冈新闻发布,具体探讨人工智能对人类社会的影响,在Hacker News平台获得104点关注,反映了话题的广泛热度。

Claude:Blog一手05.19

Claude智能体托管平台新增自托管沙箱与MCP隧道功能

Anthropic为其Claude智能体托管平台推出两项更新:自托管沙箱允许用户在自有基础设施或合作云平台上运行工具,确保敏感数据与服务保留在用户控制范围内;MCP隧道则通过轻量网关,使智能体能安全连接企业私有网络内的数据库与API,无需暴露于公网。目前沙箱功能已进入公测,隧道处于研究预览阶段。这两项更新进一步增强了企业用户对智能体执行环境与内部资源访问的安全管控能力。

03

AI代理可靠性:记忆重写缺陷与防护机制创新

本版导读随着AI代理广泛应用,其可靠性问题凸显。研究发现LLM智能体的记忆重写机制会损害可靠性,导致性能下降。对此,开源社区推出Forge等可靠性层,通过防护机制将8B模型在复杂任务中的表现从53%提升至99%。同时,GBrain等知识系统通过多层结构解决AI记忆缺陷,Membrane则通过单一技能连接超10万API,降低集成复杂度。这些创新共同推动AI代理向更可靠、更易用的方向发展。

Rohan Paul05.17

研究揭示LLM智能体记忆重写机制损害可靠性

伊利诺伊大学与清华大学等机构的研究发现,LLM智能体虽能从经验中学习,但其通过LLM将原始经历压缩成书面教训的记忆重写机制会损害记忆可靠性。在网页购物、模拟世界及ARC风格谜题等任务测试中,反复重写记忆会导致错误分组、规则过度泛化或过拟合,使智能体遗忘细节或混淆任务类型。例如,GPT-4在无记忆时可100%解决小型ARC-AGI问题集,而建立记忆并流式更新后,性能降至约54%。研究主张智能体记忆系统应重视原始经历作为关键证据,而非自动将所有经验重写为摘要,保留原始证据并选择性摘要效果更佳。

Hacker News:AI 热帖05.19

Forge:通过防护机制大幅提升8B模型性能的可靠性层

Forge 是一个为自托管大语言模型设计的可靠性层,专注于提升工具调用能力。它通过错误解析、重试提示、步骤强制等防护机制以及高效的上下文管理,成功将8B参数模型在复杂多步骤智能体任务中的表现从53%大幅提升至99%。其核心配置(Ministral-3 8B模型)在自建的26项评估中综合得分达86.5%。Forge 提供三种集成方式:作为全托管工作流运行器、多智能体架构的共享调度器,或嵌入自有编排循环的防护中间件,并附带一个可透明接入的OpenAI兼容代理服务器。

Garry Tan发布的GBrain直接捅破个人AI天花板 · 该内容已按来源方要求下架或调整展示方式。

Rohan Paul05.19

AI代理集成新方案:Membrane推出单一技能连接万种API

AI代理在实际应用中需为每个外部服务重复构建集成逻辑,成为其发展的主要瓶颈。针对此问题,Membrane推出了一种通用“技能”解决方案。通过该单一技能,Claude Code、ChatGPT、Cursor等主流AI代理能够用一条指令调用超过10万个不同的API,涵盖从Stripe支付服务到NASA火星车数据等各类服务。这极大简化了开发流程,将定制化集成转变为通用的连接能力,降低了使用门槛。同时,Membrane正发起社区挑战,鼓励用户提交小众API以获得演示和免费额度激励,旨在持续扩展其连接生态。

04

多模态生成与视频模型:从4K到世界模型

本版导读多模态生成领域迎来多项突破:Kling AI推出全球首个原生4K视频生成模型,获得好莱坞团队采用;NVIDIA开源首个4-bit量化长视频生成基础设施;阿里云推出HappyHorse视频生成模型。更引人注目的是,奥德赛实验室发布全球首个实时多agent世界模型Agora-1,允许多人机同屏互动,标志着从单人生成视频向多人共享“活世界”的转变。

可灵 Kling AI一手05.20

Kling AI推出全球首个原生4K视频生成模型

4月23日,Kling AI正式推出全球首个原生4K视频生成模型,专为专业内容创作设计。该功能支持一键生成真4K画质视频,显著提升画面细节与制作效率。模型已获得好莱坞团队、动画工作室等多方采用。好莱坞制片人指出,这是其工作流中首个使用的原生4K基础模型;Wonder Studios强调,原生4K从底层生成避免了传统放大技术的角色变形问题,保持了画面一致性;动画导演则认为,该模型在保留艺术色调与复杂特效纹理方面优于同类产品。

NVIDIA开源首个4-bit超长视频生成基础设施 · 该内容已按来源方要求下架或调整展示方式。

阿里云推出HappyHorse视频生成模型 · 该内容已按来源方要求下架或调整展示方式。

首个实时多agent世界模型发布,人类可与AI同屏互动 · 该内容已按来源方要求下架或调整展示方式。

05

AI行业趋势:软件免费化、白领自动化与伦理对话

本版导读多位行业领袖发出重磅预测:Anthropic CEO认为软件成本将急剧下降甚至免费,微软AI CEO预测18个月内AI将自动化所有白领工作。这些言论引发对职业结构巨变的讨论。同时,Anthropic与多元群体展开对话,探索AI伦理对齐;研究发现人类说服技巧对AI同样有效,凸显AI安全复杂性。开源工具api-relay-audit则揭露了AI API中转站的安全风险。

Rohan Paul05.17

Anthropic CEO预言软件免费化与职业结构巨变

Anthropic CEO Dario Amodei在《华尔街日报》YouTube频道采访中表示,软件成本将急剧下降,可能基本免费,传统软件需百万用户分摊成本的前提将不再成立。同时,数十年来建立的许多工作和职业可能消失。Amodei认为社会能够应对并适应这种变化,但他警告人们目前完全未意识到即将到来的变革及其巨大规模。

微软AI CEO预测18个月内AI自动化所有白领工作 · 该内容已按来源方要求下架或调整展示方式。

Ethan Mollick05.20

研究发现人类说服技巧对AI同样有效

🚨我们的论文已在PNAS发表:我们发现经典的人类说服技巧以一种“类人”的方式对AI有效,使其同意不当请求(将顺从率从35%提高到51%) 该技巧对一系列主流大语言模型有效,尽管较新的模型抵抗力更强 https://www.pnas.org/doi/10.1073/pnas.2535868123

Anthropic:Newsroom一手05.19

拓宽关于前沿AI的对话

Anthropic为构建负责任的先进AI,正与全球多元群体展开对话。首轮讨论汇集了超过15个宗教、哲学及跨文化传统的学者与伦理学者,旨在为Claude等模型的道德形成与价值观对齐提供多元视角。受“外部良知”概念启发,团队开发并测试了伦理承诺提醒工具,初步实验显示其能有效降低模型不对齐行为。公司计划未来将对话拓展至法律、心理学及公民社会等领域,以共同应对AI对社会结构的重塑。

开源工具揭露AI API中转站安全风险与检测差异 · 该内容已按来源方要求下架或调整展示方式。

往期 AI 周报
(本期完)

由来科技 周报由编辑系统根据公开来源自动综合,每条均附原文 · 往期周报