跳到正文
北京时间

Google / Gemini

Google 与 DeepMind 的 AI 动态:Gemini 系列、Veo 视频模型、研究成果与产品生态的持续追踪。

最新精选

第 201–220 条 · 共 316 条
5月20日周三
  1. Google Developers Blog(RSS)65

    更智能的 Google AI Edge Gallery:MCP 集成、通知和会话连续性

    Google AI Edge Gallery 应用在安卓平台上扩展了设备端 AI 能力,通过引入对开源模型上下文协议(MCP)的实验性支持,使得 Gemma 4 模型能够协调处理跨 Google Workspace 和 Google Maps 等外部数据源的复杂任务。此次更新添加了“定时通知”技能,用于实现日常事务的自动化管理,并新增了持久化聊天记录功能,允许用户近乎即时地恢复长会话上下文。该平台依托开源工具包,积极鼓励社区开发者通过其 GitHub 仓库构建并分享专注实用的工作流、提示配置与工具集成。

    推荐理由:MCP 终于跑在 Android 设备上了,虽然是实验性支持,但 Gemma 4 能直连 Workspace 和 Maps,做自动化的开发者可以上手试试。

  2. Google Developers Blog(RSS)69

    Google Tensor ML SDK 测试版发布

    Google Tensor ML SDK 进入测试版,支持开发者直接在 Pixel 10 设备的 TPU 上构建和部署高性能机器学习模型。该 SDK 集成边缘部署框架 LiteRT,提供统一工作流,可高效转换、编译并运行 PyTorch 或 TFLite 模型,并具备稳定回退机制。此外,新推出的模型库包含超过 100 个经典及生成式 AI 模型(如 Gemma 3),支持低延迟、注重隐私的语音识别、计算机视觉与文本生成等功能。

    推荐理由:Google 把 TPU 塞进了 Pixel 10,现在开发者能直接在手机上跑 Gemma 3 了,这是移动端 AI 从「能用」到「好用」的关键一步,做 app 的值得关注。

  3. Google DeepMind72

    Google Flow 🤝 Gemini Omni 使用我们的最新模型创作更具电影感的故事,它带来了批量编辑、改进的角色一致性等功能。以下是@FlowbyGoogle的其他新功能 → https://goo.gle/42K2nge #GoogleIO

    推荐理由:Google Flow 终于把批量编辑和角色一致性拉上来了,对做视频内容的人能省不少事,虽然不算颠覆性的代际更新,但实用度提升明显。

  4. Google Gemini76

    每月有超过9亿用户使用Gemini应用。 这一增长的重要部分源于我们快速的发布节奏。以下是过去一年我们推出的一些最重要功能的回顾。🧵 #GoogleIO

    推荐理由:Gemini 月活冲破 9 亿,这条线说明 AI 助手已不再是少数人的玩具,Google 的「快发版」策略正在把生成式 AI 塞进每一部安卓手机。产品经理应该看到这是从实验室到亿级设备的真实穿透率。

  5. Google Gemini72

    Daily Brief是一项新的个性化摘要功能,旨在成为您每天早晨的首选信息来源。 它从您的收件箱、日历和任务中收集信息,进行优先级排序、整理,并在专为快速浏览设计的超简洁晨间摘要中为您建议下一步行动。#GoogleIO

    推荐理由:Google 终于把 Gemini 往真正的个人助理方向推了一步,整合邮件、日历、任务的每日摘要,如果执行到位会抢掉很多人的早晨首页。

  6. Google Gemini68

    我们在#GoogleIO上宣布了多项Gemini更新,包括: - 采用神经表达技术的全新Gemini体验设计 - 即将推出的Gemini智能体功能,含每日简报与Gemini Spark - Gemini Omni与3.5 Flash模型 - 以及更多内容! 详情请见此线程🧵

    推荐理由:Google IO上Gemini这波更新,从Neural Expressive到代理体验,是在把AI助手往主动帮你做事的方向推,产品人和开发者该认真看看。

  7. Google Developers Blog(RSS)58

    重要更新:Gemini CLI将迁移至Antigravity CLI

    Google正在整合其AI终端工具,将面向社区的Gemini CLI迁移至全新平台Antigravity CLI。这款新工具采用Go语言开发,作为代理优先的平台,支持复杂的多代理工作流,并提供更快的执行速度、异步处理能力以及与Antigravity 2.0桌面应用同步的统一架构。企业客户可维持现有访问权限,但个人及免费用户必须在2026年6月18日Gemini CLI停止服务前,完成向新平台的迁移。

    推荐理由:Google 终端工具从 Gemini CLI 全面转向 Antigravity CLI,强调 agent 优先和多 agent 工作流,6 月 18 日后 Gemini CLI 停服,个人用户得赶紧迁移。

  8. Google Blog:AI(RSS)74

    Google AI 订阅服务全新内容,源自 I/O 2026 大会

    Google 在 I/O 2026 大会上宣布更新其 AI 订阅服务,推出了全新的 100 美元“AI Ultra”计划。同时,面向 Google AI Plus、Pro 和 Ultra 三个层级的现有订阅者,服务均增加了新的功能和权益。此次更新标志着 Google 在 AI 付费订阅领域推出了更高端的选项并强化了现有套餐的价值。

    推荐理由:Google 在 I/O 上推出 $100 的 AI Ultra 计划,这是大厂把 AI 订阅当成‘基础套餐’来卖的信号,虽然细节还不算多,但想知道 Google AI 付费版最新整合的可以进去看一眼。

  9. Google Blog:AI(RSS)70

    AI搜索的新时代

    谷歌宣布了其搜索引擎与AI技术融合的最新进展,标志着AI搜索进入新阶段。此次更新旨在将搜索引擎的广度与AI的深度理解能力相结合,目标是提供更智能、更直观的搜索体验,推动搜索技术的下一代演进。

    推荐理由:Google搜索宣称开启AI新纪元,但这次官宣只放了张图没给干货,搜索入口的任何变动都牵动流量,值得跟踪但别急着判断。

  10. Google Blog:AI(RSS)83

    Gemini 3.5:前沿智能与行动能力相结合

    Google 在 I/O 大会上正式发布了最新的 Gemini 3.5 模型系列。该系列模型将前沿的人工智能能力与执行操作的功能相结合,旨在提供更强的综合性能。作为 Google 最新推出的模型,它代表了其在大模型技术上的最新进展。

    推荐理由:Google 在 I/O 上甩出 Gemini 3.5,这次不只拼多模态,更强调‘行动’,是所有做 Agent 的团队必须对标的新基座。

  11. Google Blog:AI(RSS)89

    I/O 2026: 欢迎来到自主的 Gemini 时代

    Google 在 I/O 2026 大会上宣布 Gemini 进入自主代理时代,新功能使其能够自动执行复杂任务,显著提升用户工作效率。大会展示了 Gemini 如何通过代理操作简化工作流程,实现自动化处理,例如自动管理邮件、安排日程或生成报告,帮助用户从重复性工作中解放出来,专注于创造性任务。这一更新基于先进机器学习模型,强调准确性与效率,标志着 AI 助手向更智能、更自主的方向发展。

    推荐理由:谷歌 I/O 大会上 Sundar Pichai 亲自宣布 agentic Gemini 时代到来,这是把 Gemini 从对话助手升级成真正能自主执行任务的 agent,所有做 AI 应用的接下来都得重新看一遍技术选型。

  12. Google Blog:AI(RSS)75

    Google Workspace 推出全新创建方式与高效工作功能

    Google 在最新更新中为 Gmail、Docs 和 Keep 增添了新的语音功能,并推出了一款名为 Google Pics 的全新设计工具。同时,其 AI Inbox 功能也得到了升级与优化。这些更新旨在进一步提升用户在工作场景中的协作效率与创作体验,通过集成更智能的工具和交互方式,帮助用户更便捷地完成多项任务。

    推荐理由:Google Workspace 直接植入了语音操作和设计工具 Pics,这波更新对办公效率很实在,做产品和运营的可以关注一下实际落地效果。

  13. Google Blog:AI(RSS)71

    AI Mode 如何改变美国人的搜索方式

    AI Mode 上线一周年,美国用户搜索行为呈现关键转变。数据显示,用户正从传统的关键词输入模式逐渐转向自然语言查询,这一变化反映了AI搜索技术的普及和用户交互方式的优化。自然语言查询的使用率显著提升,体现了AI搜索在日常信息获取中的影响力增强,预示着未来搜索体验的革新方向。

    推荐理由:AI Mode 上线一周年,Google 第一次拿出用户行为数据,从关键词到自然语言的转向比想象中快,做搜索和 SEO 的可以重新理解用户意图了。

  14. Google Gemini74

    Gemini Spark 是你的新全天候个人AI代理。 给它一个任务,它会在后台自主工作,即使你的手机和笔记本电脑已关机。你选择启用它,它被设计为在执行重大操作前会先征询你的意见。#GoogleIO

    推荐理由:Google把AI代理做成了24/7在线的背景进程,手机关机也不停,这是从对话助手到自主执行的一步大跨越,对普通人来说,真正的虚拟助理可能要来了。

  15. Google Gemini67

    我们将顶级Google AI Ultra套餐的价格从每月250美元降至200美元,并推出新的每月100美元Ultra套餐档位。 这个新套餐解锁了比Pro套餐高5倍的Gemini应用使用限额,助您加速编程与创作。它还包括新功能抢先体验、20TB存储空间、@YouTube Premium等更多权益。适用条款。https://goo.gle/4wEuFGK #GoogleIO

    推荐理由:Google 把顶级 AI 订阅门槛压到 $100/月,还捆着 YouTube Premium 和 20TB 云存储,这是用互联网式捆绑法打 AI 价格战,对重度用户吸引力不小。

  16. Google Research:Blog(网页)65

    经验研究助手(ERA):从Nature发表到催化计算发现

    Google Research开发的经验研究助手(ERA)现已在《Nature》期刊发表论文。这是一款基于Gemini的AI工具,旨在协助科学家编写专业级经验科学代码,其核心能力包括搜索文献、生成代码、探索方案并迭代优化,以加速耗时的计算实验过程。该工具已被用于构建“计算发现”原型,并已通过Google Labs的“可信赖测试者计划”向更广泛的科学家群体开放初步试用。

    推荐理由:谷歌把AI科学编码工具ERA发到了Nature,顺便在Google Labs推出了计算发现实验版,流行病预测和碳追踪的案例很扎实,科研圈的开发者和产品人可以关注下实际进展。

  17. Noam Shazeer83

    来自 #GoogleIO 现场,我们正在推出 Gemini 3.5 Flash,这是我们最新的模型,为智能体和编码提供前沿性能。我们今天在全球范围内推出,以其他前沿模型 4 倍的速度为现实世界的智能体工作流提供前沿级性能。🧵

    推荐理由:Google IO上发布的Gemini 3.5 Flash,主打Agent和编码,速度四倍于其他前沿模型,直接拉低Agent应用的门槛,做相关开发的可以马上试试。

  18. Google Blog:AI(RSS)81

    Google I/O 2026

    在Google I/O 2026大会上,Google宣布了多项旨在让AI更普惠、更实用的更新。这些发布聚焦于提升人工智能的辅助能力,使其能够服务更广泛的用户群体。大会涵盖了AI在开发者工具、用户应用以及日常生活场景中的具体改进,强调通过技术优化实现更自然、更便捷的人机交互体验。

    推荐理由:Google I/O 2026 官方合集,一页看完今年谷歌所有的 AI 动作,从模型到产品都在这,嫌消息碎的收藏这篇就够了。

  19. Google DeepMind:Blog(RSS)81

    介绍 Google Antigravity 2.0

    Google Antigravity 2.0 是一款全新独立桌面应用,支持 macOS、Linux 和 Windows,无 IDE 绑定,由最新 Gemini 模型驱动,面向企业。核心为智能体,支持同步与异步交互。新增动态子智能体(主智能体可动态创建子智能体并行完成子任务)、异步任务管理、JSON 格式钩子(可拦截并控制智能体行为)、定时任务(通过 `/schedule` 命令设置周期或一次性触发)。引入“项目”概念替代“工作区”,可跨多个文件夹并独立设置权限与规则。新增斜杠命令:`/goal` 自动执行至完成、`/grill-me` 实施前反向确认、`/browser` 显式控制浏览器。语音输入改为实时转录。

    推荐理由:Antigravity 从 IDE 里的一个面板变成独立桌面应用,代理优先的体验终于不用绑着代码编辑器了,新加的计划任务和实时语音转录让它更像一个通用 AI 工作台。

  20. Google DeepMind:Blog(RSS)83

    推出Gemini Omni多模态AI模型

    谷歌推出原生多模态AI模型Gemini Omni,能够整合视频、图像、音频和文本等多种输入,生成高质量视频内容。其核心能力是通过自然语言对话进行视频编辑,并能保持角色一致性、物理规律与场景连贯性。首个模型Gemini Omni Flash已上线,未来将支持图像和音频输出。Gemini Omni结合了对物理世界的直觉理解与丰富的知识库,支持从写实到叙事的创意生成,并可通过多轮对话持续编辑视频,而不丢失原始场景上下文。

    推荐理由:Gemini Omni 把视频生成从画面堆砌推到了物理世界叙事,多轮自然语言编辑和世界知识融合是真正的代际升级,做视频内容的该重新理解工具的定义了。