跳到正文
北京时间

Google / Gemini

Google 与 DeepMind 的 AI 动态:Gemini 系列、Veo 视频模型、研究成果与产品生态的持续追踪。

最新精选

第 61–80 条 · 共 316 条
7月30日周四
  1. Google DeepMind:Blog(RSS)63

    Google DeepMind 在 Flow Music 中推出 Lyria 3.5,提升音乐性、歌词、人声与创作控制

    Google DeepMind 今日在 Google Flow Music 中发布新一代音乐生成模型 Lyria 3.5,带来音乐性、歌词质量、人声表现力与创作控制的多项提升。新模型能生成更自然复杂的旋律结构,歌词对提示词的遵循度和结构意识更强,人声更逼真且富有情感,同时支持更便捷地控制输出节奏与时长。

    推荐理由:Lyria 3.5 把音乐生成从玩具级推到了可用创作工具级别,歌词和情感人声的提升对内容创作者是实实在在的福音。

  2. Google Research:Blog(网页)76

    Science One Framework:通过 Chain-of-Evidence 实现可验证的自主科研框架

    Google Research 推出 Science One Framework,一个原生构建证据链的自主科研原型,旨在消除模型幻觉,并配套自动化评估协议 CoE Audit。

    推荐理由:对自主科研系统而言,可验证性从后置修补变为前置架构,提出的审计方法让生成论文的完整性有了可量化的衡量尺度。

7月29日周三
  1. Artificial Intelligence News(网页)73

    Google AI Overviews 在搜索中占比升至 43%

    市场情报公司 Similarweb 的 2026 年生成式 AI 格局报告显示,Google AI 生成的摘要(AI Overviews)已出现在 43% 的美国搜索中,较一年前的 15% 大幅上升。AI Overviews 在常规搜索结果中显示生成摘要,而 AI Mode 则为长问题与后续提示词提供对话式界面。

    推荐理由:Google 的 AI 回答现在出现在四成搜索里,比一年前涨了近三倍。对做 SEO 和内容的人,信号很直白,流量入口的游戏规则正在被改写。

  2. Google Blog:AI(RSS)72

    Gemini API Managed Agents 默认升级为 3.6 Flash,新增环境钩子与免费套餐

    Google DeepMind 将 Gemini API Managed Agents 的默认模型升级为 Gemini 3.6 Flash,并支持显式选择 3.5 Flash 或 3.5 Flash-Lite。新增环境钩子允许在沙箱内工具调用前后执行自定义脚本,用于安全审查或代码格式化。此外,还推出了免费套餐、预算控制和基于 cron 的定时触发功能。

    推荐理由:Gemini 的 managed agents 把钩子机制和预算控制做进了官方 API,对重度依赖 agent 做代码审计和任务的团队是个实用升级,Offdeal 已经用上了。

7月28日周二
  1. Google Blog:AI(RSS)71

    Google Search 的 AI Mode 推出 5 项新功能,帮你规划线下生活

    Google Search 的 AI Mode 新增 5 项工具,帮助用户规划线下活动。功能包括:通过 Personal Intelligence 连接 Google Calendar 推荐本地课程;在 AI Mode 内直接购物并查询附近库存;利用 Canvas 生成桌游策略指南并模拟对弈;根据预算和人数筛选并预订演唱会等门票;连接 Canva 生成邀请函设计。

    推荐理由:Google搜索的AI Mode把线下生活场景串起来了,从找课到订票都是实用教程,对普通用户比单纯benchmark更有体感,看完就能照着做。

  2. TechCrunch:AI(RSS)76

    Google AI Overviews 搜索结果出现率升至43%

    Google AI Overviews 在搜索结果中的出现率一年内从15%升至43%,AI Mode月访问量从1.26亿增至2.79亿。用户搜索长度增加,正从短关键词转向更长的自然对话式查询。

    推荐理由:Similarweb 的数据坐实了搜索范式的代际切换,Google 从链接跳板变成终点站。网站主和 SEO 从业者该认真对待 AI 引文不带来点击的现实了。

7月26日周日
  1. Google AI:DEV 作者专属(RSS)68

    Gemini 3.6 Flash 登陆 Google Cloud 数据库:更快更便宜

    Google Cloud 数据库现已支持 Gemini 3.6 Flash,该模型知识截止日期约为今年 3 月底,且成本更低。在 Cloud SQL for Postgres 的基准测试中,Gemini 3.6 Flash 平均延迟 3694.53ms,快于 Gemini 3.5 Flash 的 4918.86ms;在 AlloyDB 中两者响应时间几乎相同。

    推荐理由:在Cloud SQL和AlloyDB环境中的实测表明,Gemini 3.5 Flash Lite以7倍速度与接近满分质量,为简单任务提供了更经济的选项,但样本量小且评判模型自带偏好,结论需谨慎采纳。

7月23日周四
  1. TechCrunch:AI(RSS)72

    Google Gemini 月活用户逼近 9.5 亿,有望成为下一个十亿级产品

    Google 在 Q2 2026 财报电话会上宣布,AI 助手 Gemini 月活跃用户已超过 9.5 亿,用户数较去年增长三倍。Gemini 正与月活突破 10 亿的 ChatGPT 展开更直接竞争,其 AI 搜索模式用户也已超过 10 亿。Sensor Tower 报告显示,Gemini 在 AI 助手市场份额升至 27.7%,而 ChatGPT 份额首次跌破 50%。

    推荐理由:Gemini 快 10 亿用户了,ChatGPT 份额跌破 50%,双雄争霸格局成形。谷歌把搜索和 AI 助手绑在一起,这个策略比 OpenAI 更稳。

  2. Google AI:DEV 作者专属(RSS)61

    Google Cloud Agent Skills 完整指南:从基础到高级云运维

    Google Cloud 推出官方 Agent Skills 开源指令集,旨在让 AI 编码智能体安全、高效地执行多步骤云操作。该仓库基于 agentskills.io 开放标准,目前收录 70 多项技能,涵盖安全审计、无服务器部署、BigQuery 优化等 8 个类别。技能采用渐进式披露模型,通过验证工作流、安全门控和上下文感知机制,防止智能体盲目执行破坏性命令。

    推荐理由:这是 Google Cloud Skills 系列教程第一篇,从安装到触发讲得很细,把 Agent Skills 的“渐进式披露”和安全门机制都拆解了,适合想让 AI 编码代理帮你管云资源的开发者。

  3. Google AI:DEV 作者专属(RSS)73

    Gemini 3.6 Flash 与 3.5 Flash-Lite 正式版发布

    Google 发布 Gemini 3.6 Flash 和 Gemini 3.5 Flash-Lite 正式版。3.6 Flash 在复杂智能体和多模态任务上性能更强,输出 token 价格降至 $7.50/1M,支持 1M token 上下文窗口和 Computer Use 工具。

    推荐理由:Gemini 3.6 Flash 降本增效,3.5 Flash-Lite 主打低成本高速,弃用 temperature 等参数是个硬变更,使用 Gemini 的开发者必须检查迁移。

  4. Sundar Pichai62

    Alphabet Q2 营收同比增长 24%,Google Cloud 增速达 82%。Gemini 应用月活跃用户达 9.5 亿,模型 API 处理量升至 220 亿 token/分钟,由 Flash 模型驱动。Gemini Enterprise 已被 90% 的财富 100 强企业采用。

    推荐理由:Google 这份季报显示 AI 正在变成真金白银的驱动引擎,云业务 82% 增长和 Gemini 近 10 亿用户是硬信号,做 AI 应用的人该看看风向。

7月22日周三
  1. Tomer Tunguz 博客(VC 分析)75

    Google Cloud 营收增速向 NVIDIA 看齐

    Google Cloud 在 2026 年 Q2 营收同比增长 82% 至 $24.8b,超过 $22.3b 的预期,增速已与 NVIDIA 趋同。增长主要来自 AI 算力租赁需求,而非 TPU 系统销售——后者本季度才开始确认收入,大部分收入将在 2027 年落地。云业务积压订单达 $514b,同比增长 385%,营业利润率从一年前的 20.7% 扩大至 35.6%。

    推荐理由:作者用财报数据对比 Google Cloud 与 NVIDIA 的增速趋同和利润率变化,帮助读者理解云厂商与芯片商共享同一需求曲线。

  2. OpenRouter72

    今日在 OpenRouter 上线:Gemini 3.6 Flash 和 Gemini 3.5 Flash-Lite! 两者均为其模型系列的重大更新,具备高吞吐量(150+ tok/s),适用于智能体场景,从高效 token 的编码与知识工作,到低延迟、高并发的子智能体。 详情如下 🧵

    推荐理由:Google Gemini Flash 系列更新到 3.6,150+ tok/s 的吞吐量对 agent 场景是实际提升,OpenRouter 第一时间上线,开发者可以直接调。

  3. Josh Woodward69

    Google 推出三款新模型,旨在提升性能、降低延迟和成本。其中,3.6 Flash 在复杂编码任务上 token 用量最高减少 65%,3.5 Flash-Lite 速度达 350 输出 token/秒。3.6 Flash 和 3.5 Flash-Lite 已在 Gemini 应用上线,3.5 Pro 进入合作伙伴测试。

    引用Google DeepMind@GoogleDeepMind

    我们正在推出三款新模型,旨在让 AI 智能体在大规模应用中更快、更智能、更经济: 🔵 Gemini 3.6 Flash:它比 Gemini 3.5 Flash 使用更少的模型 token,就能以完全相同的成本提供更高质量的工作成果。 🔵 Gemini 3.5 Flash-Lite:一款快速、经济高效的选择,适用于处理文档和智能体搜索等日常任务。 🔵 Gemini 3.5 Flash Cyber:一款专为网络安全打造的模型,用于发现并修补关键软件漏洞。

    推荐理由:Google一口气扔出三个Gemini Flash新模型,3.6 Flash把复杂编码token砍了65%,做Agent的成本敏感型选手可以直接收益,Cyber模型专攻漏洞修复是个有意思的细分信号。

  4. Google Developers Blog(RSS)63

    Google 推出 Tunix:基于 JAX 的高吞吐智能体后训练库

    Google 发布 Tunix,一个基于 JAX 的原生后训练库,旨在消除多轮、使用工具的 LLM 推理智能体训练中的 TPU 闲置瓶颈。Tunix 通过高并发异步 rollout 与解耦的生产者-消费者流水线最大化硬件吞吐量,确保训练器持续获得数据。该库提供即插即用抽象和持续宏观级性能分析,便于集成自定义环境。

    推荐理由:Google 这个训练库直接解决 agent 训练中 TPU 空转的隐性成本,对做后训练的团队可能是基础设施级改进,值得跟进。

  5. Google Cloud:Databases(RSS)71

    AlloyDB 推出列式引擎加速 HNSW,pgvector 向量搜索 QPS 提升最高 4.9 倍

    Google Cloud 的 AlloyDB 在预览版中推出列式引擎加速的 HNSW 索引,使 pgvector 向量搜索的每秒查询数(QPS)相比标准 PostgreSQL HNSW 提升最高 4.9 倍,在固定 QPS 下召回率可提升 0.163。该加速通过将索引固定在列式引擎内存中、使用向量化内存布局并绕过标准 PostgreSQL 缓冲管理器开销实现,无需修改应用即可获得性能提升。

    推荐理由:AlloyDB 把 pgvector 的 HNSW 搜索提速 4 倍,不是靠 GPU 而是靠内存架构,对已经在 PostgreSQL 上跑 RAG 的团队可能是个省钱又提精度的实用升级,点开看看基准测试。

7月21日周二
  1. Google DeepMind:Blog(RSS)57

    Google DeepMind 发布 Gemini 3.6 Flash、3.5 Flash-Lite 与 3.5 Flash Cyber 三款新模型

    Google DeepMind 推出 Gemini 3.6 Flash、3.5 Flash-Lite 和 3.5 Flash Cyber 三款新模型。其中 Gemini 3.6 Flash 为最新主力模型,3.5 Flash-Lite 主打更低成本与更高效率,3.5 Flash Cyber 则针对网络安全场景优化。三款模型均通过 Google AI 开发者平台提供 API 访问。

    推荐理由:Gemini Flash 系列常规更新,Flash-Lite 和 Cyber 变体值得 API 开发者留意,但细节还没出来,目前只能先标记。

7月17日周五
  1. Google Blog:AI(RSS)60

    Google Vids 上线 Gemini Omni 与个人数字分身功能

    Google Vids 推出两项更新:Gemini Omni 支持用户通过自然语言提示词和图片参考生成、逐步编辑高质量视频片段;个人数字分身功能允许用户上传自拍和语音录制后,输入文字即可让数字分身出镜。两项功能面向 Google AI Pro 和 Ultra 订阅者及 Google Workspace 商业客户开放,所有生成内容均含不可见的 SynthID 数字水印。

    推荐理由:如果你已经在用 Google Workspace,这两个更新让 Vids 的可用性提升了一档,但对于外部的 AI 视频生成,没带来新变量。

7月16日周四
  1. Google AI:DEV 作者专属(RSS)72

    DiffusionGemma 开发者指南发布

    Google AI 发布 DiffusionGemma 开发者指南,该实验性模型基于 Gemma 4 架构,采用计算受限并行生成,在单张 NVIDIA H100 上实现 1000+ tokens/秒的生成速度。模型为 26B 参数的 MoE 架构,推理时仅激活 3.8B 参数,可在 18 GB VRAM 内量化部署。

    推荐理由:虽然 DiffusionGemma 是实验性的,但把文本生成从内存带宽瓶颈转向计算瓶颈的思路非常新颖,这篇指南给出了可落地的服务方案和微调手法,做推理优化的值得跟进。

  2. The Verge:AI(RSS)78

    欧盟裁定 Google 必须向竞争对手开放 Android 和 Search,影响 Gemini 等 AI 服务

    欧盟依据《数字市场法案》(DMA)裁定 Google 必须向竞争对手开放 Android 和 Google Search 的关键部分,包括允许第三方 AI 助手和搜索引擎获得更大访问权限。这两项决定可能削弱 Google 对两大核心平台的控制,并为其 AI 工具 Gemini 的未来格局带来深远影响,同时为竞争对手创造新的发展机会。

    推荐理由:欧盟这两项裁决直接撬开了谷歌安卓和搜索的围墙,对Gemini等AI助手的地位是实质冲击,做AI应用和搜索的创业者值得盯着后续执行细节。