跳到正文
北京时间

Google / Gemini

Google 与 DeepMind 的 AI 动态:Gemini 系列、Veo 视频模型、研究成果与产品生态的持续追踪。

最新精选

第 121–140 条 · 共 316 条
6月16日周二
  1. Google Cloud:Databases(RSS)61

    Google Cloud 发布多项 Data Agent 新工具,助力 AI 工作流

    Google Cloud 发布一系列 Data Agent 新工具,帮助开发者利用企业数据构建 AI 智能体。新功能包括 BigQuery 中 Conversational Analytics 的扩展支持、已正式上线的 Data Engineering Agent,以及预览版的 Database Observability Agent。

    推荐理由:Google Cloud 一口气发布多个数据代理,覆盖从运维到 BI 的全流程,自家生态的数据工程师应该看看,但对不依赖 GCP 的团队意义有限。

6月13日周六
  1. IT之家(RSS)80

    谷歌Android安全负责人因反对军事AI合作辞职

    谷歌Android平台安全负责人René Mayrhofer辞职,他在5月18日内部告别信中指责公司“丧失道德指针”,批评谷歌悄悄放弃碳中和目标(因AI模型能耗),并与美国战争部签署允许AI用于“任何合法目的”的协议。今年4月下旬谷歌宣布向五角大楼提供AI用于机密工作,2025年2月更新AI原则时移除了不使用AI开发武器或监控工具的承诺。Mayrhofer担忧谷歌AI产品可能被用于针对公民的大规模监控,包括自己和家人。

    推荐理由:Android 安全主管因军事 AI 合作愤而辞职,并公开内部告别信,这是谷歌放弃不作恶后最响亮的内部抗议,暴露了 AI 伦理与商业利益的深层冲突。

  2. TechCrunch:AI(RSS)74

    Google 起诉被指使用 AI 发送诈骗短信的中国网络犯罪团伙“Outsider Enterprise”

    Google 起诉一个名为“Outsider Enterprise”的组织,指控其利用人工智能在两周内发送了 250 万条诈骗短信,导致数十万受害者上当。该组织被描述为中国网络犯罪团伙。

    推荐理由:谷歌起诉利用AI进行诈骗的中国犯罪团伙,披露细节和19亿美元损失规模让人震惊,这标志着AI滥用从实验走向产业化,所有AI工具厂商都该看看起诉书,思考如何防止平台被武器化。

6月12日周五
  1. Google DeepMind67

    我们的机器人加速器已启动,15家初创公司助力塑造欧洲的物理AI未来。🤖 这个为期三个月的项目将为他们提供我们的AI堆栈、Gemini Robotics模型以及我们团队的实际支持。 了解这些公司 → https://goo.gle/4oeEk2K

    推荐理由:Google DeepMind启动机器人加速器,选了15家欧洲初创用Gemini Robotics,这是他们物理AI战略的落地信号,看看选了什么方向就知道大厂押注在哪。

6月11日周四
  1. Google Gemini65

    Gemini 的 Notebooks 功能现已面向欧洲经济区、英国和瑞士用户开放。Notebooks 提供一个独立专注的空间,可记忆用户的来源、指令和聊天记录,用于组织项目。用户可通过 gemini.google 或应用创建自己的 notebook。该功能旨在将用户常聊的话题归入独立空间,帮助保持条理。

    引用Google Gemini@GeminiApp

    给你最常聊的话题各自一个家。🗂️ 滑动了解如何在 Gemini 中用笔记本保持井然有序,并在回复中告诉我们你是如何使用它们的。

    推荐理由:地区解锁而非新功能,EEA 用户终于能用 Notebooks 整理会话了,其他地区的人看看就好。

  2. Google DeepMind:Blog(RSS)60

    Google DeepMind 宣布投入 1000 万美元资助多智能体AI安全研究

    Google DeepMind 与合作伙伴共同发起一项 1000 万美元的资金征集,专门用于多智能体 AI 安全方向的研究。

    推荐理由:DeepMind 联合 Schmidt Sciences 等发起千万美元级多智能体安全研究资助,标志着对大规模 agent 交互中深层风险的正式关注,做 agent 安全的人可重点关注。

  3. OpenRouter:Announcements(RSS)64

    Gemini 2.5 Flash API - 定价、快速入门与提供商比较

    Gemini 2.5 Flash API 支持配置思考预算(thinking budgets),用户可跨提供商进行比较,并在5分钟内完成首次API调用。

    推荐理由:这是 OpenRouter 上接入 Gemini 2.5 Flash 的保姆级指南,把三家 Google 提供商的延迟和定价差异摆在明面上,需要做模型选型和成本估算的开发者可以直接抄里面的 quickstart 代码。

  4. Google Research:Blog(网页)63

    Google Research提出审计机器遗忘新框架

    Google Research 在 AISTATS 2026 发表正则化 f-散度核检验,用于高效审计 LLM 等模型的机器遗忘。该方法通过统计两样本检验判断模型是否真正“忘记”特定训练数据,避免完全重训的巨大成本。相比最大均值差异等现有工具,新框架理论上可在任意样本量下自然控制假阳性,且假阴性风险随可用样本增加可靠收敛至零,解决了大规模模型审计中计算成本过高的问题。

    推荐理由:机器遗忘是AI合规的硬需求,但验证‘真忘了’一直是统计难题。谷歌这篇AISTATS论文提出了一套更灵敏的差异测试框架,做隐私审计的值得细看。

  5. Gary Marcus:The Road to AI We Can Trust(RSS)73

    突发:Google 因模型幻觉被判负有法律责任

    一项法律裁决判定 Google 对其 AI 模型产生的幻觉内容负有法律责任。该判决可能产生巨大影响,尤其若其他国家跟进做出类似裁定。

    推荐理由:Google 因 AI 幻觉被追责,这个判例如果扩散,所有生成式 AI 产品都要重新审视风险,对行业是重大信号。

  6. Google DeepMind:Blog(RSS)72

    DiffusionGemma:文本生成速度提升4倍的开源扩散模型

    Google DeepMind 发布开源实验模型 DiffusionGemma,采用文本扩散技术,突破自回归逐 token 生成方式,每次前向并行生成 256 个 token。该 26B MoE 模型推理时仅激活 3.8B 参数,量化后适配 18GB 显存消费级 GPU。在 H100 上达 1000+ tokens/s,RTX 5090 上 700+ tokens/s,速度提升 4 倍。具备双向注意力和自我修正能力,面向内联编辑、代码填充等本地交互工作流,以 Apache 2.0 许可证开放。

    推荐理由:DiffusionGemma 虽为实验性质,但它把文本生成从“串行打字机”变成了“并行印刷机”,本地推理速度 4 倍提升,对需要实时交互的开发者是个值得关注的方向。

  7. The Verge:AI(RSS)74

    Google将保存用户的Lens图片、Search Live录音和Translate音频用于AI训练

    Google更新搜索交互数据保存方式,新增“Search Services History”设置,用于保存用户搜索时使用的图片、文件、音频和视频,包括Google Lens搜索的图片、实时搜索工具Search Live的录音、语音搜索和Translate中的语音片段。这些数据将被用于“提供、改进和开发AI模型”。用户可关闭该设置并禁用“Save Media”选项以避免保存。

    推荐理由:Google这回悄悄把图片、录音存下来训练AI,默认开启,虽然可以关,但灰度操作值得每个用搜索的人看一眼。

6月10日周三
  1. IT之家(RSS)70

    谷歌 DeepMind 经济学家伊马斯:尚未发现 AI 造成岗位流失的证据,跟风裁员恐适得其反

    谷歌 DeepMind AGI 经济学负责人亚历克斯·伊马斯表示,目前没有看到白领岗位因 AI 大规模消失的证据。他强调,若企业因“不裁员就等于 AI 转型慢”的叙事而跟风裁员,可能适得其反。伊马斯认为,AI 更多是接手部分任务、提升生产力,让员工专注机器无法完成的工作,岗位冲击尚未真正出现。

    推荐理由:来自AI核心阵营的经济学家说‘还没证据’,这本身就值得每个担心被AI替代的人看一眼,那种‘没裁员就是落后’的FOMO叙事可能更危险。

  2. NotebookLM67

    NotbookLM 宣布其笔记本功能已在欧洲的 Gemini App 中 100% 上线。此前用户只能上传笔记本作为 Gemini 的来源,现在可直接在 Gemini App 内访问所有个人未共享的笔记本,并将与 Gemini 的对话作为新笔记本或已有笔记本的来源。该功能先面向 Google AI Ultra、Pro 和 Plus 订阅者的网页端,未来几周将扩展到移动端、更多欧洲国家及免费用户。

    引用NotebookLM@NotebookLM

    去年,我们通过允许你将笔记本作为来源上传,整合进了 @GeminiApp。现在,我们将这段关系提升到新的层次 🏠 ♥️ 从今天开始,你现在可以: — 直接在 Gemini App 内访问你所有个人的、未共享的笔记本 — 将你与 Gemini 的对话作为新笔记本或现有未共享笔记本中的来源 我们今天开始在 Gemini 中推出笔记本功能,首先面向网页端的 Google AI Ultra、Pro 和 Plus 订阅用户。在接下来的几周内,我们将把访问权限扩展到移动端、欧洲更多国家以及免费用户。

    推荐理由:这不是一个惊天动地的更新,对用NotebookLM做深度研究和写作的人,把笔记无缝塞进Gemini对话里是实实在在的效率提升。普通用户可能感觉不大。

  3. Jeff Dean81

    语音翻译一直是Google历时最久的机器学习项目之一,我们已经取得了长足进展。Gemini 3.5 Live Translate是我们最新的语音到语音模型,支持70多种语言。它能让日常产品和应用中跨语言的对话更加自然。 以下是一个示例,展示@InsideGrab的合作伙伴如何帮助旅客与司机建立联系。🚗 已在Google Translate和@GoogleAIStudio的Live API中推出。

    推荐理由:Google把语音翻译做到70+语言,Gemini 3.5 Live Translate直接塞进Google Translate和API,普通人下载App就能用,做跨国生意的这下有福了。

  4. OpenRouter:Announcements(RSS)60

    Gemini 2.5 Flash API:定价、快速入门与提供商对比

    Gemini 2.5 Flash API 的定价与快速入门指南,指导用户配置 thinking budgets、比较不同提供商,并在 5 分钟内完成首次 API 调用。

    推荐理由:Gemini 2.5 Flash 最值得关注的是 thinking budget,这篇教程把怎么用、怎么省都讲清楚了,但对早已熟悉文档的开发者来说新东西有限。

6月9日周二
  1. NotebookLM72

    推出更强大的 NotebookLM 🚀 重大升级带来了对话中的智能体能力、更高级的推理以及一系列新的输出格式。处理复杂的多步骤研究问题从未如此简单。 现已面向 Google AI Ultra 订阅者推出。

    推荐理由:NotebookLM 这次升级把 agent 能力塞进聊天框,从被动答案变成能拆解多步研究,对深度资料整理的人是真迭代,但仅限 Google AI Ultra 订阅,门槛不低。