跳到正文
北京时间

产品更新

AI 产品与应用的功能上新、改版与商业化动态——谁家的产品变强了、变贵了、能用了。

985条精选相关主题模型发布行业动态AI 编码

最新精选

第 701–720 条 · 共 985 条
5月9日周六
  1. Elon Musk75

    Grok 升级 [引用 @grok]:... 今天就在 iOS、Android 和 http://grok.com 上的所有计划中添加您的连接器到 Grok。

    引用Grok@grok

    让 Grok 获取你的邮件、改进你的幻灯片、整理你的日历或组织你的 Notion。 今天就在 iOS、Android 和 http://grok.com 上的所有套餐中为 Grok 添加你的连接器。

    推荐理由:Elon 亲自下场推这个功能,说明 xAI 把 Grok 的定位从聊天转向行动,打通邮件和日历后,AI 帮你去做的杂事比帮你聊的多。

  2. Cursor Blog67

    Bugbot团队与个人计划更新

    Bugbot宣布将团队与个人计划从每月每席位40美元的订阅制改为按使用量计费。现有用户的变化将于2026年6月5日后的下一个账单周期开始生效,例如2026年5月购买的年订阅将在2027年5月切换。团队按需消费计费,个人按包含使用量计费,平均每次运行成本约为1.00-1.50美元,具体取决于PR大小和复杂度。同时,用户现在可配置Bugbot审查PR的工作强度:默认强度下80%被识别的问题在合并时得到解决;高强度模式下可多发现35%的问题,解决率仍保持在80%。现有客户可在Cursor面板中提前切换至用量计费。

    推荐理由:Cursor Bugbot 这次改用量计费对个人和小团队更友好,一次审查平均只要 1-1.5 美元,而且高努力模式能多抓 35% 的 bug,代码审查工具可能要变天了。

  3. Google Gemini73

    Gemini中的笔记本功能为复杂任务带来条理性。 以研究生院申请流程为例:通过笔记本,您可以将成绩单、文书草稿和录取要求集中在一处,让Gemini帮助追踪截止日期、提供反馈并评估您的进展。

    推荐理由:Gemini笔记本像是给ChatGPT加了个项目管理面板,如果你在手里捏着一堆碎片化任务,这个功能值得到回来看看。但别指望它超越模型本身的能力边界。

5月8日周五
  1. OpenRouter:Announcements(RSS)56

    Agent SDK 中的人机协同工具

    OpenRouter Agent SDK 引入了一种新工具类型,使智能体能够自动处理常规决策,并在高风险决策时暂停以请求人工输入。该功能通过两个钩子实现,无需编写任何循环管理代码,从而在自动化流程中灵活嵌入关键的人工判断环节。

    推荐理由:OpenRouter给Agent SDK加了人类介入挂钩,做复杂流程的团队不用自己写循环管理代码了,关键决策能拉人进来确认,是个实用的小升级。

  2. Claude Code:GitHub Releases(RSS)69

    Claude v2.1.133 版本更新

    Claude 发布 v2.1.133 版本,新增多项配置与优化。主要新增 `worktree.baseRef` 设置以选择工作树分支基础,引入 `sandbox.bwrapPath` 等设置允许指定自定义二进制路径,并添加 `parentSettingsBehavior` 键供管理员控制设置合并策略。功能上,钩子现在可接收活动努力级别信息,Bash 工具命令可读取相应环境变量。此外,改进了焦点模式行为,并在内存压力下优化了后台工作进程的释放。本次更新修复了大量问题,包括并行会话死锁、权限规则误匹配、代理设置不生效、网络驱动器访问被拒、远程控制中断不彻底、努力级别跨会话更改以及子代理技能发现失败等。`claude --help` 现已列出远程控制选项,VSCode 扩展也修复了相关错误。

    推荐理由:Claude Code 这个版本修了一堆让人抓狂的 bug,并行会话掉认证、网络驱动器权限、子代理找不到 skill 都解决了,重度用户应该尽快升级。

  3. OpenRouter:Announcements(RSS)73

    为所有模型提供一致的网络搜索与抓取能力

    该工具赋予任何具备工具调用能力的模型自主进行网络搜索和抓取网页内容的功能。它支持多种搜索引擎和抓取引擎供用户选择,实现了跨模型的一致操作体验。这意味着开发者可以便捷地为不同的大语言模型(如GPT、Claude、LLaMA等)集成实时、可靠的网络信息获取能力,无需为每个模型单独适配。

    推荐理由:让任何模型都能用统一接口做联网搜索和抓取,做 agent 的同学不用再为每个模型单独配工具了,在 OpenRouter 上搭产品的实用性直接拉高。

  4. Simon Willison 博客78

    GitHub Repo Stats

    作者开发了一个名为“GitHub Repo Stats”的在线工具,用于解决GitHub移动端网站不显示仓库提交次数的问题。用户只需输入GitHub仓库的URL或“foo/bar”格式的仓库ID,该工具便会通过REST或GraphQL API获取并展示仓库的关键统计数据,其中首要指标就是提交总数。工具已提供实际示例,如查看simonw/datasette和simonw/llm这两个仓库的详细数据。

    推荐理由:Simon 这个 GitHub Repo Stats 工具虽小,但直接解决了移动端看不了 commit 数这个真实痛点,做开源评估的开发者可以立刻用起来。

  5. OpenAI75

    Codex现可直接在macOS和Windows的Chrome中运行。 它在处理Chrome中的应用和网站时表现更佳,并能在后台跨标签页并行工作,而不会占用浏览器控制权。 要开始使用,请在Codex应用中安装Chrome插件。

    推荐理由:Codex 从终端跑进 Chrome,最大的变化不是平台迁移,而是能跨标签并行在后台干活不接管浏览器,这对前端开发和依赖网页工具的流程是实打实的效率提升。

  6. Rohan Paul77

    Proprioceptive AI开发的Cygnus技术,通过为冻结的大语言模型添加自感知适配器,使其能读取内部认知几何。该技术将模型的隐藏状态投影到由gl(4,R)李代数定义的数学空间,分离出包含主要精度信号的“暗模式”,从而无需重新训练即可显著提升模型性能。例如,仅用一张RTX 3090显卡,就将Qwen-32B在ARC-Challenge基准上的准确率从82.2%提升至94.97%。其适配器将覆盖从3B到405B的多款模型,服务节点可支持5万用户并发,预计本周末上线。相关设计论文已公开。

    引用Logan Matthew Napolitano@Propriocetive

    小型模型上的最终对抗性测试现在正在收尾,GPU 每天到货,目前已有 1TB 内存、128 VRAM 并还在增加。将会有从 3b Qwen 到 Nous Hermes 405 B 以及介于两者之间的各种适配器。集群已上线并不断扩展,产品几乎完成。最终用户可以下载我们的应用,连接到我们的 API,不会给最终用户增加延迟。目前我们的 droplet 可以同时托管多达 50,000 名用户。如果广告测试进展顺利,应该会在本周末前上线。下载将在 https://www.proprioceptiveai.com/cygnus 提供 @grok 你有什么想法? 关于我们的 Proprioceptive Adapters 和 Cygnus 设计的论文已发布 https://proprioceptiveai.com/publications.html https://zenodo.org/records/19223882 - Cygnus 论文 - 63 页。3 月 - 26 2026’ https://zenodo.org/records/19080172 - 459 页。3 月 - 17 2036’ https://zenodo.org/records/18471775 - “LLM”中的统一行为修改 33 页。2 月 - 3 2026’ https://zenodo.org/records/18247585 - Holonomy Transformer - 36 页。2026 年 1 月 14 日’(首批概念 - Fiber Theory、数学、开放代码)

    推荐理由:用Lie代数揪出模型内部的“黑暗模式”,在ARC上狂涨12个点还只要一张3090,如果真能泛化到其他任务,这或许是今年最巧妙的模型增强方案,但单基准提升仍需更多验证。

  7. Satya Nadella67

    很高兴今天将 GPT 5.5 Instant 引入 M365 Copilot。 凭借更快、更清晰、更准确的响应,您可以用更少的来回交流获得有用的答案。 同时也在向 Copilot Studio 和 Foundry 推出。这都是我们专注于为您在工作、智能体和应用程序中提供更多模型选择的一部分。

    推荐理由:微软把 GPT 5.5 Instant 直接塞进 M365 Copilot,对每天用 PPT/Excel 的职场人来说,响应速度提升比任何 benchmark 都实在。

  8. OpenAI:官网动态(RSS · 排除企业/客户案例)71

    在ChatGPT中测试广告

    OpenAI开始在ChatGPT中测试广告功能,旨在支持其免费服务的持续运营。测试强调广告会带有明确标识,且广告内容不会影响ChatGPT的回答独立性。该举措配套严格的隐私保护措施,并确保用户对广告体验拥有控制权。

    推荐理由:ChatGPT免费版要开始看广告了,虽然官方承诺回答不受影响且隐私保护,但这是AI商业化的大实验,所有免费用户都会盯着会不会掺水。

  9. Claude:Blog(网页)85

    在Excel、PowerPoint、Word和Outlook中与Claude协同工作

    Claude for Excel、PowerPoint和Word现已全面上市,Outlook版本开放公开测试。Claude能在四大微软应用间保持连续对话上下文,实现跨文件智能协作。例如,在Outlook中分类邮件并起草回复,在Excel中调整数据后,PowerPoint图表和Word文档会自动同步更新。企业管理员可通过微软管理中心统一部署,并配置OpenTelemetry进行全流程监控。该套件支持通过Claude账户或现有LLM网关访问,Microsoft 365 Copilot用户也可在Excel和PowerPoint中直接调用Claude。

    推荐理由:Claude 这次 Office 集成不是普通插件,它让 Excel、PPT、Word、Outlook 共享同一对话上下文,改一个数其余自动更新,生产力提升是实打实的,企业用户值得立即部署。

  10. Perplexity68

    Personal Computer现已通过全新的Perplexity Mac应用向所有用户开放。 Personal Computer是Perplexity Computer的进阶版本。 它可在任何Mac设备上运行,能跨本地文件、原生Mac应用、网络以及Perplexity安全服务器执行任务。

    推荐理由:Perplexity 把计算机使用能力做进了 Mac 原生应用,能跨本地文件、桌面程序和网络运行任务,对 Mac 用户而言 AI 助手真正开始接管操作系统层级的工作。

  11. Replit ⠕67

    我们安全承诺的下一步:安全中心2.0。 我们极大地简化了理解您管理的每个Replit应用安全状况的流程,并支持批量对所有应用执行操作。 通过安全中心2.0,您可以: - 即时识别高风险应用 - 数秒内通过Agent修复关键漏洞 - 通过批量操作通知所有者或下架应用 - 导出软件物料清单(SBOM)以集成外部工具

    推荐理由:如果你用Replit管理一堆应用,这个安全中心2.0的批量修复和SBOM导出是实打实的效率提升,但对个人开发者来说属于‘有比没有好’的更新。

  12. OpenRouter68

    Gemini 3.1 Flash Lite 来自 @GoogleDeepMind,现已在 OpenRouter 正式发布。 多模态(文本/图像/视频/音频/PDF → 文本),100万上下文,可选的思考层级,输入每百万次$0.25,输出每百万次$1.50。 还可配合我们新的 service_tier 参数使用,以权衡成本与延迟!

    推荐理由:OpenRouter 把 Gemini 3.1 Flash Lite 的多模态 1M 上下文压到 $0.25/M token,这个定价让 Flash 系列不再是试验品,轻量级应用可以认真考虑它了。

  13. OpenAI:官网动态(RSS · 排除企业/客户案例)56

    Introducing Trusted Contact in ChatGPT

    ChatGPT 推出了一项名为“可信联系人”的可选安全功能。当系统检测到用户存在严重的自残风险时,该功能会主动通知用户预先设定的一位可信联系人。这项更新旨在通过社交支持干预,为面临心理健康危机的用户提供额外安全保障。

    推荐理由:ChatGPT 这次更新的不是模型能力,而是安全机制,引入可信联系人针对严重自残风险,对部分用户是真正的底线保障。

5月7日周四
  1. OpenRouter72

    1/ 音频现已成为OpenRouter的一等公民。 今日上线两个新端点: 📢 /api/v1/audio/speech — 文本转语音(TTS) 🎤 /api/v1/audio/transcriptions — 语音转文本(SST) 沿用您已在文本、图像和视频中使用的相同路由、计费和密钥。

    推荐理由:OpenRouter 突然把 TTS 和 STT 拉进了统一路由,用同一把 Key 和账单,做多模态 App 的人可以少调一个 API。更新不大,但省事。

  2. Google DeepMind:Blog(RSS)66

    AlphaEvolve:我们由Gemini驱动的编程智能体如何跨领域扩展影响力

    AlphaEvolve推出了基于Gemini大模型的编程智能体,其算法正驱动多个领域产生实际影响。该智能体在商业流程、基础设施优化与科学研究三个关键领域实现规模化应用,通过自动化代码生成与问题解决提升效率。具体实践表明,它能显著加速开发周期并处理复杂任务,标志着AI编程助手从辅助工具向核心生产力引擎的演进。

    推荐理由:DeepMind这次不只是秀参数,AlphaEvolve用Gemini驱动编码代理,已经开始在工业设计和科学发现里产生真实影响了,做自动化的可以盯着看。