跳到正文
北京时间

产品更新

AI 产品与应用的功能上新、改版与商业化动态——谁家的产品变强了、变贵了、能用了。

985条精选相关主题模型发布行业动态AI 编码

最新精选

第 661–680 条 · 共 985 条
5月15日周五
  1. Claude Code:GitHub Releases(RSS)63

    Claude 代理工具 v2.1.142 版本更新

    Claude 代理工具发布 v2.1.142 版本。本次更新新增了 `--add-dir`、`--settings`、`--model` 等 8 个用于配置后台会话的命令行标志,并将 Fast 模式的默认模型升级为 Opus 4.7。插件功能得到增强,拥有根目录 `SKILL.md` 的插件现可被识别为技能,插件详情面板会显示其提供的 LSP 服务器。此外,版本修复了超过 15 项问题,包括 MCP 工具超时设置失效、后台会话在系统休眠后异常断开、守护进程升级后无法正常退出、Windows 网络驱动器工作目录下死锁等关键错误,并改进了响应式压缩和钩子配置错误提示。

    推荐理由:Claude Code 把 Agent 配置折腾得更顺手了,后台任务死锁、睡眠唤醒崩掉这类老毛病也修了一串,如果你的 Dispatch Agent 经常掉链子,这次升级很实在。

  2. OpenAI Developers76

    Codex正变得更易于围绕用户代码实现自动化与定制。其核心更新包括“钩子”功能,允许在任务关键节点运行脚本,以进行工作验证、扫描密钥、记录对话或按仓库定制行为。同时,面向商业和企业团队推出“程序化访问令牌”,提供范围化凭证,可从ChatGPT工作区设置创建,用于CI/CD、发布流程和内部自动化,支持设置过期或撤销,并将使用情况关联回工作区。

    推荐理由:Codex 引入 hooks 和程序化访问令牌,CI/CD 集成和定制化开发变成标准化操作,做内部工具链的可以立刻用上,这是它从个人工具走向团队基础设施的关键一步。

  3. OpenAI:官网动态(RSS · 排除企业/客户案例)78

    随时随地使用 Codex

    用户现可通过 ChatGPT 移动应用随时随地使用 Codex。该功能支持跨设备和远程环境实时监控、引导及批准编码任务,实现了对编程工作的无缝移动端管理。

    推荐理由:Codex mobile让你在手机上监控和指挥AI写代码,对需要远程协作的开发者是个实用升级,不过更像功能补全而非颠覆性创新,适合日常需要随时掌控进度的团队。

  4. xAI:News(网页)73

    xAI 推出 Grok Build 早期测试版

    xAI 面向 SuperGrok Heavy 订阅用户推出 Grok Build 早期测试版。这是一个直接在终端运行的新型编程智能体与命令行工具,专为专业软件工程和复杂任务设计。其核心功能包括:支持“计划模式”,允许用户在代码执行前审阅和修改详细步骤;能无缝集成现有开发工具链;可将大型任务分解,交由并行运行的专用子智能体处理。此外,该工具提供无头模式,便于脚本和自动化流程集成。用户可通过单行命令安装并立即在项目中使用。

    推荐理由:xAI终于下场做终端里的编码代理了,功能规划看着挺全,但早期beta只开放给SuperGrok Heavy用户,普通开发者还得再等等。

  5. Google Developers Blog(RSS)62

    Genkit 推出中间件系统:增强智能体AI应用的可控性与可靠性

    Google开源框架Genkit近日推出其核心中间件系统,旨在提升智能体AI应用的可靠性与可控性。该系统允许开发者在生成调用、模型及工具层进行拦截,以注入自定义行为,如重试机制、模型回退以及人工介入的工具审批流程。通过创建并堆叠自定义中间件,开发者能够实现对模型输出的确定性控制。所有中间件的执行流程均可通过专用的开发者界面进行实时查看与调试,有效支持使用TypeScript、Go、Dart和Python构建生产就绪的智能体应用。

    推荐理由:Genkit 的中间件系统把 agent 行为变成可编程的拦截点,重试、fallback、人机审批都能挂上,对用 Genkit 上生产的团队来说,是个能让应用更「硬」的更新。

  6. 🚨 AI News | TestingCatalog76

    Kimi发布了Kimi Web Bridge,这是一款可与多种代理协同工作的新浏览器扩展,包括Claude Code、Hermes、Codex、Kimi Code CLI等。 一浏览器通用于所有 👀 试用地址:http://kimi.com/features/webbridge 及Chrome网上应用店。

    引用Kimi.ai@Kimi_Moonshot

    支持 Kimi Code CLI、Claude Code、Cursor、Codex、Hermes 等。 试用地址:http://kimi.com/features/webbridge 以及 Chrome 应用商店。

    推荐理由:Kimi这个浏览器扩展把Claude Code、Cursor等各路Agent的网页交互统一了,如果真能无缝衔接,做开发的和做自动化的人可以省下大把调试时间。

  7. OpenRouter68

    现已在 OpenRouter 上线:@recraftai V4.1! 包含六款新图像生成模型:追求高美学的 V4.1 和 V4.1 Pro,用于 SVG 插画的 V4.1 Vector 和 V4.1 Pro Vector,以及优先考虑克制风格的产品图像的 V4.1 Utility 和 V4.1 Utility Pro。 照片级真实感更自然,渐变更平滑,简短提示词能更准确地命中目标,无需过多手动调整。

    推荐理由:Recraft V4.1 把图像生成从「能看」推到「好用」,六个变体覆盖从电商图到 SVG 的细分需求,短提示就能出好图,做设计的应该当天就用上。

5月14日周四
  1. Perplexity68

    计算机现已连接至Snowflake。 可基于实时仓库数据开展端到端工作,通过SQL、源表、筛选器和指标获取答案。 这就像一支随时待命的个人数据科学团队,从公司实时数据中提供精准答案。

    推荐理由:Computer 接入 Snowflake,等于给公司内部数据分析配了个可对话的 SQL 助手,做报表的人可以试试,但暂时只是便利性提升,不算根本性的变化。

  2. Kimi.ai80

    认识Kimi网页桥接——Kimi的浏览器扩展。 现在智能体可以像人类一样与网站互动:搜索、滚动、点击、输入并完成任务。 支持Kimi Code CLI、Claude Code、Cursor、Codex、Hermes等平台。 现已在http://kimi.com/features/webbridge和Chrome应用商店上线。

    推荐理由:这是Kimi给Agent加的'手',直接操作网页,支持主流CLI,对做网页自动化的开发者多了一个选择,即装即用挺方便。

  3. Claude Code:GitHub Releases(RSS)67

    Claude 工具 v2.1.141 版本更新

    Claude 工具发布 v2.1.141 版本,带来多项功能新增与优化。主要更新包括:为钩子输出添加 `terminalSequence` 字段以支持无控制终端的桌面通知;新增 `CLAUDE_CODE_PLUGIN_PREFER_HTTPS` 环境变量,便于通过 HTTPS 克隆插件源码;引入 `ANTHROPIC_WORKSPACE_ID` 变量以在多工作区联盟中限定令牌范围。会话管理方面,`claude agents` 命令新增 `--cwd` 参数用于按目录筛选,并优化后台代理的状态归类。用户体验改进包括:在倒带菜单添加“总结至此”选项以压缩早期上下文;长思考超时后旋转指示器变色提供更明确反馈;此外,还修复了 Markdown 表格渲染异常、权限提示逻辑、历史记录管理等超过 30 项问题。

    推荐理由:Claude Code 的小版本但修得扎实,MCP 连接、/bg 权限继承、VSCode 语音等一堆边角都补了,Agent 模式稳定性明显提升,强烈建议升级。

  4. Cursor Blog67

    为智能体配置开发环境

    Cursor发布新工具,用于配置云端智能体开发环境。核心更新包括:支持多仓库环境,使智能体可跨代码库协同工作;提供基于Dockerfile的代码化配置,支持构建密钥并优化缓存,命中缓存后构建速度提升70%;增强由智能体主导的环境设置流程,提供验证与故障回退机制。同时新增环境治理与安全功能,如版本历史、审计日志,以及可在环境级别独立管控的网络出口和密钥权限。这些改进旨在帮助团队在受控环境中更高效地运行能端到端处理任务的并行智能体集群。

    推荐理由:Cursor 云代理这次把多仓库、环境即代码和审计控制打包补齐,让开发团队可以真正放养一队 agent 跑端到端任务,企业落地门槛降了一大截。

  5. ClaudeDevs73

    自6月15日起,付费Claude计划可申领专用的月度编程使用额度。 该额度涵盖以下用途: - Claude Agent SDK - claude -p - Claude Code GitHub Actions - 基于Agent SDK构建的第三方应用

    推荐理由:Claude 给付费用户每个月送专项额度跑 Agent SDK 和 Claude Code,把‘编程式使用’从按需付费变成内置预算,靠 Claude 做自动化的开发者该看看这能省多少。

  6. Runway:News(网页)76

    Introducing Runway Agent

    Runway正式发布Runway Agent,这是一个能够通过单次对话将创意想法转化为完整、可发布视频的智能创作伙伴。用户只需用自然语言描述需求,Agent便能根据上下文和目标,自主完成概念提案、故事节奏设计、视觉方向规划,并最终生成包含多场景、旁白、对话和音乐的成片。它旨在为品牌团队、营销人员、创意机构和电影制作人快速生产各类视频内容,如品牌宣传、社交媒体素材和短片,将传统需要数天或数周的审核制作周期压缩至几分钟。该产品现已上线,新免费计划用户可获得1500积分用于制作首个视频。

    推荐理由:Runway Agent 把视频生产从“一个团队干一周”变成“一个人聊十分钟”,品牌和内容团队的视频成本结构可能就此改写。

  7. Anthropic:Newsroom(网页)80

    Anthropic推出面向小型企业的Claude服务包

    Anthropic推出“Claude for Small Business”服务包,旨在帮助小型企业弥补在AI应用资源上与大型公司的差距。该产品包含一系列连接器和15个开箱即用的自动化工作流,能将Claude深度集成到QuickBooks、PayPal、HubSpot等企业日常工具中。其核心功能是自动化处理财务、运营、销售等领域的重复性任务,如规划薪资、月末结算、追踪发票和分析营销活动等。用户通过Claude Cowork界面操作并手动批准关键步骤,所有任务均由用户发起和控制,Anthropic承诺保障数据安全。

    推荐理由:Anthropic 把 Claude 装进 QuickBooks、PayPal、HubSpot,直接帮小老板跑 payroll、关账、催发票,这是 AI 第一次真正为那些「深夜还在忙杂务」的人减负,小企业主和做 SaaS 的朋友值得细看。

  8. Google Cloud:Databases(RSS)71

    Google Cloud 用代理模型加速数据库 AI 函数

    Google Cloud 在 SIGMOD 发表论文,提出用代理模型(proxy model)加速 BigQuery 和 AlloyDB 中的 AI 函数。代理模型是面向特定查询和数据微调的轻量级模型,在 10 个基准测试中 F1 分数达到 LLM 的 90%-116%。该优化已默认集成在 BigQuery 和 AlloyDB 的优化模式下。

    推荐理由:Google 把数据库里的 LLM 调用换成了超轻量代理模型,成本降了两个数量级且准确度几乎无损,做数据分析和 SQL 的同行该认真看了。

5月13日周三
  1. 公众号:MiniMax(稀宇科技)68

    MiniMax 升级 Agent 为 Mavis,推出 Agent Teams 多智能体协作

    MiniMax 将升级后的 Agent 命名为 Mavis,并上线 Agent Teams,支持桌面端多个 Agent 并行协作,以解决单 Agent 在复杂任务中易中途停止、长任务性能下降、响应慢及角色分工不清等痛点。

    推荐理由:把多 Agent 系统的交接、共享与聚合成本摊开讲,比多数产品发布更实在地描述了从演示走向交付需要跨过的基础设施门槛,对选型团队有参考价值。

  2. Tibo76

    Codex应用内浏览器功能迎来多项改进,支持在不同视口尺寸下测试应用,并能控制设备工具栏、在不同断点进行点击验证。长时测试中,Codex会在关键节点截图供用户核查。为加速测试,可隐藏应用内浏览器以禁用动画,使测试速度提升1-2倍。此外,标注功能现在发送更快且消耗更少tokens。

    引用James Sun@JamesZmSun

    Codex 现在可以使用应用内浏览器在不同视口尺寸下测试你的应用! 它会控制设备工具栏,并在不同断点下点击浏览你的应用,以进行验证和迭代。 如果运行时间较长,Codex 会在测试过程中的关键时刻截图,并在本轮结束时展示给你,以便你验证它的工作。 为了加快测试速度,Codex 可以隐藏 IAB 以禁用动画,并将测试速度提升 1-2 倍。 另外,我们还让标注发送得更快,并消耗更少的 token。 希望你喜欢这些更新,并告诉我们你的想法!

    推荐理由:Codex这个内测浏览器升级挺实用,不同视口尺寸下截图验证,做响应式布局的人能省下反复部署的时间,更新不大但痛点打得很准。

  3. Satya Nadella68

    微软推出新型多模型智能体安全系统,整合了超过100个基于前沿和定制模型的专用智能体,用于发现可利用的安全漏洞。该系统在CyberGym基准测试中取得了顶级性能。在最近的Patch Tuesday之前,该系统已帮助发现并修复了16个漏洞。微软宣布客户现可申请加入该系统的私有预览测试。

    推荐理由:微软把多模型代理系统用到安全漏洞挖掘上,100多个专业代理协作,在CyberGym基准拿了第一,做安全的朋友值得看看实际效果。