跳到正文
北京时间

产品更新

AI 产品与应用的功能上新、改版与商业化动态——谁家的产品变强了、变贵了、能用了。

985条精选相关主题模型发布行业动态AI 编码

最新精选

第 101–120 条 · 共 985 条
8月14日周五
  1. Google Blog:AI(RSS)61

    Google Sheets 推出 Sheets canvas:用 Gemini 将表格数据变为交互式迷你应用

    Google Sheets 发布新功能 Sheets canvas,基于 Gemini 构建,用户只需用自然语言提示词即可将表格数据转化为交互式仪表盘、学习追踪器、座位表等“迷你应用”。

    推荐理由:与单独 BI 工具不同,Sheets canvas 直接在原表上生成可读写界面,临时仪表盘能沿用表格的共享和权限体系,降低轻量场景的搭建成本。

  2. Google Developers Blog(RSS)60

    Google 开源 C++ 库 Credentio,用于本地验证 C2PA Content Credentials

    Google 发布开源 C++ 库 Credentio,用于处理 C2PA Content Credentials,初期支持规范 2.2 和 2.4 版本。该代码此前驱动近 40 个符合 C2PA 标准的 Google 产品,扩展至数百亿个生成的图像、视频、音频和文档资产。

    推荐理由:Google 开源了自家验证数十亿生成资产所用的 C2PA 库,本地验证带来零带宽开销和小内存占用,对做媒体溯源工具的开发者有直接参考价值。

8月13日周四
  1. SiliconFlow67

    阿里开源 Qwen3.8-2.4T-A95B,硅基流动已提供 Day-0 支持。该模型拥有 2.4T 参数、95B 激活参数,主打自主编码、深度研究与端到端智能体执行。API 定价为输入 $2.00/百万 token,输出 $6.00/百万 token,缓存输入 $0.25/百万 token。

    推荐理由:缓存输入每百万 token 0.25 美元,让需要反复读取长上下文的 agent 工作流更接近可长期运行,而非只看单次生成价格。

  2. 公众号:数字生命卡兹克65

    WorkBuddy上线远程控制,国内也有了最丝滑的Agent工作方式

    WorkBuddy更新上线远程控制功能,将PC、App和小程序打通,手机端可实时同步电脑端的任务、对话、工作空间和产物,支持一台手机连接多台电脑并随时切换。App需升级至1.2.0及以上,电脑端需升级至5.3.8及以上,连接无需扫码。本次更新还新增资料库(我的文档与团队空间)、Markdown多人共同编辑、AI原生审阅模式,以及将资料库内容生成可发布链接的HTML网站。

    推荐理由:远程控制把 Agent 任务从电脑旁解放到手机上,连接和多设备切换比 Codex 更省事,对国内依赖 Agent 处理长任务的用户直接降低了使用门槛。

  3. Claude:Blog(网页)65

    Claude in Chrome 侧边栏升级为 Claude Cowork 会话

    Claude in Chrome 浏览器扩展的侧边栏现已升级为 Claude Cowork 会话,对话会保存至历史记录,技能和连接器可在浏览器中工作,且任务可在桌面、网页和移动端应用间无缝切换。

    推荐理由:把浏览器扩展升级为与桌面、网页、移动共享的 Cowork 会话,解决以往侧边栏与主应用上下文割裂的问题,长流程任务可以在不同设备间接力。

8月12日周三
  1. OpenRouter:Announcements(RSS)67

    OpenRouter 推出实时网页搜索基准测试:如何为智能体选择引擎、深度与模型

    OpenRouter 发布实时排行榜,系统评测模型、搜索引擎、搜索方法与预算四类配置组合。数据显示,将搜索预算从 1 轮增至 25 轮可使 BrowseComp 得分近乎翻倍,成本仅增 2.5-7 倍;模型选择比引擎更重要,平均分差 15 分 vs 10 分。失败率高的任务应降低搜索深度以控制成本。

    推荐理由:这份基准把搜索预算的作用量化到分数与成本上,显示从单轮增加到 25 轮搜索,质量提升幅度超过更换模型或引擎,为 agent 搜索配置提供了更直接的取舍依据。

  2. OpenRouter72

    Meta AI 超级智能实验室的首个开放权重模型 Muse Glimmer 已在 OpenRouter 上线! 这是一款 30B 密集文本+图像模型,采用 Apache 2.0 许可证,旨在成为可靠的本地智能体,MCP Atlas 得分 75.5,SWE-Bench Pro 得分 51.2。 https://openrouter.ai/meta/muse-glimmer-30b

    推荐理由:Apache 2.0许可和两项代理基准得分,为评估30B规模本地开源模型是否达到生产可用提供了直接参照,分数分别指向工具调用和编码能力。

  3. Hacker News 热门(buzzing.cc 中文翻译)73

    Mojo 1.0 正式发布:为生态系统增长提供稳定基础

    Mojo 语言正式发布 1.0 版本,提供稳定、可用于生产环境的语言基础,自 2023 年首次发布以来已发展成通用语言。自开源标准库以来,近 200 名贡献者合入超 1,100 个拉取请求,改动超 200,000 行代码。

    推荐理由:稳定性承诺让 Mojo 成为 AI 基础设施可长期选用的语言基础,lambda 语法和内存安全诊断减少了日常开发阻力,对 MAX 生态项目直接降低维护成本。

  4. Google Cloud:Databases(RSS)72

    Gemini 助力 Database Migration Service 加速 PostgreSQL 迁移

    Google Cloud 在 Database Migration Service(DMS)中推出由 Gemini 驱动的 AI 辅助代码转换,可将 Oracle 或 SQL Server 的存储过程、触发器和自定义函数转换为 PostgreSQL PL/pgSQL 代码。

    推荐理由:将AI编解能力直接嵌入数据库迁移流程,不同于通用聊天工具,它能感知全量Schema上下文,并保留审查与校验环节,更适合企业级迁移场景。

8月11日周二
  1. Unsloth AI68

    Unsloth 发布开源桌面应用 Unsloth Desktop,支持在 Mac、Windows 和 Linux 本地运行和训练模型,已在官网和 GitHub 提供。支持 MLX、扩散图像/视频、音频、GGUF,可连接 Claude Code 和 Codex 到本地 LLM,宣称训练速度提升 2 倍、VRAM 降低 70%,并提供 RAG、MCP、OpenAI 兼容 API 和远程部署等能力。

    推荐理由:官方公布产品的主要能力清单和下载入口,读者可据此评估本地运行与训练模型的实际选项。

  2. 公众号:智谱(GLM)71

    ZCode全面升级:Goal、Subagents、Remote Control与闲时任务四大功能上线

    ZCode针对GLM深度优化,今日上线Goal、Subagents、Remote Control与闲时任务四大功能。在Z.ai Code Bench测试中,GLM-5.2搭配ZCode较搭配Claude Code任务整体通过率高2.39%;ZCode缓存命中率超98%,叠加1.5倍限时额度加成后,GLM Coding Plan整体使用量接近常规额度的1.8倍。

    推荐理由:Goal模式将复杂任务从需要开发者逐轮推动变为设定目标后自行迭代,搭配Subagents并行协作,适合跨文件重构和全栈开发的长流程任务。

8月10日周一
  1. OpenRouter:Announcements(RSS)77

    OpenRouter 推出由市场智慧驱动的新版 Auto 路由器

    OpenRouter 基于每周超 55T token 的社区消费数据,推出新版 Auto 路由器(openrouter/auto),其模型选择在多数任务和成本档位上优于旧版。新路由器按约 30 种任务类型匹配近 7 天社区实际消费的模型,支持 cost_tier 参数(low 至 max)并遵循账户隐私设置。在 MMLU Pro 等基准上,新默认档位在多数领域以更低成本达到旧版同等性能。

    推荐理由:基于平台每周55T token的社区支出分布,新路由将模型选择众包化,基准显示默认档成本下降超60%且多数任务性能不减,适合调用量大的应用。

  2. Qwen71

    👀 看见只是开始。 借助 Qwen-MM-Plugins,让你的智能体原生支持多模态——读取图片、视频和文档,编辑视频,处理 3D/CAD,以及更多。 从多模态模型 → 多模态智能体。🚀 观看实际效果:https://github.com/QwenLM/Qwen-MM-Plugins

    推荐理由:让智能体直接获得视觉、文档和 3D 感知能力,把原本需要单独集成的工作流变成一组可调用的插件,原型开发速度可能因此加快。

  3. 公众号:千问APP(阿里)73

    千问开放平台上线:租房、寄快递、查理财等十余领域服务可对话办理

    千问开放平台今日上线,面向生态伙伴和开发者开放手机、PC和AI眼镜三类终端的服务接入,首批覆盖物流运输、房产居住、本地生活、理财、汽车等十多个领域。用户可在对话中@相关服务或点击“圆点角标”进入智能体,完成从咨询、推荐到下单的完整流程。平台支持标准化协议接入、一键授权与端到端调测,并提供账号、AI支付、订单接入等基础设施。

    推荐理由:把快递查询、租房比价、天气建议等高频生活服务接入对话窗口,用户从「问信息」到「下单」不再跳出应用,减少了多任务切换和重复输入的摩擦。

  4. Hacker News 热门(buzzing.cc 中文翻译)70

    OpenChamber:一个基于代理的开发环境

    OpenChamber 是一个基于代理的开发环境,可跨桌面、浏览器、手机和 VS Code 使用,支持会话目标、多模型并行运行与融合、变更走查、从 issue 到 PR 的完整流程及定时任务。该工具基于 OpenCode SDK,完全开源且免费,代码和会话内容均保存在本地,远程访问可通过 UI 密码和端到端加密的 Private Relay 保护。

    推荐理由:将多模型并行、日程化任务和跨设备工作区整合到同一界面,减少了切工具的时间,适合需要在多个 AI 代理间协调的开发者。

  5. 公众号:数字生命卡兹克61

    我花了54个小时,做了一个可能更公平的AI大模型排行榜。

    作者耗时54小时开发并免费开放了一个聚合多家可信榜单的AI大模型综合排行榜LatentRank。该榜单采用Bradley-Terry成对比较算法,并加入先验限制小样本结果,以解决不同榜单规模、领先幅度和模型缺失带来的评分偏差。目前榜单前五名中,Opus 5超过Fable 5位居前列。

    推荐理由:聚合榜单的难点在于不同榜的排名含金量不可比,作者用 Bradley-Terry 模型将问题转为成对比较,为评估模型综合能力提供了比简单平均更合理的框架。