跳到正文
北京时间

产品更新

AI 产品与应用的功能上新、改版与商业化动态——谁家的产品变强了、变贵了、能用了。

985条精选相关主题模型发布行业动态AI 编码

最新精选

第 181–200 条 · 共 985 条
7月24日周五
  1. Runway:News(网页)69

    Runway 推出 Media Router,首个面向生成式媒体的偏好优化路由模型

    Runway 发布 Media Router,这是首个为生成式媒体模型设计的模型路由器,已集成至 Runway Dev 平台。该路由器可根据用户设定的成本、质量和延迟偏好,自动为每次视频、图像或音频生成请求选择最优模型,支持 Gen-4.5、Seedance、GPT Image 2 等第一方及第三方模型。用户只需配置一次偏好并调用单一端点,即可避免手动选型与持续更新代码的麻烦。

    推荐理由:Runway Dev 首次把智能路由引入生成媒体,开发者不用再手工选模型,跑量时成本与延迟优势明显,但这是平台内生态能力,对非 Runway 用户意义不大。

  2. Claude:Blog(网页)75

    Claude 语音模式现已支持 Opus、Sonnet 及连接工具与多语言

    即日起,Claude 语音模式在 Opus、Sonnet 和 Haiku 上运行,并支持连接 Gmail、Slack 等工具及更多语言。用户可在对话中切换模型,语音模式默认沿用上次文本聊天使用的模型。该功能面向所有用户开放 beta 测试,免费版可使用 Haiku 及一个连接工具,付费版可访问更多模型和全部连接工具。

    推荐理由:Claude 语音模式终于能调用最强模型了,深度思考不再受限于轻量版,加上工具集成和多语言,移动端从随口问答升级为实时脑力伙伴,值得立即上手。

  3. OpenAI79

    ChatGPT 语音功能现已登陆桌面应用。 只需使用语音,即可控制你的电脑,并指挥在 ChatGPT Work 或 Codex 中运行的多个智能体。 该功能由 GPT-Live 驱动,因此它能够同时在该应用中说话、聆听并协调工作。 今日起,面向 macOS 和 Windows 平台的 Plus、Pro、Business、Edu 及 Enterprise 计划用户全球推送。

    推荐理由:ChatGPT 的语音助手正式上岸桌面,关键是能同时指挥多个代理干活,一边写代码一边查资料,全程动嘴就行。对重度用户来说,这可能比任何新模型都更直接影响工作流。

  4. Greg Brockman69

    OpenAI 宣布向美国用户推出 ChatGPT 健康功能,支持安全连接 Apple Health 及受支持的医疗记录。每周有 3 亿用户使用 ChatGPT 进行健康咨询,新功能可让 ChatGPT 理解个人健康上下文,追踪变化并提供更个性化的帮助。

    引用OpenAI@OpenAI

    ChatGPT 中的健康功能开始向美国用户推出。 你可以安全地连接 Apple Health 和受支持的医疗记录,以在上下文中理解你的信息、追踪变化,并进行更有依据的对话。 https://openai.com/index/health-in-chatgpt/

    推荐理由:ChatGPT 正式接入医疗记录,300M 周活健康查询用户终于有了上下文,对产品人是高频场景的粘性升级,对行业则是平台化健康能力的信号。

7月23日周四
  1. Hacker News 热门(buzzing.cc 中文翻译)76

    GigaToken 发布:语言模型分词速度最高提升约 1000 倍,可无缝替代 HuggingFace Tokenizers

    GigaToken 是一款新的语言模型分词器,在 AMD EPYC 9565 双路 144 核 CPU 上对 GPT-2 分词速度达 24.53 GB/s,比 HuggingFace Tokenizers 快 989 倍、比 tiktoken 快 681 倍。

    推荐理由:GigaToken 把分词速度直接拉到 GB/s 级别,对处理大规模文本的团队是实打实的效率提升,数据集预处理不再是瓶颈。

  2. Cursor Blog70

    Cursor 发布智能模型路由系统 Cursor Router

    Cursor 推出 Cursor Router,可自动将每个编码请求分配给最合适的模型。在线 A/B 测试显示,Auto Intelligence 模式在用户满意度接近 Fable 的同时,成本降低约 60%;Auto Balance 模式满意度超过 Opus 4.8,成本降低约 36%。

    推荐理由:Cursor Router 把模型路由从个人选择变成团队策略,实测成本降低 30-50% 且满意度不降,对管理 AI 预算的工程 Leader 来说是个值得立刻试点的新功能。

  3. Anthropic:Newsroom(网页)70

    Claude 新增 Anthropic Economic Index 连接器,可直接查询 AI 对经济与职业的影响数据

    Anthropic 为 Claude 推出 Anthropic Economic Index 连接器,用户可在 claude.ai 中直接向 Claude 提问“哪些职业使用 AI 最多”等问题,答案基于 Index 的真实数据。该连接器无需安装,适用于任何 Claude 模型,并会引导用户查看原始数据及其局限性。完整数据集仍免费开放。

    推荐理由:Anthropic把自家经济指数直接接入了Claude对话,用自然语言就能挖出AI影响就业的真实数据,对关注职业变化的研究者和产品人来说是个顺手的小工具。

7月22日周三
  1. OpenRouter:Announcements(RSS)72

    OpenRouter 新增音频转写 API,支持 Whisper 与 token 计价 STT 模型

    OpenRouter 推出 POST /api/v1/audio/transcriptions 端点,用户可使用同一 API key 将 base64 编码音频发送至该端点,返回 JSON 格式文本与用量对象。

    推荐理由:OpenRouter 把语音转录集成进 API,一份 key 搞定聊天和转写,对已经在用的团队省心不少,这篇教程直接可跑。

  2. 公众号:数字生命卡兹克77

    腾讯设计Agent平台Miora全面开放

    腾讯设计Agent平台Miora今日全面开放,无需邀请码即可使用。该平台由WorkBuddy团队打造,提供品牌设计、影视创意等五大场景模式,支持自定义多模态模型和Agent推理深度,并内置Skill市场与记忆系统。

    推荐理由:腾讯用WorkBuddy的底子做了设计Agent,记忆系统和Skill市场让设计流程有了Agent的基因,设计师和产品人可以上手试试。

  3. OpenRouter72

    今日在 OpenRouter 上线:Gemini 3.6 Flash 和 Gemini 3.5 Flash-Lite! 两者均为其模型系列的重大更新,具备高吞吐量(150+ tok/s),适用于智能体场景,从高效 token 的编码与知识工作,到低延迟、高并发的子智能体。 详情如下 🧵

    推荐理由:Google Gemini Flash 系列更新到 3.6,150+ tok/s 的吞吐量对 agent 场景是实际提升,OpenRouter 第一时间上线,开发者可以直接调。

  4. Hacker News 热门(buzzing.cc 中文翻译)77

    OpenAI 在 ChatGPT 中正式推出广告服务

    OpenAI 在 ChatGPT 中推出原生广告服务,允许广告主在用户探索选项、比较选择和做出决策时投放相关广告。广告在体验中明确标注并与回答区分,首批广告主包括 Best Buy、Lowe's 和 VistaPrint。广告主可通过 Ads Manager 创建广告系列、设置预算并优化效果。

    推荐理由:ChatGPT正式开放广告投放,这是AI助手从订阅制转向广告收入的标志性一步,对于广告行业是震撼弹,用户体验却可能面临考验。早期测试数据虽乐观,但真正考验在于广告与回答的边界能否守住。

  5. xAI:News(网页)63

    xAI 推出 Grok for Outlook 加载项

    xAI 今日推出 Grok for Outlook,一个 Microsoft 365 加载项,可将 Grok 智能体嵌入邮箱,用于总结长邮件线程、以用户风格起草回复并整理收件箱。该工具即日起对所有付费 X 和 SuperGrok 用户开放,可从 Microsoft Marketplace 添加。

    推荐理由:xAI 这次把 Grok 直接嵌进了 Outlook,读附件加联网搜索能让邮件处理少跳转几次应用,虽然类似功能很多助手都有,但紧贴收件箱的体验值得 Outlook 重度用户一试。

  6. Claude71

    Claude Cowork 新功能:教 Claude 一项技能。 录制你执行任务时的屏幕操作,边做边讲解,Claude 会将其转化为可重复运行的技能。在 Claude 桌面应用的 + 菜单中找到“录制技能”即可使用。 适用于 Pro、Max 和 Team 套餐。

    推荐理由:Claude 现在能通过录屏学会你的操作流程,这是从「回答问题」到「执行任务」的关键步。如果你有重复性操作,把它教给 Claude 的成本几乎为零,Pro 用户值得立刻试试。

  7. Google Developers Blog(RSS)63

    Google 推出 Tunix:基于 JAX 的高吞吐智能体后训练库

    Google 发布 Tunix,一个基于 JAX 的原生后训练库,旨在消除多轮、使用工具的 LLM 推理智能体训练中的 TPU 闲置瓶颈。Tunix 通过高并发异步 rollout 与解耦的生产者-消费者流水线最大化硬件吞吐量,确保训练器持续获得数据。该库提供即插即用抽象和持续宏观级性能分析,便于集成自定义环境。

    推荐理由:Google 这个训练库直接解决 agent 训练中 TPU 空转的隐性成本,对做后训练的团队可能是基础设施级改进,值得跟进。

  8. Prime Intellect(网页)64

    Prime Intellect 整合 23 个任务集,提供超 365,000 个智能体 RL 环境

    Prime Intellect 发布 research-environments,通过 verifiers v1 的 taskset API 将 SWE、终端和搜索三类共 23 个任务集统一到一套运行时和沙箱钩子下,总计约 365,000 个任务,包括约 198,000 个软件工程任务、约 28,600 个终端任务和约 137,600 个搜索任务。

    推荐理由:原文给出 23 个任务集统一为一套 API 的整合方法,以及 gold patch 验证和 reward hack 防护的具体做法,可复用于 RL 环境搭建。

  9. Google Cloud:Databases(RSS)71

    AlloyDB 推出列式引擎加速 HNSW,pgvector 向量搜索 QPS 提升最高 4.9 倍

    Google Cloud 的 AlloyDB 在预览版中推出列式引擎加速的 HNSW 索引,使 pgvector 向量搜索的每秒查询数(QPS)相比标准 PostgreSQL HNSW 提升最高 4.9 倍,在固定 QPS 下召回率可提升 0.163。该加速通过将索引固定在列式引擎内存中、使用向量化内存布局并绕过标准 PostgreSQL 缓冲管理器开销实现,无需修改应用即可获得性能提升。

    推荐理由:AlloyDB 把 pgvector 的 HNSW 搜索提速 4 倍,不是靠 GPU 而是靠内存架构,对已经在 PostgreSQL 上跑 RAG 的团队可能是个省钱又提精度的实用升级,点开看看基准测试。

7月21日周二
  1. 公众号:腾讯混元64

    腾讯混元推出Hyra-1.0递归自我改进研究智能体

    腾讯混元推出Hyra-1.0,一个能递归自我改进的研究智能体,在NanoChat等三项任务上均超越Recursive公开结果。Hyra在55个数学开放问题中刷新29个历史最好结果,并设计出仅含15个可训练参数即可完成10位数加法的Transformer。所有产物已在GitHub开源。

    推荐理由:腾讯自己下场做递归自我改进的科研智能体,而且一口气在数学、量子、药物设计多个方向刷榜,这比发个单一模型更有想象空间。

  2. 公众号:腾讯混元70

    Hyra发布:一个简单有效的科学发现智能体

    腾讯混元推出 Hyra-1.0,一个能递归自我改进、专为性能导向研究与工程任务打造的智能体。其 Harness 采用双层循环架构,在 NanoChat、NanoGPT Speedrun、SOL-ExecBench 三项任务上均超过 Recursive 报告的结果,并在 55 个数学开放问题中的 29 个上刷新历史最好成绩。相关产物已在 Github Repo 开源。

    推荐理由:展示了同一套循环在AI研发、数学、量子计算和药物设计中的迁移能力,更关键的是通过双层循环将评估器与solution共进化,使模糊目标也能被纳入搜索。

  3. Modal 官方工程博客(RSS)61

    Modal 与 Cognition 推出 Devin Outposts,AI 工程师可在自有 Sandbox 中执行任务

    Cognition 推出 Devin Outposts,让 AI 软件工程师 Devin 的执行环境迁移到用户自控环境,推理仍留在 Cognition 云端;Modal 是启动合作伙伴,7 月 21 日起开放 alpha。

    推荐理由:官方发布方介绍了 Devin 执行环境迁入自有 Modal Sandbox 的方式,GPU 按需启动和会话快照是可对比的实际能力变化。