跳到正文
北京时间

全部动态

今日 84 条
3月19日周四
  1. Cognition 模型 / Devin 博客(网页)67

    Cognition 推出 managed Devins:Devin 可拆解任务并并行调度多个子 Devin

    Cognition 宣布 Devin 可将大型任务拆解并委派给多个并行运行的 managed Devins。每个子 Devin 在独立虚拟机中运行,拥有自己的终端、浏览器、开发环境和会话链接,主 Devin 负责拆分任务、分配工作、监控进度并汇总结果,还能读取子会话轨迹以改进后续任务拆解。用户可监控 ACU 消耗、发送中途指令、暂停或终止子会话。功能现已对所有用户开放。

    推荐理由:原文给出了多智能体协作的能力细节和适用场景,读者可以据此判断它是否适合拆解自己的大型编码任务。

  2. LlamaIndex:产品、工程与评测69

    LlamaIndex 开源 LiteParse:面向 AI Agent 的本地文档解析工具

    LlamaIndex 开源 LiteParse,一个完全本地运行的 CLI 和 TS 原生库,可从 PDF、Office 文档和图片中提取布局感知文本,无需 Python 依赖,内置 Tesseract.js OCR 并支持外接 PaddleOCR、EasyOCR 等 OCR 服务。

    推荐理由:开源工具主打本地快速解析加截图兜底的 Agent 模式,并自建评测对比 PyPDF 等基线,读者可评估是否迁移现有解析流程。

3月18日周三
  1. X:Sky Computing Lab (@haoailab)65

    FastVideo推出Dreamverse原型,实现“氛围导演”式实时视频生成

    FastVideo团队发布Dreamverse原型界面,引入创新的“氛围导演”工作流。该模式允许用户通过自然语言实时、迭代地引导视频生成,如更换背景或调整运镜,无需编写复杂的长提示词。其核心是全新的实时推理栈,能在单GPU上以约4.55秒生成5秒1080p视频,速度快于观看时间,从而将生成过程从被动等待转变为实时导演体验。团队认为,视频生成的未来在于让创作速度跟上想象速度,快速的反馈循环比单纯追求模型性能更能催生优质作品。

    推荐理由:视频生成从「等一分钟看结果」变成「边看边改」,这个交互范式转变比模型本身更值得关注。做内容创作工具的产品人,这个 demo 值得花五分钟体验一下实时迭代的手感。

3月13日周五
  1. Claude Platform:开发者版本说明(RSS)69

    Claude Opus 4.6 和 Sonnet 4.6 的 1M token 上下文窗口正式可用

    Claude Opus 4.6 和 Sonnet 4.6 的 1M token 上下文窗口现已正式可用,按标准定价计费,超过 200k token 的请求无需 beta header 即可自动生效。同时,所有支持模型的专用 1M 速率限制已移除,改用标准账户限制;使用 1M 上下文窗口时,每请求的媒体上限从 100 提升至 600 张图片或 PDF 页面。

    推荐理由:Claude 的百万 token 上下文终于从 beta 转正,200k token 以上请求不再需要 beta 头,媒体文件限制一口气提到 600 页,做长文档处理的开发者可以直接切生产。

2月24日周二
  1. Cognition 模型 / Devin 博客(网页)64

    Cognition 发布 Devin 2.2,支持桌面端测试与自动修复

    Cognition 发布 Devin 2.2,智能体现在可用 computer use 在自己的 Linux 桌面上端到端测试网页和桌面应用,并在开 PR 前自查代码、自动修复问题,完成后回传屏幕录制供用户审阅。

    推荐理由:官方公告给出自主测试、自动修复和启动提速等具体能力变化,读者可以据此评估对现有开发流程的影响。

2月19日周四
  1. Claude Platform:开发者版本说明(RSS)60

    Claude API 推出自动缓存功能,并退役 Sonnet 3.7 与 Haiku 3.5 模型

    Claude Messages API 新增自动缓存功能,只需在请求体中添加 `cache_control` 字段,系统即可自动缓存最后一个可缓存块,无需手动管理断点,并可与现有块级缓存配合使用。

    推荐理由:自动缓存把提示缓存从手工档变成自动档,对 Messages API 高频场景的开发者是个实在的省心更新,模型退役通知则是硬切换信号,用旧模型的该迁移了。

2月11日周三
  1. 蚂蚁 inclusionAI:GitHub 新仓库61

    inclusionAI 发布高性能量化推理 GEMM 内核库 Humming

    inclusionAI 开源了 Humming,这是一个专为量化推理设计的高性能、轻量级即时编译 GEMM 内核库。它支持在 FP16、BF16、FP8 等多种激活数据类型下进行 8 比特以下任意权重类型的推理,兼容多种量化策略与缩放类型,并同时支持稠密 GEMM 和混合专家 GEMM 运算。该库兼容 SM75+ 及以上的所有 NVIDIA GPU,在多种计算场景下能提供业界领先的吞吐量和效率。其依赖极简,仅需 PyTorch 和 NVCC,软件包大小仅约 100 KB,便于超轻量化部署。

    推荐理由:蚂蚁 inclusionAI 开源了一个 100KB 级的量化 GEMM 库,支持从 INT1 到 FP8 全家桶,SM75+ 全覆盖,做推理部署的工程师值得花半小时跑一下 benchmark,看看能不能替换掉现有的 Marlin 方案。

  2. Modal 官方工程博客(RSS)71

    Modal 上线 Z.ai GLM-5 免费端点并提供自部署代码

    Z.ai 发布开源权重模型 GLM-5(MIT 许可,面向长程 Agent 和系统工程),Modal 与其合作上线免费体验端点,4 月底前可用,限单并发请求。FP8 精度下模型约 700 GB,需多 GPU 部署,Modal 用 8 张 B200 单节点配合 SGLang 运行,内部实测每用户 30-75 tokens/秒。

    推荐理由:Modal 官方给出 GLM-5 的部署细节、免费端点限制和前端接入配置,读者可直接照做在自己常用的 Agent 框架里试用。

2月10日周二
  1. Cognition 模型 / Devin 博客(网页)66

    Cognition 推出 Devin 自动修复 PR 审查评论功能

    Cognition 宣布 Devin 现在可自动修复 Devin Review 及其他审查机器人留下的 PR 评论,包括 linter、CI/CD、安全扫描和依赖管理机器人。用户可在 Settings > Customization > Autofix settings 中配置;该功能大幅增加了内部 token 消耗,但团队称 PR bug 明显减少,并缩小了人类只需处理需判断的工作。

    推荐理由:原文给出具体配置入口和适用范围,读者可以了解如何让 Devin 自动修复 PR 上的机器人评论。

  2. Prime Intellect(网页)65

    Prime Intellect 发布 Lab 全栈后训练平台,向所有人开放

    Prime Intellect 发布 Lab 平台,将 Environments Hub 与 Hosted Training、Hosted Evaluations 整合为覆盖大规模智能体 RL、推理与评估的后训练全栈平台,即日起向所有人开放。

    推荐理由:原文交代了平台构成、已开放状态和训练配置方式,读者可以判断它能否替代自建 GPU 集群做智能体后训练。

2月7日周六
  1. FireRedTeam:原创语音与多模态项目63

    FireRedTeam 开源 FireRed-OpenStoryline 对话式视频创作工具

    FireRedTeam 于 2026-02-10 正式开源 FireRed-OpenStoryline,将视频创作变为自然语言对话,支持素材搜索下载、脚本生成、BGM 与配音字体推荐,以及全流程剪辑。

    推荐理由:官方开源的对话式视频剪辑项目,覆盖素材检索、脚本生成到剪辑全流程,并可直接通过 Claude Code 等 Agent Skills 安装使用。

2月6日周五
  1. Suno:Blog(网页)57

    Suno Studio 1.2 新功能介绍

    Suno Studio 1.2 现已面向 Suno Premier 订阅用户发布。此次更新旨在为创作者提供更强大的创作与制作控制能力。主要新增功能包括:Remove FX,可移除音频片段中的效果;带量化功能的 Warp Markers,用于调整音频的时间与律动;Alternates 功能,允许在同一轨道内创建并预览声音的不同变体;以及新增对 6/8、7/8 等非 4/4 拍号的支持。这些功能让用户无需离开 Suno 平台,即可更精细地控制音乐创作过程。

    推荐理由:这是Suno为专业创作者铺的路,Warp Markers和Remove FX让AI生成音乐能真正进入后期流程,但113天前的更新,现在看更适合补课而非抢鲜。

2月2日周一
  1. OpenAI Developers(RSS)62

    OpenAI 发布 Codex 应用并演示核心工作流

    OpenAI 发布 Codex 应用,并提供了介绍性演示视频,展示该应用及其核心工作流。

    推荐理由:官方演示了 Codex 应用的核心工作流,想了解这款编码工具实际用法的读者可以从中看到直接的操作示例。

1月30日周五
  1. 蚂蚁 inclusionAI:GitHub 新仓库61

    高效离线推理框架 Flood:吞吐量显著领先,支持多模态与量化

    Flood 是一款面向离线应用的高效大语言模型推理框架。它采用流水线并行降低通信开销,并通过分段式KV缓存管理提升连续性。框架支持连续批处理、分块预填充、FP8/INT8量化及多模态模型推理。性能测试表明,其在多种模型和硬件上的吞吐量最高可达 vLLM 的 2.4 倍。其专用内核 SegmentAttention 在处理长序列时,解码速度较 FlashAttention 最高提升 3.16 倍。该项目于 2025 年 3 月开源并快速迭代,已支持前瞻解码等新特性。

    推荐理由:蚂蚁的 FLOOD 框架用流水线并行替代张量并行来压通信开销,实测吞吐比 vLLM 高 1.4 到 2.4 倍,做离线推理部署的团队值得花半小时跑一下 benchmark 看看自家场景能不能吃这个红利。

1月29日周四
  1. Claude Platform:开发者版本说明(RSS)67

    Claude API 结构化输出功能正式上线

    Claude API 结构化输出功能现已对 Claude Sonnet 4.5、Claude Opus 4.5 和 Claude Haiku 4.5 全面开放。GA 版本扩展了 schema 支持、改进了语法编译延迟,并简化了集成路径(无需 beta header)。该功能在 Amazon Bedrock 和 Microsoft Foundry 上仍为公开 beta。

    推荐理由:结构化输出终于 GA,去掉了 beta 的不确定性,对依赖 JSON 模式的生产应用是个好消息,但功能上不算重大突破,只是工程完善。

1月21日周三
  1. Cognition 模型 / Devin 博客(网页)66

    Cognition 发布 AI 代码审查工具 Devin Review

    Cognition 发布 Devin Review,一款针对 GitHub PR 的 AI 代码审查工具,称代码审查已成为 AI 编程时代的瓶颈。

    推荐理由:原文给出三项具体能力和免登录试用入口,读者可以直接对照现有 GitHub 审查流程判断是否值得替换。

12月18日周四
  1. OpenRouter:Announcements(RSS)57

    OpenRouter 推出 Response Healing:将 JSON 缺陷减少 80% 以上

    OpenRouter 推出 Response Healing 新功能,可在响应到达应用前自动修复大语言模型产生的格式错误的 JSON,从而将 JSON 缺陷减少 80% 以上。

    推荐理由:如果你无数次被 LLM 返回的残缺 JSON 搞到崩溃,OpenRouter 这个 response healing 能自动修复 80% 的缺陷,以后 debug 可以少肝半小时。

  2. OpenRouter:Announcements(RSS)61

    Response Healing:将 JSON 缺陷减少 80% 以上

    OpenRouter 推出新功能 Response Healing,可在 LLM 生成的畸形 JSON 响应抵达用户应用前自动修复。该功能旨在将 JSON 格式错误减少超过 80%,直接提升 API 响应的结构完整性与可靠性,减少下游应用的处理负担。

    推荐理由:做 Agent 的人最怕 JSON 解析炸掉整个 pipeline,OpenRouter 这个 Response Healing 相当于在网关层加了自动纠错,接入成本几乎为零,值得试试。

12月3日周三
  1. 蚂蚁 inclusionAI:GitHub 新仓库63

    蚂蚁集团开源AState:面向强化学习的高性能状态管理系统

    蚂蚁集团开源了AState,这是一个专为强化学习设计的高性能通用状态数据管理系统。它旨在解决RL训练与推理中的I/O效率低下、权重同步性能不足及状态恢复不鲁棒等核心挑战。系统采用三层架构:提供张量原生接口的API层、支持多种部署模式的服务层以及具备高效可扩展传输能力的基础层。其关键特性包括统一的张量级API、高性能权重同步和拓扑感知设计。在万亿参数规模下,AState能在约6秒内完成权重同步,远低于业界常见的分钟级延迟,目前已作为ASystem的关键组件在蚂蚁内部生产环境部署。

    推荐理由:蚂蚁把万亿参数 RL 训练的权重同步从分钟级压到 6 秒,这套 AState 系统是真刀真枪的工程解法,做大规模 RL infra 的团队值得拆一拆它的 RDMA P2P 架构。

11月25日周二
  1. Together AI 研究与产品博客(RSS)64

    Together AI 上线 Black Forest Labs 的 FLUX.2 多参考图生图模型

    Together AI 将 Black Forest Labs 的 FLUX.2 图像模型接入 Model Library,面向 100 万以上开发者提供多参考输入、hex 色号颜色匹配和文本渲染能力。

    推荐理由:原文列出了多参考输入、hex 色号匹配和三个型号的具体参数,读者可据此判断是否接入现有生成工作流。

11月24日周一
  1. Anthropic:Engineering(事故复盘 + 工程实践 · 网页)77

    Claude开发者平台推出高级工具使用功能,提升AI代理效率

    Anthropic在Claude开发者平台发布三项新功能,以解决传统工具调用消耗大量上下文、易出错的问题。工具搜索工具允许按需加载工具,内部测试中将上下文消耗从约7.7万令牌降至8700令牌,降幅达85%,并将准确率从49%提升至74%。程序化工具调用支持在代码环境中调用工具,减少对上下文窗口的影响,例如Claude for Excel可借此处理数千行数据。工具使用示例则提供了展示工具有效使用方法的通用标准。这些功能共同提升了AI代理处理大规模工具库的能力。

    推荐理由:做 Agent 的人都卡在工具一多上下文就爆、调用就错这两个坑上,Anthropic 这三个功能直接把工具管理从「全塞进去」变成「按需加载+代码编排+示例纠错」,是目前最工程化的解法。

11月14日周五
  1. Claude Platform:开发者版本说明(RSS)63

    Claude Platform 推出结构化输出公测,支持 Claude Sonnet 4.5 和 Opus 4.1

    Claude Platform 上线结构化输出公测,可为 Claude 的响应提供有保证的 schema 一致性。开发者可通过 JSON 输出获取结构化数据,或使用严格工具调用进行验证。该功能适用于 Claude Sonnet 4.5 和 Claude Opus 4.1,需在请求中设置 beta 头 `structured-outputs-2025-11-13`。

    推荐理由:Claude 终于支持结构化输出,这是 API 开发者久盼的功能,能让 JSON 输出更稳定可控,虽然还只在两款模型上 beta,但信号明确。

11月4日周二
  1. Cognition 模型 / Devin 博客(网页)63

    Cognition 发布 Windsurf Codemaps:AI 生成的代码结构地图

    Cognition 发布 Windsurf Codemaps,由 SWE-1.5 和 Claude Sonnet 4.5 驱动,生成 AI 标注的代码结构地图,帮助工程师在调试、重构和上手新代码库前理解代码。

    推荐理由:官方介绍了 Codemaps 的入口、模型选择和 Cascade 引用方式,读者可以据此判断它如何用于代码库理解和上下文工程。

10月21日周二
  1. Together AI 研究与产品博客(RSS)66

    Together AI 上线 40 多个图像与视频生成模型,新增视频生成 API

    Together AI 宣布扩展模型库,通过 Runware 合作集成 20 多个视频模型(含 OpenAI Sora 2、Google Veo 3、Minimax Hailuo、Kling v2.1)和 15 个以上图像模型(含 Google Imagen 4.0 Ultra、Nano Banana、Qwen Image),共 40 多个。

    推荐理由:Together AI 官方给出了 40 多个图像与视频模型的名称、时长和逐模型定价,开发者可据此评估能否用一个平台替代多家供应商。

  2. OpenRouter:Announcements(RSS)68

    Provider Variance: Introducing Exacto

    同一AI模型在不同服务提供商上的性能表现可能存在显著差异。为了量化这种“提供商方差”,研究团队推出了Exacto评估平台。该平台通过标准化测试揭示,即使是相同的模型(如GPT-4、Claude或LLaMA),在不同云服务或API提供商处运行时,其输出质量、响应速度和稳定性都可能产生高达30%的波动。这一发现对企业和开发者的模型部署策略具有直接影响,强调在选择服务商时需进行针对性性能基准测试。

    推荐理由:OpenRouter 推出 Exacto,直接回答了开发者最头疼的问题:同一个模型换家供应商跑出来的结果到底差多少。做 Agent 或多模型路由的产品人,这个工具能帮你少踩很多坑。

10月20日周一
  1. LangChain:Blog(RSS)64

    LangChain 三年回顾:从开源到 12.5 亿美元公司,发布 LangChain 1.0 与 LangSmith 扩展

    LangChain 创始人 Harrison Chase 回顾项目三年历程,公司估值达 12.5 亿美元,并宣布 LangChain 1.0 发布、LangSmith 扩展及 1.25 亿美元融资。

    推荐理由:三周年反思同时宣布 1.0 和 1.25 亿美元融资,LangChain 从实验框架转向企业级基础设施,影响开发者在兼容性与长期维护上的判断。

  2. Anthropic:Engineering(事故复盘 + 工程实践 · 网页)73

    超越权限提示:让Claude Code更安全、更自主

    Claude Code引入沙盒化技术,通过文件系统与网络双重隔离来增强安全性,并大幅减少权限提示。内部测试显示,该技术将权限提示安全地降低了84%。新推出的沙盒运行时(作为开源研究预览版)允许开发者自定义目录和网络访问权限,使Claude能在限定范围内自主运行命令。同时,网页版Claude Code在云端隔离沙盒中运行,即使遭遇提示注入或代码入侵,也能有效保护Git密钥等敏感凭证不被泄露,从而提升开发安全性与效率。

    推荐理由:Claude Code 的沙箱方案把安全和自主性这对矛盾解开了,权限提示减少 84% 不是数字游戏,是真把 agent 从「每步都要你点确认」变成「在笼子里自己跑」,做 coding agent 的团队该认真看看这套 OS 级隔离思路。

10月17日周五
  1. OpenAI Developers(RSS)68

    OpenAI 展示 Codex 在代码编辑器中的使用方式

    OpenAI 发布视频,演示如何将 Codex 与主流代码编辑器搭配使用,简化编辑器内的开发工作流。内容涉及 Codex 与 IDE 扩展(codex, IDE extension),视频链接为 https://www.youtube.com/watch?v=sd21Igx4HtA。

    推荐理由:OpenAI 官方演示视频,展示如何把 Codex 接入主流代码编辑器并简化编辑器内工作流。

10月16日周四
  1. Claude Platform:开发者版本说明(RSS)67

    Claude Platform 发布 Agent Skills 功能,支持 PowerPoint/Excel/Word/PDF 文件处理

    Anthropic 在 Claude Platform 推出 Agent Skills(技能)测试版,通过动态加载指令、脚本和资源来扩展 Claude 的能力。首批提供 PowerPoint、Excel、Word 和 PDF 文件的预置技能,用户也可通过 Skills API 上传自定义技能封装领域知识和组织工作流。该功能需启用代码执行工具。

    推荐理由:Anthropic给Claude加上Agent Skills,直接把领域知识打包成可复用技能,构建复杂Agent的门槛降了一个数量级,做自动化的团队该关注了。

  2. Anthropic:Engineering(事故复盘 + 工程实践 · 网页)73

    为智能体配备现实世界技能:Agent Skills 开放标准

    Anthropic 推出了“Agent Skills”开放标准,旨在为通用智能体(如Claude)提供可组合、可扩展且可移植的领域专业知识。一个Skill是一个包含指令、脚本和资源的文件夹,其核心SKILL.md文件采用渐进式披露设计,智能体可根据任务动态加载所需信息,从而最小化上下文占用。例如,PDF技能赋予了Claude直接操作PDF表单的新能力。该框架允许用户通过封装和共享程序性知识来定制智能体,无需为每个用例构建碎片化的定制代理。

    推荐理由:Agent Skills 把「给 Agent 喂知识」从手写 prompt 变成了可复用的文件夹协议,做 Claude Code 或 Agent 产品的人现在就该动手试,这比 MCP 更轻量也更贴近日常开发。

10月1日周三
  1. Answer.AI 官方研发博客(RSS)65

    Answer.AI 开源 cachy,让 notebook 中 LLM 调用快 60 倍

    Answer.AI 发布开源 Python 包 cachy(pip install pycachy),通过补丁 httpx 的 send 方法,把 Anthropic 和 OpenAI SDK 的 LLM 调用响应自动缓存到本地并在相同请求时复用,无需编写 mock。

    推荐理由:原文给出了补丁原理和提速数据,读者可以直接复用这个零代码缓存方案加速自己的 LLM 测试和 notebook 工作流。

  2. OpenRouter:Announcements(RSS)58

    OpenRouter 推出每月100万免费BYOK请求

    OpenRouter 向每位客户每月提供100万次“Bring Your Own Key”(BYOK)请求,完全免费。

    推荐理由:这个公告虽然旧了,但 OpenRouter 的 BYOK 免费额度至今仍在,对想低成本折腾模型的个人开发者来说,每月 100 万次请求比很多付费计划都香。

  3. OpenRouter:Announcements(RSS)60

    每月 100 万次免费 BYOK 请求

    所有客户每月可免费获得 100 万次“自带密钥”(BYOK)请求。这一政策将 BYOK 功能从付费服务转变为免费提供的基础配额,大幅降低了企业使用自有密钥管理数据安全的技术与成本门槛。免费额度覆盖了绝大多数中小规模企业的典型月请求量。

    推荐理由:OpenRouter 给 BYOK 用户每月免 100 万次请求,对用自己 API key 跑 Agent 的开发者来说是实打实的成本减免,值得顺手薅。

9月29日周一
  1. 蚂蚁 inclusionAI:GitHub 新仓库58

    inclusionAI/dInfer

    inclusionAI团队发布了dInfer,一个专为扩散语言模型设计的高效推理框架。该框架旨在解决扩散模型在文本生成领域推理速度慢、资源消耗大的核心挑战。dInfer通过一系列底层优化技术,显著提升了推理效率,能够更快地生成文本,同时降低计算成本,为扩散模型在更广泛的实际应用场景中部署提供了关键技术支持。

    推荐理由:蚂蚁把扩散语言模型的推理框架开源了,这类模型的推理效率一直是落地瓶颈,做端侧或低成本部署的团队值得看看能不能接上。

  2. OpenAI Developers(RSS)65

    OpenAI 发布 Agentic Commerce Protocol 开放标准,连接商家与 ChatGPT 用户

    OpenAI 推出 Agentic Commerce Protocol(ACP),一个连接商家与 ChatGPT 用户的开放标准,作为两者之间的基础设施。它让 ChatGPT 能接收结构化商品目录数据、理解商家库存并在对话中呈现相关商品。文档提供了带示例 payload 的入门指引,以及关于商品文案、变体建模和归因的 feed 质量优化最佳实践。

    推荐理由:OpenAI 官方文档介绍了 ACP 的定位和接入路径,商家可据此了解如何让商品出现在 ChatGPT 中。

  3. Cognition 模型 / Devin 博客(网页)65

    Cognition 为 Claude Sonnet 4.5 重构 Devin:新版本快 2 倍、评测提升 12%

    Cognition 发布基于 Claude Sonnet 4.5 重构的新版 Devin,速度提升 2 倍,Junior Developer Evals 提升 12%,已在 Agent Preview 上线,旧版 Devin 仍可用。

    推荐理由:来自一线 Agent 团队的适配复盘,给出了 Sonnet 4.5 的具体新行为和对应的工程应对,可迁移到类似智能体架构。

9月9日周二
  1. FireRedTeam:原创语音与多模态项目64

    FireRedTeam 开源 FireRedChat 全自托管全双工语音交互方案

    FireRedTeam 发布 FireRedChat,一个完全自托管的实时语音 AI 智能体全双工交互解决方案。系统集成了 TTS、ASR、pVAD(个性化语音活动检测)和 EoT(结束轮次检测),不依赖外部 API、无数据泄露、部署完全可控。

    推荐理由:官方发布了可完全自托管的实时语音智能体方案,组件构成和部署路径都写清楚了,适合评估私有化语音交互搭建。

9月3日周三
  1. Linear:Now(RSS)61

    Linear 发布 Triage Intelligence:用搜索与 LLM 推理自动整理工单

    Linear 上月推出 Triage Intelligence,利用搜索、排序和 LLM 推理自动为新增工单标记重复项、关联问题并推荐标签与负责人。早期版本使用 GPT-4o mini 和 Gemini 2.0 Flash 等小模型,后转向 GPT-5 和 Gemini 2.5 Pro 等更大模型实现智能体式决策。

    推荐理由:Linear 的 Triage Intelligence 用 agentic 方案把 issue 自动分类和去重做得很实用,透明可解释的交互设计让 AI 建议不再像个黑箱,做工具类产品的值得看一看。

9月2日周二
  1. Claude Platform:开发者版本说明(RSS)64

    Claude Platform 发布 Code Execution Tool v2 公测版,支持 Bash 命令与文件操作

    Claude Platform 推出 Code Execution Tool v2 公测版,取代原先仅支持 Python 的工具,新增 Bash 命令执行和直接文件操作能力,包括用其他语言编写代码。

    推荐理由:Anthropic把代码执行工具从Python解放到了Bash和任意语言,这不再是玩具,而是能在沙箱里跑真实脚本的实用功能,做自动化的开发者可以直接拿来用了。

8月27日周三
  1. Claude Platform:开发者版本说明(RSS)61

    Claude Platform 发布 PHP SDK 测试版

    Claude Platform 于 8 月 27 日推出 PHP SDK 测试版。该 SDK 允许开发者通过 PHP 语言调用 Claude API,构建基于 Claude 的应用程序。

    推荐理由:Anthropic 给 PHP 开发者递了橄榄枝,beta 版 SDK 让 PHP 项目接入 Claude 更容易了,虽然量级不大但补上了生态缺口。