跳到正文
北京时间

MCP 与工具调用

模型连接外部世界的协议与实践:MCP 生态、function calling、工具链集成的动态。

252条精选相关主题Agent 智能体AI 编码开源生态

最新精选

第 141–160 条 · 共 252 条
5月29日周五
  1. IT之家(RSS)70

    阿里云开源百炼 CLI,Agent 可调用全套模型和应用能力

    阿里云宣布百炼核心能力已 CLI 化,仅需一行命令即可让 Agent 接入百炼的 150 多款模型、十多款应用及知识库、记忆、联网搜索等能力。该 CLI 专为 Agent 设计,原生支持 Claude Code、Qoder 等主流框架,已在 GitHub 开源,支持多模态模型调用、Workflow 调用与结构化输出。

    推荐理由:阿里云把百炼的全套能力打包成 CLI,Agent 开发终于不用再一个个接 API 了,做企业智能助手的可以试试。

  2. 公众号:阶跃星辰(Step)61

    阶跃发布 Step 3.7 Flash,面向生产级 Agent 的高效率 Flash 模型

    阶跃星辰发布并开源 Step 3.7 Flash,采用稀疏 MoE 架构(总参数 196B+1.8B,激活 11B),最高生成速度 400 Tokens/s。围绕原生多模态理解与执行、联网与视觉搜索增强、高可靠工具调用与编排、Agent 生态兼容优化四大能力优化。在 Toolathlon 达 49.5%,ClawEval-1.1 达 67.1%,GDPval 达 45.8%,τ²-bench Telecom 通过率超 98%。兼容 Claude Code、KiloCode 等主流架构及 MCP/Skills 协议,支持云端与本地部署,已在 Kilo Code 等生态中完成接入验证。

    推荐理由:Step 3.7 Flash 用激活仅 11B 的 MoE 架构把 Agent 工作流稳定性做透了,兼容主流框架还开源,对需要低延迟、高可靠性的生产环境 Agent 是真正可用的选择。

  3. Claude Platform:开发者版本说明(RSS)63

    Claude Platform on AWS 新增 Managed Agents webhooks、多智能体编排与自托管沙箱

    Claude Platform on AWS 现已支持 Managed Agents webhooks、多智能体编排和自托管沙箱。新增了 IAM 操作及 `AnthropicSelfHostedEnvironmentAccess` 托管策略,用于在 AWS 上管理 Claude 智能体的触发、协作与安全执行环境。

    推荐理由:这次更新让 Claude 托管代理直接跑在 AWS 上,对已经在用 Claude Platform 的企业算是好消息,webhooks 和多代理编排能简化不少工作流,但并不会改变行业格局。

  4. Google Developers Blog(RSS)73

    使用 Google Pay & Wallet Developer MCP server 加速你的集成工作流

    Google 推出 Google Pay & Wallet Developer MCP server,这是一款开放标准工具,旨在将 AI 开发助手和 IDE 安全连接到实时的 API 与账户上下文。开发者无需离开开发环境,即可搜索官方文档、验证 Wallet pass 定义、检查集成状态以及管理商户账户。该集成旨在通过减少上下文切换并提供实时、可靠的 AI 支持来减少开发摩擦,从而加速开发工作流。

    推荐理由:这是 Google 为支付场景做的 MCP 服务器,把文档和账户操作直接塞进 IDE,减少上下文切换,做 Google Pay 集成的开发者可以试试看。

  5. Claude Code:GitHub Releases(RSS)73

    Claude Code v2.1.154 发布:新增 Opus 4.8 与动态工作流

    Claude Code 更新至 v2.1.154 版本,正式引入 Opus 4.8 模型。新功能包括“动态工作流”,可通过 `/workflows` 指令让 Claude 在后台编排数十到数百个 AI 智能体协同处理复杂任务。Opus 4.8 的快速模式现已可用,成本降低为 2 倍标准费率可实现 2.5 倍速度提升。其他更新有:精简系统提示词成为默认设置(除 Haiku、Sonnet 及 Opus 4.7 及更早版本外),优化多选题决策逻辑,简化 `/simplify` 命令。此次更新修复了包括后台会话管理、终端渲染在内的多个 bug,并增强了自动模式对数据外泄的检测能力。

    推荐理由:Claude Code 这版把多 agent 编排做成了产品功能,动态工作流让一个 prompt 能调度上百个 agent,再加上 Opus 4.8 快速模式只要 2 倍价格,做复杂任务的开发者可以试一下。

  6. Tomer Tunguz 博客(VC 分析)61

    AI智能体时代下的安全变革

    Lemonade的CISO Jonathan Jaffe探讨了AI智能体时代的安全新挑战。他指出,AI对攻击者和防御者同样强大,但可被利用的漏洞窗口正在缩小,因为AI能更快地生成、审查和修补代码。为此,安全团队正向工程团队转型,例如Lemonade的安全部门均由工程师组成,并构建了包含智能体的内部AI平台。同时,每个智能体(单个终端上可能运行200到10000个)都需要被赋予身份,并在操作点由策略进行更复杂的管控,这超越了当前身份与访问管理系统的能力。

    推荐理由:Jaffe 给出的结论很提气,AI 对防御方的加成被市场严重低估了,尤其每个 Agent 必须拥有身份和策略控制这个预判,值得所有在做 Agent 架构的人看一遍。

5月28日周四
  1. Mistral AI:News(网页)63

    Mistral 发布开源 Search Toolkit 公开预览版,统一搜索管道的摄入、检索与评估

    Mistral AI 于 5 月 28 日发布 Search Toolkit 公开预览版,一个用于构建 AI 应用生产级搜索管道的开源组合式框架,把摄入、检索和评估纳入统一接口,可部署在云端、本地或边缘。

    推荐理由:原文完整列出框架的摄入、检索、评估三大模块与内置指标和企业案例,读者可据此判断能否替代自建检索管道。

  2. Claude Code:GitHub Releases(RSS)67

    Claude Code v2.1.153 版本更新

    Claude Code 发布 v2.1.153 版本。主要新增 `skipLfs` 选项以跳过 Git LFS 下载;优化了 `claude agents` 的自动补全建议和 PR 列显示格式。本次更新修复了大量问题,包括:MCP 服务器的连接与重连、子代理的配置策略与严格模式行为、后台会话的管理与权限提示(如恢复、输入响应、临时文件处理),以及跨 macOS/Windows/VSCode 平台的稳定性。此外,还修复了 Windows 更新回滚、内存占用、会话恢复等多个具体问题。`/model` 命令现在会将选择设为新会话的默认模型。

    推荐理由:Claude Code 的一次日常小修小补,但修复了 OAuth 凭证泄露和内存泄漏这种真影响使用的 bug,且 /model 现在可以记住默认模型了,升级一下不亏。

  3. Greg Brockman71

    自带MCP服务器: 你的团队可以将MCP服务器保留在内部网络中,同时ChatGPT、Codex和Responses API通过仅出站的HTTPS进行连接。 🔗 https://developers.openai.com/api/docs/guides/secure-mcp-tunnels

    引用OpenAI Developers@OpenAIDevs

    私有 MCP 服务器 🤝 OpenAI 产品 你的团队可以将 MCP 服务器保留在网络内部,同时 ChatGPT、Codex 和 Responses API 通过仅出站 HTTPS 进行连接。 🔗 https://developers.openai.com/api/docs/guides/secure-mcp-tunnels

    推荐理由:OpenAI终于把MCP接进自家产品了,而且是企业最关心的私有化部署,这步棋走得精,既补了工具调用生态又没动安全底线,做B端产品的可以认真看看链接。

  4. Tomer Tunguz 博客(VC 分析)61

    软件之后是AI时代

    软件时代正过渡至“智能体框架”时代。AI作为强大但需驯化的“野马”,其智能驯化包含七个核心组成部分:上下文与记忆、工具与行动、编排与循环、状态与持久性、沙箱与计算、可观测性与治理、成本与工作流优化。这些组件共同构成了一个生产级的智能体系统。这一转变将重塑软件竞争格局,模型通用化的未来中,最佳的智能体驾驭者将获胜。

    推荐理由:Tomer 把 agent 时代的竞争拆成七个组件,不是空谈,而是给了创业公司一个具体的 check-list,做 agent 产品的值得对照一下。

  5. Google Developers Blog(RSS)66

    Google Pay 最新更新

    Google Pay 正向"智能体商务"演进,推出了通用商务协议和新的 MCP 服务器,允许 AI 智能体管理集成与分析趋势。Android 平台更新引入了动态回调以支持快速结账,并通过 WebView 将支付功能扩展至社交媒体应用。此外,平台还推出了跨设备生物认证和新的交易信号,旨在帮助商家减少流程摩擦。

    推荐理由:Google Pay 往 agentic commerce 迈了一大步,新的通用协议和 MCP server 让 AI agent 能直接管支付和分析,做 agent 或支付的开发者都得看看。

5月27日周三
  1. Runway:News(网页)73

    Runway 推出 Model Context Protocol 服务器

    Runway 正式推出 Runway MCP 服务器,允许任何兼容 MCP 的 AI 智能体(如 Claude、ChatGPT、Cursor)在对话界面中直接生成图像与视频,无需切换工作流。该服务器接入了 Runway 最新的多款 SOTA 模型,包括 Gen-4.5、Seedance 2.0、GPT Image 2、Kling 3.0 及 Nano Banana Pro。其应用场景涵盖为产品制作营销视频、批量生成网站视觉素材、创作角色广告以及在应用开发中集成视觉内容。用户设置简便,通过 runwayml.com/mcp 添加服务器并登录现有 Runway 账户即可使用,无需单独申请 API 密钥。

    推荐理由:Runway 把 Gen-4.5 和 Seedance 2.0 等模型接入了 MCP,以后做产品图、营销视频不用切窗口,这个集成对依赖视觉内容的 Agent 工作流是个 real upgrade。

  2. Claude:Blog(网页)75

    Code w/ Claude 伦敦活动:重塑开发体验

    在Code w/ Claude 伦敦活动上,Anthropic 宣布了 Claude Managed Agents 的两项新能力:自托管沙箱(公开测试版)和 MCP 隧道(研究预览)。这两项功能使 AI 智能体的工具执行环境与企业私有网络内的 MCP 服务器连接均可运行在客户自有基础设施或指定托管服务商处。活动还介绍了如何通过 Claude Code、优化思维预算以及模型努力级别来提升开发体验。目前,包括 Spotify、Base44 和 Legora 在内的客户已在使用这些新功能。

    推荐理由:Claude 平台企业部署的最后一公里被补上了,自托管沙箱和 MCP 隧道让 agent 真正能进生产环境,做 2B 的企业级应用终于有了安全底座。

5月26日周二
  1. IT之家(RSS)77

    “龙虾之父”Peter 开源 skill-cleaner,为 AI 智能体技能“做体检”

    “龙虾之父”Peter 开源了 skill-cleaner 工具,用于诊断和优化 AI 智能体的技能提示词。该工具包含5项核心功能,包括技能提示词预算审计、重复技能检测、未使用技能筛查、技能根目录审计和描述精简优化。其脚本采用标准 token 预算核算逻辑,旨在帮助减少冗长描述对 token 预算和上下文窗口的占用。已有用户实践显示,将技能描述从90多词精简至40词以内,能提升智能体选择技能的准确率。

    推荐理由:Peter 直接开源了一个给 Skill '减肥' 的工具,把描述精简、重复检测、预算审计全自动化了,装完跑一遍就能直观看到哪些 Skill 在烧你的 token。做 Agent 的可以立刻装上试试。

  2. Hugging Face:Blog(RSS)58

    Harness、Scaffold 与 AI 智能体术语辨析

    本文旨在厘清 AI 智能体领域中易混淆的关键术语。文章指出,模型(如 Claude、GPT)本身是无记忆、无循环的大语言模型。其行为由“Scaffolding”(行为定义层,如系统提示、工具描述)塑造,而“Harness”(执行层)负责调用模型、处理工具调用与控制循环,是智能体运行的核心。两者结合,模型才能成为智能体。文章以 Claude Code、Codex 为例,说明同一模型搭配不同 Harness 会产生迥异体验,并提出了 Agent = Model + Harness 的常见理解框架。术语尚未统一,本文旨在提供一个实用的心智模型。

    推荐理由:Agent圈术语混乱的文章很多,但HF这篇把harness、scaffold、context engineering的关系讲得最透,做agent开发的读完至少能少吵一半的架。

5月25日周一
5月24日周日
  1. Replit ⠕66

    Replit Agent与Squidler已完成集成,形成一套完整的AI驱动质量保障闭环。用户可通过自然语言描述应用功能,由Replit Agent负责构建。构建完成后,Squidler会像真实用户一样对线上应用进行自动化测试,无需编写任何测试脚本。测试中发现的问题会自动反馈给Replit Agent进行修复。该流程已通过Squidler加入Replit的MCP库正式上线,实现了从构建、测试到修复的全自动化,显著降低了应用测试与维护的门槛。

    引用Squidler@SquidlerIO

    官方今日消息:Squidler 已加入 @Replit MCP 库。用 #Replit 构建。用 Squidler 测试。Replit Agent 负责构建,Squidler 针对实时 URL 运行真实用户流程,结果回传给 agent。无需选择器,无需脚本。https://replit.com/partners/squidler

    推荐理由:Replit 把用户流测试塞进了 MCP 库,Squidler 不需要写测试脚本就能跑真实操作,然后 Agent 自动修 bug,这个 QA 闭环对不会写测试的独立开发者是个大加分。

5月23日周六
  1. Claude Code:GitHub Releases(RSS)64

    v2.1.149 更新摘要

    本次 v2.1.149 更新包含功能增强、企业设置和多项修复。新增 `/usage` 命令的使用量分类显示功能,可区分技能、子代理、插件及每个 MCP 服务器的消耗;`/diff` 详情视图支持键盘滚动;Markdown 输出兼容 GFM 任务列表。企业版新增 `allowAllClaudeAiMcps` 设置以加载云 MCP 连接器。修复了 PowerShell 权限绕过、Git 工作树沙盒写入白名单越界、脚本路径含空格时 `otelHeadersHelper` 静默失败等安全问题。改进了 `/feedback` 报告,包含上下文压缩前的对话内容,便于排查长会话中的早期问题。

    推荐理由:Claude Code 这次把 /usage 拆到每个技能和子代理的用量,排查成本不再是猜谜,/diff 终于能键盘滚动,修了一堆权限坑,日常靠 Claude Code 写代码的人值得秒升。

5月22日周五
  1. 公众号:龙猫LongCat(美团)69

    美团跑腿 Skill:一句话,骑手来帮忙

    美团推出跑腿 Skill,接入 Claw 助手后可将六步下单流程压缩为一步,用户用自然语言描述需求即可生成真实跑腿订单。该 Skill 支持所有 Claw 客户端,包括 OpenClaw 本地版、火山引擎云部署版及 QClaw 等第三方客户端,并提供智能地址匹配、订单预览确认、支付安全门控及实时配送进度查询等功能。

    推荐理由:将跑腿下单压缩为自然语言交互,展示了AI助手调用线下服务的实际落地路径,对频繁使用跑腿的用户减少了多步操作。