跳到正文
北京时间
原文
OpenRouter:Announcements(RSS)·· 2026-06-10精选AI 评分75

OpenRouter 推出 Advisor 工具:让低成本模型可随时调用强模型增强生成

Advisor: Give Any Model a Lifeline to a Smarter One

AI 导读

OpenRouter 发布 advisor 服务器工具,允许一个快速、便宜的模型在生成过程中咨询一个更强大的模型。具体而言,可用 GPT-4o Mini 处理日常例行工作,在关键时刻调用 Claude Fable 解决真正重要的问题,从而实现成本和质量的动态平衡。

推荐理由

OpenRouter 开放了跨模型顾问调用,让便宜模型在关键节点求助昂贵模型,这会让 agent 开发重心从选一个万能模型转向编排一组模型,值得所有做 agent 架构的人试一下。

正文 · AI 翻译

将 openrouter:advisor 添加到你的 tools 数组中,你的模型就可以在生成过程中向更强的模型求助。当执行模型遇到艰难决策、陷入困境,或者想在完成前做一个合理性检查时,它会带着提示词调用顾问模型。顾问模型进行思考,以工具结果的形式返回指导建议,执行模型则带着更好的信息继续运行。

两个角色都是开放的:OpenRouter 上的任何模型都可以担任执行模型,任何提供商的任何模型都可以担任顾问模型。你可以让 Gemini 执行模型咨询 Claude,或者让 GPT 执行模型咨询 DeepSeek。如何搭配由你决定。

在聊天室中试用,或阅读文档查看完整的 API 参考。

{
  "model": "openai/gpt-4o-mini",
  "messages": [{ "role": "user", "content": "Design a rate limiter for a distributed API gateway." }],
  "tools": [
    {
      "type": "openrouter:advisor",
      "parameters": { "model": "anthropic/claude-fable-5" }
    }
  ]
}

67 倍的价格差距,按需咨询

Claude Fable 5 的价格为每百万输入 token 10 美元。GPT-4o Mini 的价格为每百万 0.15 美元。两者相差 67 倍。

大多数请求并不需要前沿级别的推理能力。中档模型可以轻松承担大部分工作负载。但那 10-20% 涉及架构决策、模糊的边界情况或多步推理链的部分,正是较便宜的模型容易出错的地方。

顾问工具可以有选择地填补这一空白。你的快速模型掌控全局。当它遇到真正困难的问题时,才会寻求帮助。你只需在需要前沿思考能力的时刻支付前沿模型的价格。

在一次包含 50 次工具调用的智能体编码会话中,大概只有 2-3 次是顾问咨询,其余都以 mini 价格运行。你在保持质量上限的同时,把每次会话的成本磨到了最低。

服务端执行,只需一次工具调用

顾问在生成过程中于服务端运行。你的模型像调用其他任何工具一样调用它:传入一个 prompt 描述它需要什么帮助,然后以工具结果的形式获得顾问的文本回复。模型随后参考这些建议,自己写出最终答案。顾问是顾问,不是代笔者。

四件值得了解的事:

  1. 任何模型,无论来自哪家提供商,都可以担任顾问。 在工具配置中通过 parameters.model 指定(模型目录中的任何模型都可以),或者让执行模型在每次调用时自行选择。使用 ~anthropic/claude-fable-latest 可始终解析为最新的 Fable。

  2. 顾问拥有自己的工具。 给它 openrouter:web_search,它就会在回应之前先用最新来源为其建议提供依据。它作为一个子智能体运行,拥有自己的工具循环,最后只返回最终的建议。

  3. 递归被禁止。 顾问不能调用自身。通过深度标头和自引用检查来防止无限制的嵌套,并且每个请求的咨询次数有上限,以控制成本。

  4. 顾问是有记忆的。在后续请求中回放对话记录(包含 advisor 的工具调用及其结果),每个 advisor 都会重建自己此前的咨询内容,因此后续提问能建立在 advisor 已经说过的内容之上。记忆是按 advisor 分别保存的(你的安全审查员和架构师各自维护自己的线程),并且可在 Chat Completions、Responses 和 Anthropic Messages 之间通用。完整细节。

命名顾问

对于复杂的工作流,你可以配置一组专家阵容。为每个 advisor 添加一条 openrouter:advisor 条目,各自拥有独立的名称、模型、指令和工具集:

{
  "tools": [
    {
      "type": "openrouter:advisor",
      "parameters": {
        "name": "security-reviewer",
        "model": "anthropic/claude-fable-5",
        "instructions": "You are a security engineer. Find vulnerabilities."
      }
    },
    {
      "type": "openrouter:advisor",
      "parameters": {
        "name": "architect",
        "model": "openai/gpt-5.5",
        "instructions": "You are a systems architect. Prioritize simplicity and scalability."
      }
    }
  ]
}

执行器会为每个 advisor 看到一个独立的工具,并通过一条 prompt 调用最适合当前任务的那个。认证流程审查会路由给具有安全角色的 Claude Fable;架构问题则交给 GPT-5.5。名称可使用字母、数字、空格、下划线和短横线(“Lead Architect”这样的名称也可用),且在所有条目之间必须唯一。其中一个条目可以省略 name,从而作为默认 advisor。

建议内容也可以流式输出。在 advisor 条目上设置 "stream": true,你就能在 advisor 撰写建议的过程中增量收到内容。在 Responses API 中,这意味着建议生成期间会有 response.output_text.delta 事件;完成后的输出项仍会携带完整文本,因此忽略增量事件的消费方不会察觉任何差异。(Chat Completions 会忽略该标志,Messages-API 的流式支持将随后跟进。)

与其他 advisor 工具的对比

一些供应商在他们自己的 API 中提供了类似的顾问概念,但它仅限于其模型家族内部:执行者和顾问必须来自同一供应商,通常来自一个固定的配对矩阵,有时还要在 beta 门槛之后。OpenRouter 的顾问移除了这些限制,并在此基础上增加了一些东西:

  • 任意模型、任意供应商,两侧皆可。执行者和顾问可以是 目录 中数百个模型中的任意一个:便宜的开放权重执行者咨询前沿模型、Gemini 执行者咨询 Claude,或者 Claude 执行者向自家模型家族之外的 GPT-5.5 寻求第二意见。
  • 一份具名顾问的花名册。在单个请求中配置多个各自拥有模型、指令和工具集的专家,让执行者把每个问题路由给合适的那一个。单一供应商版本只给你一个未命名的顾问。
  • 顾问拥有自己的工具。给顾问配备 openrouter:web_search,它就会在回应之前基于最新来源来夯实其建议。
  • 跨 API 格式可用,无需 beta 门槛。同一个工具可以通过 Chat Completions、Responses 和 Anthropic Messages 使用(三种格式均支持跨请求记忆),并且已正式全面开放。无需 beta 请求头,无需向客户团队申请访问权限。

如果你已经通过我们某个兼容的 API 封装使用供应商原生的顾问,切换到 openrouter:advisor 即可解锁完整目录,而无需更改请求的其余部分。

计费

Advisor token 按 advisor 模型的费率计费,与 executor 分开。如果你的 executor 是 GPT-4o Mini(每 M tokens $0.15/$0.60),而 advisor 是 Claude Fable 5(每 M tokens $10/$50),则每个模型的 token 都按各自的价格计费。两者都会显示在你的 活动页面上。

在 tools 数组中加一行:

{ "type": "openrouter:advisor", "parameters": { "model": "anthropic/claude-fable-5" } } 由模型决定何时使用它。大多数请求不会触发咨询;而触发咨询的那些请求会因此变得更好。参数、指定 advisor、子智能体工具等更多内容请阅读完整文档。

来源:OpenRouter:Announcements(RSS) · openrouter.ai