跳到正文
北京时间
原文
OpenRouter:Announcements(RSS)· Kenny Rogers·· 2026-06-11精选AI 评分69

Advisor:让任何模型在生成过程中求助更强的模型

Advisor: Give Any Model a Lifeline to a Smarter One

AI 导读

OpenRouter 推出 advisor 服务器工具,允许快速、便宜的模型在生成过程中向更强模型咨询。用户可用 GPT-4o Mini 处理常规任务,在关键环节调用 Claude Fable 进行更高质量的推理。

推荐理由

让 GPT-4o Mini 在关键时刻请教 Claude,用 1/10 的成本得到相近质量,这种跨模型顾问把“模型路由”做成了开箱即用的工具,做 agent 的值得试。

正文 · AI 翻译

Advisor: Give Any Model a Lifeline to a Smarter One

把 openrouter:advisor 添加到你的 tools 数组中,你的模型就可以在生成过程中向更强的模型求助。当执行模型遇到难以抉择的问题、陷入困境,或者想在完成前做一次合理性检查时,它会带着提示词调用顾问模型。顾问模型思考后,将指导建议作为工具结果返回,执行模型则带着更好的信息继续运行。

两个角色都是开放的:OpenRouter 上的任何模型都可以充当执行模型,任何提供商的任何模型都可以充当顾问模型。你可以让 Gemini 执行模型咨询 Claude,或者让 GPT 执行模型咨询 DeepSeek。配对由你决定。

在[]聊天室[]中试用,或[]阅读文档[]查看完整的 API 参考。

{
  "model": "openai/gpt-4o-mini",
  "messages": [{ "role": "user", "content": "Design a rate limiter for a distributed API gateway." }],
  "tools": [
    {
      "type": "openrouter:advisor",
      "parameters": { "model": "anthropic/claude-fable-5" }
    }
  ]
}

67 倍价格差距,选择性咨询

Claude Fable 5 的价格为每百万输入 token 10 美元。GPT-4o Mini 的价格为每百万 0.15 美元。差距达 67 倍。

大多数请求并不需要前沿级别的推理。中档模型可以毫无问题地完成大部分工作负载。但那 10-20% 涉及架构决策、模糊的边界情况或多步推理链的部分,才是较便宜的模型容易出问题的地方。

advisor 工具有选择地填补了这一空白。你的快速模型主导全局。当它遇到真正困难的问题时,才会寻求帮助。你只需为那些需要前沿思考的时刻支付前沿模型的价格。

在一个包含 50 次工具调用的智能体编码会话中,大概只有 2-3 次是 advisor 咨询。其余部分都以 mini 模型的价格运行。你在保持质量上限的同时,降低了每次会话的成本。

服务端执行,一次工具调用

advisor 在生成过程中于服务端运行。你的模型像调用任何其他工具一样调用它:传入一个 prompt 描述它需要什么帮助,然后以工具结果的形式获取 advisor 的文本回复。模型随后会参考这些建议,自己撰写最终答案。advisor 是顾问,不是代笔人。

四件值得了解的事:

  1. 任何模型、来自任何提供商的模型,都可以作为 advisor。你可以在工具配置中通过 parameters.model 指定它(模型目录中的任何模型都可用),也可以让执行模型在每次调用时自行选择。使用 ~anthropic/claude-fable-latest 可始终解析为最新的 Fable。

  2. [该顾问拥有自己的工具。[] 给它 openrouter:web_search,它会在响应之前基于最新来源来支撑其建议。它作为子智能体运行,拥有自己的工具循环,然后只返回最终的建议。

  3. [递归被阻止。[] 顾问无法调用自身。深度标头和自引用检查会防止无限嵌套,并且每次请求的咨询次数设有上限,以控制成本。

  4. [顾问具有记忆能力。[] 在后续请求中重放对话记录(包括顾问的工具调用及其结果),每个顾问会重建其先前的咨询内容,因此后续问题能建立在顾问已经说过的内容之上。记忆按顾问各自独立保存(你的安全审查员和架构师各自维护自己的线程),并且适用于 Chat Completions、Responses 和 Anthropic Messages。[完整详情[]。

命名顾问

对于复杂的工作流,你可以配置一组专家。为每个顾问添加一条 openrouter:advisor 条目,每个条目都有各自的名称、模型、指令和工具集:

{
  "tools": [
    {
      "type": "openrouter:advisor",
      "parameters": {
        "name": "security-reviewer",
        "model": "anthropic/claude-fable-5",
        "instructions": "You are a security engineer. Find vulnerabilities."
      }
    },
    {
      "type": "openrouter:advisor",
      "parameters": {
        "name": "architect",
        "model": "openai/gpt-5.5",
        "instructions": "You are a systems architect. Prioritize simplicity and scalability."
      }
    }
  ]
}

执行器会看到每个顾问对应的一个独立工具,并通过 prompt 调用最适合该任务的顾问。一次鉴权流程审查会路由给带有安全角色设定的 Claude Fable;架构问题则交给 GPT-5.5。名称可以使用字母、数字、空格、下划线和短横线(“Lead Architect”是可行的),并且必须在所有条目之间保持唯一。其中一条条目可以省略 name,作为默认顾问。

建议内容也支持流式输出。在 advisor 条目上设置 "stream": true,就能在顾问写入建议时增量地收到内容。在 Responses API 中,这意味着建议生成期间会有 response.output_text.delta 事件;完成的输出项仍然携带完整文本,因此忽略增量(delta)的消费方不会察觉任何差异。(Chat Completions 会忽略该标志,Messages API 的流式支持将在后续快速跟进。)

与其他顾问工具的对比

一些供应商在自己的 API 中提供了类似的 advisor 概念,但它被限制在其模型族内部:执行者和顾问必须来自同一供应商,通常来自固定的配对矩阵,有时还处于 beta 门控之下。OpenRouter 的 advisor 去除了这些限制,并额外增加了几项功能:

  • 任意模型、任意供应商,双方皆可。 执行者和顾问都可以是 目录中数百个模型中的任意一个:便宜的开源权重执行者咨询前沿模型,Gemini 执行者咨询 Claude,或者 Claude 执行者向自身模型族之外的 GPT-5.5 寻求第二意见。
  • 一组有名有姓的顾问。 在单个请求中配置多个专家,各自拥有自己的模型、指令和工具集,并让执行者把每个问题路由给合适的顾问。单一供应商的版本只给你一个匿名顾问。
  • 顾问拥有自己的工具。 给顾问配备 openrouter:web_search,它就会在回应之前基于最新来源来夯实其建议。
  • 跨 API 格式通用,无需 beta 门槛。同一工具可通过 Chat Completions、Responses 和 Anthropic Messages 使用(三种方式均支持跨请求记忆),且现已全面可用。无需 beta 请求头,也无需联系客户团队申请权限。

如果你已通过我们某个兼容的 API 封装使用提供商原生的 advisor,切换到 openrouter:advisor 即可解锁完整模型目录,而无需更改请求的其余部分。

计费

Advisor 的 token 按 advisor 模型的费率计费,与执行器分开。如果你的执行器是 GPT-4o Mini(每百万 token $0.15/$0.60),而 advisor 是 Claude Fable 5(每百万 token $10/$50),那么每个模型的 token 各自按其价格计费。两者都会显示在你的 活动页面上。

在 tools 数组中只需一行:

{ "type": "openrouter:advisor", "parameters": { "model": "anthropic/claude-fable-5" } }

由模型决定何时使用它。大多数请求不会触发咨询;触发咨询的那些请求会因此获得更好的结果。阅读完整文档,了解参数、命名 advisor、子智能体工具等更多内容。

来源:OpenRouter:Announcements(RSS) · openrouter.ai