OpenRouter:Announcements(RSS)
精选
75AI 编辑部评分,满分 100

OpenRouter 推出 Advisor 工具:让低成本模型可随时调用强模型增强生成

2026-06-10 02:00· 60天前
AI 导读

OpenRouter 发布 advisor 服务器工具,允许一个快速、便宜的模型在生成过程中咨询一个更强大的模型。具体而言,可用 GPT-4o Mini 处理日常例行工作,在关键时刻调用 Claude Fable 解决真正重要的问题,从而实现成本和质量的动态平衡。

推荐理由

OpenRouter 开放了跨模型顾问调用,让便宜模型在关键节点求助昂贵模型,这会让 agent 开发重心从选一个万能模型转向编排一组模型,值得所有做 agent 架构的人试一下。

正文 · AI 翻译

顾问:为任意模型提供一条通向更聪明模型的救生索

Kenny Rogers · 2026年6月10日

  • 67倍价格差距,选择性咨询
  • 服务端执行,单次工具调用
  • 命名顾问
  • 与其他顾问工具对比
  • 计费

将 `openrouter:advisor` 添加到你的工具数组中,你的模型便能在生成过程中向更强的模型求助。当执行模型遇到艰难决策、陷入困境或在完成前想要一次合理性检查时,它会向顾问发送一个提示词。顾问进行思考,将指导意见作为工具结果返回,执行模型则带着更好的信息继续运行。

两个角色都是开放的:OpenRouter 上的任何模型都可以作为执行模型,任何提供商的任何模型都可以作为顾问。你可以让 Gemini 执行模型咨询 Claude,或者让 GPT 执行模型咨询 DeepSeek。你来选择配对。

在聊天室中尝试,或阅读文档以获取完整的 API 参考。

{
  "model": "openai/gpt-4o-mini",
  "messages": [{ "role": "user", "content": "Design a rate limiter for a distributed API gateway." }],
  "tools": [
    {
      "type": "openrouter:advisor",
      "parameters": { "model": "anthropic/claude-fable-5" }
    }
  ]
}

67倍价格差距,选择性咨询

Claude Fable 5 每百万输入 token 收费 10 美元。GPT-4o Mini 每百万输入 token 收费 0.15 美元。这是 67 倍的差距。

大多数请求并不需要前沿级别的推理。一个中档模型可以毫无问题地处理大部分工作负载。但涉及架构决策、模糊边界情况或多步骤推理链的那 10-20% 的任务,正是廉价模型容易出错的地方。

顾问工具选择性地填补了这一差距。你的快速模型负责主导运行。当它遇到真正困难的问题时,它会请求帮助。你只需在需要前沿思考的时刻支付前沿模型的价格。

在一个包含 50 次工具调用的智能体编码会话中,可能只有 2-3 次是顾问咨询。其余调用都以迷你模型的价格运行。你在降低每次会话成本的同时,保持了高质量的上限。

服务端执行,单次工具调用

顾问在生成过程中于服务端运行。你的模型像调用其他任何工具一样调用它:传递一个描述它需要什么帮助的提示词,然后接收顾问的文本作为工具结果。模型随后根据得到的建议,自己写出最终答案。顾问是咨询师,而不是代笔人。

有四件事值得了解:

  1. 任何提供商提供的任何模型都可以担任顾问。在工具配置中通过 `parameters.model`(模型目录中的任何模型均可)将其固定,或者让执行者按需选择。使用 `~anthropic/claude-fable-latest` 可始终解析到最新的 Fable 模型。

  2. 顾问拥有自己的工具。为其配置 `openrouter:web_search`,它便会在回复前基于最新来源来支撑其建议。顾问作为子智能体运行,拥有自己的工具循环,然后仅返回最终指导。

  3. 递归被阻止。顾问不能调用自身。深度标头和自引用检查可防止无限嵌套,且每次请求的咨询次数设有上限以控制成本。

  4. 顾问具有记忆能力。在后续请求中重放对话记录(包含顾问的工具调用及其结果),每个顾问会重建其之前的咨询内容,因此后续问题可以基于顾问已给出的建议进行构建。记忆按顾问独立管理(你的安全审查员和架构师各自维护自己的线索),并适用于 Chat Completions、Responses 和 Anthropic Messages 接口。详情请参阅完整文档。

命名顾问

对于复杂工作流,你可以配置一个专家团队。每个顾问添加一条 `openrouter:advisor` 条目,各自拥有独立的名称、模型、指令和工具集:

{
  "tools": [
    {
      "type": "openrouter:advisor",
      "parameters": {
        "name": "security-reviewer",
        "model": "anthropic/claude-fable-5",
        "instructions": "You are a security engineer. Find vulnerabilities."
      }
    },
    {
      "type": "openrouter:advisor",
      "parameters": {
        "name": "architect",
        "model": "openai/gpt-5.5",
        "instructions": "You are a systems architect. Prioritize simplicity and scalability."
      }
    }
  ]
}

执行者会看到每个顾问对应一个不同的工具,只需通过提示词即可调用适合当前任务的顾问。身份验证流程审查会路由到具有安全角色设定的 Claude Fable;架构问题则交给 GPT-5.5。名称可使用字母、数字、空格、下划线和短横线(例如“Lead Architect”有效),且各条目间必须唯一。可以省略某个条目的名称,使其作为默认顾问。

建议也可以流式传输。在顾问条目上设置 `"stream": true`,即可在顾问撰写建议时逐步获取内容。在 Responses API 中,这意味着在建议传输过程中会触发 `response.output_text.delta` 事件;完成后的输出项仍会包含完整文本,因此忽略增量事件的消费者不会察觉到差异。(Chat Completions 会忽略此标志,Messages-API 的流式传输功能将很快跟进。)

与其他顾问工具的比较

部分提供商在其自有 API 中提供了类似的顾问概念,但这仅限于其模型家族内部:执行者和顾问都必须来自同一供应商,通常遵循固定的配对矩阵,有时还需经过测试版准入。OpenRouter 的顾问消除了这些限制,并在此基础上增加了若干功能:

  • 双方均可使用任意模型、任意提供商。执行者和顾问都可以是目录中数百个模型中的任意一个:一个廉价的开放权重执行者咨询前沿模型,一个 Gemini 执行者咨询 Claude,或者一个 Claude 执行者从 GPT-5.5 获取其模型家族之外的第二意见。
  • 一个命名顾问列表。在单个请求中配置多个专家,每个专家拥有自己的模型、指令和工具集,并让执行者将每个问题路由给合适的专家。单一供应商版本只提供一个未命名的顾问。
  • 拥有自有工具的顾问。将 openrouter:web_search 交给顾问,它便能在响应之前基于最新来源为其建议提供依据。
  • 跨 API 格式工作,无需测试版准入。同一工具可通过 Chat Completions、Responses 和 Anthropic Messages(三者均支持跨请求记忆)使用,且已全面开放。无需测试版标头,也无需向客户团队申请访问权限。

如果你已通过我们的兼容 API 皮肤使用供应商原生的顾问,切换到 openrouter:advisor 即可解锁完整目录,而无需更改请求的其他部分。

计费

顾问的 token 按顾问模型的费率计费,与执行者分开。如果你的执行者是 GPT-4o Mini(每百万 token 0.15/0.60 美元),而顾问是 Claude Fable 5(每百万 token 10/50 美元),则每个模型的 token 按其自身价格计费。两者都会显示在你的活动页面上。

在你的工具数组中添加一行:

{ "type": "openrouter:advisor", "parameters": { "model": "anthropic/claude-fable-5" } } 模型自行决定何时使用它。大多数请求不会触发咨询;而那些触发的请求将因此变得更好。请阅读完整文档,了解参数、命名顾问、子智能体工具等更多信息。

来源:OpenRouter:Announcements(RSS) · openrouter.ai

同一事件 · 2

OpenRouter 推出 Advisor 工具:让低成本模型可随时调用强模型增强生成

OpenRouter:Announcements(RSS)·2026-06-10 02:00·60天前
AI 导读

OpenRouter 发布 advisor 服务器工具,允许一个快速、便宜的模型在生成过程中咨询一个更强大的模型。具体而言,可用 GPT-4o Mini 处理日常例行工作,在关键时刻调用 Claude Fable 解决真正重要的问题,从而实现成本和质量的动态平衡。

正文 · AI 翻译

顾问:为任意模型提供一条通向更聪明模型的救生索

Kenny Rogers · 2026年6月10日

  • 67倍价格差距,选择性咨询
  • 服务端执行,单次工具调用
  • 命名顾问
  • 与其他顾问工具对比
  • 计费

将 `openrouter:advisor` 添加到你的工具数组中,你的模型便能在生成过程中向更强的模型求助。当执行模型遇到艰难决策、陷入困境或在完成前想要一次合理性检查时,它会向顾问发送一个提示词。顾问进行思考,将指导意见作为工具结果返回,执行模型则带着更好的信息继续运行。

两个角色都是开放的:OpenRouter 上的任何模型都可以作为执行模型,任何提供商的任何模型都可以作为顾问。你可以让 Gemini 执行模型咨询 Claude,或者让 GPT 执行模型咨询 DeepSeek。你来选择配对。

在聊天室中尝试,或阅读文档以获取完整的 API 参考。

{
  "model": "openai/gpt-4o-mini",
  "messages": [{ "role": "user", "content": "Design a rate limiter for a distributed API gateway." }],
  "tools": [
    {
      "type": "openrouter:advisor",
      "parameters": { "model": "anthropic/claude-fable-5" }
    }
  ]
}

67倍价格差距,选择性咨询

Claude Fable 5 每百万输入 token 收费 10 美元。GPT-4o Mini 每百万输入 token 收费 0.15 美元。这是 67 倍的差距。

大多数请求并不需要前沿级别的推理。一个中档模型可以毫无问题地处理大部分工作负载。但涉及架构决策、模糊边界情况或多步骤推理链的那 10-20% 的任务,正是廉价模型容易出错的地方。

顾问工具选择性地填补了这一差距。你的快速模型负责主导运行。当它遇到真正困难的问题时,它会请求帮助。你只需在需要前沿思考的时刻支付前沿模型的价格。

在一个包含 50 次工具调用的智能体编码会话中,可能只有 2-3 次是顾问咨询。其余调用都以迷你模型的价格运行。你在降低每次会话成本的同时,保持了高质量的上限。

服务端执行,单次工具调用

顾问在生成过程中于服务端运行。你的模型像调用其他任何工具一样调用它:传递一个描述它需要什么帮助的提示词,然后接收顾问的文本作为工具结果。模型随后根据得到的建议,自己写出最终答案。顾问是咨询师,而不是代笔人。

有四件事值得了解:

  1. 任何提供商提供的任何模型都可以担任顾问。在工具配置中通过 `parameters.model`(模型目录中的任何模型均可)将其固定,或者让执行者按需选择。使用 `~anthropic/claude-fable-latest` 可始终解析到最新的 Fable 模型。

  2. 顾问拥有自己的工具。为其配置 `openrouter:web_search`,它便会在回复前基于最新来源来支撑其建议。顾问作为子智能体运行,拥有自己的工具循环,然后仅返回最终指导。

  3. 递归被阻止。顾问不能调用自身。深度标头和自引用检查可防止无限嵌套,且每次请求的咨询次数设有上限以控制成本。

  4. 顾问具有记忆能力。在后续请求中重放对话记录(包含顾问的工具调用及其结果),每个顾问会重建其之前的咨询内容,因此后续问题可以基于顾问已给出的建议进行构建。记忆按顾问独立管理(你的安全审查员和架构师各自维护自己的线索),并适用于 Chat Completions、Responses 和 Anthropic Messages 接口。详情请参阅完整文档。

命名顾问

对于复杂工作流,你可以配置一个专家团队。每个顾问添加一条 `openrouter:advisor` 条目,各自拥有独立的名称、模型、指令和工具集:

{
  "tools": [
    {
      "type": "openrouter:advisor",
      "parameters": {
        "name": "security-reviewer",
        "model": "anthropic/claude-fable-5",
        "instructions": "You are a security engineer. Find vulnerabilities."
      }
    },
    {
      "type": "openrouter:advisor",
      "parameters": {
        "name": "architect",
        "model": "openai/gpt-5.5",
        "instructions": "You are a systems architect. Prioritize simplicity and scalability."
      }
    }
  ]
}

执行者会看到每个顾问对应一个不同的工具,只需通过提示词即可调用适合当前任务的顾问。身份验证流程审查会路由到具有安全角色设定的 Claude Fable;架构问题则交给 GPT-5.5。名称可使用字母、数字、空格、下划线和短横线(例如“Lead Architect”有效),且各条目间必须唯一。可以省略某个条目的名称,使其作为默认顾问。

建议也可以流式传输。在顾问条目上设置 `"stream": true`,即可在顾问撰写建议时逐步获取内容。在 Responses API 中,这意味着在建议传输过程中会触发 `response.output_text.delta` 事件;完成后的输出项仍会包含完整文本,因此忽略增量事件的消费者不会察觉到差异。(Chat Completions 会忽略此标志,Messages-API 的流式传输功能将很快跟进。)

与其他顾问工具的比较

部分提供商在其自有 API 中提供了类似的顾问概念,但这仅限于其模型家族内部:执行者和顾问都必须来自同一供应商,通常遵循固定的配对矩阵,有时还需经过测试版准入。OpenRouter 的顾问消除了这些限制,并在此基础上增加了若干功能:

  • 双方均可使用任意模型、任意提供商。执行者和顾问都可以是目录中数百个模型中的任意一个:一个廉价的开放权重执行者咨询前沿模型,一个 Gemini 执行者咨询 Claude,或者一个 Claude 执行者从 GPT-5.5 获取其模型家族之外的第二意见。
  • 一个命名顾问列表。在单个请求中配置多个专家,每个专家拥有自己的模型、指令和工具集,并让执行者将每个问题路由给合适的专家。单一供应商版本只提供一个未命名的顾问。
  • 拥有自有工具的顾问。将 openrouter:web_search 交给顾问,它便能在响应之前基于最新来源为其建议提供依据。
  • 跨 API 格式工作,无需测试版准入。同一工具可通过 Chat Completions、Responses 和 Anthropic Messages(三者均支持跨请求记忆)使用,且已全面开放。无需测试版标头,也无需向客户团队申请访问权限。

如果你已通过我们的兼容 API 皮肤使用供应商原生的顾问,切换到 openrouter:advisor 即可解锁完整目录,而无需更改请求的其他部分。

计费

顾问的 token 按顾问模型的费率计费,与执行者分开。如果你的执行者是 GPT-4o Mini(每百万 token 0.15/0.60 美元),而顾问是 Claude Fable 5(每百万 token 10/50 美元),则每个模型的 token 按其自身价格计费。两者都会显示在你的活动页面上。

在你的工具数组中添加一行:

{ "type": "openrouter:advisor", "parameters": { "model": "anthropic/claude-fable-5" } } 模型自行决定何时使用它。大多数请求不会触发咨询;而那些触发的请求将因此变得更好。请阅读完整文档,了解参数、命名顾问、子智能体工具等更多信息。

来源:OpenRouter:Announcements(RSS)· openrouter.ai

同一事件 · 2