# OpenRouter 推出 Advisor 工具：让低成本模型可随时调用强模型增强生成

- 来源：OpenRouter：Announcements（RSS）
- 发布时间：2026-06-10 02:00
- AIHOT 分数：75
- AIHOT 标记：精选
- AIHOT 链接：https://aihot.virxact.com/items/cmq737old00b0sle3025e4b4c
- 原文链接：https://openrouter.ai/blog/advisor-server-tool

## 精选理由

OpenRouter 开放了跨模型顾问调用，让便宜模型在关键节点求助昂贵模型，这会让 agent 开发重心从选一个万能模型转向编排一组模型，值得所有做 agent 架构的人试一下。

## AI 摘要

OpenRouter 发布 advisor 服务器工具，允许一个快速、便宜的模型在生成过程中咨询一个更强大的模型。具体而言，可用 GPT-4o Mini 处理日常例行工作，在关键时刻调用 Claude Fable 解决真正重要的问题，从而实现成本和质量的动态平衡。

## 正文

顾问：为任意模型提供一条通向更聪明模型的救生索

Kenny Rogers · 2026年6月10日

67倍价格差距，选择性咨询

服务端执行，单次工具调用

命名顾问

与其他顾问工具对比

计费

将 `openrouter:advisor` 添加到你的工具数组中，你的模型便能在生成过程中向更强的模型求助。当执行模型遇到艰难决策、陷入困境或在完成前想要一次合理性检查时，它会向顾问发送一个提示词。顾问进行思考，将指导意见作为工具结果返回，执行模型则带着更好的信息继续运行。

两个角色都是开放的：OpenRouter 上的任何模型都可以作为执行模型，任何提供商的任何模型都可以作为顾问。你可以让 Gemini 执行模型咨询 Claude，或者让 GPT 执行模型咨询 DeepSeek。你来选择配对。

在聊天室中尝试，或阅读文档以获取完整的 API 参考。

{ "model": "openai/gpt-4o-mini", "messages": [{ "role": "user", "content": "Design a rate limiter for a distributed API gateway." }], "tools": [ { "type": "openrouter:advisor", "parameters": { "model": "anthropic/claude-fable-5" } } ] }

67倍价格差距，选择性咨询

Claude Fable 5 每百万输入 token 收费 10 美元。GPT-4o Mini 每百万输入 token 收费 0.15 美元。这是 67 倍的差距。

大多数请求并不需要前沿级别的推理。一个中档模型可以毫无问题地处理大部分工作负载。但涉及架构决策、模糊边界情况或多步骤推理链的那 10-20% 的任务，正是廉价模型容易出错的地方。

顾问工具选择性地填补了这一差距。你的快速模型负责主导运行。当它遇到真正困难的问题时，它会请求帮助。你只需在需要前沿思考的时刻支付前沿模型的价格。

在一个包含 50 次工具调用的智能体编码会话中，可能只有 2-3 次是顾问咨询。其余调用都以迷你模型的价格运行。你在降低每次会话成本的同时，保持了高质量的上限。

服务端执行，单次工具调用

顾问在生成过程中于服务端运行。你的模型像调用其他任何工具一样调用它：传递一个描述它需要什么帮助的提示词，然后接收顾问的文本作为工具结果。模型随后根据得到的建议，自己写出最终答案。顾问是咨询师，而不是代笔人。

有四件事值得了解：

任何提供商提供的任何模型都可以担任顾问。在工具配置中通过 `parameters.model`（模型目录中的任何模型均可）将其固定，或者让执行者按需选择。使用 `~anthropic/claude-fable-latest` 可始终解析到最新的 Fable 模型。

顾问拥有自己的工具。为其配置 `openrouter:web_search`，它便会在回复前基于最新来源来支撑其建议。顾问作为子智能体运行，拥有自己的工具循环，然后仅返回最终指导。

递归被阻止。顾问不能调用自身。深度标头和自引用检查可防止无限嵌套，且每次请求的咨询次数设有上限以控制成本。

顾问具有记忆能力。在后续请求中重放对话记录（包含顾问的工具调用及其结果），每个顾问会重建其之前的咨询内容，因此后续问题可以基于顾问已给出的建议进行构建。记忆按顾问独立管理（你的安全审查员和架构师各自维护自己的线索），并适用于 Chat Completions、Responses 和 Anthropic Messages 接口。详情请参阅完整文档。

命名顾问

对于复杂工作流，你可以配置一个专家团队。每个顾问添加一条 `openrouter:advisor` 条目，各自拥有独立的名称、模型、指令和工具集：

{ "tools": [ { "type": "openrouter:advisor", "parameters": { "name": "security-reviewer", "model": "anthropic/claude-fable-5", "instructions": "You are a security engineer. Find vulnerabilities." } }, { "type": "openrouter:advisor", "parameters": { "name": "architect", "model": "openai/gpt-5.5", "instructions": "You are a systems architect. Prioritize simplicity and scalability." } } ] }

执行者会看到每个顾问对应一个不同的工具，只需通过提示词即可调用适合当前任务的顾问。身份验证流程审查会路由到具有安全角色设定的 Claude Fable；架构问题则交给 GPT-5.5。名称可使用字母、数字、空格、下划线和短横线（例如“Lead Architect”有效），且各条目间必须唯一。可以省略某个条目的名称，使其作为默认顾问。

建议也可以流式传输。在顾问条目上设置 `"stream": true`，即可在顾问撰写建议时逐步获取内容。在 Responses API 中，这意味着在建议传输过程中会触发 `response.output_text.delta` 事件；完成后的输出项仍会包含完整文本，因此忽略增量事件的消费者不会察觉到差异。（Chat Completions 会忽略此标志，Messages-API 的流式传输功能将很快跟进。）

与其他顾问工具的比较

部分提供商在其自有 API 中提供了类似的顾问概念，但这仅限于其模型家族内部：执行者和顾问都必须来自同一供应商，通常遵循固定的配对矩阵，有时还需经过测试版准入。OpenRouter 的顾问消除了这些限制，并在此基础上增加了若干功能：

双方均可使用任意模型、任意提供商。执行者和顾问都可以是目录中数百个模型中的任意一个：一个廉价的开放权重执行者咨询前沿模型，一个 Gemini 执行者咨询 Claude，或者一个 Claude 执行者从 GPT-5.5 获取其模型家族之外的第二意见。

一个命名顾问列表。在单个请求中配置多个专家，每个专家拥有自己的模型、指令和工具集，并让执行者将每个问题路由给合适的专家。单一供应商版本只提供一个未命名的顾问。

拥有自有工具的顾问。将 openrouter:web_search 交给顾问，它便能在响应之前基于最新来源为其建议提供依据。

跨 API 格式工作，无需测试版准入。同一工具可通过 Chat Completions、Responses 和 Anthropic Messages（三者均支持跨请求记忆）使用，且已全面开放。无需测试版标头，也无需向客户团队申请访问权限。

如果你已通过我们的兼容 API 皮肤使用供应商原生的顾问，切换到 openrouter:advisor 即可解锁完整目录，而无需更改请求的其他部分。

计费

顾问的 token 按顾问模型的费率计费，与执行者分开。如果你的执行者是 GPT-4o Mini（每百万 token 0.15/0.60 美元），而顾问是 Claude Fable 5（每百万 token 10/50 美元），则每个模型的 token 按其自身价格计费。两者都会显示在你的活动页面上。

在你的工具数组中添加一行：

{ "type": "openrouter:advisor", "parameters": { "model": "anthropic/claude-fable-5" } } 模型自行决定何时使用它。大多数请求不会触发咨询；而那些触发的请求将因此变得更好。请阅读完整文档，了解参数、命名顾问、子智能体工具等更多信息。
