顾问:为任意模型提供一条通向更聪明模型的救生索
Kenny Rogers · 2026年6月10日
- 67倍价格差距,选择性咨询
- 服务端执行,单次工具调用
- 命名顾问
- 与其他顾问工具对比
- 计费
将 `openrouter:advisor` 添加到你的工具数组中,你的模型便能在生成过程中向更强的模型求助。当执行模型遇到艰难决策、陷入困境或在完成前想要一次合理性检查时,它会向顾问发送一个提示词。顾问进行思考,将指导意见作为工具结果返回,执行模型则带着更好的信息继续运行。
两个角色都是开放的:OpenRouter 上的任何模型都可以作为执行模型,任何提供商的任何模型都可以作为顾问。你可以让 Gemini 执行模型咨询 Claude,或者让 GPT 执行模型咨询 DeepSeek。你来选择配对。
在聊天室中尝试,或阅读文档以获取完整的 API 参考。
{
"model": "openai/gpt-4o-mini",
"messages": [{ "role": "user", "content": "Design a rate limiter for a distributed API gateway." }],
"tools": [
{
"type": "openrouter:advisor",
"parameters": { "model": "anthropic/claude-fable-5" }
}
]
}
67倍价格差距,选择性咨询
Claude Fable 5 每百万输入 token 收费 10 美元。GPT-4o Mini 每百万输入 token 收费 0.15 美元。这是 67 倍的差距。
大多数请求并不需要前沿级别的推理。一个中档模型可以毫无问题地处理大部分工作负载。但涉及架构决策、模糊边界情况或多步骤推理链的那 10-20% 的任务,正是廉价模型容易出错的地方。
顾问工具选择性地填补了这一差距。你的快速模型负责主导运行。当它遇到真正困难的问题时,它会请求帮助。你只需在需要前沿思考的时刻支付前沿模型的价格。
在一个包含 50 次工具调用的智能体编码会话中,可能只有 2-3 次是顾问咨询。其余调用都以迷你模型的价格运行。你在降低每次会话成本的同时,保持了高质量的上限。
服务端执行,单次工具调用
顾问在生成过程中于服务端运行。你的模型像调用其他任何工具一样调用它:传递一个描述它需要什么帮助的提示词,然后接收顾问的文本作为工具结果。模型随后根据得到的建议,自己写出最终答案。顾问是咨询师,而不是代笔人。
有四件事值得了解:
任何提供商提供的任何模型都可以担任顾问。在工具配置中通过 `parameters.model`(模型目录中的任何模型均可)将其固定,或者让执行者按需选择。使用 `~anthropic/claude-fable-latest` 可始终解析到最新的 Fable 模型。
顾问拥有自己的工具。为其配置 `openrouter:web_search`,它便会在回复前基于最新来源来支撑其建议。顾问作为子智能体运行,拥有自己的工具循环,然后仅返回最终指导。
递归被阻止。顾问不能调用自身。深度标头和自引用检查可防止无限嵌套,且每次请求的咨询次数设有上限以控制成本。
顾问具有记忆能力。在后续请求中重放对话记录(包含顾问的工具调用及其结果),每个顾问会重建其之前的咨询内容,因此后续问题可以基于顾问已给出的建议进行构建。记忆按顾问独立管理(你的安全审查员和架构师各自维护自己的线索),并适用于 Chat Completions、Responses 和 Anthropic Messages 接口。详情请参阅完整文档。
命名顾问
对于复杂工作流,你可以配置一个专家团队。每个顾问添加一条 `openrouter:advisor` 条目,各自拥有独立的名称、模型、指令和工具集:
{
"tools": [
{
"type": "openrouter:advisor",
"parameters": {
"name": "security-reviewer",
"model": "anthropic/claude-fable-5",
"instructions": "You are a security engineer. Find vulnerabilities."
}
},
{
"type": "openrouter:advisor",
"parameters": {
"name": "architect",
"model": "openai/gpt-5.5",
"instructions": "You are a systems architect. Prioritize simplicity and scalability."
}
}
]
}
执行者会看到每个顾问对应一个不同的工具,只需通过提示词即可调用适合当前任务的顾问。身份验证流程审查会路由到具有安全角色设定的 Claude Fable;架构问题则交给 GPT-5.5。名称可使用字母、数字、空格、下划线和短横线(例如“Lead Architect”有效),且各条目间必须唯一。可以省略某个条目的名称,使其作为默认顾问。
建议也可以流式传输。在顾问条目上设置 `"stream": true`,即可在顾问撰写建议时逐步获取内容。在 Responses API 中,这意味着在建议传输过程中会触发 `response.output_text.delta` 事件;完成后的输出项仍会包含完整文本,因此忽略增量事件的消费者不会察觉到差异。(Chat Completions 会忽略此标志,Messages-API 的流式传输功能将很快跟进。)
与其他顾问工具的比较
部分提供商在其自有 API 中提供了类似的顾问概念,但这仅限于其模型家族内部:执行者和顾问都必须来自同一供应商,通常遵循固定的配对矩阵,有时还需经过测试版准入。OpenRouter 的顾问消除了这些限制,并在此基础上增加了若干功能:
- 双方均可使用任意模型、任意提供商。执行者和顾问都可以是目录中数百个模型中的任意一个:一个廉价的开放权重执行者咨询前沿模型,一个 Gemini 执行者咨询 Claude,或者一个 Claude 执行者从 GPT-5.5 获取其模型家族之外的第二意见。
- 一个命名顾问列表。在单个请求中配置多个专家,每个专家拥有自己的模型、指令和工具集,并让执行者将每个问题路由给合适的专家。单一供应商版本只提供一个未命名的顾问。
- 拥有自有工具的顾问。将 openrouter:web_search 交给顾问,它便能在响应之前基于最新来源为其建议提供依据。
- 跨 API 格式工作,无需测试版准入。同一工具可通过 Chat Completions、Responses 和 Anthropic Messages(三者均支持跨请求记忆)使用,且已全面开放。无需测试版标头,也无需向客户团队申请访问权限。
如果你已通过我们的兼容 API 皮肤使用供应商原生的顾问,切换到 openrouter:advisor 即可解锁完整目录,而无需更改请求的其他部分。
计费
顾问的 token 按顾问模型的费率计费,与执行者分开。如果你的执行者是 GPT-4o Mini(每百万 token 0.15/0.60 美元),而顾问是 Claude Fable 5(每百万 token 10/50 美元),则每个模型的 token 按其自身价格计费。两者都会显示在你的活动页面上。
在你的工具数组中添加一行:
{ "type": "openrouter:advisor", "parameters": { "model": "anthropic/claude-fable-5" } } 模型自行决定何时使用它。大多数请求不会触发咨询;而那些触发的请求将因此变得更好。请阅读完整文档,了解参数、命名顾问、子智能体工具等更多信息。