你的编程智能体在编写代码方面表现出色。
但在为特定任务选择合适模型时——比如既要能编程,又不想一天内花光月度预算,或者要找到设计落地页的最佳模型——它就真的力不从心了。
你的智能体可以大致猜测出“最佳”模型,但它的猜测依据是数月前的训练数据,对模型的实际成本、在特定任务上的表现、应该固定使用哪家供应商等信息一无所知。
这种情况将不复存在。
今天,我们非常激动地宣布 OpenRouter MCP 正式发布。
OpenRouter MCP 服务器将实时模型数据、基准排名、定价、文档和测试推理能力直接提供给你和你的智能体,帮助你们就使用哪个最佳模型做出正确决策。只需一条命令即可安装,你最喜欢的智能体就能根据 Artificial Analysis、Design Arena 和 OpenRouter 自身模型排名的最新数据,回答“哪个模型最擅长编程又不会让我破产”这样的问题。提示:答案是 GLM-5.2。
一条命令即可安装
Claude Code:
claude mcp add --transport http openrouter https://mcp.openrouter.ai/mcp
claude mcp openrouter Codex CLI:
codex mcp add openrouter --url https://mcp.openrouter.ai/mcp
codex mcp openrouter Cursor:添加到 ~/.cursor/mcp.json:
{
"mcpServers": {
"openrouter": { "url": "https://mcp.openrouter.ai/mcp" }
}
} Claude Desktop / Web:OpenRouter 不在 Claude 的连接器目录中,因此需要手动添加:设置 > 连接器 > 自定义 > 连接器,点击 + > 添加自定义连接器,输入名称 OpenRouter MCP 和远程 MCP 服务器 URL https://mcp.openrouter.ai/mcp,点击添加,然后打开该连接器并点击连接以运行 OAuth 流程。
某些组织不允许添加自定义连接器,因此该选项可能不会对所有人显示。如果是这种情况,请联系你的管理员。
请参阅连接指南,了解 OAuth 登录及所有支持的客户端。
无需切换标签页即可选对模型
你正在开发一个需要结构化 JSON 输出的功能,并且想要一个速度快、成本低、且真正擅长此道的模型。通常,你需要打开 OpenRouter 网站,浏览模型列表,比较基准测试结果,查看定价,或许还要在 Playground 中运行几个测试提示词。在你写下一行集成代码之前,这就要花掉 15 分钟进行上下文切换。
连接 MCP 服务器后,你可以在编程智能体中完成所有这些操作:
You: "I need a model for structured JSON extraction from legal documents.
Fast, under $1/M input tokens, good at following schemas."
Agent: [calls list-models with filters] → [calls list-benchmarks] → [calls list-model-endpoints]
Agent: "google/gemini-3-flash-preview fits well: $0.10/M input,
138k context, strong structured output support. Here's the
endpoint with the lowest latency..." 智能体会从实时模型目录中获取信息,交叉参考 Artificial Analysis 的智能评分和 Design Arena 的 ELO 排名,并检查各供应商的定价和延迟。推荐结果完全基于当前数据,而非模型上次训练(六个月前)时的旧数据。
先测试,再投入
send-message 让你的智能体可以向任意模型发送测试提示词,并查看响应、成本以及由哪家供应商提供服务。你的智能体可以并排比较不同模型的回答:
You: "Compare how Claude Opus 4.8, GPT-5.5, and DeepSeek V4 Pro
handle this structured extraction prompt."
Agent: [sends the same prompt to all three via send-message]
[calls get-generation for each to get cost breakdowns]
Agent: "All three produced valid JSON. Opus 4.8 nailed the edge
case in row 12. GPT-5.5 was 40% cheaper. DeepSeek V4 Pro
was fastest at 180ms TTFB." 模型标识符支持后缀:`:online` 用于网络搜索,`:nitro` 用于速度优先,`:floor` 用于最低价格,`:free` 用于免费端点。你的智能体可以在不同变体间进行测试,无需你记忆这些语法。
无需离开编辑器即可搜索文档
你的智能体拥有 search-docs 功能,可以对 OpenRouter 文档进行全文搜索。“如何将模型固定到特定供应商?”“工具调用的格式是什么?”“提示词缓存是如何工作的?”你的智能体会找到答案并应用它,整个过程一气呵成。
这正是 MCP 服务器作为开发助手的价值所在。你的智能体可以查找它需要的精确 API 参数,检查正确的请求格式,并将其接入你的代码,而你无需亲自查找和阅读文档页面。
专用且设有上限的密钥
该服务器是远程的(本地无需安装任何东西),首次登录会运行一个 OAuth 流程,生成一个专用的 API 密钥,有效期为 7 天,并设有 10 美元的使用上限(可在批准屏幕上编辑)。该密钥与你的其他密钥分开,并会显示在你的密钥管理面板上。你可以随时撤销它。
请参阅连接指南,了解如何在 OpenCode、Claude Desktop 以及其他所有支持的客户端中进行设置。
工具箱里有什么
| 工具 | 功能说明 |
|---|---|
| list-models | 搜索实时模型目录,支持按价格范围、上下文长度、模态、供应商、模型系列等条件进行筛选 |
| get-model | 获取单个模型的完整详情:能力、定价、上下文窗口、支持的参数 |
| list-model-endpoints | 按供应商细分:价格、延迟、吞吐量、数据政策 |
| list-benchmarks | 来自 Artificial Analysis 和 Design Arena 的第三方质量评分 |
| list-daily-model-rankings | 按 token 用量显示哪些模型使用最多和增长最快 |
| send-message | 向任意模型发送测试提示词,获取响应和费用 |
| 获取生成结果 | 特定生成任务的费用、token 数量及服务提供商 |
| 搜索文档 | 在 OpenRouter 文档中进行全文搜索 |
| 获取积分 | 您账户的剩余积分 |
| 列出提供商 | 可用于路由偏好的提供商列表 |
| 列出应用排名 | 按类别显示哪些应用带来了最多的 OpenRouter 流量 |
除发送消息外,所有工具均为只读查询。发送消息会使用您 MCP 密钥的余额进行可计费的推理调用。
常见问题
这会取代 OpenRouter API 吗?
不会。MCP 服务器是供您的编程智能体使用的开发助手。它拉取 OpenRouter 的实时数据,并能发送测试消息,以便您的智能体在您开发时做出明智决策。您的应用仍应直接调用 OpenRouter API。
身份验证是如何工作的?
您的 MCP 客户端会触发一个 OAuth 流程,在您的浏览器中打开 OpenRouter 的授权页面。您批准一个专用的 API 密钥,该密钥有效期为 7 天,消费上限为 10 美元。该密钥与您的其他密钥分开,您可以随时从控制面板中断开连接。
我的源代码会被发送到任何地方吗?
不会。这些工具是对 OpenRouter API 的只读查询。唯一的例外是发送消息功能,它只会将您显式传递给它的消息发送给模型。除非您将源代码包含在发送消息的调用中,否则不会有任何源代码离开您的机器。
立即尝试:连接您的智能体并询问“最适合我使用场景的模型是什么?”