在 SillyTavern 中使用多个 AI 模型通常需要分别注册 Anthropic、Google、Mistral 等平台,每个平台都有独立账户,且通常每月需支付 20 美元订阅费。一个 OpenRouter 密钥即可替代这一切,只需一个统一额度余额,便可在 SillyTavern 的下拉菜单中调用来自 70 多家提供商的 300 多个模型。许多模型可免费使用,大约五分钟内即可开始聊天。
本指南涵盖连接步骤、值得尝试的角色扮演模型、真正重要的设置,以及 SillyTavern 用户最常遇到的错误修复方法。
五步将 SillyTavern 连接到 OpenRouter
在 SillyTavern 的 API 连接面板中进行操作。目标是让 SillyTavern 指向 OpenRouter,验证你的密钥,选择一个模型,并在开始长对话前发送一条测试消息。
- 打开 API 连接面板(顶部栏的插头图标),将 API 类型设置为 Chat Completion。
- 将 Chat Completion 来源设置为 OpenRouter。
- 点击 Authorize 通过 OAuth 流程创建密钥,或在 openrouter.ai/settings/keys 生成密钥并粘贴到 API 密钥字段中。
- 点击 Connect,等待 SillyTavern 验证密钥。
- 从下拉菜单中选择一个模型,然后点击 Test Message。
在开始长时间会话之前,务必先发送那条测试消息。连接成功仅证明 SillyTavern 能验证你的密钥。如果模型不可用、提供商路由无法处理请求、模型标识符错误、你的账户无法访问该模型,或提示词超出模型的上下文窗口,生成仍可能失败。
几乎所有场景都应使用 Chat Completion。图像内联和工具调用仅通过 Chat Completion 工作,这与当前 OpenRouter 模型处理提示词的方式相匹配。Text Completion 为高级用户提供对原始提示词格式的更精细控制,但不适合初学者。如果你的版本中 OpenRouter 仅出现在 Chat Completion 来源下,这是正常现象。完整设置细节请参阅 SillyTavern OpenRouter 文档。
免费模型与 10 美元额度规则
标记为 :free 的模型每 token 费用为 $0,但请求限制仍然适用,这一点常让人措手不及。
| 账户状态 | 每日 :free 上限 | 每分钟上限 |
|---|---|---|
| 账户余额低于 $10 | 每天 50 次请求 | 每分钟 20 次请求 |
| 账户余额达到 $10 或以上 | 每天 1,000 次请求 | 每分钟 20 次请求 |
这 $10 是一次性充值,并非订阅,且余额可用于付费模型。OpenRouter 在提供商定价基础上不加价,因此目录价格即为你支付的价格,失败的请求不计费。如果你已直接向某提供商付费并希望保留原有合同,请改用你自己的 API 密钥。
“免费”模型产生费用,几乎总是因为按 token 计费和请求限制被突破。请检查你是否实际选择了付费模型、启用了付费备用路由,或使用了不以 :free 结尾的模型标识符。触及免费模型上限是限制问题,而非免费模型向你收费。
值得尝试的角色扮演模型
DeepSeek V3.2 是处理长场景时廉价且可靠的默认选择。如需更具表现力、过滤更少的文本,可尝试 Euryale 微调版本。当角色卡包含模型必须遵循的复杂指令时,Hermes 4 405B 的处理能力优于大多数模型。
| 模型标识符 | 上下文窗口 | 输入 / 输出(每百万 token) | 免费变体 | 最佳用途 |
|---|---|---|---|---|
| deepseek/deepseek-v3.2 | 131K | $0.23 / $0.34 | 无 | 长会话中廉价、连贯的默认选择 |
| deepseek/deepseek-r1-0528 | 164K | $0.50 / $2.15 | 无 | 推理密集型场景与规划 |
| sao10k/l3.3-euryale-70b | 131K | $0.65 / $0.75 | 无 | 长窗口下富有角色特色的角色扮演文本 |
| gryphe/mythomax-l2-13b | 4K | $0.06 / $0.06 | 无 | 经典经济型主力模型,上下文窗口极小 |
| aion-labs/aion-rp-llama-3.1-8b | 32K | $0.80 / $1.60 | 无 | 专为角色扮演调优的轻量级模型 |
| nousresearch/hermes-4-405b | 131K | $1.00 / $3.00 | 无 | 复杂角色卡,严格遵循指令 |
| z-ai/glm-4.6 | 203K | $0.43 / $1.74 | 无 | 强大的通用模型 |
| mistralai/mistral-large-2512 | 262K | $0.50 / $1.50 | 无 | 精良的付费选择,过滤更少 |
价格和上下文窗口已根据 2026 年 6 月 16 日的 OpenRouter 目录进行核实。每 token 费率会变化,因此在长时间会话前请确认模型页面上的最新信息。
免费变体在模型本身不变的情况下出现和消失,而且它们通常运行比付费版本更小的上下文窗口。这就是角色卡在场景中途开始遗忘的常见原因。在围绕任何免费模型搭建配置之前,请访问 openrouter.ai/models?q=free 并确认确切的 :free 标识仍然有效。
重要的设置和路由
从能保持聊天稳定的设置开始,待连接稳固后再进行调优。
- 开启流式传输,这样回复会随着模型生成而逐段显示。
- 将上下文长度滑块设置为上表中该模型的实际窗口大小。免费变体的窗口更小,因此请查看目录页面,而不是第三方指南。
- 保留备用提供商以实现可靠性。仅当您需要精确控制由哪个提供商处理请求时,才禁用它们。
- 对于拥有大型系统提示词或重复知识库内容的长期运行角色,请使用提示词缓存。它不会让请求免费,但能降低跨轮次重复输入的成本。
两个路由后缀会附加在模型标识符的末尾。:nitro 排序到最快的提供商;:floor 排序到最便宜的提供商。两者都映射到 OpenRouter 的提供商路由排序选项。对于使用固定角色卡的长时间会话,:floor 加上提示词缓存能显著降低成本。对于时间敏感型生成,请使用 :nitro。
关于流式传输的一个计费说明:中止流式传输仅对支持取消的提供商停止处理和计费。有几家不支持,包括 AWS Bedrock、Groq、Google、Google AI Studio、Minimax 和 Mistral。对于这些提供商,或对于非流式请求,模型可能会运行至完成并收取完整响应的费用。
保持角色扮演聊天的私密性
OpenRouter 的隐私性取决于两个层面:OpenRouter 存储的内容,以及处理您请求的提供商存储的内容。除非您选择启用日志记录,否则 OpenRouter 不会存储提示词或响应,但它会保留使用元数据,如 token 数量和延迟。下游提供商有自己的数据保留政策,这就是路由控制至关重要的原因。
启用零数据留存功能,即可按请求或账户范围,仅将流量路由至不存储提示词或响应的提供商。OpenRouter 可能会为选择记录提示词和补全内容的用户提供小额折扣;大多数角色扮演用户应关闭此功能,以免角色卡和聊天记录暴露在日志中。
OpenRouter 本身不进行内容过滤,但它会将流量路由至执行自身政策的提供商,因此称该设置为“无审查”有些言过其实。如果某个模型持续拒绝或中断场景,那是提供商的审核机制在起作用。请切换至过滤较少的模型或提供商。信任中心有具体说明。
修复最常见的错误
大多数 SillyTavern 和 OpenRouter 的问题都属于几种常见模式。请从确切的错误信息入手,然后应用相应的修复方法。
“无法验证 OpenRouter token。”这是一个常见错误,且该信息具有误导性。密钥几乎总是没问题的;真正的原因是 DNS 或网络问题导致 SillyTavern 无法访问 openrouter.ai,因此请求始终无法被验证。请在密钥页面确认密钥处于激活状态,重新粘贴密钥(确保末尾无空格),如果使用了 OAuth 则重新授权,然后重启。如果问题依旧,请将 DNS 解析器切换至 8.8.8.8 或 1.1.1.1 并重启。大多数情况下,修复 DNS 即可解决问题。
401 错误。这意味着 OpenRouter 拒绝了 SillyTavern 发送的密钥。请重新生成密钥,重新粘贴(确保末尾无空格),并确认账户有足够额度(如果你调用的是付费模型)。
OpenRouter 未出现在来源列表中。请先将 API 类型设置为 Chat Completion,因为它不会在其他类型下显示。更新并重启 SillyTavern。仅在较旧或非标准安装中,才需要编辑 config.yaml 文件,其中 `show_openrouter_api: true` 作为临时解决方案存在,并非默认设置。在修改前,请先查阅相关的 SillyTavern 问题。
模型下拉菜单为空。账户通常没问题;是 SillyTavern 未能加载模型列表。请刷新连接并重启。如果仍然失败,请手动输入模型页面上的确切模型 slug。
Connect 功能可以连接,但生成失败。Connect 仅能证明密钥有效。请切换到其他模型进行测试,确认账户有余额可用于付费模型,检查 slug 路径,如果大型卡片、设定集或历史记录超出上下文窗口,请降低上下文长度。
常见问题
如何将 OpenRouter 连接到 SillyTavern?
打开 API 连接面板,将 API 类型设置为 Chat Completion,选择 OpenRouter 作为来源,点击 Authorize 获取 OAuth 密钥,或从 openrouter.ai/settings/keys 粘贴一个密钥,点击 Connect,选择一个模型,然后发送一条测试消息。
OpenRouter 对 SillyTavern 真的免费吗?
对于标记为 :free 的模型,是的,但有使用限制。免费模型的使用上限为每天 50 次请求,每分钟 20 次。一次性购买 10 美元额度后,每日上限提升至 1000 次请求,每分钟上限保持不变。这不是订阅制,且该额度可用于付费模型。
最适合 SillyTavern 角色扮演的免费模型是什么?
meta-llama/llama-3.3-70b-instruct:free 是一个强劲的选择,可用时支持 131K 上下文。免费模型的可用性经常变化,因此在围绕某个模型搭建配置前,请确认确切的 :free slug 在 openrouter.ai/models?q=free 上处于可用状态。
如何修复“无法验证 OpenRouter token”?
这通常是 DNS 或网络问题,而非密钥本身的问题。将 DNS 切换到 8.8.8.8(Google)或 1.1.1.1(Cloudflare),确认密钥处于激活状态,重新粘贴密钥并确保末尾没有空格,然后重启 SillyTavern。
为什么我的生成内容会提前停止?
首先检查响应的 finish reason,因为相同的症状可能有多种原因:提供商的审核机制、max-tokens 限制、上下文长度问题或流式传输行为。如果某个提供商总是截断场景,请尝试其他模型或提供商;如果响应仅仅是过早结束,则提高最大输出设置。
为 SillyTavern 选择 OpenRouter 还是单一提供商密钥?
如果你只使用一个提供商且希望计费最简单,请使用直接密钥。如果你希望一套配置支持多种模型、提供商路由、路由故障时的备用方案、可尝试的免费模型以及统一的额度池,请使用 OpenRouter。