如何将 SillyTavern 连接到 OpenRouter(2026 指南)
How to Connect SillyTavern to OpenRouter (2026 Guide)
一个 OpenRouter API 密钥即可在 SillyTavern 的下拉菜单中解锁 300 多个模型,其中许多免费。指南包含五步连接流程、推荐尝试的角色扮演模型以及常见错误的修复方法。
如果你用 SillyTavern 玩角色扮演,这篇官方教程能让你五分钟接上 300+ 模型,但本身只是基础操作指南,没给出新认知。

在 SillyTavern 中使用多个 AI 模型,通常意味着要分别注册 Anthropic、Google、Mistral 等好几家的账号,每家都有自己的账户,而且往往还要每月 20 美元的订阅费。而一个 OpenRouter 密钥就能取代这一切,只需一个统一的额度余额,就能在 SillyTavern 的一个下拉菜单里使用来自 70 多家提供商的 300 多个模型。许多模型可以免费上手,大约五分钟你就能开始聊天了。
本指南涵盖连接步骤、值得一试的角色扮演模型、真正重要的设置,以及 SillyTavern 用户最常遇到的错误的解决办法。
五步将 SillyTavern 连接到 OpenRouter
在 SillyTavern 的 API Connections 面板中操作。目标是让 SillyTavern 指向 OpenRouter、验证你的密钥、选择一个模型,并在进行较长对话前先发送一条测试消息。
- 打开 API Connections 面板(顶栏中的插头图标),将 API Type 设置为 Chat Completion。
- 将 Chat Completion Source 设置为 OpenRouter。
- 点击 Authorize 通过 OAuth 流程创建密钥,或者到 openrouter.ai/settings/keys 生成一个密钥,然后粘贴到 API key 字段中。
- 点击 Connect,等待 SillyTavern 验证密钥。
- 从下拉菜单中选择一个模型,然后点击测试消息。
在投入长时间会话之前,先发送那条测试消息。连接成功只能证明 SillyTavern 能够验证你的密钥。如果模型不可用、提供商路由无法处理该请求、slug 有误、你的账户无法访问该模型,或者你的提示词超出了模型的上下文窗口,生成仍然可能失败。
几乎所有配置都请使用 Chat Completion。图像内联和工具调用只能通过 Chat Completion 工作,这也符合当前 OpenRouter 模型对提示词的预期方式。Text Completion 为高级用户提供了对原始提示词格式更精细的控制,但不适合作为起点。如果你所用的版本中 OpenRouter 只出现在 Chat Completion 来源下,这是正常的。完整的配置细节见SillyTavern OpenRouter 文档。
免费模型与 $10 额度规则
标记为:free的模型每 token 费用为 $0,但请求限制仍然适用,这一点常常让人措手不及。
| 账户状态 | 每日 :free 上限 | 每分钟上限 |
|---|---|---|
| 额度低于 $10 | 50 次请求/天 | 20 次请求/分钟 |
| $10 或更多额度 | 1,000 次请求/天 | 20 次请求/分钟 |
这 $10 是一次性额度购买,而非订阅,并且它仍可用于付费模型。OpenRouter 不对提供商定价加收 加价,因此目录价格就是你实际支付的价格,失败的请求不计费。如果你已经直接向某个提供商付费并希望保留该合约,那就改为 自带密钥。
在“免费”模型上产生费用,几乎总是意味着按 token 计费和请求限制被触发了。检查一下你是否实际选择了付费模型、启用了付费回退路由,或者使用了一个不以 :free 结尾的 slug。触及免费模型上限是限制问题,而不是免费模型在向你收费。
值得一试的角色扮演模型
DeepSeek V3.2 是长场景下便宜、可靠的默认选择。若想要更具表现力、过滤更少的文本,可以试试 Euryale 微调版。当角色卡带有模型必须遵循的复杂指令时,Hermes 4 405B 比大多数模型处理得更好。
| 模型 slug | 上下文 | 每 1M 输入/输出 | 免费变体 | 最适合 |
|---|---|---|---|---|
deepseek/deepseek-v3.2 | 131K | $0.23 / $0.34 | 否 | 廉价、连贯的长会话默认之选 |
deepseek/deepseek-r1-0528 | 164K | $0.50 / $2.15 | 否 | 推理密集型场景与规划 |
sao10k/l3.3-euryale-70b | 131K | $0.65 / $0.75 | 否 | 富有角色个性的 RP 文本,配备长上下文窗口 |
gryphe/mythomax-l2-13b | 4K | $0.06 / $0.06 | 否 | 经典的经济型主力模型,上下文窗口很小 |
aion-labs/aion-rp-llama-3.1-8b | 32K | $0.80 / $1.60 | 否 | 专为角色扮演打造的微调模型,轻量级 |
nousresearch/hermes-4-405b | 131K | $1.00 / $3.00 | 否 | 复杂角色卡,严格的指令遵循 |
z-ai/glm-4.6 | 203K | $0.43 / $1.74 | 否 | 强大的通用模型 |
mistralai/mistral-large-2512 | 262K | $0.50 / $1.50 | 否 | 精调付费选项,过滤更少 |
价格和上下文窗口已于 2026-06-16 对照 OpenRouter 目录核实。按 token 计费的价格会变动,因此在进行长时间会话前,请在该模型页面上确认。
免费变体会来来去去,而模型本身并未改变,而且它们通常比付费版本运行更小的上下文窗口。这就是角色卡在场景中途开始遗忘的常见原因。在你围绕任何免费模型搭建配置之前,请查看 openrouter.ai/models?q=free,并确认确切的 :free slug 仍然可用。
重要的设置与路由
先从保持聊天稳定的设置入手,等连接稳定后再进行调优。
- 开启流式传输,这样回复会在模型生成时逐步显示。
- 将上下文长度滑块设置为上表中该模型的真实窗口。免费变体更小,所以要查看目录页面,而不是第三方指南。
- 为提升可靠性,请保持备用提供商启用。只有当你需要精确控制由哪个提供商处理请求时,才禁用它们。
- 对于拥有庞大系统提示词或反复使用设定集上下文的长时运行角色,请使用提示词缓存。它不会让请求免费,但能降低多轮对话中重复输入的成本。
两个路由后缀加在模型 slug 的末尾。:nitro 会排序到最快的提供商;:floor 会排序到最便宜的。两者都对应 OpenRouter 的提供商路由排序选项。对于使用固定角色卡的长会话,:floor 加上提示词缓存能显著降低成本。对于时间敏感的生成,请使用 :nitro。
关于流式传输的一条计费说明:中止流式传输只会对支持取消的提供商停止处理和计费。有几家不支持,包括 AWS Bedrock、Groq、Google、Google AI Studio、Minimax 和 Mistral。对于这些提供商,或者对于非流式请求,模型会运行至完成并按完整响应计费。
让角色扮演对话保持私密
OpenRouter 的隐私保护归结为两个层面:OpenRouter 存储什么,以及为你的请求提供服务的提供商存储什么。除非你选择开启日志记录,否则 OpenRouter 不会存储提示词或响应,但它会保留 token 数量和延迟等使用元数据。下游提供商有自己的保留策略,这正是路由控制之所以重要的原因。
启用 零数据保留,即可按单次请求或整个账户,仅路由到不存储提示词或响应的提供商。OpenRouter 可能会为选择开启提示词与补全日志记录的用户提供小幅折扣;大多数角色扮演用户应当关闭该选项,而不是将角色卡和聊天记录暴露给日志。
OpenRouter 本身不筛选内容,但它会路由到执行各自政策的提供商,因此把这种设置称为“无审查”是言过其实。如果某个模型不断拒绝或截断场景,那是提供商的内容审核所致。请切换到过滤较少的模型或提供商。信任中心有具体说明。
修复最常见的错误
大多数 SillyTavern 和 OpenRouter 问题都归为几种模式。请从确切的错误信息入手,然后应用对应的修复方法。
“Could not verify OpenRouter token.”这是一个常见错误,而且这条信息具有误导性。密钥几乎总是没问题的;真正的原因是 DNS 或网络问题,导致 SillyTavern 无法访问 openrouter.ai,因此该请求从未得到验证。请在你的密钥页面确认密钥处于活跃状态,重新粘贴并确保末尾没有空格,如果你使用的是 OAuth 就重新授权,然后重启。如果问题仍然存在,请将 DNS 解析器切换为 8.8.8.8 或 1.1.1.1 并重启。大多数情况下,DNS 就是解决办法。
401 错误。 这意味着 OpenRouter 拒绝了 SillyTavern 发送的密钥。请重新生成密钥,再次粘贴时不要带尾部空格,并且如果你调用的是付费模型,请确认账户有余额。
OpenRouter 未出现在来源列表中。 请先将 API Type 设置为 Chat Completion,因为它在其他类型下不会显示。更新并重启 SillyTavern。只有在较旧或不寻常的安装环境中才需要编辑 config.yaml,此时 show_openrouter_api: true 是作为一种变通方案存在,而非默认设置。在修改之前,请先查看 相关的 SillyTavern issue。
模型下拉列表为空。 账户通常没有问题;是 SillyTavern 未能加载列表。刷新连接并重启。如果仍然失败,请从模型页面手动输入准确的模型 slug。
连接正常,但生成失败。 连接成功只能证明密钥有效。请切换到另一个模型进行测试,确认账户对某个付费模型有额度,检查 slug,并且如果大型角色卡、世界书或历史记录超出了上下文窗口,请降低上下文长度。
常见问题
如何将 OpenRouter 连接到 SillyTavern?
打开 API Connections 面板,将 API Type 设为 Chat Completion,选择 OpenRouter 作为来源,点击 Authorize 获取 OAuth 密钥,或从 openrouter.ai/settings/keys 粘贴一个密钥,点击 Connect,选择一个模型,然后发送一条测试消息。
OpenRouter 对 SillyTavern 真的免费吗?
对于标记为 :free 的模型,是的,但有额度限制。免费模型的使用上限为每天 50 次请求、每分钟 20 次。一次性购买 $10 额度后,每日上限提升至 1,000 次请求,而每分钟上限保持不变。这不是订阅制,且额度仍可用于付费模型。
SillyTavern 角色扮演最好的免费模型是哪个?
meta-llama/llama-3.3-70b-instruct:free是一个很强的选择,在可用时提供 131K 上下文。免费模型的可用性经常变化,因此请确认确切的:freeslug 已在以下地址上线openrouter.ai/models?q=free再围绕它构建配置。
如何修复“could not verify OpenRouter token”?
这通常是 DNS 或网络问题,而不是密钥有问题。把你的 DNS 切换到 8.8.8.8(Google)或 1.1.1.1(Cloudflare),确认密钥处于有效状态,重新粘贴并确保末尾没有空格,然后重启 SillyTavern。
为什么我的生成会提前停止?
先检查响应的 finish reason,因为同样的症状可能有多种原因:提供商的内容审核、max-tokens 限制、上下文长度问题,或流式传输行为。如果某个提供商总是把场景截断,就换一个模型或提供商试试;如果响应只是结束得太早,那就调高最大输出设置。
SillyTavern 该用 OpenRouter 还是单一提供商的密钥?
如果你只使用一个提供商,并且想要最简单的计费方式,就直接使用该提供商的密钥。如果你希望用一套配置对接多种模型、进行提供商路由、在某条路由宕机时自动回退、用免费模型做实验,并且使用统一的额度池,那就使用 OpenRouter。
来源:OpenRouter:Announcements(RSS) · openrouter.ai