跳到正文
北京时间
原文
OpenRouter:Announcements(RSS)· OpenRouter·· 2026-06-18精选AI 评分55

如何将 SillyTavern 连接到 OpenRouter(2026 指南)

How to Connect SillyTavern to OpenRouter (2026 Guide)

AI 导读

一个 OpenRouter API 密钥即可在 SillyTavern 的下拉菜单中解锁 300 多个模型,其中许多免费。指南包含五步连接流程、推荐尝试的角色扮演模型以及常见错误的修复方法。

推荐理由

如果你用 SillyTavern 玩角色扮演,这篇官方教程能让你五分钟接上 300+ 模型,但本身只是基础操作指南,没给出新认知。

正文 · AI 翻译

How to Connect SillyTavern to OpenRouter (2026 Guide)

在 SillyTavern 中使用多个 AI 模型,通常意味着要分别注册 Anthropic、Google、Mistral 等好几家的账号,每家都有自己的账户,而且往往还要每月 20 美元的订阅费。而一个 OpenRouter 密钥就能取代这一切,只需一个统一的额度余额,就能在 SillyTavern 的一个下拉菜单里使用来自 70 多家提供商的 300 多个模型。许多模型可以免费上手,大约五分钟你就能开始聊天了。

本指南涵盖连接步骤、值得一试的角色扮演模型、真正重要的设置,以及 SillyTavern 用户最常遇到的错误的解决办法。

五步将 SillyTavern 连接到 OpenRouter

在 SillyTavern 的 API Connections 面板中操作。目标是让 SillyTavern 指向 OpenRouter、验证你的密钥、选择一个模型,并在进行较长对话前先发送一条测试消息。

  1. 打开 API Connections 面板(顶栏中的插头图标),将 API Type 设置为 Chat Completion。
  2. 将 Chat Completion Source 设置为 OpenRouter。
  3. 点击 Authorize 通过 OAuth 流程创建密钥,或者到 openrouter.ai/settings/keys 生成一个密钥,然后粘贴到 API key 字段中。
  4. 点击 Connect,等待 SillyTavern 验证密钥。
  5. 从下拉菜单中选择一个模型,然后点击测试消息。

在投入长时间会话之前,先发送那条测试消息。连接成功只能证明 SillyTavern 能够验证你的密钥。如果模型不可用、提供商路由无法处理该请求、slug 有误、你的账户无法访问该模型,或者你的提示词超出了模型的上下文窗口,生成仍然可能失败。

几乎所有配置都请使用 Chat Completion。图像内联和工具调用只能通过 Chat Completion 工作,这也符合当前 OpenRouter 模型对提示词的预期方式。Text Completion 为高级用户提供了对原始提示词格式更精细的控制,但不适合作为起点。如果你所用的版本中 OpenRouter 只出现在 Chat Completion 来源下,这是正常的。完整的配置细节见SillyTavern OpenRouter 文档。

免费模型与 $10 额度规则

标记为:free的模型每 token 费用为 $0,但请求限制仍然适用,这一点常常让人措手不及。

账户状态每日 :free 上限每分钟上限
额度低于 $1050 次请求/天20 次请求/分钟
$10 或更多额度1,000 次请求/天20 次请求/分钟

这 $10 是一次性额度购买,而非订阅,并且它仍可用于付费模型。OpenRouter 不对提供商定价加收 加价,因此目录价格就是你实际支付的价格,失败的请求不计费。如果你已经直接向某个提供商付费并希望保留该合约,那就改为 自带密钥。

在“免费”模型上产生费用,几乎总是意味着按 token 计费和请求限制被触发了。检查一下你是否实际选择了付费模型、启用了付费回退路由,或者使用了一个不以 :free 结尾的 slug。触及免费模型上限是限制问题,而不是免费模型在向你收费。

值得一试的角色扮演模型

DeepSeek V3.2 是长场景下便宜、可靠的默认选择。若想要更具表现力、过滤更少的文本,可以试试 Euryale 微调版。当角色卡带有模型必须遵循的复杂指令时,Hermes 4 405B 比大多数模型处理得更好。

模型 slug上下文每 1M 输入/输出免费变体最适合
deepseek/deepseek-v3.2131K$0.23 / $0.34否廉价、连贯的长会话默认之选
deepseek/deepseek-r1-0528164K$0.50 / $2.15否推理密集型场景与规划
sao10k/l3.3-euryale-70b131K$0.65 / $0.75否富有角色个性的 RP 文本,配备长上下文窗口
gryphe/mythomax-l2-13b4K$0.06 / $0.06否经典的经济型主力模型,上下文窗口很小
aion-labs/aion-rp-llama-3.1-8b32K$0.80 / $1.60否专为角色扮演打造的微调模型,轻量级
nousresearch/hermes-4-405b131K$1.00 / $3.00否复杂角色卡,严格的指令遵循
z-ai/glm-4.6203K$0.43 / $1.74否强大的通用模型
mistralai/mistral-large-2512262K$0.50 / $1.50否精调付费选项,过滤更少

价格和上下文窗口已于 2026-06-16 对照 OpenRouter 目录核实。按 token 计费的价格会变动,因此在进行长时间会话前,请在该模型页面上确认。

免费变体会来来去去,而模型本身并未改变,而且它们通常比付费版本运行更小的上下文窗口。这就是角色卡在场景中途开始遗忘的常见原因。在你围绕任何免费模型搭建配置之前,请查看 openrouter.ai/models?q=free,并确认确切的 :free slug 仍然可用。

重要的设置与路由

先从保持聊天稳定的设置入手,等连接稳定后再进行调优。

  • 开启流式传输,这样回复会在模型生成时逐步显示。
  • 将上下文长度滑块设置为上表中该模型的真实窗口。免费变体更小,所以要查看目录页面,而不是第三方指南。
  • 为提升可靠性,请保持备用提供商启用。只有当你需要精确控制由哪个提供商处理请求时,才禁用它们。
  • 对于拥有庞大系统提示词或反复使用设定集上下文的长时运行角色,请使用提示词缓存。它不会让请求免费,但能降低多轮对话中重复输入的成本。

两个路由后缀加在模型 slug 的末尾。:nitro 会排序到最快的提供商;:floor 会排序到最便宜的。两者都对应 OpenRouter 的提供商路由排序选项。对于使用固定角色卡的长会话,:floor 加上提示词缓存能显著降低成本。对于时间敏感的生成,请使用 :nitro。

关于流式传输的一条计费说明:中止流式传输只会对支持取消的提供商停止处理和计费。有几家不支持,包括 AWS Bedrock、Groq、Google、Google AI Studio、Minimax 和 Mistral。对于这些提供商,或者对于非流式请求,模型会运行至完成并按完整响应计费。

让角色扮演对话保持私密

OpenRouter 的隐私保护归结为两个层面:OpenRouter 存储什么,以及为你的请求提供服务的提供商存储什么。除非你选择开启日志记录,否则 OpenRouter 不会存储提示词或响应,但它会保留 token 数量和延迟等使用元数据。下游提供商有自己的保留策略,这正是路由控制之所以重要的原因。

启用 零数据保留,即可按单次请求或整个账户,仅路由到不存储提示词或响应的提供商。OpenRouter 可能会为选择开启提示词与补全日志记录的用户提供小幅折扣;大多数角色扮演用户应当关闭该选项,而不是将角色卡和聊天记录暴露给日志。

OpenRouter 本身不筛选内容,但它会路由到执行各自政策的提供商,因此把这种设置称为“无审查”是言过其实。如果某个模型不断拒绝或截断场景,那是提供商的内容审核所致。请切换到过滤较少的模型或提供商。信任中心有具体说明。

修复最常见的错误

大多数 SillyTavern 和 OpenRouter 问题都归为几种模式。请从确切的错误信息入手,然后应用对应的修复方法。

“Could not verify OpenRouter token.”这是一个常见错误,而且这条信息具有误导性。密钥几乎总是没问题的;真正的原因是 DNS 或网络问题,导致 SillyTavern 无法访问 openrouter.ai,因此该请求从未得到验证。请在你的密钥页面确认密钥处于活跃状态,重新粘贴并确保末尾没有空格,如果你使用的是 OAuth 就重新授权,然后重启。如果问题仍然存在,请将 DNS 解析器切换为 8.8.8.8 或 1.1.1.1 并重启。大多数情况下,DNS 就是解决办法。

401 错误。 这意味着 OpenRouter 拒绝了 SillyTavern 发送的密钥。请重新生成密钥,再次粘贴时不要带尾部空格,并且如果你调用的是付费模型,请确认账户有余额。

OpenRouter 未出现在来源列表中。 请先将 API Type 设置为 Chat Completion,因为它在其他类型下不会显示。更新并重启 SillyTavern。只有在较旧或不寻常的安装环境中才需要编辑 config.yaml,此时 show_openrouter_api: true 是作为一种变通方案存在,而非默认设置。在修改之前,请先查看 相关的 SillyTavern issue。

模型下拉列表为空。 账户通常没有问题;是 SillyTavern 未能加载列表。刷新连接并重启。如果仍然失败,请从模型页面手动输入准确的模型 slug。

连接正常,但生成失败。 连接成功只能证明密钥有效。请切换到另一个模型进行测试,确认账户对某个付费模型有额度,检查 slug,并且如果大型角色卡、世界书或历史记录超出了上下文窗口,请降低上下文长度。

常见问题

如何将 OpenRouter 连接到 SillyTavern?

打开 API Connections 面板,将 API Type 设为 Chat Completion,选择 OpenRouter 作为来源,点击 Authorize 获取 OAuth 密钥,或从 openrouter.ai/settings/keys 粘贴一个密钥,点击 Connect,选择一个模型,然后发送一条测试消息。

OpenRouter 对 SillyTavern 真的免费吗?

对于标记为 :free 的模型,是的,但有额度限制。免费模型的使用上限为每天 50 次请求、每分钟 20 次。一次性购买 $10 额度后,每日上限提升至 1,000 次请求,而每分钟上限保持不变。这不是订阅制,且额度仍可用于付费模型。

SillyTavern 角色扮演最好的免费模型是哪个?

meta-llama/llama-3.3-70b-instruct:free是一个很强的选择,在可用时提供 131K 上下文。免费模型的可用性经常变化,因此请确认确切的:freeslug 已在以下地址上线openrouter.ai/models?q=free再围绕它构建配置。

如何修复“could not verify OpenRouter token”?

这通常是 DNS 或网络问题,而不是密钥有问题。把你的 DNS 切换到 8.8.8.8(Google)或 1.1.1.1(Cloudflare),确认密钥处于有效状态,重新粘贴并确保末尾没有空格,然后重启 SillyTavern。

为什么我的生成会提前停止?

先检查响应的 finish reason,因为同样的症状可能有多种原因:提供商的内容审核、max-tokens 限制、上下文长度问题,或流式传输行为。如果某个提供商总是把场景截断,就换一个模型或提供商试试;如果响应只是结束得太早,那就调高最大输出设置。

SillyTavern 该用 OpenRouter 还是单一提供商的密钥?

如果你只使用一个提供商,并且想要最简单的计费方式,就直接使用该提供商的密钥。如果你希望用一套配置对接多种模型、进行提供商路由、在某条路由宕机时自动回退、用免费模型做实验,并且使用统一的额度池,那就使用 OpenRouter。

来源:OpenRouter:Announcements(RSS) · openrouter.ai