NezhaGateNezhaGate

零基础照着做:在 SillyTavern 里填好 NezhaGate 的地址和 API Key,选模型,发出第一条消息。附推荐模型和常见报错的解决办法。

按此版本编写:SillyTavern 1.19

开始前你需要

  • 一台电脑(Windows、macOS 或 Linux 都可以)。
  • 一个 NezhaGate 账号和 API Key(第 1 步教你拿)。
  • 大约 10 分钟。已经装好 SillyTavern 的话,直接跳到第 3 步。

第 1 步:注册 NezhaGate,创建 API Key

  1. 打开 nezhagate.com,点右上角「免费注册」。可以用邮箱注册,也可以用 Google / GitHub 一键登录。
  2. 登录后进入「控制台」→「API Keys」。在「创建 API Key」里给 Key 起个名字(比如 sillytavern),「单 Key 限额」填 0 表示不限,然后点「创建 Key」。
  3. 页面会显示一串以 sk- 开头的 Key,马上点复制,它只显示这一次。先粘贴到记事本里备用。
【截图:控制台 → API Keys 页面,标出「创建 Key」按钮和新 Key 的复制按钮】
余额在「账单」页查看和充值。按实际用量计费,请求失败不扣费。各模型价格见 定价页。

第 2 步:安装并启动 SillyTavern

SillyTavern 需要先装两个免费工具:Node.js(20 或更高版本,官网下载 LTS 版一路下一步即可)和 Git。

Windows

  1. 新建一个普通文件夹,比如 D:\AI。不要放在 Program Files、System32 这类系统目录里。
  2. 打开这个文件夹,在资源管理器的地址栏输入 cmd 回车,会弹出黑色命令行窗口。
  3. 粘贴下面这行命令并回车,等它下载完:
cmd
git clone https://github.com/SillyTavern/SillyTavern -b release
  1. 进入新出现的 SillyTavern 文件夹,双击 Start.bat(不要右键「以管理员身份运行」)。第一次启动会自动安装依赖,稍等一会儿。

macOS / Linux

打开「终端」,粘贴下面这行并回车:

Terminal
git clone https://github.com/SillyTavern/SillyTavern -b release && cd SillyTavern && ./start.sh

启动成功后,浏览器会自动打开 http://127.0.0.1:8000。以后每次使用,都是再次运行 Start.bat(或 ./start.sh),这个命令行窗口要一直开着。

【截图:SillyTavern 首次打开的主界面,标出顶部的插头图标】

第 3 步:在 SillyTavern 里连接 NezhaGate

  1. 点顶部工具栏的插头图标(鼠标悬停显示「API 连接」)。
  2. 「API」下拉框选「聊天补全」(Chat Completion)。
  3. 「聊天补全来源」选「自定义(兼容 OpenAI)」(Custom (OpenAI-compatible))。
  4. 「自定义端点(基础 URL)」填:
Base URL
https://nezhagate.com/v1
  1. 「自定义 API 密钥」粘贴第 1 步复制的 Key。
  2. 点「连接」。状态显示 Valid,就说明地址和 Key 都对了,「可用模型」列表也会自动加载出来。
  3. 在「可用模型」里选一个模型,新手推荐 deepseek-v4.1-flash。也可以在「输入模型名」里直接填模型 ID。
  4. 点「发送测试消息」,看到 API connection successful! 就接好了。这条测试是一次真实调用,费用极低。
【截图:API 连接面板,依次标出:聊天补全来源、自定义端点、API 密钥、连接按钮、可用模型、Valid 状态】
地址只填到 /v1。SillyTavern 会自动在后面加 /chat/completions,你自己再加一遍会 404。

现在回到聊天页,选一个角色卡就可以开始聊了。

第 4 步:调两个参数(很重要)

点顶部最左边的滑块图标,打开 AI 回复参数面板(AI Response Configuration),把下面两项改掉。SillyTavern 的默认值是给小模型准备的,直接用会出问题:

设置项默认建议为什么
最大回复长度(Max Response Length)3002000–4000DeepSeek、Kimi、GLM、Qwen、Grok 都会先「思考」再回答,思考也占回复长度。300 太小,回复容易被截断甚至是空的。
上下文长度(Context Size)409516000–32000决定每次带上多少聊天记录。太小角色会「失忆」;太大每条消息都更贵。
只按实际生成的内容计费,把最大回复长度调大不会让你多花钱,它只是个上限。

推荐模型

你想要模型 ID说明
便宜、快,适合长期跑团deepseek-v4.1-flash价格低,中文英文都自然。可以关掉思考,回复更快更省(见下方)。
文笔最好,叙事、长篇claude-fable-5人物动机和情绪推进更连贯,适合小说和剧本式角色扮演;价格较高。
设定多、世界书长kimi-k3长文本理解强,中文写作好。温度由模型固定,调温度不起作用。
均衡glm-5.3、qwen3.7-max总是先思考,记得把最大回复长度调到 2000 以上。

价格随时可在 定价页 查看;换模型只需要在「可用模型」里重新选择。

DeepSeek 关闭思考

在 API 连接面板点「附加参数」,在「包含主体参数」里填下面两行,保存:

YAML
thinking:
  type: disabled

换回其它模型时记得把它删掉。

常见问题和报错

现象怎么办
点「连接」后显示 Status check bypassed,模型列表是空的地址或 Key 不对,或者网络连不上。确认地址是 https://nezhagate.com/v1,Key 完整复制、前后没有空格。
「发送测试消息」提示 Could not get a reply from API同上,先检查地址和 Key;再确认账户有余额。
404地址末尾多写了 /chat/completions,删掉只留 /v1。
401Key 错误或已删除。回控制台重新创建并复制。
402余额不足,或这个 Key 超过了你设的限额。到「账单」充值,或在控制台调高限额。
400,提示某个参数不支持(例如用 grok-4.7 时的 stop)点「附加参数」,在「排除主体参数」里加一行 - stop(换成报错里提到的参数名)。
回复只有半截,或者是空的把最大回复长度调大(第 4 步)。
调了温度(Temperature)好像没变化部分模型(Claude 5 代、Kimi K3、GPT 系列)会忽略温度等采样参数,这是正常的,不会报错。

还有问题?看 接入文档 或 常见问题。

更多集成