SillyTavern 接入 NezhaGate:10 分钟上手教程
零基础照着做:在 SillyTavern 里填好 NezhaGate 的地址和 API Key,选模型,发出第一条消息。附推荐模型和常见报错的解决办法。
开始前你需要
- 一台电脑(Windows、macOS 或 Linux 都可以)。
- 一个 NezhaGate 账号和 API Key(第 1 步教你拿)。
- 大约 10 分钟。已经装好 SillyTavern 的话,直接跳到第 3 步。
第 1 步:注册 NezhaGate,创建 API Key
- 打开 nezhagate.com,点右上角「免费注册」。可以用邮箱注册,也可以用 Google / GitHub 一键登录。
- 登录后进入「控制台」→「API Keys」。在「创建 API Key」里给 Key 起个名字(比如
sillytavern),「单 Key 限额」填 0 表示不限,然后点「创建 Key」。 - 页面会显示一串以
sk-开头的 Key,马上点复制,它只显示这一次。先粘贴到记事本里备用。
【截图:控制台 → API Keys 页面,标出「创建 Key」按钮和新 Key 的复制按钮】
余额在「账单」页查看和充值。按实际用量计费,请求失败不扣费。各模型价格见 定价页。
第 2 步:安装并启动 SillyTavern
SillyTavern 需要先装两个免费工具:Node.js(20 或更高版本,官网下载 LTS 版一路下一步即可)和 Git。
Windows
- 新建一个普通文件夹,比如
D:\AI。不要放在 Program Files、System32 这类系统目录里。 - 打开这个文件夹,在资源管理器的地址栏输入
cmd回车,会弹出黑色命令行窗口。 - 粘贴下面这行命令并回车,等它下载完:
git clone https://github.com/SillyTavern/SillyTavern -b release
- 进入新出现的
SillyTavern文件夹,双击Start.bat(不要右键「以管理员身份运行」)。第一次启动会自动安装依赖,稍等一会儿。
macOS / Linux
打开「终端」,粘贴下面这行并回车:
git clone https://github.com/SillyTavern/SillyTavern -b release && cd SillyTavern && ./start.sh
启动成功后,浏览器会自动打开 http://127.0.0.1:8000。以后每次使用,都是再次运行 Start.bat(或 ./start.sh),这个命令行窗口要一直开着。
【截图:SillyTavern 首次打开的主界面,标出顶部的插头图标】
第 3 步:在 SillyTavern 里连接 NezhaGate
- 点顶部工具栏的插头图标(鼠标悬停显示「API 连接」)。
- 「API」下拉框选「聊天补全」(Chat Completion)。
- 「聊天补全来源」选「自定义(兼容 OpenAI)」(Custom (OpenAI-compatible))。
- 「自定义端点(基础 URL)」填:
https://nezhagate.com/v1
- 「自定义 API 密钥」粘贴第 1 步复制的 Key。
- 点「连接」。状态显示 Valid,就说明地址和 Key 都对了,「可用模型」列表也会自动加载出来。
- 在「可用模型」里选一个模型,新手推荐
deepseek-v4.1-flash。也可以在「输入模型名」里直接填模型 ID。 - 点「发送测试消息」,看到 API connection successful! 就接好了。这条测试是一次真实调用,费用极低。
【截图:API 连接面板,依次标出:聊天补全来源、自定义端点、API 密钥、连接按钮、可用模型、Valid 状态】
地址只填到
/v1。SillyTavern 会自动在后面加 /chat/completions,你自己再加一遍会 404。现在回到聊天页,选一个角色卡就可以开始聊了。
第 4 步:调两个参数(很重要)
点顶部最左边的滑块图标,打开 AI 回复参数面板(AI Response Configuration),把下面两项改掉。SillyTavern 的默认值是给小模型准备的,直接用会出问题:
| 设置项 | 默认 | 建议 | 为什么 |
|---|---|---|---|
| 最大回复长度(Max Response Length) | 300 | 2000–4000 | DeepSeek、Kimi、GLM、Qwen、Grok 都会先「思考」再回答,思考也占回复长度。300 太小,回复容易被截断甚至是空的。 |
| 上下文长度(Context Size) | 4095 | 16000–32000 | 决定每次带上多少聊天记录。太小角色会「失忆」;太大每条消息都更贵。 |
只按实际生成的内容计费,把最大回复长度调大不会让你多花钱,它只是个上限。
推荐模型
| 你想要 | 模型 ID | 说明 |
|---|---|---|
| 便宜、快,适合长期跑团 | deepseek-v4.1-flash | 价格低,中文英文都自然。可以关掉思考,回复更快更省(见下方)。 |
| 文笔最好,叙事、长篇 | claude-fable-5 | 人物动机和情绪推进更连贯,适合小说和剧本式角色扮演;价格较高。 |
| 设定多、世界书长 | kimi-k3 | 长文本理解强,中文写作好。温度由模型固定,调温度不起作用。 |
| 均衡 | glm-5.3、qwen3.7-max | 总是先思考,记得把最大回复长度调到 2000 以上。 |
价格随时可在 定价页 查看;换模型只需要在「可用模型」里重新选择。
DeepSeek 关闭思考
在 API 连接面板点「附加参数」,在「包含主体参数」里填下面两行,保存:
thinking: type: disabled
换回其它模型时记得把它删掉。
常见问题和报错
| 现象 | 怎么办 |
|---|---|
| 点「连接」后显示 Status check bypassed,模型列表是空的 | 地址或 Key 不对,或者网络连不上。确认地址是 https://nezhagate.com/v1,Key 完整复制、前后没有空格。 |
| 「发送测试消息」提示 Could not get a reply from API | 同上,先检查地址和 Key;再确认账户有余额。 |
| 404 | 地址末尾多写了 /chat/completions,删掉只留 /v1。 |
| 401 | Key 错误或已删除。回控制台重新创建并复制。 |
| 402 | 余额不足,或这个 Key 超过了你设的限额。到「账单」充值,或在控制台调高限额。 |
400,提示某个参数不支持(例如用 grok-4.7 时的 stop) | 点「附加参数」,在「排除主体参数」里加一行 - stop(换成报错里提到的参数名)。 |
| 回复只有半截,或者是空的 | 把最大回复长度调大(第 4 步)。 |
| 调了温度(Temperature)好像没变化 | 部分模型(Claude 5 代、Kimi K3、GPT 系列)会忽略温度等采样参数,这是正常的,不会报错。 |