# SillyTavern 接入 NezhaGate：10 分钟上手教程

零基础照着做：在 SillyTavern 里填好 NezhaGate 的地址和 API Key，选模型，发出第一条消息。附推荐模型和常见报错的解决办法。

> https://nezhagate.com/docs/integrations/sillytavern

## 开始前你需要

- 一台电脑（Windows、macOS 或 Linux 都可以）。

- 一个 NezhaGate 账号和 API Key（第 1 步教你拿）。

- 大约 10 分钟。已经装好 SillyTavern 的话，直接跳到第 3 步。

## 第 1 步：注册 NezhaGate，创建 API Key

1. 打开 [nezhagate.com](https://nezhagate.com/)，点右上角「免费注册」。可以用邮箱注册，也可以用 Google / GitHub 一键登录。

2. 登录后进入「控制台」→「API Keys」。在「创建 API Key」里给 Key 起个名字（比如 `sillytavern`），「单 Key 限额」填 0 表示不限，然后点「创建 Key」。

3. 页面会显示一串以 `sk-` 开头的 Key，**马上点复制**，它只显示这一次。先粘贴到记事本里备用。

余额在「账单」页查看和充值。按实际用量计费，请求失败不扣费。各模型价格见 [定价页](https://nezhagate.com/pricing)。

## 第 2 步：安装并启动 SillyTavern

SillyTavern 需要先装两个免费工具：**Node.js**（20 或更高版本，官网下载 LTS 版一路下一步即可）和 **Git**。

### Windows

1. 新建一个普通文件夹，比如 `D:\AI`。**不要**放在 Program Files、System32 这类系统目录里。

2. 打开这个文件夹，在资源管理器的地址栏输入 `cmd` 回车，会弹出黑色命令行窗口。

3. 粘贴下面这行命令并回车，等它下载完：

```
git clone https://github.com/SillyTavern/SillyTavern -b release
```

1. 进入新出现的 `SillyTavern` 文件夹，双击 `Start.bat`（不要右键「以管理员身份运行」）。第一次启动会自动安装依赖，稍等一会儿。

### macOS / Linux

打开「终端」，粘贴下面这行并回车：

```
git clone https://github.com/SillyTavern/SillyTavern -b release && cd SillyTavern && ./start.sh
```

启动成功后，浏览器会自动打开 `http://127.0.0.1:8000`。以后每次使用，都是再次运行 `Start.bat`（或 `./start.sh`），这个命令行窗口要一直开着。

## 第 3 步：在 SillyTavern 里连接 NezhaGate

1. 点顶部工具栏的**插头图标**（鼠标悬停显示「API 连接」）。

2. 「API」下拉框选「**聊天补全**」（Chat Completion）。

3. 「聊天补全来源」选「**自定义（兼容 OpenAI）**」（Custom (OpenAI-compatible)）。

4. 「自定义端点（基础 URL）」填：

```
https://nezhagate.com/v1
```

1. 「自定义 API 密钥」粘贴第 1 步复制的 Key。

2. 点「**连接**」。状态显示 **Valid**，就说明地址和 Key 都对了，「可用模型」列表也会自动加载出来。

3. 在「可用模型」里选一个模型，新手推荐 `deepseek-v4.1-flash`。也可以在「输入模型名」里直接填模型 ID。

4. 点「**发送测试消息**」，看到 **API connection successful!** 就接好了。这条测试是一次真实调用，费用极低。

地址只填到 `/v1`。SillyTavern 会自动在后面加 `/chat/completions`，你自己再加一遍会 404。

现在回到聊天页，选一个角色卡就可以开始聊了。

## 第 4 步：调两个参数（很重要）

点顶部最左边的**滑块图标**，打开 AI 回复参数面板（AI Response Configuration），把下面两项改掉。SillyTavern 的默认值是给小模型准备的，直接用会出问题：

| 设置项 | 默认 | 建议 | 为什么 |
| --- | --- | --- | --- |
| 最大回复长度（Max Response Length） | 300 | 2000–4000 | DeepSeek、Kimi、GLM、Qwen、Grok 都会先「思考」再回答，思考也占回复长度。300 太小，回复容易被截断甚至是空的。 |
| 上下文长度（Context Size） | 4095 | 16000–32000 | 决定每次带上多少聊天记录。太小角色会「失忆」；太大每条消息都更贵。 |

只按实际生成的内容计费，把最大回复长度调大不会让你多花钱，它只是个上限。

## 推荐模型

| 你想要 | 模型 ID | 说明 |
| --- | --- | --- |
| 便宜、快，适合长期跑团 | `deepseek-v4.1-flash` | 价格低，中文英文都自然。可以关掉思考，回复更快更省（见下方）。 |
| 文笔最好，叙事、长篇 | `claude-fable-5` | 人物动机和情绪推进更连贯，适合小说和剧本式角色扮演；价格较高。 |
| 设定多、世界书长 | `kimi-k3` | 长文本理解强，中文写作好。温度由模型固定，调温度不起作用。 |
| 均衡 | `glm-5.3`、`qwen3.7-max` | 总是先思考，记得把最大回复长度调到 2000 以上。 |

价格随时可在 [定价页](https://nezhagate.com/pricing) 查看；换模型只需要在「可用模型」里重新选择。

### DeepSeek 关闭思考

在 API 连接面板点「**附加参数**」，在「包含主体参数」里填下面两行，保存：

```
thinking:
  type: disabled
```

换回其它模型时记得把它删掉。

## 常见问题和报错

| 现象 | 怎么办 |
| --- | --- |
| 点「连接」后显示 Status check bypassed，模型列表是空的 | 地址或 Key 不对，或者网络连不上。确认地址是 `https://nezhagate.com/v1`，Key 完整复制、前后没有空格。 |
| 「发送测试消息」提示 Could not get a reply from API | 同上，先检查地址和 Key；再确认账户有余额。 |
| 404 | 地址末尾多写了 `/chat/completions`，删掉只留 `/v1`。 |
| 401 | Key 错误或已删除。回控制台重新创建并复制。 |
| 402 | 余额不足，或这个 Key 超过了你设的限额。到「账单」充值，或在控制台调高限额。 |
| 400，提示某个参数不支持（例如用 `grok-4.7` 时的 `stop`） | 点「附加参数」，在「排除主体参数」里加一行 `- stop`（换成报错里提到的参数名）。 |
| 回复只有半截，或者是空的 | 把最大回复长度调大（第 4 步）。 |
| 调了温度（Temperature）好像没变化 | 部分模型（Claude 5 代、Kimi K3、GPT 系列）会忽略温度等采样参数，这是正常的，不会报错。 |

还有问题？看 [接入文档](https://nezhagate.com/docs-guide) 或 [常见问题](https://nezhagate.com/faq)。
