# SillyTavern + NezhaGate: настройка за 10 минут

Пошагово для новичков: подключите SillyTavern к NezhaGate, выберите модель и отправьте первое сообщение. Плюс рекомендуемые модели и частые ошибки.

> https://nezhagate.com/ru/docs/integrations/sillytavern

## Что понадобится

- Компьютер с Windows, macOS или Linux.

- Аккаунт NezhaGate и API-ключ (как их получить — см. шаг 1).

- Около 10 минут. Уже установили SillyTavern? Переходите сразу к шагу 3.

## Шаг 1. Регистрация в NezhaGate и создание API-ключа

1. Откройте [nezhagate.com](https://nezhagate.com/ru/) и нажмите «Зарегистрироваться бесплатно» в правом верхнем углу. Подойдёт вход по email, а также вход в один клик через Google или GitHub.

2. После входа перейдите в **«Консоль → API-ключи»**. В разделе **«Создать API-ключ»** в поле «Название ключа» укажите имя ключа (например, `sillytavern`), оставьте **«Лимит на ключ (USD, 0 = без ограничений)»** равным 0 (без ограничения) и нажмите **«Создать ключ»**.

3. Появится ключ, начинающийся с `sk-`. **Скопируйте его сразу же**: он показывается только один раз. Вставьте его в блокнот — он понадобится на следующих шагах.

Проверяйте и пополняйте баланс на странице **«Оплата»**. Вы платите только за то, что реально использовали, а неудачные запросы никогда не оплачиваются. Актуальные цены по каждой модели — на [странице цен](https://nezhagate.com/ru/pricing).

## Шаг 2. Установка и запуск SillyTavern

Для SillyTavern сначала понадобятся два бесплатных инструмента: **Node.js** (версия 20 или новее — скачайте установщик LTS-версии и пройдите шаги установки) и **Git**.

### Windows

1. Создайте обычную папку, например `D:\AI`. **Не** используйте системную папку вроде Program Files или System32.

2. Откройте эту папку, введите `cmd` в адресной строке Проводника и нажмите Enter. Откроется чёрное окно командной строки.

3. Вставьте эту строку, нажмите Enter и дождитесь окончания загрузки:

```
git clone https://github.com/SillyTavern/SillyTavern -b release
```

1. Откройте новую папку `SillyTavern` и дважды щёлкните `Start.bat` (не выбирайте «Запуск от имени администратора»). При первом запуске устанавливаются зависимости — это займёт минуту.

### macOS / Linux

Откройте Терминал, вставьте эту строку и нажмите Enter:

```
git clone https://github.com/SillyTavern/SillyTavern -b release && cd SillyTavern && ./start.sh
```

Когда всё загрузится, браузер сам откроет `http://127.0.0.1:8000`. В следующий раз просто снова запустите `Start.bat` (или `./start.sh`) и не закрывайте это окно командной строки, пока пользуетесь SillyTavern.

## Шаг 3. Подключение SillyTavern к NezhaGate

1. Нажмите на **значок вилки** в верхней панели (в подсказке к нему написано **«Соединение с API»** (API Connections)).

2. В выпадающем списке **API** выберите **Chat Completion**.

3. В поле **«Источник для Chat Completion»** (Chat Completion Source) укажите **«Кастомный (совместимый с OpenAI)»** (Custom (OpenAI-compatible)).

4. В поле **«Кастомный эндпоинт (базовый URL)»** (Custom Endpoint (Base URL)) введите:

```
https://nezhagate.com/v1
```

1. Вставьте ключ из шага 1 в поле **«Ключ от кастомного API»** (Custom API Key).

2. Нажмите **«Подключиться»** (Connect). Когда статус покажет **Valid**, это значит, что адрес и ключ верны, и заполнится список **«Доступные модели»** (Available Models).

3. Выберите модель в списке **«Доступные модели»**; хорошим первым выбором будет `deepseek-v4.1-flash`. Модель можно также ввести вручную в поле **«Введите идентификатор модели»** (Enter a Model ID).

4. Нажмите **«Тестовое сообщение»** (Test Message). **API connection successful!** означает, что всё готово. Это один настоящий запрос, который стоит доли цента.

Не дописывайте ничего после `/v1`. SillyTavern сам добавляет `/chat/completions`; если добавить это самостоятельно, получите 404.

Теперь вернитесь на экран чата, выберите карточку персонажа и начинайте общение.

## Шаг 4. Измените две настройки (важно)

Нажмите на **значок ползунков** в левом краю верхней панели, чтобы открыть **«Настройка ответа ИИ»** (AI Response Configuration), и измените следующие два значения. Настройки SillyTavern по умолчанию рассчитаны на небольшие модели и создают проблемы с современными:

| Настройка | По умолчанию | Использовать | Почему |
| --- | --- | --- | --- |
| «Макс. длина ответа (в токенах)» (Max Response Length (tokens)) | 300 | 2000–4000 | DeepSeek, Kimi, GLM, Qwen и Grok перед ответом рассуждают, и это рассуждение тоже учитывается в этой длине. При значении 300 ответы обрываются или приходят пустыми. |
| «Размер контекста (в токенах)» (Context Size (tokens)) | 4095 | 16000–32000 | Сколько истории чата передаётся вместе с каждым сообщением. Слишком мало — персонажи забывают; слишком много — каждое сообщение стоит дороже. |

Вы платите только за то, что модель реально сгенерировала, поэтому увеличение «Макс. длина ответа» само по себе не увеличивает стоимость. Это просто верхний потолок.

## Рекомендуемые модели

| Вам нужно | ID модели | Примечания |
| --- | --- | --- |
| Дёшево и быстро, для длинных кампаний | `deepseek-v4.1-flash` | Низкая цена, естественный английский и китайский языки. Отключите рассуждение для более быстрых и дешёвых ответов (см. ниже). |
| Лучшая проза, повествование, длинные тексты | `claude-fable-5` | Стабильно удерживает мотивацию персонажей и целостность эмоциональных арок; создана для художественной прозы и ролевых игр в стиле сценария. Цена выше. |
| Большие лорбуки (lorebook) и объёмные карточки персонажей | `kimi-k3` | Отлично понимает длинный контекст. Температура жёстко задана моделью, поэтому ползунок «Температура» (Temperature) на неё не влияет. |
| Хороший универсальный вариант | `glm-5.3`, `qwen3.7-max` | Обе модели всегда сначала рассуждают: держите «Макс. длина ответа» не ниже 2000. |

Актуальные цены — на [странице цен](https://nezhagate.com/ru/pricing). Чтобы сменить модель, выберите другую в списке «Доступные модели».

### Как отключить рассуждение у DeepSeek

На панели «Соединение с API» нажмите **«Доп. параметры»** (Additional Parameters), вставьте эти две строки в поле **«Добавить параметры в тело»** (Include Body Parameters) и сохраните:

```
thinking:
  type: disabled
```

Удалите эти строки, когда переключитесь на другую модель.

## Частые проблемы и ошибки

| Что вы видите | Что делать |
| --- | --- |
| После нажатия Connect появляется "Status check bypassed", а список моделей пуст | Адрес или ключ неверны, либо сеть не может до нас достучаться. Проверьте, что адрес — это `https://nezhagate.com/v1`, и что ключ скопирован целиком, без пробелов по краям. |
| «Тестовое сообщение» показывает "Could not get a reply from API" | Те же проверки, что и выше, а затем убедитесь, что на счету есть баланс. |
| 404 | Адрес заканчивается на `/chat/completions`. Удалите эту часть и оставьте только `/v1`. |
| 401 | Ключ неверный или был удалён. Создайте новый в консоли и скопируйте его. |
| 402 | Баланс закончился, либо ключ упёрся в заданный вами лимит. Пополните баланс на странице «Оплата» или увеличьте лимит ключа. |
| 400 из-за неподдерживаемого параметра (например, `stop` с `grok-4.7`) | Откройте «Доп. параметры» и добавьте строку `- stop` в поле **«Исключить параметры из тела»** (Exclude Body Parameters) (используйте параметр, указанный в ошибке). |
| Ответы обрываются на середине или приходят пустыми | Увеличьте «Макс. длина ответа» (шаг 4). |
| Изменение «Температуры» как будто ничего не меняет | Некоторые модели (поколение Claude 5, Kimi K3, семейство GPT) игнорируют настройки сэмплирования. Это ожидаемое поведение, оно не является ошибкой. |

Не получилось разобраться? Смотрите [документацию по API](https://nezhagate.com/ru/docs-guide) или [FAQ](https://nezhagate.com/ru/faq).
