NezhaGateNezhaGate
← Все инструкции

SillyTavern + NezhaGate: настройка за 10 минут

Пошагово для новичков: подключите SillyTavern к NezhaGate, выберите модель и отправьте первое сообщение. Плюс рекомендуемые модели и частые ошибки.

Около 10 минут · Проверено на версии SillyTavern 1.19

Что понадобится

Шаг 1. Регистрация в NezhaGate и создание API-ключа

  1. Откройте nezhagate.com и нажмите «Зарегистрироваться бесплатно» в правом верхнем углу. Подойдёт вход по email, а также вход в один клик через Google или GitHub.
  2. После входа перейдите в «Консоль → API-ключи». В разделе «Создать API-ключ» в поле «Название ключа» укажите имя ключа (например, sillytavern), оставьте «Лимит на ключ (USD, 0 = без ограничений)» равным 0 (без ограничения) и нажмите «Создать ключ».
  3. Появится ключ, начинающийся с sk-. Скопируйте его сразу же: он показывается только один раз. Вставьте его в блокнот — он понадобится на следующих шагах.
[Скриншот: «Консоль → API-ключи», отмечены кнопка «Создать ключ» и кнопка копирования нового ключа]
Проверяйте и пополняйте баланс на странице «Оплата». Вы платите только за то, что реально использовали, а неудачные запросы никогда не оплачиваются. Актуальные цены по каждой модели — на странице цен.

Шаг 2. Установка и запуск SillyTavern

Для SillyTavern сначала понадобятся два бесплатных инструмента: Node.js (версия 20 или новее — скачайте установщик LTS-версии и пройдите шаги установки) и Git.

Windows

  1. Создайте обычную папку, например D:\AI. Не используйте системную папку вроде Program Files или System32.
  2. Откройте эту папку, введите cmd в адресной строке Проводника и нажмите Enter. Откроется чёрное окно командной строки.
  3. Вставьте эту строку, нажмите Enter и дождитесь окончания загрузки:
cmd
git clone https://github.com/SillyTavern/SillyTavern -b release
  1. Откройте новую папку SillyTavern и дважды щёлкните Start.bat (не выбирайте «Запуск от имени администратора»). При первом запуске устанавливаются зависимости — это займёт минуту.

macOS / Linux

Откройте Терминал, вставьте эту строку и нажмите Enter:

Terminal
git clone https://github.com/SillyTavern/SillyTavern -b release && cd SillyTavern && ./start.sh

Когда всё загрузится, браузер сам откроет http://127.0.0.1:8000. В следующий раз просто снова запустите Start.bat (или ./start.sh) и не закрывайте это окно командной строки, пока пользуетесь SillyTavern.

[Скриншот: главный экран SillyTavern при первом запуске, отмечен значок вилки в верхней панели]

Шаг 3. Подключение SillyTavern к NezhaGate

  1. Нажмите на значок вилки в верхней панели (в подсказке к нему написано «Соединение с API» (API Connections)).
  2. В выпадающем списке API выберите Chat Completion.
  3. В поле «Источник для Chat Completion» (Chat Completion Source) укажите «Кастомный (совместимый с OpenAI)» (Custom (OpenAI-compatible)).
  4. В поле «Кастомный эндпоинт (базовый URL)» (Custom Endpoint (Base URL)) введите:
Base URL
https://nezhagate.com/v1
  1. Вставьте ключ из шага 1 в поле «Ключ от кастомного API» (Custom API Key).
  2. Нажмите «Подключиться» (Connect). Когда статус покажет Valid, это значит, что адрес и ключ верны, и заполнится список «Доступные модели» (Available Models).
  3. Выберите модель в списке «Доступные модели»; хорошим первым выбором будет deepseek-v4.1-flash. Модель можно также ввести вручную в поле «Введите идентификатор модели» (Enter a Model ID).
  4. Нажмите «Тестовое сообщение» (Test Message). API connection successful! означает, что всё готово. Это один настоящий запрос, который стоит доли цента.
[Скриншот: панель «Соединение с API», на которой по порядку отмечены «Источник для Chat Completion», «Кастомный эндпоинт», API-ключ, кнопка «Подключиться», список «Доступные модели» и статус Valid]
Не дописывайте ничего после /v1. SillyTavern сам добавляет /chat/completions; если добавить это самостоятельно, получите 404.

Теперь вернитесь на экран чата, выберите карточку персонажа и начинайте общение.

Шаг 4. Измените две настройки (важно)

Нажмите на значок ползунков в левом краю верхней панели, чтобы открыть «Настройка ответа ИИ» (AI Response Configuration), и измените следующие два значения. Настройки SillyTavern по умолчанию рассчитаны на небольшие модели и создают проблемы с современными:

НастройкаПо умолчаниюИспользоватьПочему
«Макс. длина ответа (в токенах)» (Max Response Length (tokens))3002000–4000DeepSeek, Kimi, GLM, Qwen и Grok перед ответом рассуждают, и это рассуждение тоже учитывается в этой длине. При значении 300 ответы обрываются или приходят пустыми.
«Размер контекста (в токенах)» (Context Size (tokens))409516000–32000Сколько истории чата передаётся вместе с каждым сообщением. Слишком мало — персонажи забывают; слишком много — каждое сообщение стоит дороже.
Вы платите только за то, что модель реально сгенерировала, поэтому увеличение «Макс. длина ответа» само по себе не увеличивает стоимость. Это просто верхний потолок.

Рекомендуемые модели

Вам нужноID моделиПримечания
Дёшево и быстро, для длинных кампанийdeepseek-v4.1-flashНизкая цена, естественный английский и китайский языки. Отключите рассуждение для более быстрых и дешёвых ответов (см. ниже).
Лучшая проза, повествование, длинные текстыclaude-fable-5Стабильно удерживает мотивацию персонажей и целостность эмоциональных арок; создана для художественной прозы и ролевых игр в стиле сценария. Цена выше.
Большие лорбуки (lorebook) и объёмные карточки персонажейkimi-k3Отлично понимает длинный контекст. Температура жёстко задана моделью, поэтому ползунок «Температура» (Temperature) на неё не влияет.
Хороший универсальный вариантglm-5.3, qwen3.7-maxОбе модели всегда сначала рассуждают: держите «Макс. длина ответа» не ниже 2000.

Актуальные цены — на странице цен. Чтобы сменить модель, выберите другую в списке «Доступные модели».

Как отключить рассуждение у DeepSeek

На панели «Соединение с API» нажмите «Доп. параметры» (Additional Parameters), вставьте эти две строки в поле «Добавить параметры в тело» (Include Body Parameters) и сохраните:

YAML
thinking:
  type: disabled

Удалите эти строки, когда переключитесь на другую модель.

Частые проблемы и ошибки

Что вы видитеЧто делать
После нажатия Connect появляется "Status check bypassed", а список моделей пустАдрес или ключ неверны, либо сеть не может до нас достучаться. Проверьте, что адрес — это https://nezhagate.com/v1, и что ключ скопирован целиком, без пробелов по краям.
«Тестовое сообщение» показывает "Could not get a reply from API"Те же проверки, что и выше, а затем убедитесь, что на счету есть баланс.
404Адрес заканчивается на /chat/completions. Удалите эту часть и оставьте только /v1.
401Ключ неверный или был удалён. Создайте новый в консоли и скопируйте его.
402Баланс закончился, либо ключ упёрся в заданный вами лимит. Пополните баланс на странице «Оплата» или увеличьте лимит ключа.
400 из-за неподдерживаемого параметра (например, stop с grok-4.7)Откройте «Доп. параметры» и добавьте строку - stop в поле «Исключить параметры из тела» (Exclude Body Parameters) (используйте параметр, указанный в ошибке).
Ответы обрываются на середине или приходят пустымиУвеличьте «Макс. длина ответа» (шаг 4).
Изменение «Температуры» как будто ничего не меняетНекоторые модели (поколение Claude 5, Kimi K3, семейство GPT) игнорируют настройки сэмплирования. Это ожидаемое поведение, оно не является ошибкой.

Не получилось разобраться? Смотрите документацию по API или FAQ.

Ещё нет API-ключа?

Зарегистрируйтесь и создайте ключ в консоли. Оплата по факту использования; неудачные запросы никогда не оплачиваются.

Получить API-ключ → Цены

Другие инструкции: Cherry Studio · Cline