NezhaGateNezhaGate
Документация API

NezhaGate API — документация для разработчиков

ИИ-шлюз, совместимый с OpenAI, — единый эндпоинт для всего каталога: GPT-5.5, семейство чат-моделей Gemini и генерация изображений gpt-image. Понятно человеку и копируется в один клик для ИИ-помощников по написанию кода.

Быстрый старт

Просто укажите свои Base URL и API-ключ — и ваш существующий OpenAI SDK заработает сразу, без доработок.

Base URL
https://nezhagate.com/v1
curl · API чата: Chat Completions
curl https://nezhagate.com/v1/chat/completions -H "Authorization: Bearer YOUR_API_KEY" -H "Content-Type: application/json" -d '{"model": "gpt-5.5", "messages": [{"role": "user", "content": "Напишите короткое вступление о продукте — API для ИИ"}], "stream": false}'

Полные параметры запроса, примеры и особенности асинхронных задач для каждой модели — в её собственной документации: откройте её из таблицы моделей и цен ниже.

Больше готовых к запуску примеров (Python / Node / curl, включая асинхронный процесс для изображений и видео): github.com/gaoorange/nezhagate-api-examples

Аутентификация

Для всех запросов к API требуется Bearer-токен.

Header
Authorization: Bearer YOUR_API_KEY
Content-Type: application/json

Модели и цены

Полные параметры запроса, примеры и особенности асинхронных задач для каждой модели — в её собственной документации: откройте её из таблицы моделей и цен ниже.

МодельВозможностьЭндпоинтЦена
deepseek-v4.1-flashЧат, рассуждение, программирование, вызов инструментов, переключаемый режим рассуждения/chat/completions Ввод $0.09/1M · Вывод $0.36/1M Документация API →
deepseek-v4-flash-0731Чат, рассуждение, программирование, вызов инструментов, переключаемый режим рассуждения, зафиксированная версия/chat/completions Ввод $0.045/1M · Вывод $0.18/1M Документация API →
glm-5.3Чат, программирование, агентные сценарии, рассуждение, письмо на китайском и английском, вызов инструментов/chat/completions Ввод $0.34/1M · Вывод $1.25/1M Документация API →
glm-5.3-flashЧат с высокой нагрузкой, классификация и извлечение данных, суммаризация и переписывание текста, вызов функций/chat/completions Ввод $0.072/1M · Вывод $0.25/1M Документация API →
kimi-k3Понимание длинных документов, анализ нескольких документов, написание текстов на китайском, агенты и вызов функций, рассуждение/chat/completions Ввод $1.8/1M · Вывод $9.0/1M Документация API →
qwen3.7-maxРассуждение, код, агенты и вызов функций, написание текстов на китайском и английском, длинный контекст/chat/completions Ввод $1.65/1M · Вывод $4.85/1M Документация API →
gpt-5.6-solРассуждения переднего края, агентное программирование, долгосрочные задачи, структурированный вывод/chat/completions Ввод $0.4/1M · Вывод $2.0/1M Документация API →
gpt-5.6-terraПовседневный чат, агентное программирование, рассуждения, структурированный вывод/chat/completions Ввод $0.2/1M · Вывод $1.2/1M Документация API →
gpt-5.6-lunaБыстрый чат, агентное программирование, большие объёмы с низкой задержкой, структурированный вывод/chat/completions Ввод $0.07/1M · Вывод $0.4/1M Документация API →
gpt-5.5Чат, рассуждения, агенты, структурированный вывод/chat/completions Ввод $0.5/1M · Вывод $3.0/1M Документация API →
gpt-6-astraГлубокое рассуждение, агентное программирование, очень длинный контекст, ввод изображений, структурированный вывод/chat/completions Ввод $1.0/1M · Вывод $5.0/1M Документация API →
gpt-6-solСложное программирование, агентные сценарии, рассуждение, очень длинный контекст, ввод изображений, структурированный вывод/chat/completions Ввод $0.2/1M · Вывод $1.0/1M Документация API →
gpt-6-lunaВысоконагруженный чат, агентные шаги с низкой задержкой, классификация и извлечение данных, очень длинный контекст, структурированный вывод/chat/completions Ввод $0.07/1M · Вывод $0.4/1M Документация API →
gpt-image-2Генерация изображений из текста, редактирование изображений (по изображению), обложки, постеры, иллюстрации/images/generations 1K $0.005 · 2K $0.01 · 4K $0.02 Документация API →
gpt-image-2.5-flareГенерация изображений из текста, редактирование изображений (по изображению), обложки, постеры, иллюстрации, типографика/images/generations 1K $0.005 · 2K $0.01 · 4K $0.02 Документация API →
gpt-image-2.5-sunburstГенерация изображений из текста, редактирование изображений (по изображению), обложки, постеры, иллюстрации, типографика/images/generations 1K $0.005 · 2K $0.01 · 4K $0.02 Документация API →
nano-banana-2Текст в изображение, изображение в изображение, обложки, постеры, иллюстрации/images/generations 1K $0.025 · 2K $0.0375 · 4K $0.0625 Документация API →
nano-banana-proТекст в изображение, изображение в изображение, обложки, постеры, иллюстрации, инфографика/images/generations 1K $0.04 · 2K $0.06 · 4K $0.1 Документация API →
claude-sonnet-4-6Чат, код, рассуждение, длинный контекст/chat/completions Ввод $1.5/1M · Вывод $7.5/1M Документация API →
claude-opus-5Глубокое рассуждение, код, агенты, длинный контекст, распознавание изображений/chat/completions Ввод $4.0/1M · Вывод $20.0/1M Документация API →
claude-fable-5Письмо на китайском, создание нарратива, генерация объёмных текстов, чат, код, распознавание изображений/chat/completions Ввод $8.0/1M · Вывод $40.0/1M Документация API →
gemini-3.1-proЧат, рассуждение, очень длинный контекст, мультимодальность/chat/completions Ввод $0.5/1M · Вывод $3.0/1M Документация API →
gemini-3.8-flashЧат, рассуждение, адаптивное мышление, ввод изображений, очень длинный контекст/chat/completions Ввод $0.6/1M · Вывод $3.6/1M Документация API →
gemini-3.7-flashЧат, рассуждение, адаптивное мышление, ввод изображений, очень длинный контекст/chat/completions Ввод $0.6/1M · Вывод $3.6/1M Документация API →
gemini-3.6-flashЧат, рассуждение, мышление, ввод изображений, очень длинный контекст/chat/completions Ввод $0.6/1M · Вывод $3.6/1M Документация API →
gemini-3.6-flash-highГлубокие рассуждения, сложные задачи, мышление, ввод изображений, очень длинный контекст/chat/completions Ввод $0.6/1M · Вывод $3.6/1M Документация API →
gemini-3.6-flash-lowБыстрый чат, большие объёмы, низкая задержка, ввод изображений/chat/completions Ввод $0.6/1M · Вывод $3.6/1M Документация API →
gemini-3.6-flash-tieredАдаптивное мышление, чат, рассуждения, ввод изображений/chat/completions Ввод $0.6/1M · Вывод $3.6/1M Документация API →
gemini-3-flash-previewЧат, рассуждения, высокая параллельность, низкая задержка/chat/completions Ввод $0.3/1M · Вывод $1.2/1M Документация API →
gemini-2.5-flashЧат, высокая параллельность, низкая задержка, мультимодальность/chat/completions Ввод $0.3/1M · Вывод $1.2/1M Документация API →
grok-4.7Сложные рассуждения, программирование, анализ длинных документов, вызов инструментов, структурированный вывод, распознавание изображений/chat/completions Ввод $0.3/1M · Вывод $0.9/1M Документация API →
veo-3.1Текст в видео, изображение в видео, короткие ролики, коммерческие съёмки/videos/generations $0.075 /clip+ Документация API →
seedance-2.5Короткие ролики одним длинным кадром, несколько референсов на входе, коммерческая съёмка/videos/generations $0.158 /s Документация API →
seedance-2.0Короткие ролики, коммерческие материалы/videos/generations $0.15 /s Документация API →
seedance-2.0-fastМассовое производство материалов, быстрая проверка концепций/videos/generations $0.075 /s Документация API →
seedance-2.5-30sСюжетные видео одним длинным планом, длинные продуктовые ролики/videos/generations $1.5 /clip+ Документация API →
wan3.0-videoСъёмка длинным планом, композиция из нескольких материалов, переработка видео/videos/generations $0.12 /s Документация API →
wan3.0-video-primeСрочные материалы к дедлайну, пакетные тест-съёмки/videos/generations $0.16 /s Документация API →
minimax-h3HD-видео, короткие ролики со звуком/videos/generations $0.036 /s Документация API →
grok-imagine-video-1.5Массовая генерация коротких видео, быстрая проверка концепций/videos/generations $0.3 /clip+ Документация API →

Использование в приложении (без кода)

В любом приложении, которое поддерживает API OpenAI, заполните эти три поля — программирование не требуется:

Base URL APIhttps://nezhagate.com/v1
API-ключключ, который вы создали в консоли (Консоль → API-ключи → Копировать)
Название моделиdeepseek-v4.1-flash deepseek-v4-flash-0731 glm-5.3 glm-5.3-flash kimi-k3 qwen3.7-max gpt-5.6-sol gpt-5.6-terra gpt-5.6-luna gpt-5.5 gpt-6-astra gpt-6-sol gpt-6-luna gpt-image-2 gpt-image-2.5-flare gpt-image-2.5-sunburst nano-banana-2 nano-banana-pro claude-sonnet-4-6 claude-opus-5 claude-fable-5 gemini-3.1-pro gemini-3.8-flash gemini-3.7-flash gemini-3.6-flash gemini-3.6-flash-high gemini-3.6-flash-low gemini-3.6-flash-tiered gemini-3-flash-preview gemini-2.5-flash grok-4.7 veo-3.1 seedance-2.5 seedance-2.0 seedance-2.0-fast seedance-2.5-30s wan3.0-video wan3.0-video-prime minimax-h3 grok-imagine-video-1.5

Проверено с ChatBox, Cherry Studio, NextChat, LobeChat, Immersive Translate, Open WebUI и др.

Пошаговые инструкции для клиентов: SillyTavern · Cherry Studio · Cline

Нативный API Anthropic (Claude Code)

Помимо совместимого с OpenAI маршрута, модели Claude также предоставляют нативный Anthropic Messages API. Укажите Claude Code (или любому SDK Anthropic) базовый URL ниже и используйте ваш ключ шлюза в качестве x-api-key — рассуждение, вызов инструментов и кэширование промптов сохраняются в нативном виде.

Claude Code · env
export ANTHROPIC_BASE_URL=https://nezhagate.com/anthropic
export ANTHROPIC_API_KEY=YOUR_API_KEY
# claude-sonnet-4-6 / claude-opus-5 / claude-fable-5
curl · /anthropic/v1/messages
curl https://nezhagate.com/anthropic/v1/messages -H "x-api-key: YOUR_API_KEY" -H "anthropic-version: 2023-06-01" -H "Content-Type: application/json" -d '{"model": "claude-sonnet-4-6", "max_tokens": 1024, "messages": [{"role": "user", "content": "Hello"}]}'

Модели: claude-opus-5, claude-fable-5, claude-sonnet-4-6. Тарификация как у /v1 — за токен.

Тарификация кэша промптов: попадания в кэш (чтение кэша) оплачиваются по 1/10 (0.1×) от цены ввода, запись в кэш — по 1.25× (тарифы по каждой модели — на странице цен). Для попадания в кэш нужен стабильный и достаточно длинный префикс (Claude Opus ≥ 4096 токенов, Sonnet ≥ 2048), повторяющийся в течение короткого промежутка времени — Claude Code с большим CLAUDE.md или системным промптом поверх реальной кодовой базы попадает в кэш на каждом шаге, снижая стоимость ввода примерно до 1/10. Короткие чаты в песочнице слишком малы, чтобы кэшироваться.

Генерация видео (асинхронно)

Текст в видео / изображение в видео — это асинхронные задачи: вызов сразу возвращает HTTP 202 и id задачи ({"id":"img_...","object":"video.generation.job","status":"queued"}); опрашивайте GET /v1/videos/jobs/{id}, пока status не станет succeeded, результат — в data[0].url (переразмещённый mp4). 1-12 мин на клип. Два режима тарификации: Veo 3.1 тарифицируется за клип; Seedance 2.x и MiniMax H3 тарифицируются посекундно (rate x duration). Оба резервируют ровно столько, сколько затем списывают, и полностью возвращают средства при сбое. Соотношение сторон задаётся через size (по умолчанию — 16:9, альбомная ориентация); для варианта «изображение в видео» передайте референс первого кадра в image.

curl · отправка
curl https://nezhagate.com/v1/videos/generations -H 'Authorization: Bearer YOUR_API_KEY' -H 'Content-Type: application/json' -d '{"model": "veo-3.1", "prompt": "кот занимается сёрфингом на закате", "tier": "quality", "resolution": "1080p", "size": "16:9", "duration": "8s"}'
curl · опрос
curl https://nezhagate.com/v1/videos/jobs/img_3f9a...c2 -H 'Authorization: Bearer YOUR_API_KEY'

Видеомодели: veo-3.1 seedance-2.5 seedance-2.0 seedance-2.0-fast seedance-2.5-30s wan3.0-video wan3.0-video-prime minimax-h3 grok-imagine-video-1.5

Заметки по интеграции для ИИ

Отправьте весь блок ниже в Codex / Claude Code / Cursor — он поймёт, как выполнить интеграцию. Также можно скопировать всю документацию целиком с помощью кнопки «Скопировать страницу» в правом верхнем углу.

AI Integration Prompt
Integrate NezhaGate through its OpenAI-compatible API.
Base URL: https://nezhagate.com/v1
API Key: read it from the environment variable NEZHAAPI_KEY.
Claude models can also use the native Anthropic protocol (for Claude Code / the Anthropic SDK): ANTHROPIC_BASE_URL=https://nezhagate.com/anthropic, headers x-api-key=API Key and anthropic-version: 2023-06-01, POST /anthropic/v1/messages (max_tokens is required), models claude-sonnet-4-6 / claude-opus-5 / claude-fable-5.
Chat models (/chat/completions): deepseek-v4.1-flash / deepseek-v4-flash-0731 / glm-5.3 / glm-5.3-flash / kimi-k3 / qwen3.7-max / gpt-5.6-sol / gpt-5.6-terra / gpt-5.6-luna / gpt-5.5 / gpt-6-astra / gpt-6-sol / gpt-6-luna / claude-sonnet-4-6 / claude-opus-5 / claude-fable-5 / gemini-3.1-pro / gemini-3.8-flash / gemini-3.7-flash / gemini-3.6-flash / gemini-3.6-flash-high / gemini-3.6-flash-low / gemini-3.6-flash-tiered / gemini-3-flash-preview / gemini-2.5-flash / grok-4.7
Image models (text-to-image /images/generations; image-to-image /images/edits or add an image parameter): gpt-image-2 / gpt-image-2.5-flare / gpt-image-2.5-sunburst / nano-banana-2 / nano-banana-pro
Video models (text-to-video /videos/generations, async jobs; add an image parameter for image-to-video, the image becomes the first frame): veo-3.1 / seedance-2.5 / seedance-2.0 / seedance-2.0-fast / seedance-2.5-30s / wan3.0-video / wan3.0-video-prime / minimax-h3 / grok-imagine-video-1.5
Auth: Authorization: Bearer YOUR_API_KEY
Requirements (chat): return choices[0].message.content; on 401 check the key, 402 means insufficient balance, 429/5xx can be retried.
Requirements (images, async): POST /images/generations or /images/edits returns HTTP 202 with a job id right away ({"id":"img_...","object":"image.generation.job","status":"queued"}); then poll GET /v1/images/jobs/{id} until status=succeeded and read data[0].url (an img.nezhagate.com link kept for 60 days; download it or copy it to your own storage). Do not read data right after submitting.
Requirements (video, async): POST /videos/generations returns HTTP 202 with a job id (object=video.generation.job); then poll GET /v1/videos/jobs/{id} until status=succeeded and read data[0].url (a re-hosted mp4 link kept for 60 days). About 1-2 minutes per clip; failed jobs are refunded in full.

Проверка баланса и расхода

С помощью любого API-ключа можно узнать остаток баланса и расход аккаунта — вход в панель управления не требуется. Проще всего: GET /v1/usage. Также доступен совместимый с OpenAI эндпоинт: /v1/dashboard/billing/credit_grants (баланс = total_available).

curl · /v1/usage
curl https://nezhagate.com/v1/usage -H "Authorization: Bearer YOUR_API_KEY"
curl · /v1/dashboard/billing/credit_grants
curl https://nezhagate.com/v1/dashboard/billing/credit_grants -H "Authorization: Bearer YOUR_API_KEY"

Коды ошибок

Каждая ошибка использует единый конверт с фиксированными полями. code — это стабильный машиночитаемый идентификатор, формулировка которого никогда не меняется — ветвите логику по code, а не по тексту message.

error envelope
{
  "error": {
    "message": "human readable",
    "type": "invalid_request_error | authentication_error | insufficient_quota | rate_limit_error | server_error",
    "code": "stable_snake_case",
    "param": "field_name_or_null"
  }
}
HTTPcodeЗначение
401missing_api_keyОтсутствует заголовок Authorization: Bearer
401invalid_api_keyКлюч недействителен или отключён
402insufficient_quotaНедостаточно средств на балансе, либо ключ превысил свой лимит
400model_not_foundИдентификатор модели отсутствует в каталоге
400model_disabledМодель снята с обслуживания и больше не вызывается
400model_coming_soonУже указана в каталоге, но заказы пока не принимаются
400invalid_messagesmessages отсутствует, пусто, либо один из элементов не является объектом
400invalid_rolerole — не одно из значений system / developer / user / assistant / tool / function
400invalid_max_tokensmax_tokens не является положительным целым числом (0, -1 и строки отклоняются)
400missing_promptВ запросе на генерацию изображения или видео отсутствует prompt
400invalid_jsonТело запроса не является корректным JSON
404job_not_foundТакой задачи не существует, либо она принадлежит другому ключу
429rate_limit_exceededПревышен лимит запросов, либо все линии перегружены — повторите попытку через время, указанное в заголовке Retry-After
502empty_completionВышестоящий провайдер вернул пустой ответ. Это не решение по содержимому запроса, поэтому запрос не оплачивается и его можно безопасно повторить.
502upstream_error5xx от вышестоящего провайдера, тайм-аут, либо сбой на всех линиях. Не оплачивается.

max_tokens для моделей с рассуждением — Модели Gemini 3.x Flash (3-flash-preview / 3.6 / 3.7 / 3.8, все уровни) тратят часть бюджета на скрытые рассуждения ещё до того, как начинают писать видимый ответ, поэтому небольшая часть бюджета расходуется прежде, чем ответ вообще появится: по замерам, max_tokens=16 сразу завершается ошибкой, а 32 / 64 возвращают правдоподобно выглядящее, но неверное значение с finish_reason=length. Шлюз поднимает бюджет вывода для этих моделей минимум до 512 (оплата — только за фактически использованные токены), но всё равно указывайте >=512 сами; любой finish_reason=length считайте возможным усечением ответа и повторяйте запрос с большим max_tokens.

Код статусаЗначениеКак обработать
401API-ключ отсутствует или недействителенПроверьте заголовок Authorization
402Недостаточно средств на балансе или превышена квота ключаОбратитесь к администратору для пополнения баланса
400Неподдерживаемая модель или параметрИспользуйте только gpt-5.5 / gpt-image-2
429Лимит запросов у провайдераПовторите попытку позже
502Все маршруты к провайдерам не сработалиПодождите восстановления или обратитесь к администратору

Частые вопросы о доступе, оплате, моделях и безопасности. Частые вопросы NezhaGate →