ИИ-шлюз, совместимый с OpenAI, — единый эндпоинт для всего каталога: GPT-5.5, семейство чат-моделей Gemini и генерация изображений gpt-image. Понятно человеку и копируется в один клик для ИИ-помощников по написанию кода.
Быстрый старт
Просто укажите свои Base URL и API-ключ — и ваш существующий OpenAI SDK заработает сразу, без доработок.
https://nezhagate.com/v1
curl https://nezhagate.com/v1/chat/completions -H "Authorization: Bearer YOUR_API_KEY" -H "Content-Type: application/json" -d '{"model": "gpt-5.5", "messages": [{"role": "user", "content": "Напишите короткое вступление о продукте — API для ИИ"}], "stream": false}'
Полные параметры запроса, примеры и особенности асинхронных задач для каждой модели — в её собственной документации: откройте её из таблицы моделей и цен ниже.
Больше готовых к запуску примеров (Python / Node / curl, включая асинхронный процесс для изображений и видео): github.com/gaoorange/nezhagate-api-examples
Аутентификация
Для всех запросов к API требуется Bearer-токен.
Authorization: Bearer YOUR_API_KEY Content-Type: application/json
Модели и цены
Полные параметры запроса, примеры и особенности асинхронных задач для каждой модели — в её собственной документации: откройте её из таблицы моделей и цен ниже.
| Модель | Возможность | Эндпоинт | Цена | |
|---|---|---|---|---|
| deepseek-v4.1-flash | Чат, рассуждение, программирование, вызов инструментов, переключаемый режим рассуждения | /chat/completions | Ввод $0.09/1M · Вывод $0.36/1M | Документация API → |
| deepseek-v4-flash-0731 | Чат, рассуждение, программирование, вызов инструментов, переключаемый режим рассуждения, зафиксированная версия | /chat/completions | Ввод $0.045/1M · Вывод $0.18/1M | Документация API → |
| glm-5.3 | Чат, программирование, агентные сценарии, рассуждение, письмо на китайском и английском, вызов инструментов | /chat/completions | Ввод $0.34/1M · Вывод $1.25/1M | Документация API → |
| glm-5.3-flash | Чат с высокой нагрузкой, классификация и извлечение данных, суммаризация и переписывание текста, вызов функций | /chat/completions | Ввод $0.072/1M · Вывод $0.25/1M | Документация API → |
| kimi-k3 | Понимание длинных документов, анализ нескольких документов, написание текстов на китайском, агенты и вызов функций, рассуждение | /chat/completions | Ввод $1.8/1M · Вывод $9.0/1M | Документация API → |
| qwen3.7-max | Рассуждение, код, агенты и вызов функций, написание текстов на китайском и английском, длинный контекст | /chat/completions | Ввод $1.65/1M · Вывод $4.85/1M | Документация API → |
| gpt-5.6-sol | Рассуждения переднего края, агентное программирование, долгосрочные задачи, структурированный вывод | /chat/completions | Ввод $0.4/1M · Вывод $2.0/1M | Документация API → |
| gpt-5.6-terra | Повседневный чат, агентное программирование, рассуждения, структурированный вывод | /chat/completions | Ввод $0.2/1M · Вывод $1.2/1M | Документация API → |
| gpt-5.6-luna | Быстрый чат, агентное программирование, большие объёмы с низкой задержкой, структурированный вывод | /chat/completions | Ввод $0.07/1M · Вывод $0.4/1M | Документация API → |
| gpt-5.5 | Чат, рассуждения, агенты, структурированный вывод | /chat/completions | Ввод $0.5/1M · Вывод $3.0/1M | Документация API → |
| gpt-6-astra | Глубокое рассуждение, агентное программирование, очень длинный контекст, ввод изображений, структурированный вывод | /chat/completions | Ввод $1.0/1M · Вывод $5.0/1M | Документация API → |
| gpt-6-sol | Сложное программирование, агентные сценарии, рассуждение, очень длинный контекст, ввод изображений, структурированный вывод | /chat/completions | Ввод $0.2/1M · Вывод $1.0/1M | Документация API → |
| gpt-6-luna | Высоконагруженный чат, агентные шаги с низкой задержкой, классификация и извлечение данных, очень длинный контекст, структурированный вывод | /chat/completions | Ввод $0.07/1M · Вывод $0.4/1M | Документация API → |
| gpt-image-2 | Генерация изображений из текста, редактирование изображений (по изображению), обложки, постеры, иллюстрации | /images/generations | 1K $0.005 · 2K $0.01 · 4K $0.02 | Документация API → |
| gpt-image-2.5-flare | Генерация изображений из текста, редактирование изображений (по изображению), обложки, постеры, иллюстрации, типографика | /images/generations | 1K $0.005 · 2K $0.01 · 4K $0.02 | Документация API → |
| gpt-image-2.5-sunburst | Генерация изображений из текста, редактирование изображений (по изображению), обложки, постеры, иллюстрации, типографика | /images/generations | 1K $0.005 · 2K $0.01 · 4K $0.02 | Документация API → |
| nano-banana-2 | Текст в изображение, изображение в изображение, обложки, постеры, иллюстрации | /images/generations | 1K $0.025 · 2K $0.0375 · 4K $0.0625 | Документация API → |
| nano-banana-pro | Текст в изображение, изображение в изображение, обложки, постеры, иллюстрации, инфографика | /images/generations | 1K $0.04 · 2K $0.06 · 4K $0.1 | Документация API → |
| claude-sonnet-4-6 | Чат, код, рассуждение, длинный контекст | /chat/completions | Ввод $1.5/1M · Вывод $7.5/1M | Документация API → |
| claude-opus-5 | Глубокое рассуждение, код, агенты, длинный контекст, распознавание изображений | /chat/completions | Ввод $4.0/1M · Вывод $20.0/1M | Документация API → |
| claude-fable-5 | Письмо на китайском, создание нарратива, генерация объёмных текстов, чат, код, распознавание изображений | /chat/completions | Ввод $8.0/1M · Вывод $40.0/1M | Документация API → |
| gemini-3.1-pro | Чат, рассуждение, очень длинный контекст, мультимодальность | /chat/completions | Ввод $0.5/1M · Вывод $3.0/1M | Документация API → |
| gemini-3.8-flash | Чат, рассуждение, адаптивное мышление, ввод изображений, очень длинный контекст | /chat/completions | Ввод $0.6/1M · Вывод $3.6/1M | Документация API → |
| gemini-3.7-flash | Чат, рассуждение, адаптивное мышление, ввод изображений, очень длинный контекст | /chat/completions | Ввод $0.6/1M · Вывод $3.6/1M | Документация API → |
| gemini-3.6-flash | Чат, рассуждение, мышление, ввод изображений, очень длинный контекст | /chat/completions | Ввод $0.6/1M · Вывод $3.6/1M | Документация API → |
| gemini-3.6-flash-high | Глубокие рассуждения, сложные задачи, мышление, ввод изображений, очень длинный контекст | /chat/completions | Ввод $0.6/1M · Вывод $3.6/1M | Документация API → |
| gemini-3.6-flash-low | Быстрый чат, большие объёмы, низкая задержка, ввод изображений | /chat/completions | Ввод $0.6/1M · Вывод $3.6/1M | Документация API → |
| gemini-3.6-flash-tiered | Адаптивное мышление, чат, рассуждения, ввод изображений | /chat/completions | Ввод $0.6/1M · Вывод $3.6/1M | Документация API → |
| gemini-3-flash-preview | Чат, рассуждения, высокая параллельность, низкая задержка | /chat/completions | Ввод $0.3/1M · Вывод $1.2/1M | Документация API → |
| gemini-2.5-flash | Чат, высокая параллельность, низкая задержка, мультимодальность | /chat/completions | Ввод $0.3/1M · Вывод $1.2/1M | Документация API → |
| grok-4.7 | Сложные рассуждения, программирование, анализ длинных документов, вызов инструментов, структурированный вывод, распознавание изображений | /chat/completions | Ввод $0.3/1M · Вывод $0.9/1M | Документация API → |
| veo-3.1 | Текст в видео, изображение в видео, короткие ролики, коммерческие съёмки | /videos/generations | $0.075 /clip+ | Документация API → |
| seedance-2.5 | Короткие ролики одним длинным кадром, несколько референсов на входе, коммерческая съёмка | /videos/generations | $0.158 /s | Документация API → |
| seedance-2.0 | Короткие ролики, коммерческие материалы | /videos/generations | $0.15 /s | Документация API → |
| seedance-2.0-fast | Массовое производство материалов, быстрая проверка концепций | /videos/generations | $0.075 /s | Документация API → |
| seedance-2.5-30s | Сюжетные видео одним длинным планом, длинные продуктовые ролики | /videos/generations | $1.5 /clip+ | Документация API → |
| wan3.0-video | Съёмка длинным планом, композиция из нескольких материалов, переработка видео | /videos/generations | $0.12 /s | Документация API → |
| wan3.0-video-prime | Срочные материалы к дедлайну, пакетные тест-съёмки | /videos/generations | $0.16 /s | Документация API → |
| minimax-h3 | HD-видео, короткие ролики со звуком | /videos/generations | $0.036 /s | Документация API → |
| grok-imagine-video-1.5 | Массовая генерация коротких видео, быстрая проверка концепций | /videos/generations | $0.3 /clip+ | Документация API → |
Использование в приложении (без кода)
В любом приложении, которое поддерживает API OpenAI, заполните эти три поля — программирование не требуется:
| Base URL API | https://nezhagate.com/v1 |
| API-ключ | ключ, который вы создали в консоли (Консоль → API-ключи → Копировать) |
| Название модели | deepseek-v4.1-flash deepseek-v4-flash-0731 glm-5.3 glm-5.3-flash kimi-k3 qwen3.7-max gpt-5.6-sol gpt-5.6-terra gpt-5.6-luna gpt-5.5 gpt-6-astra gpt-6-sol gpt-6-luna gpt-image-2 gpt-image-2.5-flare gpt-image-2.5-sunburst nano-banana-2 nano-banana-pro claude-sonnet-4-6 claude-opus-5 claude-fable-5 gemini-3.1-pro gemini-3.8-flash gemini-3.7-flash gemini-3.6-flash gemini-3.6-flash-high gemini-3.6-flash-low gemini-3.6-flash-tiered gemini-3-flash-preview gemini-2.5-flash grok-4.7 veo-3.1 seedance-2.5 seedance-2.0 seedance-2.0-fast seedance-2.5-30s wan3.0-video wan3.0-video-prime minimax-h3 grok-imagine-video-1.5 |
Проверено с ChatBox, Cherry Studio, NextChat, LobeChat, Immersive Translate, Open WebUI и др.
Пошаговые инструкции для клиентов: SillyTavern · Cherry Studio · Cline
Нативный API Anthropic (Claude Code)
Помимо совместимого с OpenAI маршрута, модели Claude также предоставляют нативный Anthropic Messages API. Укажите Claude Code (или любому SDK Anthropic) базовый URL ниже и используйте ваш ключ шлюза в качестве x-api-key — рассуждение, вызов инструментов и кэширование промптов сохраняются в нативном виде.
export ANTHROPIC_BASE_URL=https://nezhagate.com/anthropic export ANTHROPIC_API_KEY=YOUR_API_KEY # claude-sonnet-4-6 / claude-opus-5 / claude-fable-5
curl https://nezhagate.com/anthropic/v1/messages -H "x-api-key: YOUR_API_KEY" -H "anthropic-version: 2023-06-01" -H "Content-Type: application/json" -d '{"model": "claude-sonnet-4-6", "max_tokens": 1024, "messages": [{"role": "user", "content": "Hello"}]}'
Модели: claude-opus-5, claude-fable-5, claude-sonnet-4-6. Тарификация как у /v1 — за токен.
Тарификация кэша промптов: попадания в кэш (чтение кэша) оплачиваются по 1/10 (0.1×) от цены ввода, запись в кэш — по 1.25× (тарифы по каждой модели — на странице цен). Для попадания в кэш нужен стабильный и достаточно длинный префикс (Claude Opus ≥ 4096 токенов, Sonnet ≥ 2048), повторяющийся в течение короткого промежутка времени — Claude Code с большим CLAUDE.md или системным промптом поверх реальной кодовой базы попадает в кэш на каждом шаге, снижая стоимость ввода примерно до 1/10. Короткие чаты в песочнице слишком малы, чтобы кэшироваться.
Генерация видео (асинхронно)
Текст в видео / изображение в видео — это асинхронные задачи: вызов сразу возвращает HTTP 202 и id задачи ({"id":"img_...","object":"video.generation.job","status":"queued"}); опрашивайте GET /v1/videos/jobs/{id}, пока status не станет succeeded, результат — в data[0].url (переразмещённый mp4). 1-12 мин на клип. Два режима тарификации: Veo 3.1 тарифицируется за клип; Seedance 2.x и MiniMax H3 тарифицируются посекундно (rate x duration). Оба резервируют ровно столько, сколько затем списывают, и полностью возвращают средства при сбое. Соотношение сторон задаётся через size (по умолчанию — 16:9, альбомная ориентация); для варианта «изображение в видео» передайте референс первого кадра в image.
curl https://nezhagate.com/v1/videos/generations -H 'Authorization: Bearer YOUR_API_KEY' -H 'Content-Type: application/json' -d '{"model": "veo-3.1", "prompt": "кот занимается сёрфингом на закате", "tier": "quality", "resolution": "1080p", "size": "16:9", "duration": "8s"}'curl https://nezhagate.com/v1/videos/jobs/img_3f9a...c2 -H 'Authorization: Bearer YOUR_API_KEY'
Видеомодели: veo-3.1 seedance-2.5 seedance-2.0 seedance-2.0-fast seedance-2.5-30s wan3.0-video wan3.0-video-prime minimax-h3 grok-imagine-video-1.5
Заметки по интеграции для ИИ
Отправьте весь блок ниже в Codex / Claude Code / Cursor — он поймёт, как выполнить интеграцию. Также можно скопировать всю документацию целиком с помощью кнопки «Скопировать страницу» в правом верхнем углу.
Integrate NezhaGate through its OpenAI-compatible API.
Base URL: https://nezhagate.com/v1
API Key: read it from the environment variable NEZHAAPI_KEY.
Claude models can also use the native Anthropic protocol (for Claude Code / the Anthropic SDK): ANTHROPIC_BASE_URL=https://nezhagate.com/anthropic, headers x-api-key=API Key and anthropic-version: 2023-06-01, POST /anthropic/v1/messages (max_tokens is required), models claude-sonnet-4-6 / claude-opus-5 / claude-fable-5.
Chat models (/chat/completions): deepseek-v4.1-flash / deepseek-v4-flash-0731 / glm-5.3 / glm-5.3-flash / kimi-k3 / qwen3.7-max / gpt-5.6-sol / gpt-5.6-terra / gpt-5.6-luna / gpt-5.5 / gpt-6-astra / gpt-6-sol / gpt-6-luna / claude-sonnet-4-6 / claude-opus-5 / claude-fable-5 / gemini-3.1-pro / gemini-3.8-flash / gemini-3.7-flash / gemini-3.6-flash / gemini-3.6-flash-high / gemini-3.6-flash-low / gemini-3.6-flash-tiered / gemini-3-flash-preview / gemini-2.5-flash / grok-4.7
Image models (text-to-image /images/generations; image-to-image /images/edits or add an image parameter): gpt-image-2 / gpt-image-2.5-flare / gpt-image-2.5-sunburst / nano-banana-2 / nano-banana-pro
Video models (text-to-video /videos/generations, async jobs; add an image parameter for image-to-video, the image becomes the first frame): veo-3.1 / seedance-2.5 / seedance-2.0 / seedance-2.0-fast / seedance-2.5-30s / wan3.0-video / wan3.0-video-prime / minimax-h3 / grok-imagine-video-1.5
Auth: Authorization: Bearer YOUR_API_KEY
Requirements (chat): return choices[0].message.content; on 401 check the key, 402 means insufficient balance, 429/5xx can be retried.
Requirements (images, async): POST /images/generations or /images/edits returns HTTP 202 with a job id right away ({"id":"img_...","object":"image.generation.job","status":"queued"}); then poll GET /v1/images/jobs/{id} until status=succeeded and read data[0].url (an img.nezhagate.com link kept for 60 days; download it or copy it to your own storage). Do not read data right after submitting.
Requirements (video, async): POST /videos/generations returns HTTP 202 with a job id (object=video.generation.job); then poll GET /v1/videos/jobs/{id} until status=succeeded and read data[0].url (a re-hosted mp4 link kept for 60 days). About 1-2 minutes per clip; failed jobs are refunded in full.
Проверка баланса и расхода
С помощью любого API-ключа можно узнать остаток баланса и расход аккаунта — вход в панель управления не требуется. Проще всего: GET /v1/usage. Также доступен совместимый с OpenAI эндпоинт: /v1/dashboard/billing/credit_grants (баланс = total_available).
curl https://nezhagate.com/v1/usage -H "Authorization: Bearer YOUR_API_KEY"
curl https://nezhagate.com/v1/dashboard/billing/credit_grants -H "Authorization: Bearer YOUR_API_KEY"
Коды ошибок
Каждая ошибка использует единый конверт с фиксированными полями. code — это стабильный машиночитаемый идентификатор, формулировка которого никогда не меняется — ветвите логику по code, а не по тексту message.
{
"error": {
"message": "human readable",
"type": "invalid_request_error | authentication_error | insufficient_quota | rate_limit_error | server_error",
"code": "stable_snake_case",
"param": "field_name_or_null"
}
}
| HTTP | code | Значение |
|---|---|---|
| 401 | missing_api_key | Отсутствует заголовок Authorization: Bearer |
| 401 | invalid_api_key | Ключ недействителен или отключён |
| 402 | insufficient_quota | Недостаточно средств на балансе, либо ключ превысил свой лимит |
| 400 | model_not_found | Идентификатор модели отсутствует в каталоге |
| 400 | model_disabled | Модель снята с обслуживания и больше не вызывается |
| 400 | model_coming_soon | Уже указана в каталоге, но заказы пока не принимаются |
| 400 | invalid_messages | messages отсутствует, пусто, либо один из элементов не является объектом |
| 400 | invalid_role | role — не одно из значений system / developer / user / assistant / tool / function |
| 400 | invalid_max_tokens | max_tokens не является положительным целым числом (0, -1 и строки отклоняются) |
| 400 | missing_prompt | В запросе на генерацию изображения или видео отсутствует prompt |
| 400 | invalid_json | Тело запроса не является корректным JSON |
| 404 | job_not_found | Такой задачи не существует, либо она принадлежит другому ключу |
| 429 | rate_limit_exceeded | Превышен лимит запросов, либо все линии перегружены — повторите попытку через время, указанное в заголовке Retry-After |
| 502 | empty_completion | Вышестоящий провайдер вернул пустой ответ. Это не решение по содержимому запроса, поэтому запрос не оплачивается и его можно безопасно повторить. |
| 502 | upstream_error | 5xx от вышестоящего провайдера, тайм-аут, либо сбой на всех линиях. Не оплачивается. |
max_tokens для моделей с рассуждением — Модели Gemini 3.x Flash (3-flash-preview / 3.6 / 3.7 / 3.8, все уровни) тратят часть бюджета на скрытые рассуждения ещё до того, как начинают писать видимый ответ, поэтому небольшая часть бюджета расходуется прежде, чем ответ вообще появится: по замерам, max_tokens=16 сразу завершается ошибкой, а 32 / 64 возвращают правдоподобно выглядящее, но неверное значение с finish_reason=length. Шлюз поднимает бюджет вывода для этих моделей минимум до 512 (оплата — только за фактически использованные токены), но всё равно указывайте >=512 сами; любой finish_reason=length считайте возможным усечением ответа и повторяйте запрос с большим max_tokens.
| Код статуса | Значение | Как обработать |
|---|---|---|
| 401 | API-ключ отсутствует или недействителен | Проверьте заголовок Authorization |
| 402 | Недостаточно средств на балансе или превышена квота ключа | Обратитесь к администратору для пополнения баланса |
| 400 | Неподдерживаемая модель или параметр | Используйте только gpt-5.5 / gpt-image-2 |
| 429 | Лимит запросов у провайдера | Повторите попытку позже |
| 502 | Все маршруты к провайдерам не сработали | Подождите восстановления или обратитесь к администратору |
Частые вопросы о доступе, оплате, моделях и безопасности. Частые вопросы NezhaGate →