NezhaGateNezhaGate
Каталог моделей

Каталог AI-моделей

Просматривайте все доступные AI-модели, сравнивайте цены и возможности и подключайтесь за минуты. Сейчас доступно 26 моделей, и их число постоянно растёт. Ещё 1 — пока не открыто.

DeepSeek V4.1 Flash Чат

DeepSeek V4 Flash

deepseek-v4.1-flash · 0731

Семейство DeepSeek V4 Flash: V4.1 — актуальный релиз DeepSeek Flash, а 0731 — зафиксированный снимок V4 Flash для задач, где нужны неизменная версия и воспроизводимый результат. Обе стоят одинаково и поддерживают режим рассуждения и вызов инструментов. Версию выбирайте с помощью переключателя «Тип модели».

$0.09/1M ввод · $0.36/1M вывод ↓40% Смотреть →
GLM-5.3 Чат

GLM-5.3

glm-5.3 · flash

Семейство GLM-5.3: GLM-5.3 — новый флагман от Z.ai (Zhipu), созданный для программирования, агентных сценариев и сложных рассуждений; GLM-5.3 Flash — облегчённая и более дешёвая версия для высоких объёмов запросов. Обе модели всегда рассуждают перед ответом и поддерживают вызов инструментов. Версию выбирайте с помощью переключателя «Тип модели».

$0.34/1M ввод · $1.25/1M вывод ↓73% Смотреть →
Kimi K3 Чат

Kimi K3

kimi-k3

Kimi K3 — новый флагман Moonshot AI, сильный в понимании длинных документов, анализе нескольких документов и написании текстов на китайском языке, с отличной поддержкой агентов и инструментов. Модель всегда рассуждает перед ответом, рассуждение возвращается в reasoning_content; температура сэмплирования фиксирована самой моделью, поэтому temperature / top_p в запросе игнорируются. Поддерживаются вызов функций, потоковый вывод и кэширование промптов (повторяющийся длинный префикс тарифицируется по ставке кэша). Полностью совместима с OpenAI: укажите в поле model значение kimi-k3. Оплата по факту использования, неудачные запросы никогда не оплачиваются.

$1.80/1M ввод · $9.00/1M вывод ↓40% Смотреть →
Qwen3.7 Max Чат

Qwen3.7 Max

qwen3.7-max

Qwen3.7 Max — флагман поколения Qwen 3.7 от Alibaba Cloud, сильный в рассуждении, коде и работе с агентами, с надёжной поддержкой китайского и английского языков. Модель всегда рассуждает перед ответом, рассуждение возвращается в reasoning_content, и поддерживает вызов функций, потоковый вывод и кэширование промптов. Полностью совместима с OpenAI: укажите в поле model значение qwen3.7-max. Оплата по факту использования, неудачные запросы никогда не оплачиваются.

$1.65/1M ввод · $4.85/1M вывод ↓35% Смотреть →
GPT-5.6 Terra Чат

GPT-5.6

gpt-5.6 · sol · terra · luna

Семейство GPT-5.6: Sol — флагман переднего края, Terra — сбалансированная модель для повседневных задач, Luna — быстрая и экономичная модель -- единое семейство, охватывающее диапазон от интеллекта переднего края до высокоскоростного исполнения. Используйте «Тип модели», чтобы выбрать уровень.

$0.20/1M ввод · $1.20/1M вывод ↓90% Смотреть →
GPT-5.5 Чат

GPT-5.5

gpt-5.5

GPT-5.5 обеспечивает лучшие в отрасли чат, рассуждения и программирование, с поддержкой потокового вывода, длинного контекста и структурированных задач. Полностью совместима с OpenAI SDK: подключается к Codex, Cursor, Claude Code и подобным инструментам без единого изменения кода.

$0.50/1M ввод · $3.00/1M вывод ↓90% Смотреть →
GPT-6 Astra Чат

GPT-6

gpt-6 · astra · sol · luna

Семейство GPT-6: Astra — самый мощный флагман, Sol создан для сложного программирования и агентных сценариев, а Luna — самая эффективная модель для высоких объёмов запросов; у всех трёх общий контекст на 1,050,000 токенов. Версию выбирайте с помощью переключателя «Тип модели».

$1.00/1M ввод · $5.00/1M вывод ↓90% Смотреть →
GPT Image 2 Изображения

GPT Image 2

gpt-image-2

GPT Image 2 создана для коммерческого креатива: обложки статей, предметная съёмка, постеры, инфографика и иллюстрации. Поддерживает и генерацию изображений из текста, и их редактирование (по изображению), разрешения 1K / 2K / 4K и разные соотношения сторон — через images API, совместимый с OpenAI.

$0.005/image и выше Смотреть →
GPT Image 2.5 Flare Изображения

GPT Image 2.5

gpt-image-2.5 · flare · sunburst

GPT Image 2.5 — модель изображений нового поколения от OpenAI в двух стилевых ветвях: Flare даёт более чистый и гладкий результат, Sunburst — более зернистый, с более выраженной текстурой и контрастными светами. Возможности и цена одинаковые — различается только внешний вид. Версию выбирайте с помощью переключателя «Тип модели».

$0.005/image и выше Смотреть →
Nano Banana 2 Изображения

Nano Banana 2

nano-banana-2

Nano Banana 2 (Gemini 3.1 Flash Image) отлично справляется с обложками, постерами, иллюстрациями и предметной съёмкой. Поддерживает режимы «текст в изображение» и «изображение в изображение», разрешения 1K / 2K / 4K и несколько соотношений сторон; быстрая и экономичная модель, доступна через совместимый с OpenAI images API.

$0.025/image и выше Смотреть →
Nano Banana Pro Изображения

Nano Banana Pro

nano-banana-pro

Nano Banana Pro (Gemini 3 Pro Image) — флагманская модель изображений с более проработанной детализацией и композицией. Поддерживает режимы «текст в изображение» и «изображение в изображение», отлично работает с типографикой и сложными сценами, подходит для коммерческих обложек и качественных иллюстраций — через совместимый с OpenAI images API.

$0.040/image и выше Смотреть →
Claude Sonnet 4.6 Чат

Claude Sonnet 4.6

claude-sonnet-4-6

Claude Sonnet 4.6 находит отличный баланс между возможностями и скоростью, прекрасно справляясь с повседневным чатом, кодом и агентами по отличной цене. Полностью совместима с OpenAI API: укажите в поле model значение claude-sonnet-4-6 — и вы подключены.

$1.50/1M ввод · $7.50/1M вывод ↓50% Смотреть →
Claude Opus 5 Чат

Claude Opus 5

claude-opus-5

Claude Opus 5 — флагман Anthropic нового поколения с адаптивным режимом рассуждения, включённым по умолчанию. Модель отлично справляется со сложными рассуждениями, инженерией кода и оркестрацией агентов, поддерживает распознавание изображений, вызов инструментов и кэширование промптов. Полностью совместима с OpenAI API: укажите в поле model значение claude-opus-5; либо используйте нативный Anthropic Messages API, чтобы Claude Code подключался напрямую.

$4.00/1M ввод · $20.00/1M вывод Смотреть →
Claude Fable 5 Чат

Claude Fable 5

claude-fable-5

Claude Fable 5 относится к серии Anthropic Fable: та же генерация и та же база возможностей, что и у Opus 5 (адаптивное рассуждение, вызов инструментов, распознавание изображений, кэширование промптов), но с более тонким слогом и более богатыми эмоциональными оттенками в китайском нарративе и объёмных текстах. Полностью совместима с OpenAI API: укажите в поле model значение claude-fable-5; также поддерживается нативный Anthropic Messages API.

$8.00/1M ввод · $40.00/1M вывод Смотреть →
Gemini 3.1 Pro Чат

Gemini 3.1 Pro

gemini-3.1-pro

Gemini 3.1 Pro — флагманская мультимодальная модель нового поколения от Google с очень длинным контекстным окном и рассуждением и написанием кода топ-уровня. Полностью совместима с OpenAI API: укажите model равным gemini-3.1-pro в своём текущем SDK. По умолчанию используется уровень с низким рассуждением (быстрее и дешевле); передайте reasoning_effort=high для высокого уровня (оплата по тарифу Preview). В ответах есть поле reasoning_content, позволяющее увидеть ход рассуждения (тоже передаётся потоково, чанк за чанком).

$0.50/1M ввод · $3.00/1M вывод ↓75% Смотреть →
Gemini 3.8 Flash Чат

Gemini 3.8 Flash

gemini-3.8-flash

Gemini 3.8 Flash — новейшее поколение линейки Flash от Google (выпущено в сентябре 2026 года), созданное для длительных задач написания кода, агентных сценариев и сложных рассуждений: контекст на 1M токенов, вывод до 64K, ввод изображений. Модель использует динамический бюджет мышления — быстрые ответы на простые вопросы и больше размышлений над сложными. Полностью совместима с OpenAI API: укажите model равным gemini-3.8-flash.

$0.60/1M ввод · $3.60/1M вывод ↓7% Смотреть →
Gemini 3.7 Flash Чат

Gemini 3.7 Flash

gemini-3.7-flash

Gemini 3.7 Flash — поколение, предшествующее 3.8, с тем же динамическим бюджетом мышления, контекстом на 1M токенов и вводом изображений. Хороший вариант, если ваши промпты уже настроены под 3.7 и вы пока не хотите переходить. Полностью совместима с OpenAI API: укажите model равным gemini-3.7-flash.

$0.60/1M ввод · $3.60/1M вывод ↓7% Смотреть →
Gemini 3.6 Flash Чат

Gemini 3.6 Flash

gemini-3.6-flash · high · low · tiered

Линейка Gemini 3.6 Flash: одна модель, четыре бюджета мышления — Medium для повседневного баланса, High для глубокого рассуждения, Low для скорости и низкой стоимости, Tiered — модель сама выбирает уровень по сложности задачи. Все четыре стоят одинаково; больше мышления означает просто больше токенов на выходе. Контекст 1M, ввод изображений. Выберите уровень в Model Type.

$0.60/1M ввод · $3.60/1M вывод Смотреть →
Gemini 3 Flash Чат

Gemini 3 Flash

gemini-3-flash-preview

Gemini 3 Flash делает акцент на скорости и экономичности — для высоконагруженного чата и агентных задач с низкой задержкой. Полностью совместима с OpenAI API, включая потоковый вывод: укажите в поле model значение gemini-3-flash-preview.

$0.30/1M ввод · $1.20/1M вывод ↓57% Смотреть →
Gemini 2.5 Flash Чат

Gemini 2.5 Flash

gemini-2.5-flash

Gemini 2.5 Flash делает акцент на скорости и экономичности — для крупномасштабного чата и агентных задач с низкой задержкой, с поддержкой мультимодального ввода. Полностью совместима с OpenAI API: укажите в поле model значение gemini-2.5-flash.

$0.30/1M ввод · $1.20/1M вывод ↓46% Смотреть →
Grok 4.7 Чат

Grok 4.7

grok-4.7

Grok 4.7 — флагманская модель рассуждений от xAI, сильная в сложных рассуждениях, программировании и анализе длинных документов, с поддержкой ввода изображений. Модель всегда сначала размышляет, а потом отвечает; рассуждения возвращаются в поле reasoning_content, а токены рассуждения оплачиваются по цене выходных токенов. Поддерживаются вызов инструментов, структурированный вывод по JSON Schema и потоковый вывод. Полностью совместима с OpenAI: укажите в поле model значение grok-4.7. Оплата по факту использования, неудачные запросы никогда не оплачиваются, надбавки за длинный контекст нет.

$0.30/1M ввод · $0.90/1M вывод ↓85% Смотреть →
Veo 3.1 Видео

Veo 3.1 Пока недоступно

veo-3.1

Veo 3.1 — видеомодель ИИ от Google. Один эндпоинт, режим задаётся параметрами: текст в видео без референсного изображения, изображение в видео — с ним (используется как первый кадр). Уровни качества Lite / Fast / Quality, разрешения 720p / 1080p / 4K (1080p и 4K доступны на уровне Quality), альбомная ориентация 16:9 или портретная 9:16, длительность 4s / 6s / 8s. Асинхронно: отправляете задачу, затем опрашиваете job id, чтобы получить ссылку на перезалитое видео (хранится 60 дней). Оплата за ролик; неудачные задачи возвращаются полностью.

$0.075/clip+ Смотреть →
Seedance 2.5 Видео

Seedance 2.x

seedance-2.5

Семейство видеомоделей ByteDance Seedance: 2.5 позволяет снимать ролики длительностью до 30 секунд и принимает больше всего референсов; 2.0 и 2.0 Fast — быстрее и дешевле.

$0.158/s Смотреть →
Seedance 2.5 · 30s Видео

Seedance 2.5 · 30s

seedance-2.5-30s

Seedance 2.5 (длинный формат): фиксированный 30-секундный клип в 720P, оплата за клип — $1.50. Те же 30 секунд у seedance-2.5 с посекундной оплатой стоят $4.74 -- здесь на 68% дешевле. Пять соотношений сторон, до 9 референсных изображений, встроенный звук включён. «Текст в видео» — без референсного изображения, «изображение в видео» — с одним. Асинхронно, около 15-20 минут на клип; при неудаче — полный возврат.

$1.500/clip+ Смотреть →
Wan 3.0 Видео

Wan 3.0

wan3.0-video

Семейство видеомоделей Alibaba Wan 3.0: у Standard и Prime одинаковые возможности — они отличаются только временем выполнения и ценой за единицу.

$0.120/s Смотреть →
MiniMax H3 Видео

MiniMax H3

minimax-h3

Видеомодель MiniMax H3 (Hailuo 03): вывод 1080P HD, нативный звук генерируется всегда, 5-15 секунд с шагом в одну секунду, шесть соотношений сторон. Text-to-video без референсного изображения, image-to-video с одним референсным изображением (используется как первый кадр). Асинхронно: отправьте запрос, затем опрашивайте job id, чтобы получить ссылку на перезалитый файл mp4 (хранится 60 дней). Оплата по секундам; неудачные задачи возвращаются полностью.

$0.036/s Смотреть →
Grok Imagine Video 1.5 Видео

Grok Imagine Video 1.5

grok-imagine-video-1.5

xAI Grok Imagine Video 1.5: 4-15 секунд с шагом в одну секунду, 480P / 720P, пять соотношений сторон. Text-to-video без референсного изображения, image-to-video с референсными изображениями (до 7; при 2 и более максимум составляет 10 секунд). Асинхронно, оплата за клип — 1 секунда стоит столько же, сколько 15 — а неудачные задачи возвращаются полностью. 480P $0.30 / 720P $0.40; цена меняется только в зависимости от разрешения.

$0.300/clip+ Смотреть →

Скоро

Qwen3.8-Max Скоро
qwen3.8-max · Alibaba

Крупнейший флагман Qwen от Alibaba: 2,4 трлн параметров и контекст до 1M токенов

Частые вопросы о доступе, оплате, моделях и безопасности. Частые вопросы NezhaGate →