Каталог AI-моделей
Просматривайте все доступные AI-модели, сравнивайте цены и возможности и подключайтесь за минуты. Сейчас доступно 26 моделей, и их число постоянно растёт. Ещё 1 — пока не открыто.

DeepSeek V4 Flash
Семейство DeepSeek V4 Flash: V4.1 — актуальный релиз DeepSeek Flash, а 0731 — зафиксированный снимок V4 Flash для задач, где нужны неизменная версия и воспроизводимый результат. Обе стоят одинаково и поддерживают режим рассуждения и вызов инструментов. Версию выбирайте с помощью переключателя «Тип модели».

GLM-5.3
Семейство GLM-5.3: GLM-5.3 — новый флагман от Z.ai (Zhipu), созданный для программирования, агентных сценариев и сложных рассуждений; GLM-5.3 Flash — облегчённая и более дешёвая версия для высоких объёмов запросов. Обе модели всегда рассуждают перед ответом и поддерживают вызов инструментов. Версию выбирайте с помощью переключателя «Тип модели».

Kimi K3
Kimi K3 — новый флагман Moonshot AI, сильный в понимании длинных документов, анализе нескольких документов и написании текстов на китайском языке, с отличной поддержкой агентов и инструментов. Модель всегда рассуждает перед ответом, рассуждение возвращается в reasoning_content; температура сэмплирования фиксирована самой моделью, поэтому temperature / top_p в запросе игнорируются. Поддерживаются вызов функций, потоковый вывод и кэширование промптов (повторяющийся длинный префикс тарифицируется по ставке кэша). Полностью совместима с OpenAI: укажите в поле model значение kimi-k3. Оплата по факту использования, неудачные запросы никогда не оплачиваются.

Qwen3.7 Max
Qwen3.7 Max — флагман поколения Qwen 3.7 от Alibaba Cloud, сильный в рассуждении, коде и работе с агентами, с надёжной поддержкой китайского и английского языков. Модель всегда рассуждает перед ответом, рассуждение возвращается в reasoning_content, и поддерживает вызов функций, потоковый вывод и кэширование промптов. Полностью совместима с OpenAI: укажите в поле model значение qwen3.7-max. Оплата по факту использования, неудачные запросы никогда не оплачиваются.

GPT-5.6
Семейство GPT-5.6: Sol — флагман переднего края, Terra — сбалансированная модель для повседневных задач, Luna — быстрая и экономичная модель -- единое семейство, охватывающее диапазон от интеллекта переднего края до высокоскоростного исполнения. Используйте «Тип модели», чтобы выбрать уровень.

GPT-5.5
GPT-5.5 обеспечивает лучшие в отрасли чат, рассуждения и программирование, с поддержкой потокового вывода, длинного контекста и структурированных задач. Полностью совместима с OpenAI SDK: подключается к Codex, Cursor, Claude Code и подобным инструментам без единого изменения кода.

GPT-6
Семейство GPT-6: Astra — самый мощный флагман, Sol создан для сложного программирования и агентных сценариев, а Luna — самая эффективная модель для высоких объёмов запросов; у всех трёх общий контекст на 1,050,000 токенов. Версию выбирайте с помощью переключателя «Тип модели».

GPT Image 2
GPT Image 2 создана для коммерческого креатива: обложки статей, предметная съёмка, постеры, инфографика и иллюстрации. Поддерживает и генерацию изображений из текста, и их редактирование (по изображению), разрешения 1K / 2K / 4K и разные соотношения сторон — через images API, совместимый с OpenAI.

GPT Image 2.5
GPT Image 2.5 — модель изображений нового поколения от OpenAI в двух стилевых ветвях: Flare даёт более чистый и гладкий результат, Sunburst — более зернистый, с более выраженной текстурой и контрастными светами. Возможности и цена одинаковые — различается только внешний вид. Версию выбирайте с помощью переключателя «Тип модели».

Nano Banana 2
Nano Banana 2 (Gemini 3.1 Flash Image) отлично справляется с обложками, постерами, иллюстрациями и предметной съёмкой. Поддерживает режимы «текст в изображение» и «изображение в изображение», разрешения 1K / 2K / 4K и несколько соотношений сторон; быстрая и экономичная модель, доступна через совместимый с OpenAI images API.

Nano Banana Pro
Nano Banana Pro (Gemini 3 Pro Image) — флагманская модель изображений с более проработанной детализацией и композицией. Поддерживает режимы «текст в изображение» и «изображение в изображение», отлично работает с типографикой и сложными сценами, подходит для коммерческих обложек и качественных иллюстраций — через совместимый с OpenAI images API.

Claude Sonnet 4.6
Claude Sonnet 4.6 находит отличный баланс между возможностями и скоростью, прекрасно справляясь с повседневным чатом, кодом и агентами по отличной цене. Полностью совместима с OpenAI API: укажите в поле model значение claude-sonnet-4-6 — и вы подключены.

Claude Opus 5
Claude Opus 5 — флагман Anthropic нового поколения с адаптивным режимом рассуждения, включённым по умолчанию. Модель отлично справляется со сложными рассуждениями, инженерией кода и оркестрацией агентов, поддерживает распознавание изображений, вызов инструментов и кэширование промптов. Полностью совместима с OpenAI API: укажите в поле model значение claude-opus-5; либо используйте нативный Anthropic Messages API, чтобы Claude Code подключался напрямую.

Claude Fable 5
Claude Fable 5 относится к серии Anthropic Fable: та же генерация и та же база возможностей, что и у Opus 5 (адаптивное рассуждение, вызов инструментов, распознавание изображений, кэширование промптов), но с более тонким слогом и более богатыми эмоциональными оттенками в китайском нарративе и объёмных текстах. Полностью совместима с OpenAI API: укажите в поле model значение claude-fable-5; также поддерживается нативный Anthropic Messages API.

Gemini 3.1 Pro
Gemini 3.1 Pro — флагманская мультимодальная модель нового поколения от Google с очень длинным контекстным окном и рассуждением и написанием кода топ-уровня. Полностью совместима с OpenAI API: укажите model равным gemini-3.1-pro в своём текущем SDK. По умолчанию используется уровень с низким рассуждением (быстрее и дешевле); передайте reasoning_effort=high для высокого уровня (оплата по тарифу Preview). В ответах есть поле reasoning_content, позволяющее увидеть ход рассуждения (тоже передаётся потоково, чанк за чанком).

Gemini 3.8 Flash
Gemini 3.8 Flash — новейшее поколение линейки Flash от Google (выпущено в сентябре 2026 года), созданное для длительных задач написания кода, агентных сценариев и сложных рассуждений: контекст на 1M токенов, вывод до 64K, ввод изображений. Модель использует динамический бюджет мышления — быстрые ответы на простые вопросы и больше размышлений над сложными. Полностью совместима с OpenAI API: укажите model равным gemini-3.8-flash.

Gemini 3.7 Flash
Gemini 3.7 Flash — поколение, предшествующее 3.8, с тем же динамическим бюджетом мышления, контекстом на 1M токенов и вводом изображений. Хороший вариант, если ваши промпты уже настроены под 3.7 и вы пока не хотите переходить. Полностью совместима с OpenAI API: укажите model равным gemini-3.7-flash.

Gemini 3.6 Flash
Линейка Gemini 3.6 Flash: одна модель, четыре бюджета мышления — Medium для повседневного баланса, High для глубокого рассуждения, Low для скорости и низкой стоимости, Tiered — модель сама выбирает уровень по сложности задачи. Все четыре стоят одинаково; больше мышления означает просто больше токенов на выходе. Контекст 1M, ввод изображений. Выберите уровень в Model Type.

Gemini 3 Flash
Gemini 3 Flash делает акцент на скорости и экономичности — для высоконагруженного чата и агентных задач с низкой задержкой. Полностью совместима с OpenAI API, включая потоковый вывод: укажите в поле model значение gemini-3-flash-preview.

Gemini 2.5 Flash
Gemini 2.5 Flash делает акцент на скорости и экономичности — для крупномасштабного чата и агентных задач с низкой задержкой, с поддержкой мультимодального ввода. Полностью совместима с OpenAI API: укажите в поле model значение gemini-2.5-flash.

Grok 4.7
Grok 4.7 — флагманская модель рассуждений от xAI, сильная в сложных рассуждениях, программировании и анализе длинных документов, с поддержкой ввода изображений. Модель всегда сначала размышляет, а потом отвечает; рассуждения возвращаются в поле reasoning_content, а токены рассуждения оплачиваются по цене выходных токенов. Поддерживаются вызов инструментов, структурированный вывод по JSON Schema и потоковый вывод. Полностью совместима с OpenAI: укажите в поле model значение grok-4.7. Оплата по факту использования, неудачные запросы никогда не оплачиваются, надбавки за длинный контекст нет.

Veo 3.1 Пока недоступно
Veo 3.1 — видеомодель ИИ от Google. Один эндпоинт, режим задаётся параметрами: текст в видео без референсного изображения, изображение в видео — с ним (используется как первый кадр). Уровни качества Lite / Fast / Quality, разрешения 720p / 1080p / 4K (1080p и 4K доступны на уровне Quality), альбомная ориентация 16:9 или портретная 9:16, длительность 4s / 6s / 8s. Асинхронно: отправляете задачу, затем опрашиваете job id, чтобы получить ссылку на перезалитое видео (хранится 60 дней). Оплата за ролик; неудачные задачи возвращаются полностью.

Seedance 2.x
Семейство видеомоделей ByteDance Seedance: 2.5 позволяет снимать ролики длительностью до 30 секунд и принимает больше всего референсов; 2.0 и 2.0 Fast — быстрее и дешевле.

Seedance 2.5 · 30s
Seedance 2.5 (длинный формат): фиксированный 30-секундный клип в 720P, оплата за клип — $1.50. Те же 30 секунд у seedance-2.5 с посекундной оплатой стоят $4.74 -- здесь на 68% дешевле. Пять соотношений сторон, до 9 референсных изображений, встроенный звук включён. «Текст в видео» — без референсного изображения, «изображение в видео» — с одним. Асинхронно, около 15-20 минут на клип; при неудаче — полный возврат.

Wan 3.0
Семейство видеомоделей Alibaba Wan 3.0: у Standard и Prime одинаковые возможности — они отличаются только временем выполнения и ценой за единицу.

MiniMax H3
Видеомодель MiniMax H3 (Hailuo 03): вывод 1080P HD, нативный звук генерируется всегда, 5-15 секунд с шагом в одну секунду, шесть соотношений сторон. Text-to-video без референсного изображения, image-to-video с одним референсным изображением (используется как первый кадр). Асинхронно: отправьте запрос, затем опрашивайте job id, чтобы получить ссылку на перезалитый файл mp4 (хранится 60 дней). Оплата по секундам; неудачные задачи возвращаются полностью.

Grok Imagine Video 1.5
xAI Grok Imagine Video 1.5: 4-15 секунд с шагом в одну секунду, 480P / 720P, пять соотношений сторон. Text-to-video без референсного изображения, image-to-video с референсными изображениями (до 7; при 2 и более максимум составляет 10 секунд). Асинхронно, оплата за клип — 1 секунда стоит столько же, сколько 15 — а неудачные задачи возвращаются полностью. 480P $0.30 / 720P $0.40; цена меняется только в зависимости от разрешения.
Частые вопросы о доступе, оплате, моделях и безопасности. Частые вопросы NezhaGate →