Каталог AI-моделей
Просматривайте все доступные AI-модели, сравнивайте цены и возможности и подключайтесь за минуты. Сейчас доступно 26 моделей, и их число постоянно растёт. Ещё 1 — пока не открыто.

DeepSeek V4 Flash
Семейство DeepSeek V4 Flash: V4.1 — актуальный релиз DeepSeek Flash, а 0731 — зафиксированный снимок V4 Flash для задач, где нужны неизменная версия и воспроизводимый результат. Обе стоят одинаково и поддерживают режим рассуждения и вызов инструментов. Версию выбирайте с помощью переключателя «Тип модели».

GLM-5.3
Семейство GLM-5.3: GLM-5.3 — новый флагман от Z.ai (Zhipu), созданный для программирования, агентных сценариев и сложных рассуждений; GLM-5.3 Flash — облегчённая и более дешёвая версия для высоких объёмов запросов. Обе модели всегда рассуждают перед ответом и поддерживают вызов инструментов. Версию выбирайте с помощью переключателя «Тип модели».

Kimi K3
Kimi K3 — новый флагман Moonshot AI, сильный в понимании длинных документов, анализе нескольких документов и написании текстов на китайском языке, с отличной поддержкой агентов и инструментов. Модель всегда рассуждает перед ответом, рассуждение возвращается в reasoning_content; температура сэмплирования фиксирована самой моделью, поэтому temperature / top_p в запросе игнорируются. Поддерживаются вызов функций, потоковый вывод и кэширование промптов (повторяющийся длинный префикс тарифицируется по ставке кэша). Полностью совместима с OpenAI: укажите в поле model значение kimi-k3. Оплата по факту использования, неудачные запросы никогда не оплачиваются.

Qwen3.7 Max
Qwen3.7 Max — флагман поколения Qwen 3.7 от Alibaba Cloud, сильный в рассуждении, коде и работе с агентами, с надёжной поддержкой китайского и английского языков. Модель всегда рассуждает перед ответом, рассуждение возвращается в reasoning_content, и поддерживает вызов функций, потоковый вывод и кэширование промптов. Полностью совместима с OpenAI: укажите в поле model значение qwen3.7-max. Оплата по факту использования, неудачные запросы никогда не оплачиваются.

GPT-5.6
Семейство GPT-5.6: Sol — флагман переднего края, Terra — сбалансированная модель для повседневных задач, Luna — быстрая и экономичная модель -- единое семейство, охватывающее диапазон от интеллекта переднего края до высокоскоростного исполнения. Используйте «Тип модели», чтобы выбрать уровень.

GPT-5.5
GPT-5.5 обеспечивает лучшие в отрасли чат, рассуждения и программирование, с поддержкой потокового вывода, длинного контекста и структурированных задач. Полностью совместима с OpenAI SDK: подключается к Codex, Cursor, Claude Code и подобным инструментам без единого изменения кода.

GPT-6
Семейство GPT-6: Astra — самый мощный флагман, Sol создан для сложного программирования и агентных сценариев, а Luna — самая эффективная модель для высоких объёмов запросов; у всех трёх общий контекст на 1,050,000 токенов. Версию выбирайте с помощью переключателя «Тип модели».

Claude Sonnet 4.6
Claude Sonnet 4.6 находит отличный баланс между возможностями и скоростью, прекрасно справляясь с повседневным чатом, кодом и агентами по отличной цене. Полностью совместима с OpenAI API: укажите в поле model значение claude-sonnet-4-6 — и вы подключены.

Claude Opus 5
Claude Opus 5 — флагман Anthropic нового поколения с адаптивным режимом рассуждения, включённым по умолчанию. Модель отлично справляется со сложными рассуждениями, инженерией кода и оркестрацией агентов, поддерживает распознавание изображений, вызов инструментов и кэширование промптов. Полностью совместима с OpenAI API: укажите в поле model значение claude-opus-5; либо используйте нативный Anthropic Messages API, чтобы Claude Code подключался напрямую.

Claude Fable 5
Claude Fable 5 относится к серии Anthropic Fable: та же генерация и та же база возможностей, что и у Opus 5 (адаптивное рассуждение, вызов инструментов, распознавание изображений, кэширование промптов), но с более тонким слогом и более богатыми эмоциональными оттенками в китайском нарративе и объёмных текстах. Полностью совместима с OpenAI API: укажите в поле model значение claude-fable-5; также поддерживается нативный Anthropic Messages API.

Gemini 3.1 Pro
Gemini 3.1 Pro — флагманская мультимодальная модель нового поколения от Google с очень длинным контекстным окном и рассуждением и написанием кода топ-уровня. Полностью совместима с OpenAI API: укажите model равным gemini-3.1-pro в своём текущем SDK. По умолчанию используется уровень с низким рассуждением (быстрее и дешевле); передайте reasoning_effort=high для высокого уровня (оплата по тарифу Preview). В ответах есть поле reasoning_content, позволяющее увидеть ход рассуждения (тоже передаётся потоково, чанк за чанком).

Gemini 3.8 Flash
Gemini 3.8 Flash — новейшее поколение линейки Flash от Google (выпущено в сентябре 2026 года), созданное для длительных задач написания кода, агентных сценариев и сложных рассуждений: контекст на 1M токенов, вывод до 64K, ввод изображений. Модель использует динамический бюджет мышления — быстрые ответы на простые вопросы и больше размышлений над сложными. Полностью совместима с OpenAI API: укажите model равным gemini-3.8-flash.

Gemini 3.7 Flash
Gemini 3.7 Flash — поколение, предшествующее 3.8, с тем же динамическим бюджетом мышления, контекстом на 1M токенов и вводом изображений. Хороший вариант, если ваши промпты уже настроены под 3.7 и вы пока не хотите переходить. Полностью совместима с OpenAI API: укажите model равным gemini-3.7-flash.

Gemini 3.6 Flash
Линейка Gemini 3.6 Flash: одна модель, четыре бюджета мышления — Medium для повседневного баланса, High для глубокого рассуждения, Low для скорости и низкой стоимости, Tiered — модель сама выбирает уровень по сложности задачи. Все четыре стоят одинаково; больше мышления означает просто больше токенов на выходе. Контекст 1M, ввод изображений. Выберите уровень в Model Type.

Gemini 3 Flash
Gemini 3 Flash делает акцент на скорости и экономичности — для высоконагруженного чата и агентных задач с низкой задержкой. Полностью совместима с OpenAI API, включая потоковый вывод: укажите в поле model значение gemini-3-flash-preview.

Gemini 2.5 Flash
Gemini 2.5 Flash делает акцент на скорости и экономичности — для крупномасштабного чата и агентных задач с низкой задержкой, с поддержкой мультимодального ввода. Полностью совместима с OpenAI API: укажите в поле model значение gemini-2.5-flash.

Grok 4.7
Grok 4.7 — флагманская модель рассуждений от xAI, сильная в сложных рассуждениях, программировании и анализе длинных документов, с поддержкой ввода изображений. Модель всегда сначала размышляет, а потом отвечает; рассуждения возвращаются в поле reasoning_content, а токены рассуждения оплачиваются по цене выходных токенов. Поддерживаются вызов инструментов, структурированный вывод по JSON Schema и потоковый вывод. Полностью совместима с OpenAI: укажите в поле model значение grok-4.7. Оплата по факту использования, неудачные запросы никогда не оплачиваются, надбавки за длинный контекст нет.
Частые вопросы о доступе, оплате, моделях и безопасности. Частые вопросы NezhaGate →









