NezhaGateNezhaGate
Чат

Gemini 3.1 Pro

⧉
gemini-3.1-pro

Gemini 3.1 Pro — флагманская мультимодальная модель нового поколения от Google с очень длинным контекстным окном и рассуждением и написанием кода топ-уровня. Полностью совместима с OpenAI API: укажите model равным gemini-3.1-pro в своём текущем SDK. По умолчанию используется уровень с низким рассуждением (быстрее и дешевле); передайте reasoning_effort=high для высокого уровня (оплата по тарифу Preview). В ответах есть поле reasoning_content, позволяющее увидеть ход рассуждения (тоже передаётся потоково, чанк за чанком).

ЧатДлинный контекстМультимодальностьВидимое рассуждениеСовместимость с OpenAI

Онлайн-тест · Песочница

Попробуйте Gemini 3.1 Pro прямо здесь (доступно после входа).

Ввод

Дополнительно
Веб-поиск
Память · многоходовой диалог

Диалог

Начните диалогВведите сообщение ниже, чтобы начать

О Gemini 3.1 Pro

Gemini 3.1 Pro — флагманская модель Google нового поколения для рассуждений, созданная для сложных многошаговых рассуждений, понимания длинного контекста и мультимодального ввода — текста и изображений. На NezhaGate она доступна через совместимый с OpenAI API: укажите в поле model значение "gemini-3.1-pro" и направьте свой base_url на NezhaGate, чтобы напрямую использовать SDK OpenAI. По умолчанию используется быстрый уровень с низким усилием на рассуждение; передайте reasoning_effort="high", чтобы переключиться на уровень глубокого рассуждения (тарифицируется по ставке Preview). Оплата — по факту использования, неудачные запросы не оплачиваются.

Сценарии использования

Анализ длинных документов

Суммаризация, извлечение данных и ответы на вопросы по контрактам, отчётам и научным работам — длинное контекстное окно вмещает документ целиком, не теряя связность рассуждения.

Сложные рассуждения и планирование

Многошаговые рассуждения, математические и логические задачи, декомпозиция задач и планирование решений — там, где важна чёткая структурированная цепочка анализа.

Мультимодальное понимание

Сочетание текста и изображений для интерпретации графиков, вопросов и ответов по скриншотам и описания визуального контента — всё через единый чат-интерфейс.

Генерация и ревью кода

Генерация, объяснение и рефакторинг кода с опорой на длинный контекст, позволяющий читать целые файлы или модули и помогать с отладкой и ревью архитектуры.

Вопросы и ответы по базе знаний (RAG)

Работает как основная модель в генерации с дополнением за счёт поиска (RAG): найденные фрагменты передаются вместе с вопросом пользователя, чтобы получить обоснованные ответы со ссылками на источники.

Как выбрать

Выбирайте флагманскую Gemini 3.1 Pro, если нужны самые глубокие рассуждения, самый длинный контекст и мультимодальная поддержка; если для повседневного чата важнее низкая задержка и экономичность, берите более быстрые модели Google — Gemini 3 Flash, Gemini 3.5 Flash или Gemini 2.5 Flash. Чтобы сравнить флагманы разных провайдеров, точно так же переключайтесь на GPT-5.5 или Claude Sonnet 4.6: все они работают за одним и тем же совместимым с OpenAI API, так что меняется только поле model.

Частые вопросы

Что такое Gemini 3.1 Pro?
Gemini 3.1 Pro — это флагманская модель Google нового поколения для рассуждений, нацеленная на сложные рассуждения, длинный контекст и мультимодальные задачи с текстом и изображениями. На NezhaGate она доступна через совместимый с OpenAI API под именем модели "gemini-3.1-pro", с двумя уровнями усилия, которые выбираются параметром reasoning_effort: low (по умолчанию) и high.
Как вызывать Gemini 3.1 Pro через OpenAI SDK?
Продолжайте использовать уже имеющийся у вас OpenAI SDK: направьте base_url клиента на NezhaGate, укажите свой API-ключ NezhaGate и вызывайте эндпоинт chat.completions, указав в model значение "gemini-3.1-pro". Никакой новый SDK и изменения формата запроса не требуются. Добавьте reasoning_effort="high" (либо используйте название модели gemini-3.1-pro-high), когда нужно более глубокое рассуждение.
В чём разница между уровнями low и high? Старый идентификатор gemini-3.1-pro-preview всё ещё работает?
Оба уровня — это одна и та же модель с разной глубиной рассуждения: low (по умолчанию) отвечает быстрее и дешевле, что хорошо подходит для повседневного чата и массовых задач; high рассуждает глубже для сложных задач и сложного кода, тарифицируется по ставке Preview. Переключайтесь, передав reasoning_effort="high". Устаревший идентификатор gemini-3.1-pro-preview продолжает работать — он соответствует уровню high по прежней цене, так что старые интеграции менять не нужно.
Можно ли увидеть рассуждение модели при вызове Gemini 3.1 Pro?
Да. Помимо ответа в content, в ответе присутствует поле reasoning_content с собственной сводкой модели о том, как она рассуждала над задачей; при потоковой передаче оно приходит по частям как delta.reasoning_content. Рассуждение и ответ хранятся в разных полях и никогда не смешиваются, поэтому клиентам, которые читают только content, ничего менять не нужно. По оплате: токены рассуждения тарифицируются по ставке вывода и включаются в usage.completion_tokens, а usage.completion_tokens_details.reasoning_tokens показывает, сколько из них пришлось на рассуждение. Для потоковых вызовов провайдер не сообщает отдельный счётчик размышлений, поэтому это поле возвращает 0 — токены при этом всё равно учтены в completion_tokens, так что стоимость совпадает с непотоковым вариантом.
Для чего лучше всего подходит Gemini 3.1 Pro?
Она лучше всего подходит для задач, требующих глубокого рассуждения, работы с длинными документами или мультимодального понимания текста и изображений — таких как развёрнутый анализ, решение сложных задач, ревью кода и вопросы и ответы по базе знаний (RAG). Для чата, чувствительного к задержке, или недорогого чата с высокой нагрузкой лучше подойдут более быстрые модели линейки Flash.
Gemini 3.1 Pro и Gemini 3 Flash: как выбрать?
Gemini 3.1 Pro — это флагманская модель с более глубоким рассуждением и более длинным контекстом, идеальная для требовательных и мультимодальных задач; Gemini 3 Flash — быстрый уровень с низкой задержкой, подходящий для повседневного чата, где на первом месте скорость и экономичность. Обе работают через один и тот же совместимый с OpenAI API, так что переключение — это всего лишь смена поля model.

Похожие модели

Изучите другие модели, которые можно подключить.

Смотреть все →