Gemini 3.6 Flash
⧉Gemini 3.6 Flash — быстрая думающая модель нового поколения от Google: контекст на 1M токенов, вывод до 64K, ввод изображений. Стандартный уровень (Medium) даёт сбалансированный бюджет мышления для повседневного чата и агентных сценариев. Полностью совместима с OpenAI API: укажите model равным gemini-3.6-flash.
Онлайн-тест · Песочница
Попробуйте Gemini 3.6 Flash прямо здесь (доступно после входа).
Ввод
Дополнительно
Диалог
О Gemini 3.6 Flash
Gemini 3.6 Flash — быстрая рассуждающая модель нового поколения от Google: она добавляет явный этап рассуждения (thinking) при задержке и цене уровня Flash, обрабатывает контекст на 1,000,000 токенов с выводом до 64K токенов и принимает ввод изображений. NezhaGate предоставляет четыре уровня бюджета рассуждения: стандартный gemini-3.6-flash, более глубокий gemini-3.6-flash-high, самый быстрый gemini-3.6-flash-low и gemini-3.6-flash-tiered, где модель сама решает для каждого запроса, сколько думать. Все четыре стоят одинаково за токен — то, насколько уровень «думает», просто отражается в токенах вывода. Модель работает через эндпоинт, совместимый с OpenAI: укажите base_url на NezhaGate и задайте в поле model значение "gemini-3.6-flash", чтобы использовать существующий код на OpenAI SDK без изменений — оплата по факту использования, неудачные запросы не оплачиваются.
Сценарии использования
Стандартный уровень уравновешивает скорость и рассуждение — подходит для ботов поддержки, ассистентов и агентных сценариев, которым нужно отвечать быстро, но при этом рассуждать.
Контекстное окно 1M токенов вмещает целиком большой репозиторий, объёмный отчёт или пачку договоров — для суммаризации, поиска и перекрёстной проверки за один проход.
Ввод изображений поддерживает вопросы по скриншотам, чтение форм и диаграмм и другой мультимодальный анализ.
Вариант tiered позволяет модели самой выбирать бюджет рассуждения для каждого запроса — быстрые ответы на простые вопросы, больше раздумий над сложными — что подходит для боевого трафика с большим разбросом сложности.
Как выбрать
По умолчанию используйте стандартный gemini-3.6-flash; переключайтесь на gemini-3.6-flash-high для многошаговых рассуждений; используйте gemini-3.6-flash-low для массовой классификации, извлечения данных и переписывания текста, где на практике он одновременно и самый быстрый, и самый дешёвый; а gemini-3.6-flash-tiered выбирайте, когда сложность запросов непредсказуема и вы предпочитаете, чтобы решение принимала модель. Все четыре стоят одинаково, так что смена уровня — это просто смена поля model. Если нужна более глубокая проработка рассуждений, переходите на Gemini 3.1 Pro.
Частые вопросы
В чём разница между четырьмя уровнями Gemini 3.6 Flash?
Почему все четыре уровня стоят одинаково?
Насколько велико контекстное окно?
Поддерживаются ли ввод изображений и потоковый вывод?
Как вызывать её через OpenAI SDK?
Похожие модели
Изучите другие модели, которые можно подключить.
Gemini 3.6 Flash High
Уровень глубокого мышления
Gemini 3.6 Flash Tiered
Автоматически подбираемый уровень размышления
Gemini 3.6 Flash Low
Самый быстрый и недорогой уровень
Gemini 3.8 Flash
Новейшая Flash · адаптивное мышление
Gemini 3.1 Pro
Флагманская модель рассуждения нового поколения от Google
Gemini 2.5 Flash
Быстрый и экономичный чат с низкой задержкой
Gemini 3.7 Flash
Предыдущая Flash · адаптивное мышление