NezhaGateNezhaGate
Чат

Qwen3.7 Max

⧉
qwen3.7-max

Qwen3.7 Max — флагман поколения Qwen 3.7 от Alibaba Cloud, сильный в рассуждении, коде и работе с агентами, с надёжной поддержкой китайского и английского языков. Модель всегда рассуждает перед ответом, рассуждение возвращается в reasoning_content, и поддерживает вызов функций, потоковый вывод и кэширование промптов. Полностью совместима с OpenAI: укажите в поле model значение qwen3.7-max. Оплата по факту использования, неудачные запросы никогда не оплачиваются.

ЧатРассуждениеКодВызов функцийСовместим с OpenAI

Онлайн-тест · Песочница

Попробуйте Qwen3.7 Max прямо здесь (доступно после входа).

Ввод

Дополнительно
Веб-поиск
Память · многоходовой диалог

Диалог

Начните диалогВведите сообщение ниже, чтобы начать

О Qwen3.7 Max

Qwen3.7 Max — флагман поколения Qwen 3.7 от Alibaba Cloud, доступный на NezhaGate через совместимый с OpenAI API. Модель сильна в рассуждении, написании кода и агентных задачах, уверенно работает с китайским и английским языками. Она всегда думает перед ответом: рассуждение возвращается в message.reasoning_content, а ответ — в content, поэтому клиентам, которые читают только content, ничего менять не нужно. Поддерживаются вызов инструментов, потоковый вывод и кэширование промптов (повторяющийся длинный префикс оплачивается по тарифу кэша). Укажите model равным qwen3.7-max; оплата по факту использования, неудачные запросы никогда не оплачиваются.

Сценарии использования

Сложные рассуждения и математика

Модель думает перед ответом, что хорошо подходит для многошаговых рассуждений, математических и логических задач.

Генерация и ревью кода

Написание, рефакторинг, объяснение и ревью кода со структурированным выводом.

Агенты и вызов инструментов

tools / tool_calls в формате OpenAI подключаются к любому агентному фреймворку.

Вопросы и ответы по длинным документам

Мы проверили: модель точно находит факты в документах объёмом более 100K токенов, а повторные вопросы по тому же документу попадают в кэш и стоят дешевле.

Как выбрать

Выбирайте Qwen3.7 Max, когда нужны сильное рассуждение и код. Для длинных документов и анализа нескольких документов сравните её с Kimi K3; если важнее всего стоимость, выбирайте DeepSeek V4.1 Flash. Переключение — это всего лишь поле model.

Частые вопросы

Можно ли отключить мышление или ограничить его длину?
Нет. Через NezhaGate Qwen3.7 Max всегда думает, и параметры вроде reasoning_effort, enable_thinking или thinking_budget не влияют на длительность рассуждения. Токены рассуждения оплачиваются по тарифу вывода внутри usage.completion_tokens.
Может ли max_tokens ограничить мои расходы?
max_tokens не ограничивает часть с рассуждением: даже при очень маленьком значении модель может сначала «подумать» тысячи токенов, и вы платите за фактическое число токенов в usage. Чтобы снизить расходы, попросите короткий ответ прямо в промпте.
Поддерживается ли кэширование промптов?
Да. Повторяющийся длинный префикс попадает в кэш, и эта часть оплачивается по тарифу кэша; по нашим измерениям, повторный вопрос по тому же длинному документу обходится примерно в пятую часть стоимости первого.
Поддерживает ли модель вызов инструментов и потоковый вывод?
Да, и то, и другое. tools / tool_calls используют формат OpenAI; при stream=true ответ приходит частями SSE, а рассуждение передаётся потоково в delta.reasoning_content.
Взимается ли плата за неудачные запросы?
Нет. Списание происходит только за успешно завершённые запросы, по фактическому расходу; ошибки провайдера и тайм-ауты никогда не затрагивают ваш баланс.

Похожие модели

Изучите другие модели, которые можно подключить.

Смотреть все →