NezhaGateNezhaGate
Чат

Qwen3.8 Max 0902

⧉
qwen3.8-max-0902
Тип модели Max0902Flash

Qwen3.8 Max 0902 — снимок 0902 модели Qwen3.8 Max: версия зафиксирована и не меняется вместе с обновлениями провайдера, что подходит задачам с уже настроенными промптами, где нужен стабильный и воспроизводимый вывод. Возможности и цена — как у Qwen3.8 Max. Модель всегда думает перед ответом (рассуждение возвращается в reasoning_content) и поддерживает вызов функций, потоковый вывод и ввод изображений (как data URI в base64); повторяющийся длинный префикс автоматически попадает в кэш, и эта часть оплачивается по тарифу кэша. Полностью совместима с OpenAI: укажите в поле model значение qwen3.8-max-0902.

ЧатФиксированная версияРассуждениеКэширование промптовСовместим с OpenAI

Онлайн-тест · Песочница

Попробуйте Qwen3.8 Max 0902 прямо здесь (доступно после входа).

Ввод

Дополнительно
Веб-поиск
Память · многоходовой диалог

Диалог

Начните диалогВведите сообщение ниже, чтобы начать

О Qwen3.8 Max 0902

Qwen3.8 Max 0902 — снимок 0902 модели Qwen3.8 Max, доступный на NezhaGate через совместимый с OpenAI API. Версия зафиксирована и не меняется вместе с обновлениями провайдера, что подходит задачам с уже настроенными промптами, где нужен стабильный и воспроизводимый вывод; возможности и цена — как у Qwen3.8 Max. Модель всегда думает перед ответом, рассуждение возвращается в message.reasoning_content. Поддерживаются вызов инструментов, потоковый вывод и ввод изображений, а повторяющийся длинный префикс автоматически попадает в кэш. Укажите model равным qwen3.8-max-0902; оплата по факту использования, неудачные запросы никогда не оплачиваются.

Сценарии использования

Фиксированная версия в продакшене

Для рабочих функций, базовых линий оценки и регрессионных тестов, где модель должна вести себя одинаково, без дрейфа из-за обновлений провайдера.

Повторные вопросы по длинным документам

Повторное использование одного длинного документа или длинного системного промпта автоматически попадает в кэш: в наших тестах префикс примерно в 10K токенов на втором вызове был закэширован на 97%, и эта часть оплачивается по тарифу кэша.

Рассуждение и код

Те же рассуждение, код и работа с агентами, что у Qwen3.8 Max, с вызовом инструментов в формате OpenAI и выводом в JSON.

Понимание изображений

Читает текст и содержимое скриншотов, чеков и графиков; отправляйте изображения как data URI в base64.

Как выбрать

Выбирайте снимок 0902, когда нужна зафиксированная версия и воспроизводимые результаты или когда вы повторно используете один и тот же длинный префикс; Qwen3.8 Max — чтобы всегда работать с актуальной версией; Qwen3.8 Flash — для большого объёма, когда важнее всего стоимость. Все три входят в семейство Qwen3.8, поэтому переключение — это всего лишь поле model.

Частые вопросы

Чем она отличается от Qwen3.8 Max?
Qwen3.8 Max — актуальная версия, а 0902 — зафиксированный снимок, поведение которого не меняется с обновлениями провайдера. Цена и способ подключения одинаковы. По нашим замерам, 0902 автоматически кэширует повторяющийся длинный префикс, а Qwen3.8 Max пока нет.
Как оплачивается кэш?
Повторяющийся длинный префикс автоматически попадает в кэш; эта часть отображается в usage.prompt_tokens_details.cached_tokens и оплачивается по тарифу кэша, остальной ввод — по тарифу ввода. Дополнительные параметры не нужны.
Можно ли отключить мышление?
Нет. 0902 всегда думает перед ответом, и enable_thinking, reasoning_effort или thinking_budget этого не меняют. Токены рассуждения оплачиваются по тарифу вывода внутри usage.completion_tokens.
Как отправить изображение?
Передайте image_url с data URI в base64 (data:image/png;base64,...) в content сообщения. Публичные ссылки на изображения сначала переведите в base64 или используйте Qwen3.8 Flash, которая принимает ссылки напрямую.
Взимается ли плата за неудачные запросы?
Нет. Списание происходит только за успешно завершённые запросы, по фактическому расходу; ошибки провайдера и тайм-ауты никогда не затрагивают ваш баланс.

Похожие модели

Изучите другие модели, которые можно подключить.

Смотреть все →