Qwen3.8 Flash
⧉Qwen3.8 Flash — лёгкая и быстрая версия семейства Qwen3.8 с низкой ценой за единицу и высокой пропускной способностью для пакетной обработки и высокой параллельности; в наших тестах короткие вопросы получали ответ за 2,5–6 секунд. Модель всегда думает перед ответом (рассуждение возвращается в reasoning_content) и поддерживает вызов функций, вывод в JSON, потоковый вывод и ввод изображений (публичные ссылки или base64). cache_control в текстовом блоке тоже принимается, и провайдер может отдать повторяющийся длинный префикс из кэша; попадёт ли он в кэш, решает провайдер, а оплата следует возвращённому usage (часть, отмеченная как попадание в кэш, оплачивается по тарифу кэша). Полностью совместима с OpenAI: укажите в поле model значение qwen3.8-flash. Оплата по факту использования, неудачные запросы никогда не оплачиваются.
Онлайн-тест · Песочница
Попробуйте Qwen3.8 Flash прямо здесь (доступно после входа).
Ввод
Дополнительно
Диалог
О Qwen3.8 Flash
Qwen3.8 Flash — лёгкая и быстрая версия семейства Qwen3.8 от Alibaba Cloud, доступная на NezhaGate через совместимый с OpenAI API. У неё низкая цена за единицу и высокая пропускная способность для пакетной обработки и высокой параллельности; в наших тестах короткие вопросы получали ответ за 2,5–6 секунд. Модель всегда думает перед ответом, рассуждение возвращается в message.reasoning_content. Поддерживаются вызов инструментов, вывод в JSON, потоковый вывод и ввод изображений (публичные ссылки или base64); cache_control тоже принимается, и провайдер может отдать повторяющийся длинный префикс из кэша: попадёт ли он в кэш, решает провайдер, а оплата следует возвращённому usage (часть, отмеченная как попадание в кэш, оплачивается по тарифу кэша). Укажите model равным qwen3.8-flash; оплата по факту использования, неудачные запросы никогда не оплачиваются.
Сценарии использования
Классификация, извлечение данных, суммаризация и переписывание в больших объёмах по низкой цене за единицу — удобно для пакетов с высокой параллельностью.
Читает текст и содержимое скриншотов, чеков и фото товаров; подходят и публичные ссылки, и base64.
Ответы по базе знаний и помощники в написании текстов, где нужны быстрые и недорогие ответы.
tools / tool_calls в формате OpenAI и вывод в JSON для исполнительных шагов лёгкого агента.
Как выбрать
Выбирайте Qwen3.8 Flash, когда задачи простые, объём большой, а стоимость и скорость важнее всего; переходите на Qwen3.8 Max ради более сильных рассуждения, кода и работы с агентами или на снимок 0902 ради фиксированной версии. Все три входят в семейство Qwen3.8, поэтому переключение — это всего лишь поле model.
Частые вопросы
Как включить кэширование промптов?
Можно ли отключить мышление?
Как отправить изображение?
Чем она отличается от Qwen3.8 Max?
Взимается ли плата за неудачные запросы?
Похожие модели
Изучите другие модели, которые можно подключить.
Qwen3.8 Max
Флагман Qwen 3.8 от Alibaba — рассуждение, код и агенты
Qwen3.8 Max 0902
Зафиксированный снимок Qwen3.8 Max — версия, которая не меняется
DeepSeek V4.1 Flash
Актуальная модель DeepSeek Flash — рассуждение можно включать и выключать
GLM-5.3 Flash
Лёгкая версия GLM-5.3 — для большого объёма запросов и низкой стоимости
Gemini 3.6 Flash
Быстрая думающая модель нового поколения · четыре бюджета мышления