Qwen3.8 Flash
⧉Qwen3.8 Flash es la versión ligera y rápida de la familia Qwen3.8, con un precio unitario bajo y alto rendimiento para trabajos por lotes y alta concurrencia; en nuestras pruebas respondió a preguntas cortas en 2,5-6 segundos. Siempre piensa antes de responder (el razonamiento llega en reasoning_content) y admite llamadas a herramientas, salida JSON, streaming y entrada de imágenes (enlaces públicos o base64). También acepta cache_control en un bloque de texto, y el proveedor puede servir desde caché un prefijo largo repetido; si acierta o no lo decide el proveedor, y la facturación sigue el usage devuelto (lo que se reporte como acierto de caché se liquida a la tarifa de caché). Totalmente compatible con OpenAI: indica model=qwen3.8-flash. Pago por uso y sin cargo por las llamadas fallidas.
Prueba en directo
Prueba Qwen3.8 Flash aquí mismo (disponible tras iniciar sesión).
Entrada
Avanzado
Conversación
Acerca de Qwen3.8 Flash
Qwen3.8 Flash es la versión ligera y rápida de la familia Qwen3.8 de Alibaba Cloud, servida en NezhaGate mediante la API compatible con OpenAI. Tiene un precio unitario bajo y alto rendimiento para trabajos por lotes y alta concurrencia; en nuestras pruebas respondió a preguntas cortas en 2,5-6 segundos. Siempre piensa antes de responder, con el razonamiento en message.reasoning_content. Admite llamadas a herramientas, salida JSON, streaming y entrada de imágenes (enlaces públicos o base64); también acepta cache_control, y el proveedor puede servir desde caché un prefijo largo repetido: si acierta o no lo decide el proveedor, y la facturación sigue el usage devuelto (lo que se reporte como acierto de caché se liquida a la tarifa de caché). Indica model=qwen3.8-flash; pago por uso y sin cargo por las llamadas fallidas.
Casos de uso
Clasificación, extracción, resumen y reescritura a gran volumen, con un precio unitario bajo que encaja en lotes de alta concurrencia.
Lee el texto y el contenido de capturas de pantalla, recibos y fotos de producto; funcionan tanto los enlaces públicos como base64.
Preguntas sobre una base de conocimiento y asistentes de redacción que necesitan respuestas rápidas y baratas.
tools / tool_calls en formato OpenAI y salida JSON para los pasos de ejecución de un agente ligero.
Cómo elegir
Elige Qwen3.8 Flash cuando las tareas son sencillas, de gran volumen y sensibles al coste y la velocidad; pasa a Qwen3.8 Max para un razonamiento, una programación y un trabajo con agentes más potentes, o a la instantánea 0902 para una versión fija. Los tres pertenecen a la familia Qwen3.8, así que cambiar es solo modificar el campo model.
Preguntas frecuentes
¿Cómo activo la caché de prompts?
¿Puedo desactivar el razonamiento?
¿Cómo envío una imagen?
¿En qué se diferencia de Qwen3.8 Max?
¿Se cobran las llamadas fallidas?
Modelos relacionados
Descubre otros modelos que puedes integrar.
Qwen3.8 Max
El buque insignia Qwen 3.8 de Alibaba · razonamiento, programación y agentes
Qwen3.8 Max 0902
Instantánea fija de Qwen3.8 Max · una versión que no cambia
DeepSeek V4.1 Flash
El modelo Flash actual de DeepSeek · razonamiento activable
GLM-5.3 Flash
El GLM-5.3 ligero · gran volumen a bajo coste
Gemini 3.6 Flash
Modelo rápido de nueva generación · cuatro presupuestos de razonamiento