NezhaGateNezhaGate
Chat

Qwen3.8 Max 0902

⧉
qwen3.8-max-0902
Tipo de modelo Max0902Flash

Qwen3.8 Max 0902 es la instantánea 0902 de Qwen3.8 Max: la versión queda fija y no cambia con las actualizaciones del proveedor, lo que conviene a cargas cuyos prompts ya están ajustados y necesitan resultados estables y reproducibles. Misma capacidad y mismo precio que Qwen3.8 Max. Siempre piensa antes de responder (el razonamiento llega en reasoning_content) y admite llamadas a herramientas, streaming y entrada de imágenes (como data URI en base64); un prefijo largo repetido acierta en la caché automáticamente y esa parte se liquida a la tarifa de caché. Totalmente compatible con OpenAI: indica model=qwen3.8-max-0902.

ChatVersión fijaRazonamientoCaché de promptsCompatible con OpenAI

Prueba en directo

Prueba Qwen3.8 Max 0902 aquí mismo (disponible tras iniciar sesión).

Entrada

Avanzado
Búsqueda web
Memoria · multiturno

Conversación

Empieza una conversaciónEscribe un mensaje abajo para empezar

Acerca de Qwen3.8 Max 0902

Qwen3.8 Max 0902 es la instantánea 0902 de Qwen3.8 Max, servida en NezhaGate mediante la API compatible con OpenAI. La versión queda fija y no cambia con las actualizaciones del proveedor, lo que conviene a cargas cuyos prompts ya están ajustados y necesitan resultados estables y reproducibles; capacidad y precio son los de Qwen3.8 Max. Siempre piensa antes de responder, con el razonamiento en message.reasoning_content. Admite llamadas a herramientas, streaming y entrada de imágenes, y un prefijo largo repetido acierta en la caché automáticamente. Indica model=qwen3.8-max-0902; pago por uso y sin cargo por las llamadas fallidas.

Casos de uso

Una versión fija en producción

Para funciones en producción, líneas base de evaluación y pruebas de regresión que necesitan que el modelo se comporte igual, sin la deriva que traen las actualizaciones del proveedor.

Preguntas repetidas sobre documentos largos

Reutilizar el mismo documento largo o el mismo prompt de sistema extenso acierta en la caché automáticamente; en nuestras pruebas un prefijo de unos 10K tokens quedó en caché en un 97 % en la segunda llamada, y esa parte se liquida a la tarifa de caché.

Razonamiento y código

La misma capacidad de razonamiento, programación y agentes que Qwen3.8 Max, con llamadas a herramientas en formato OpenAI y salida JSON.

Comprensión de imágenes

Lee el texto y el contenido de capturas de pantalla, recibos y gráficos; envía las imágenes como data URI en base64.

Cómo elegir

Elige la instantánea 0902 si necesitas una versión fija y resultados reproducibles, o si reutilizas el mismo prefijo largo; Qwen3.8 Max si quieres usar siempre la versión actual; y Qwen3.8 Flash para gran volumen cuando más importa el coste. Los tres pertenecen a la familia Qwen3.8, así que cambiar es solo modificar el campo model.

Preguntas frecuentes

¿En qué se diferencia de Qwen3.8 Max?
Qwen3.8 Max es la versión actual; 0902 es una instantánea fija cuyo comportamiento no cambia con las actualizaciones del proveedor. Ambas cuestan lo mismo y se integran igual. En nuestras pruebas 0902 guarda en caché un prefijo largo repetido de forma automática, mientras que Qwen3.8 Max por ahora no.
¿Cómo se factura la caché?
Un prefijo largo repetido acierta en la caché automáticamente; esa parte aparece en usage.prompt_tokens_details.cached_tokens y se liquida a la tarifa de caché, y el resto se factura a la tarifa de entrada. No hace falta ningún parámetro adicional.
¿Puedo desactivar el razonamiento?
No. 0902 siempre piensa antes de responder, y enable_thinking, reasoning_effort o thinking_budget no lo cambian. Los tokens de razonamiento se facturan a la tarifa de salida dentro de usage.completion_tokens.
¿Cómo envío una imagen?
Pon un image_url con un data URI en base64 (data:image/png;base64,...) en el content del mensaje. Convierte antes a base64 los enlaces públicos a imágenes, o usa Qwen3.8 Flash, que acepta enlaces directamente.
¿Se cobran las llamadas fallidas?
No. Solo se liquidan, según el uso real, las llamadas que responden con normalidad; los errores del proveedor y los tiempos de espera agotados nunca tocan tu saldo.

Modelos relacionados

Descubre otros modelos que puedes integrar.

Ver todo →