NezhaGateNezhaGate
Chat

Qwen3.7 Max

⧉
qwen3.7-max

Qwen3.7 Max es el modelo insignia de la generación Qwen 3.7 de Alibaba Cloud, fuerte en razonamiento, programación y trabajo con agentes, con un chino y un inglés fiables. Siempre piensa antes de responder, con el razonamiento en reasoning_content, y admite llamadas a herramientas, streaming y caché de prompts. Totalmente compatible con OpenAI: indica model=qwen3.7-max. Pago por uso y sin cargo por las llamadas fallidas.

ChatRazonamientoProgramaciónLlamadas a herramientasCompatible con OpenAI

Prueba en directo

Prueba Qwen3.7 Max aquí mismo (disponible tras iniciar sesión).

Entrada

Avanzado
Búsqueda web
Memoria · multiturno

Conversación

Empieza una conversaciónEscribe un mensaje abajo para empezar

Acerca de Qwen3.7 Max

Qwen3.7 Max es el modelo insignia de la generación Qwen 3.7 de Alibaba Cloud, servido en NezhaGate mediante la API compatible con OpenAI. Es fuerte en razonamiento, programación y trabajo con agentes, con un chino y un inglés fiables. Siempre piensa antes de responder: el razonamiento llega en message.reasoning_content y la respuesta en content, así que los clientes que solo leen content no necesitan cambios. Admite llamadas a herramientas, streaming y caché de prompts (un prefijo largo repetido se liquida a la tarifa de caché). Indica model=qwen3.7-max; pago por uso y sin cargo por las llamadas fallidas.

Casos de uso

Razonamiento complejo y matemáticas

Piensa antes de responder, útil en razonamientos de varios pasos, matemáticas y lógica.

Generación y revisión de código

Escritura, refactorización, explicación y revisión de código, con salida estructurada.

Agentes y llamadas a herramientas

tools / tool_calls en formato OpenAI para conectarlo con cualquier framework de agentes.

Preguntas sobre documentos largos

Hemos verificado que localiza la información con precisión en documentos de más de 100K tokens; las consultas repetidas sobre el mismo documento aciertan en la caché y cuestan menos.

Cómo elegir

Elige Qwen3.7 Max cuando necesites razonamiento y programación potentes. Para textos largos y varios documentos, compáralo con Kimi K3; si prima el coste, elige DeepSeek V4.1 Flash. Cambiar es solo modificar el campo model.

Preguntas frecuentes

¿Puedo desactivar el razonamiento o limitar su longitud?
No. A través de NezhaGate, Qwen3.7 Max siempre razona, y parámetros como reasoning_effort, enable_thinking o thinking_budget no cambian la longitud del razonamiento. Los tokens de razonamiento se facturan a la tarifa de salida dentro de usage.completion_tokens.
¿Puedo limitar el gasto con max_tokens?
max_tokens no limita la parte de razonamiento: aunque lo pongas muy bajo, el modelo puede pensar antes miles de tokens, y se factura por los tokens reales de usage. Para contener el coste, pide respuestas breves en el prompt.
¿Admite caché de prompts?
Sí. Un prefijo largo repetido acierta en la caché y esa parte se liquida a la tarifa de caché; hemos comprobado que la segunda consulta sobre el mismo documento largo cuesta alrededor de una quinta parte.
¿Admite llamadas a herramientas y streaming?
Sí, ambas. tools / tool_calls usan el formato de OpenAI; con stream=true la respuesta llega en fragmentos SSE y el razonamiento se transmite en delta.reasoning_content.
¿Se cobran las llamadas fallidas?
No. Solo se liquidan, según el uso real, las llamadas que responden con normalidad; los errores del proveedor y los tiempos de espera agotados nunca tocan tu saldo.

Modelos relacionados

Descubre otros modelos que puedes integrar.

Ver todo →