Qwen3.7 Max
⧉Qwen3.7 Max 是阿里云通义千问 3.7 代的旗舰模型,综合推理、代码与 Agent 能力强,中英文表现稳定。它始终先思考再作答,思考过程在 reasoning_content 返回;支持工具调用、流式输出与提示缓存。完全兼容 OpenAI 接口,把 model 改成 qwen3.7-max 即可接入;按量计费、失败不计费。
在线测试
直接试一下 Qwen3.7 Max 的效果(登录后可用)。
Input
高级设置
对话
关于 Qwen3.7 Max
Qwen3.7 Max 是阿里云通义千问 3.7 代的旗舰模型,在 NezhaGate 以 OpenAI 兼容接口提供。它综合推理、代码与 Agent 能力强,中英文表现稳定。模型始终先思考再作答:思考过程在 message.reasoning_content 返回,正文在 content,只读 content 的客户端无需改动。支持工具调用、流式输出与提示缓存(重复的长前缀按缓存价结算)。把 model 改成 qwen3.7-max 即可接入,按量计费、失败不计费。
应用场景
先思考再作答,适合多步推导、数学与逻辑问题。
代码编写、重构、解释与审查,支持结构化输出。
支持 OpenAI 格式的 tools / tool_calls,可接入各类 Agent 框架。
实测在 10 万+ token 的文档中也能精准定位信息,重复查询同一文档可命中缓存、成本更低。
如何选择
需要强推理与代码能力时选 Qwen3.7 Max;长文本与多文档分析可以对比 Kimi K3,追求低成本可选 DeepSeek V4.1 Flash,切换只改 model 字段。
常见问题
能关闭思考或控制思考长度吗?
max_tokens 能限制花费吗?
支持提示缓存吗?
支持工具调用和流式输出吗?
失败的调用会扣费吗?
相关模型
探索其它可接入的模型。
Kimi K3
Moonshot 新一代旗舰 · 长文本与 Agent
Grok 4.7
xAI 旗舰推理模型 · 长上下文
GLM-5.3
智谱新一代旗舰 · 编码与 Agent
DeepSeek V4.1 Flash
DeepSeek 当前主力 Flash 模型 · 思考可开关
GPT-6 Sol
面向复杂编码与 Agent 工作流 · 105 万上下文
Gemini 3.1 Pro
Google 新一代旗舰推理模型