NezhaGateNezhaGate
对话

Qwen3.7 Max

⧉
qwen3.7-max

Qwen3.7 Max 是阿里云通义千问 3.7 代的旗舰模型,综合推理、代码与 Agent 能力强,中英文表现稳定。它始终先思考再作答,思考过程在 reasoning_content 返回;支持工具调用、流式输出与提示缓存。完全兼容 OpenAI 接口,把 model 改成 qwen3.7-max 即可接入;按量计费、失败不计费。

文本对话推理代码工具调用OpenAI 兼容

在线测试

直接试一下 Qwen3.7 Max 的效果(登录后可用)。

Input

高级设置
联网搜索
记忆 · 多轮上下文

对话

开始对话在下方输入消息开始

关于 Qwen3.7 Max

Qwen3.7 Max 是阿里云通义千问 3.7 代的旗舰模型,在 NezhaGate 以 OpenAI 兼容接口提供。它综合推理、代码与 Agent 能力强,中英文表现稳定。模型始终先思考再作答:思考过程在 message.reasoning_content 返回,正文在 content,只读 content 的客户端无需改动。支持工具调用、流式输出与提示缓存(重复的长前缀按缓存价结算)。把 model 改成 qwen3.7-max 即可接入,按量计费、失败不计费。

应用场景

复杂推理与数学

先思考再作答,适合多步推导、数学与逻辑问题。

代码生成与审查

代码编写、重构、解释与审查,支持结构化输出。

Agent 与工具调用

支持 OpenAI 格式的 tools / tool_calls,可接入各类 Agent 框架。

长文档问答

实测在 10 万+ token 的文档中也能精准定位信息,重复查询同一文档可命中缓存、成本更低。

如何选择

需要强推理与代码能力时选 Qwen3.7 Max;长文本与多文档分析可以对比 Kimi K3,追求低成本可选 DeepSeek V4.1 Flash,切换只改 model 字段。

常见问题

能关闭思考或控制思考长度吗?
不能。通过 NezhaGate 调用时 Qwen3.7 Max 始终开启思考,reasoning_effort、enable_thinking、thinking_budget 等参数不会改变思考长度;思考 token 按输出价计入 usage.completion_tokens。
max_tokens 能限制花费吗?
max_tokens 不限制思考部分:即使设得很小,模型仍可能先思考数千 token,并按 usage 里的实际 token 计费。需要控制成本时,请在提示词里要求简短作答。
支持提示缓存吗?
支持。重复使用的长前缀会命中缓存,命中部分按缓存价结算;实测同一份长文档第二次查询,成本约降到五分之一。
支持工具调用和流式输出吗?
都支持。tools / tool_calls 使用 OpenAI 格式;stream=true 时以 SSE 分块返回,思考内容在 delta.reasoning_content。
失败的调用会扣费吗?
不会。只有正常返回的调用才按实际用量结算,上游报错与超时不会动你的余额。

相关模型

探索其它可接入的模型。

查看全部 →