NezhaGateNezhaGate
对话

Qwen3.8 Max 0902

⧉
qwen3.8-max-0902
模型类型 Max0902Flash

Qwen3.8 Max 0902 是 Qwen3.8 Max 的 0902 固定快照:版本锁定、不随上游更新变化,适合已经调好提示词、需要结果稳定可复现的业务。能力与定价同 Qwen3.8 Max,始终先思考再作答(思考过程在 reasoning_content 返回),支持工具调用、流式输出与图片输入(请用 base64 data URI);重复的长前缀会自动命中缓存,命中部分按缓存价结算。完全兼容 OpenAI 接口,把 model 改成 qwen3.8-max-0902 即可接入。

文本对话版本固定推理提示缓存OpenAI 兼容

在线测试

直接试一下 Qwen3.8 Max 0902 的效果(登录后可用)。

Input

高级设置
联网搜索
记忆 · 多轮上下文

对话

开始对话在下方输入消息开始

关于 Qwen3.8 Max 0902

Qwen3.8 Max 0902 是 Qwen3.8 Max 的 0902 固定快照,在 NezhaGate 以 OpenAI 兼容接口提供。版本锁定、不随上游更新变化,适合提示词已经调好、需要结果稳定可复现的业务;能力与定价同 Qwen3.8 Max。模型始终先思考再作答,思考过程在 message.reasoning_content 返回。支持工具调用、流式输出与图片输入,重复的长前缀会自动命中缓存。把 model 改成 qwen3.8-max-0902 即可接入,按量计费、失败不计费。

应用场景

生产环境的固定版本

线上业务、评测基线和回归测试需要模型行为不变时使用,避免上游更新带来的输出漂移。

长文档反复问答

同一份长文档或长系统提示反复使用时自动命中缓存,实测约 1 万 token 的前缀第二次命中 97%,命中部分按缓存价结算。

推理与代码

与 Qwen3.8 Max 同等的推理、代码与 Agent 能力,支持 OpenAI 格式的工具调用与 JSON 输出。

图片理解

识别截图、票据与图表中的文字和内容,图片以 base64 data URI 传入。

如何选择

需要固定版本、结果可复现,或会反复使用同一段长前缀时选 0902 快照;想始终用上 Qwen3.8 Max 的当前版本选 Qwen3.8 Max;大批量、看重成本选 Qwen3.8 Flash。三者同属 Qwen3.8 家族,切换只改 model 字段。

常见问题

和 Qwen3.8 Max 有什么区别?
Qwen3.8 Max 是当前版本;0902 是固定下来的快照,行为不会随上游更新而变化。两者同价、接入方式完全相同。实测 0902 会对重复的长前缀自动缓存,Qwen3.8 Max 目前没有。
缓存怎么计费?
重复的长前缀会自动命中缓存,命中部分出现在 usage.prompt_tokens_details.cached_tokens,按缓存价结算,其余输入按输入价。不需要额外参数。
能关闭思考吗?
不能。0902 始终先思考再作答,enable_thinking、reasoning_effort、thinking_budget 不会改变这一点;思考 token 按输出价计入 usage.completion_tokens。
怎么传图片?
在 messages 的 content 里用 image_url 传 base64 data URI(data:image/png;base64,...)。公网图片链接请先转成 base64,或改用 Qwen3.8 Flash 直接传链接。
失败的调用会扣费吗?
不会。只有正常返回的调用才按实际用量结算,上游报错与超时不会动你的余额。

相关模型

探索其它可接入的模型。

查看全部 →