NezhaGateNezhaGate
对话

DeepSeek V4 Flash 0731

⧉
deepseek-v4-flash-0731
模型类型 V4.10731

DeepSeek V4 Flash 0731 是 V4 Flash 的 0731 固定快照:版本锁定、不随上游更新变化,适合已经按 V4 Flash 调好提示词、需要结果稳定可复现的业务。默认开启思考(reasoning_content 返回思考过程),传 thinking={"type":"disabled"} 可关闭;支持工具调用与流式输出。完全兼容 OpenAI 接口,把 model 改成 deepseek-v4-flash-0731 即可接入,与 V4.1 同价。

文本对话版本固定思考模式工具调用OpenAI 兼容

在线测试

直接试一下 DeepSeek V4 Flash 0731 的效果(登录后可用)。

Input

高级设置
联网搜索
记忆 · 多轮上下文

对话

开始对话在下方输入消息开始

关于 DeepSeek V4 Flash 0731

DeepSeek V4 Flash 0731 是 DeepSeek V4 Flash 的 0731 固定快照,在 NezhaGate 以 OpenAI 兼容接口提供。版本锁定、不随上游模型更新而变化,适合已经按 V4 Flash 调好提示词、需要输出稳定可复现的业务。默认先思考再作答,思考过程在 message.reasoning_content 返回;传 thinking={"type":"disabled"} 可关闭思考。支持工具调用与流式输出。把 model 改成 deepseek-v4-flash-0731 即可接入,按量计费、失败不计费。

应用场景

已上线的稳定业务

提示词已按 V4 Flash 调好、不希望模型更新带来行为变化的线上业务。

评测与回归测试

固定版本便于做 A/B 评测和回归对比,结果差异只来自你自己的改动。

批量抽取与分类

对输出格式一致性要求高的批量任务,关闭思考后直接出结构化结果。

工具调用流程

在 Agent 与函数调用流程里保持稳定的调用行为,减少上游升级带来的意外。

如何选择

想要 DeepSeek 最新 Flash 能力选 V4.1;需要版本固定、结果可复现选 0731。两者同价,切换只改 model 字段。

常见问题

0731 是什么意思?
这是 DeepSeek V4 Flash 的一个固定快照版本号。快照版本锁定不变,适合需要长期稳定行为的业务;想用最新版本请选 DeepSeek V4.1 Flash。
和 V4.1 Flash 价格一样吗?
一样。两者在 NezhaGate 同价,都是全天统一价、不分高峰低谷,按实际 token 用量计费。
怎么关闭思考?
在请求里加 "thinking": {"type": "disabled"} 即可跳过思考直接作答;不传时默认开启思考,思考内容在 reasoning_content 返回。
max_tokens 设得很小会怎样?
这是思考模型,思考 token 也计入输出。上游对小于 1024 的 max_tokens 会按 1024 执行,实际输出(含思考)可能超过你设的值,按 usage 里的实际 token 计费。只要短答案时,建议关闭思考。
失败的调用会扣费吗?
不会。只有正常返回的调用才按实际用量结算,上游报错与超时不会动你的余额。

相关模型

探索其它可接入的模型。

查看全部 →