DeepSeek V4.1 Flash
⧉DeepSeek V4.1 Flash 是 DeepSeek 当前的 Flash 模型(官方 API 中的 deepseek-flash),默认开启思考,思考过程在 reasoning_content 返回;传 thinking={"type":"disabled"} 即可关闭思考、直接作答。支持工具调用与流式输出。完全兼容 OpenAI 接口,把 model 改成 deepseek-v4.1-flash 即可接入。全天统一价,不分高峰低谷;按量计费、失败不计费。
在线测试
直接试一下 DeepSeek V4.1 Flash 的效果(登录后可用)。
Input
高级设置
对话
关于 DeepSeek V4.1 Flash
DeepSeek V4.1 Flash 是 DeepSeek 当前的 Flash 模型(官方 API 名 deepseek-flash),在 NezhaGate 以 OpenAI 兼容接口提供。它默认先思考再作答,思考过程在 message.reasoning_content 返回,正文始终在 content;传 thinking={"type":"disabled"} 可关闭思考,简单任务更快、更省。支持工具调用(function calling)与流式输出。把 model 改成 deepseek-v4.1-flash 即可接入;全天统一价,不分高峰低谷,按量计费、失败不计费。
应用场景
客服、知识问答、写作助手等高频场景,单价低、响应快,适合大规模接入。
开启思考后先推理再作答,适合代码生成、数学与多步逻辑题。
支持 OpenAI 格式的 tools / tool_calls,可直接接入 Agent 框架做检索、函数调用与多步任务。
分类、抽取、摘要、改写等批量任务可关闭思考,直接出结果,成本更低。
如何选择
需要 DeepSeek 最新 Flash 能力时选 V4.1;已经按 V4 Flash 调好提示词、希望版本固定时选 0731 快照。更难的编码与 Agent 任务可以对比 GLM-5.3,两者都只需改 model 字段。
常见问题
和 DeepSeek V4 Flash 0731 有什么区别?
怎么关闭思考?
max_tokens 设得很小会怎样?
支持工具调用和流式输出吗?
失败的调用会扣费吗?
相关模型
探索其它可接入的模型。
DeepSeek V4 Flash 0731
V4 Flash 固定快照 · 版本稳定
GLM-5.3
智谱新一代旗舰 · 编码与 Agent
GLM-5.3 Flash
GLM-5.3 轻量版 · 大批量低成本
Gemini 3.6 Flash
新一代高速思考模型 · 四档思考预算
GPT-6 Luna
GPT-6 家族最高效的大批量款