Kimi K3
⧉Kimi K3 是 Moonshot(月之暗面)新一代旗舰模型,擅长长文本理解、多文档分析与中文写作,Agent 与工具调用能力出色。它始终先思考再作答,思考过程在 reasoning_content 返回;采样温度由模型固定,传入的 temperature / top_p 会被忽略。支持工具调用、流式输出与提示缓存(重复的长前缀按缓存价结算)。完全兼容 OpenAI 接口,把 model 改成 kimi-k3 即可接入;按量计费、失败不计费。
为什么选它
月之暗面新一代旗舰:2.8 万亿参数开放权重,约 100 万 token 上下文
能力亮点
- 2.8 万亿参数、开放权重,是目前最大的开放权重模型之一
- 约 100 万 token 上下文(1,048,576),长资料可以整份放进去
- 默认开启思考,思考过程在 reasoning_content 里单独返回,不混进正文
- 支持工具调用、流式输出和提示缓存,重复的长前缀按缓存价计费
- OpenAI 兼容接口,现有 SDK 只改 base_url 和 model
价格对比
每百万 token,美元 · 立省 ↓40%
复制即可调用
curl https://nezhagate.com/v1/chat/completions -H "Authorization: Bearer YOUR_API_KEY" -H "Content-Type: application/json" -d '{"model": "kimi-k3", "messages": [{"role": "user", "content": "Hello"}]}'from openai import OpenAI
client = OpenAI(api_key="YOUR_API_KEY", base_url="https://nezhagate.com/v1")
r = client.chat.completions.create(model="kimi-k3", messages=[{"role": "user", "content": "Hello"}])
print(r.choices[0].message.content)把 YOUR_API_KEY 换成控制台里创建的 Key。
在线测试
直接试一下 Kimi K3 的效果(登录后可用)。
Input
高级设置
对话
关于 Kimi K3
Kimi K3 是 Moonshot(月之暗面)的新一代旗舰模型,在 NezhaGate 以 OpenAI 兼容接口提供。它擅长长文本理解、多文档分析与中文写作,Agent 与工具调用能力出色。模型始终先思考再作答:思考过程在 message.reasoning_content 返回,正文在 content。采样温度由模型固定,请求里的 temperature / top_p 会被网关忽略,不会报错。支持工具调用、流式输出与提示缓存,把 model 改成 kimi-k3 即可接入;按量计费、失败不计费。
应用场景
合同、论文、财报等长材料的摘要、比对与问答,实测在 10 万+ token 的文档里也能精准定位信息。
支持 OpenAI 格式的 tools / tool_calls,适合检索增强、函数调用与多步任务编排。
长文、报告、营销文案与润色,中文表达自然流畅。
先思考再作答,适合数学、逻辑与需要多步推导的问题,思考过程可在 reasoning_content 查看。
如何选择
长文本、多文档与 Agent 任务优先选 Kimi K3;追求更低成本的日常对话可以选 DeepSeek V4.1 Flash 或 GLM-5.3,切换只需改 model 字段。
常见问题
temperature 参数有用吗?
能关闭思考吗?
长回答需要注意什么?
支持提示缓存吗?
失败的调用会扣费吗?
相关模型
探索其它可接入的模型。
GLM-5.3
智谱新一代旗舰 · 编码与 Agent
Qwen3.7 Max
通义千问旗舰 · 推理与代码
Grok 4.7
xAI 旗舰推理模型 · 长上下文
DeepSeek V4.1 Flash
DeepSeek 当前主力 Flash 模型 · 思考可开关
Claude Sonnet 4.6
均衡高效的对话 / 代码模型
Gemini 3.1 Pro
Google 新一代旗舰推理模型