GLM-5.3
⧉GLM-5.3 是智谱(Z.ai)GLM-5 系列的新一代旗舰模型,面向编码、Agent 工作流与复杂推理,中英文写作表现稳定。它始终先思考再作答,思考过程在 reasoning_content 返回;支持工具调用与流式输出。完全兼容 OpenAI 接口,把 model 改成 glm-5.3 即可接入。按量计费、失败不计费,命中缓存的输入按缓存价结算。
在线测试
直接试一下 GLM-5.3 的效果(登录后可用)。
Input
高级设置
对话
关于 GLM-5.3
GLM-5.3 是智谱(Z.ai)GLM-5 系列的新一代旗舰模型,面向编码、Agent 工作流与复杂推理,在 NezhaGate 以 OpenAI 兼容接口提供。它始终先思考再作答:思考过程在 message.reasoning_content 返回,正文在 content,只读 content 的客户端无需改动。支持工具调用(function calling)与流式输出,命中缓存的输入按缓存价结算。把 model 改成 glm-5.3 即可接入,按量计费、失败不计费。
应用场景
代码生成、重构、解释与审查,思考后再作答,适合需要多步推导的编程任务。
支持 OpenAI 格式的工具调用,可接入各类 Agent 框架完成检索、调用与多步规划。
文案、报告、邮件与翻译,中文表达自然,适合面向国内外用户的内容生产。
需要推理链条的分析、比较与决策类问题,思考过程可在 reasoning_content 查看。
如何选择
需要更强的编码、Agent 与推理能力选 GLM-5.3;任务简单、量大、看重成本时选 GLM-5.3 Flash。两者同属 GLM-5.3 家族,切换只改 model 字段。
常见问题
能关闭思考吗?
和 GLM-5.3 Flash 有什么区别?
max_tokens 设得很小会怎样?
支持工具调用和流式输出吗?
失败的调用会扣费吗?
相关模型
探索其它可接入的模型。
GLM-5.3 Flash
GLM-5.3 轻量版 · 大批量低成本
DeepSeek V4.1 Flash
DeepSeek 当前主力 Flash 模型 · 思考可开关
Claude Sonnet 4.6
均衡高效的对话 / 代码模型
GPT-6 Sol
面向复杂编码与 Agent 工作流 · 105 万上下文
Gemini 3.1 Pro
Google 新一代旗舰推理模型