NezhaGateNezhaGate
Чат

GLM-5.3

⧉
glm-5.3
Тип модели GLM-5.3Flash

GLM-5.3 — новый флагман серии GLM-5 от Z.ai (Zhipu), созданный для программирования, агентных сценариев и сложных рассуждений, с надёжным письмом на китайском и английском. Модель всегда рассуждает перед ответом, рассуждение возвращается в reasoning_content, поддерживаются вызов инструментов и потоковый вывод. Полностью совместима с OpenAI: укажите в поле model значение glm-5.3. Оплата по факту использования, неудачные запросы не оплачиваются, а закэшированный ввод тарифицируется по цене кэша.

ЧатПрограммированиеАгентыРежим рассужденияСовместимый с OpenAI

Онлайн-тест · Песочница

Попробуйте GLM-5.3 прямо здесь (доступно после входа).

Ввод

Дополнительно
Веб-поиск
Память · многоходовой диалог

Диалог

Начните диалогВведите сообщение ниже, чтобы начать

О GLM-5.3

GLM-5.3 — новый флагман серии GLM-5 от Z.ai (Zhipu), созданный для программирования, агентных сценариев и сложных рассуждений; на NezhaGate доступен через API, совместимый с OpenAI. Модель всегда рассуждает перед ответом: рассуждение возвращается в message.reasoning_content, а ответ — в content, поэтому клиентам, которые читают только content, ничего менять не нужно. Поддерживаются вызов инструментов (function calling) и потоковый вывод, а закэшированный ввод тарифицируется по цене кэша. Укажите в поле model значение glm-5.3; оплата по факту использования, неудачные запросы не оплачиваются.

Сценарии использования

Помощник в программировании

Генерация кода, рефакторинг, объяснение и ревью; модель рассуждает перед ответом, что подходит для многошаговых задач программирования.

Агентные сценарии

Вызов инструментов в формате OpenAI встраивается в агентные фреймворки для поиска по базе знаний, вызова функций и многошагового планирования.

Письмо на китайском и английском

Копирайтинг, отчёты, письма и перевод с естественными китайскими формулировками — для контента, рассчитанного на аудиторию в Китае и за рубежом.

Сложные вопросы и анализ

Анализ, сравнение и вопросы принятия решений, которым нужна цепочка рассуждений — её можно посмотреть в reasoning_content.

Как выбрать

Выбирайте GLM-5.3 для более сложных задач программирования, агентов и рассуждений, а GLM-5.3 Flash — когда задачи простые, объёмные и чувствительны к цене. Обе модели принадлежат к семейству GLM-5.3, так что переключение — это просто смена поля model.

Частые вопросы

Можно ли отключить режим рассуждения?
Нет. GLM-5.3 всегда рассуждает перед ответом, а токены рассуждения оплачиваются по цене вывода внутри usage.completion_tokens. Чтобы получить более короткие и дешёвые ответы, попросите об этом прямо в промпте или переключитесь на GLM-5.3 Flash.
Чем она отличается от GLM-5.3 Flash?
GLM-5.3 — флагман, сильнее в программировании, агентах и сложных рассуждениях; Flash легче и дешевле за единицу, подходит для простых задач с большими объёмами. Вызываются они абсолютно одинаково.
Что произойдёт при очень маленьком max_tokens?
Токены рассуждения считаются выводом. Вышестоящий провайдер трактует max_tokens меньше 1024 как 1024; если рассуждение занимает весь бюджет, content может вернуться пустым с finish_reason length, а оплата спишется по фактическим токенам в usage. Указывайте max_tokens не меньше 1024.
Поддерживаются ли вызов инструментов и потоковый вывод?
Да, и то, и другое. tools / tool_calls используют формат OpenAI; при stream=true ответ приходит SSE-чанками, а рассуждение передаётся потоком в delta.reasoning_content.
Взимается ли плата за неудачные запросы?
Нет. Списание происходит только за запросы, завершившиеся нормально, по фактическому расходу; ошибки и таймауты вышестоящего провайдера баланс не затрагивают.

Похожие модели

Изучите другие модели, которые можно подключить.

Смотреть все →