NezhaGateNezhaGate
POST https://nezhagate.com/v1/chat/completions

Chat completions compatibles con OpenAI respaldados por Z.ai GLM-5.3 Flash, el miembro ligero de la familia GLM-5.3 con un precio unitario menor para trabajo de gran volumen. Siempre piensa; el razonamiento se devuelve en message.reasoning_content y sus tokens se facturan a la tarifa de salida dentro de usage.completion_tokens. Admite llamadas a herramientas y streaming. Indica model=glm-5.3-flash; solo se sirve en /v1/chat/completions.

Probar en el Playground →

Autenticación

Header
Authorization: Bearer YOUR_API_KEY
Content-Type: application/json

Crea una clave API en la consola para empezar.

Cuerpo de la petición

ParámetroTipoObligatorioDescripción
model string Sí ID del modelo; aquí glm-5.3-flash.
messages array Sí Array de mensajes; cada uno tiene role (system/user/assistant) y content. content puede ser una cadena o un array de partes {type:text} y {type:image_url} para comprensión de imágenes (multimodal/visión).
stream boolean No Devuelve la respuesta en streaming como SSE. Por defecto false.
temperature number No Temperatura de muestreo, 0–2.
max_tokens integer No Número máximo de tokens a generar.
web_search boolean No Ponlo en true para activar la búsqueda web: la pasarela amplía el prompt con resultados en tiempo real (citando las fuentes) antes de que el modelo responda. También se puede activar con una entrada {"type":"web_search"} en tools.

Ejemplo de petición

cURL
curl https://nezhagate.com/v1/chat/completions -H "Authorization: Bearer YOUR_API_KEY" -H "Content-Type: application/json" -d '{"model": "glm-5.3-flash", "messages": [{"role": "user", "content": "Hello"}], "stream": false}'

Respuesta

200 · JSON
{
  "id": "chatcmpl_xxx",
  "object": "chat.completion",
  "model": "glm-5.3-flash",
  "choices": [
    {
      "index": 0,
      "message": {
        "role": "assistant",
        "reasoning_content": "The user is greeting me, so a short friendly reply fits...",
        "content": "Hello! How can I help you today?"
      },
      "finish_reason": "stop"
    }
  ],
  "usage": {
    "prompt_tokens": 9,
    "completion_tokens": 42,
    "total_tokens": 51,
    "completion_tokens_details": {"reasoning_tokens": 31}
  }
}

Entrada de imagen (visión)

Pon una imagen en el array content del mensaje y el modelo la analizará (preguntas sobre la imagen, lectura de texto / OCR, etc.). image_url acepta un enlace público a la imagen o un data URL en base64 (data:image/png;base64,...). Disponible en los modelos multimodales (gpt-5.5, la serie gemini, etc.).

curl · Entrada de imagen (visión)
curl https://nezhagate.com/v1/chat/completions -H "Authorization: Bearer YOUR_API_KEY" -H "Content-Type: application/json" -d '{"model": "glm-5.3-flash", "messages": [{"role": "user", "content": [{"type": "text", "text": "¿Qué hay en esta imagen?"}, {"type": "image_url", "image_url": {"url": "https://example.com/photo.jpg"}}]}]}'

Códigos de error

Todo cuerpo de error incluye error.message / error.type / error.code / error.param: ramifica según code. La lista completa está en la guía de integración.

HTTPcodeDescripción
401invalid_api_keyFalta la clave API o no es válida
402insufficient_quotaSaldo insuficiente o clave por encima de su cuota
400invalid_requestModelo o parámetro no soportado
429rate_limit_exceededLímite de tasa del proveedor
502upstream_errorFallaron todas las rutas de proveedor