Chat completions compatible con OpenAI sobre GPT-5.6 Luna: programación agéntica rápida y asequible, baja latencia, con streaming y control de reasoning_effort. Pon model en gpt-5.6-luna. Este modelo devuelve además un resumen del razonamiento: choices[].message.reasoning_content sin streaming y choices[].delta.reasoning_content con streaming. La respuesta en sí permanece en content y nunca se mezcla con el razonamiento, así que los clientes que solo leen content no necesitan cambios. Si se omite reasoning_effort, la pasarela pide el nivel medium (el valor por defecto del propio modelo) y el resumen llega igualmente. Facturación: los tokens de razonamiento se cobran a la tarifa de salida y se incluyen en usage.completion_tokens; usage.completion_tokens_details.reasoning_tokens detalla cuántos fueron de razonamiento, y esos tokens se facturan leas o no ese campo. Ten en cuenta que OpenAI solo expone un resumen del razonamiento, nunca la cadena de pensamiento en bruto, así que este campo suele ser corto. Note: this model is served over a ChatGPT-subscription upstream that does not accept temperature / top_p / max_tokens / max_completion_tokens / frequency_penalty / presence_penalty -- sending them is silently ignored (no error). Use reasoning_effort for thinking depth and prompt wording for length. For image input use a base64 data: URI; a public image URL may time out upstream.
📥 Ventana de contexto (entrada máxima):~272K tokens (ventana de contexto de la familia GPT-5; el system prompt también cuenta).
Probar en el Playground →Autenticación
Authorization: Bearer YOUR_API_KEY Content-Type: application/json
Crea una clave API en la consola para empezar.
Cuerpo de la petición
| Parámetro | Tipo | Obligatorio | Descripción |
|---|---|---|---|
| model | string | Sí | ID del modelo; aquí gpt-5.6-luna. |
| messages | array | Sí | Array de mensajes; cada uno tiene role (system/user/assistant) y content. content puede ser una cadena o un array de partes {type:text} y {type:image_url} para comprensión de imágenes (multimodal/visión). |
| stream | boolean | No | Devuelve la respuesta en streaming como SSE. Por defecto false. |
| web_search | boolean | No | Ponlo en true para activar la búsqueda web: la pasarela amplía el prompt con resultados en tiempo real (citando las fuentes) antes de que el modelo responda. También se puede activar con una entrada {"type":"web_search"} en tools. |
| reasoning_effort | string | No | Esfuerzo de razonamiento: low / medium / high / xhigh; cambia profundidad de razonamiento por velocidad (solo GPT-5.x). Menos esfuerzo = respuestas más rápidas. Si se omite, la pasarela pide medium, el valor por defecto del propio modelo. |
| tools | array | No | Llamada a funciones. Pasa el array tools estándar de OpenAI; cuando el modelo decide invocar una, devuelve finish_reason=tool_calls junto con tool_calls. Combínalo con tool_choice para forzar una herramienta concreta. |
| response_format | object | No | Salida estructurada. Pasa {"type":"json_object"} para que el modelo devuelva únicamente JSON válido. |
Ejemplo de petición
curl https://nezhagate.com/v1/chat/completions -H "Authorization: Bearer YOUR_API_KEY" -H "Content-Type: application/json" -d '{"model": "gpt-5.6-luna", "messages": [{"role": "user", "content": "Hello"}], "stream": false}'Respuesta
{
"id": "chatcmpl_xxx",
"object": "chat.completion",
"model": "gpt-5.6-luna",
"choices": [
{
"index": 0,
"message": {
"role": "assistant",
"reasoning_content": "**Weighing the options** ... (a summary of how the model reasoned)",
"content": "Hello!"
},
"finish_reason": "stop"
}
],
"usage": {
"prompt_tokens": 11,
"completion_tokens": 105,
"total_tokens": 116,
"completion_tokens_details": {"reasoning_tokens": 43}
}
}Entrada de imagen (visión)
Pon una imagen en el array content del mensaje y el modelo la analizará (preguntas sobre la imagen, lectura de texto / OCR, etc.). image_url acepta un enlace público a la imagen o un data URL en base64 (data:image/png;base64,...). Disponible en los modelos multimodales (gpt-5.5, la serie gemini, etc.).
curl https://nezhagate.com/v1/chat/completions -H "Authorization: Bearer YOUR_API_KEY" -H "Content-Type: application/json" -d '{"model": "gpt-5.6-luna", "messages": [{"role": "user", "content": [{"type": "text", "text": "¿Qué hay en esta imagen?"}, {"type": "image_url", "image_url": {"url": "https://example.com/photo.jpg"}}]}]}'Códigos de error
| Code | Descripción |
|---|---|
| 401 | Falta la clave API o no es válida |
| 402 | Saldo insuficiente o clave por encima de su cuota |
| 400 | Modelo o parámetro no soportado |
| 429 | Límite de tasa del proveedor |
| 502 | Fallaron todas las rutas de proveedor |