NezhaGate
API Documentation

Documentación para desarrolladores de la API de NezhaGate

Una pasarela de IA compatible con OpenAI: un solo endpoint para todo el catálogo, con GPT-5.5, la familia de chat Gemini y la generación de imágenes gpt-image. Legible para personas y copiable de un clic para asistentes de programación con IA.

Inicio rápido

Solo tienes que cambiar la Base URL y la clave API, y tu SDK de OpenAI actual funciona sin tocar nada más.

Base URL
https://nezhagate.com/v1
curl · API de chat: Chat Completions
curl https://nezhagate.com/v1/chat/completions -H "Authorization: Bearer YOUR_API_KEY" -H "Content-Type: application/json" -d '{"model": "gpt-5.5", "messages": [{"role": "user", "content": "Escribe una breve presentación de producto para una API de IA"}], "stream": false}'

Los parámetros completos de la petición, los ejemplos y el uso asíncrono de cada modelo están en su propia página de documentación: ábrela desde la tabla de modelos y precios de abajo.

Más ejemplos ejecutables (Python / Node / curl, incluido el flujo asíncrono de imagen y vídeo): github.com/gaoorange/nezhagate-api-examples

Autenticación

Todas las llamadas a la API requieren un Bearer Token.

Header
Authorization: Bearer YOUR_API_KEY
Content-Type: application/json

Modelos y precios

Los parámetros completos de la petición, los ejemplos y el uso asíncrono de cada modelo están en su propia página de documentación: ábrela desde la tabla de modelos y precios de abajo.

ModeloCapacidadEndpointPrecio
gpt-5.6-solRazonamiento de frontera, programación agéntica, tareas de largo recorrido, salida estructurada/chat/completions Entrada $2.0/1M · Salida $12.0/1M Documentación →
gpt-5.6-terraChat cotidiano, programación agéntica, razonamiento, salida estructurada/chat/completions Entrada $1.2/1M · Salida $7.0/1M Documentación →
gpt-5.6-lunaChat a alta velocidad, programación agéntica, gran volumen con baja latencia, salida estructurada/chat/completions Entrada $0.8/1M · Salida $4.8/1M Documentación →
gpt-5.5Chat, razonamiento, agentes, salida estructurada/chat/completions Entrada $0.7/1M · Salida $4.2/1M Documentación →
gpt-6-astraRazonamiento profundo, programación agéntica, contexto muy largo, entrada de imagen, salida estructurada/chat/completions Entrada $2.8/1M · Salida $14.0/1M Documentación →
gpt-image-2Texto a imagen, imagen a imagen, portadas, carteles, ilustraciones/images/generations 1K $0.015 · 2K $0.025 · 4K $0.04 Documentación →
gpt-image-2.5-flareTexto a imagen, imagen a imagen, portadas, carteles, ilustración, tipografía/images/generations 1K $0.015 · 2K $0.025 · 4K $0.04 Documentación →
gpt-image-2.5-sunburstTexto a imagen, imagen a imagen, portadas, carteles, ilustración, tipografía/images/generations 1K $0.015 · 2K $0.025 · 4K $0.04 Documentación →
nano-banana-2Texto a imagen, imagen a imagen, portadas, carteles, ilustraciones/images/generations 1K $0.025 · 2K $0.0375 · 4K $0.0625 Documentación →
nano-banana-proTexto a imagen, imagen a imagen, portadas, carteles, ilustraciones, infografías/images/generations 1K $0.04 · 2K $0.06 · 4K $0.1 Documentación →
claude-sonnet-4-6Chat, código, razonamiento, contexto largo/chat/completions Entrada $1.5/1M · Salida $7.5/1M Documentación →
claude-opus-5Razonamiento profundo, código, agentes, contexto largo, comprensión de imágenes/chat/completions Entrada $4.0/1M · Salida $20.0/1M Documentación →
claude-fable-5Escritura en chino, creación narrativa, textos largos, chat, código, comprensión de imágenes/chat/completions Entrada $8.0/1M · Salida $40.0/1M Documentación →
gemini-3.1-proChat, razonamiento, contexto muy largo, multimodal/chat/completions Entrada $0.5/1M · Salida $3.0/1M Documentación →
gemini-3.8-flashChat, razonamiento, razonamiento adaptativo, entrada de imagen, contexto muy largo/chat/completions Entrada $0.6/1M · Salida $3.6/1M Documentación →
gemini-3.7-flashChat, razonamiento, razonamiento adaptativo, entrada de imagen, contexto muy largo/chat/completions Entrada $0.6/1M · Salida $3.6/1M Documentación →
gemini-3.6-flashChat, razonamiento, entrada de imagen, contexto muy largo/chat/completions Entrada $0.6/1M · Salida $3.6/1M Documentación →
gemini-3.6-flash-highRazonamiento profundo, tareas complejas, entrada de imagen, contexto muy largo/chat/completions Entrada $0.6/1M · Salida $3.6/1M Documentación →
gemini-3.6-flash-lowChat a alta velocidad, gran volumen, baja latencia, entrada de imagen/chat/completions Entrada $0.6/1M · Salida $3.6/1M Documentación →
gemini-3.6-flash-tieredRazonamiento adaptativo, chat, razonamiento, entrada de imagen/chat/completions Entrada $0.6/1M · Salida $3.6/1M Documentación →
gemini-3-flash-previewChat, razonamiento, alta concurrencia, baja latencia/chat/completions Entrada $0.3/1M · Salida $1.2/1M Documentación →
gemini-3.5-flashChat, razonamiento, alta concurrencia, baja latencia, razonamiento interno/chat/completions Entrada $0.45/1M · Salida $2.7/1M Documentación →
gemini-2.5-flashChat, alta concurrencia, baja latencia, multimodal/chat/completions Entrada $0.3/1M · Salida $1.2/1M Documentación →
veo-3.1Texto a vídeo, imagen a vídeo, clips cortos, material comercial/videos/generations $0.075 /clip+ Documentación →
seedance-2.5Cortos de plano largo, entrada con varias referencias, material comercial/videos/generations $0.158 /s Documentación →
seedance-2.0Clips cortos, material comercial/videos/generations $0.15 /s Documentación →
seedance-2.0-fastMaterial en lote, validación rápida de ideas/videos/generations $0.1 /s Documentación →
seedance-2.0-miniBorradores en volumen, iteración de bajo coste/videos/generations $0.066 /s Documentación →
wan3.0-videoNarrativa de plano largo, composición con varios materiales, reescritura de vídeo/videos/generations $0.12 /s Documentación →
wan3.0-video-primeMaterial con plazo ajustado, pruebas de plano en lote/videos/generations $0.16 /s Documentación →
minimax-h3Metraje en alta definición, clips cortos con sonido/videos/generations $0.036 /s Documentación →
grok-imagine-video-1.5Vídeos cortos en volumen, comprobación rápida de ideas/videos/generations $0.3 /clip+ Documentación →

Úsalo en una aplicación (sin código)

En cualquier aplicación que hable la API de OpenAI, rellena estos tres campos; no hace falta programar:

Base URL de la APIhttps://nezhagate.com/v1
Clave APIla clave que creas en la consola (Consola → Claves API → Copiar)
Nombre del modelogpt-5.6-sol gpt-5.6-terra gpt-5.6-luna gpt-5.5 gpt-6-astra gpt-image-2 gpt-image-2.5-flare gpt-image-2.5-sunburst nano-banana-2 nano-banana-pro claude-sonnet-4-6 claude-opus-5 claude-fable-5 gemini-3.1-pro gemini-3.8-flash gemini-3.7-flash gemini-3.6-flash gemini-3.6-flash-high gemini-3.6-flash-low gemini-3.6-flash-tiered gemini-3-flash-preview gemini-3.5-flash gemini-2.5-flash veo-3.1 seedance-2.5 seedance-2.0 seedance-2.0-fast seedance-2.0-mini wan3.0-video wan3.0-video-prime minimax-h3 grok-imagine-video-1.5

Verificado con ChatBox, Cherry Studio, NextChat, LobeChat, Immersive Translate, Open WebUI, etc.

API nativa de Anthropic (Claude Code)

Además de la ruta compatible con OpenAI, los modelos Claude exponen la API nativa de mensajes de Anthropic. Apunta Claude Code (o cualquier SDK de Anthropic) a la Base URL de abajo y usa tu clave de la pasarela como x-api-key: el razonamiento, el uso de herramientas y la caché de prompts se conservan de forma nativa.

Claude Code · env
export ANTHROPIC_BASE_URL=https://nezhagate.com/anthropic
export ANTHROPIC_API_KEY=YOUR_API_KEY
# claude-sonnet-4-6 / claude-opus-5 / claude-fable-5
curl · /anthropic/v1/messages
curl https://nezhagate.com/anthropic/v1/messages -H "x-api-key: YOUR_API_KEY" -H "anthropic-version: 2023-06-01" -H "Content-Type: application/json" -d '{"model": "claude-sonnet-4-6", "max_tokens": 1024, "messages": [{"role": "user", "content": "Hello"}]}'

Modelos: claude-opus-5, claude-fable-5, claude-sonnet-4-6. Se factura exactamente igual que /v1, por token.

Facturación de la caché de prompts: los aciertos de caché (lectura) se facturan a 1/10 (0,1×) de la tarifa de entrada y las escrituras a 1,25× (las tarifas por modelo están en la página de precios). Para acertar hace falta un prefijo estable y lo bastante largo (Claude Opus ≥ 4096 tokens, Sonnet ≥ 2048) repetido en poco tiempo: Claude Code con un CLAUDE.md o system prompt grande sobre un repositorio real acierta en cada turno y reduce el coste de entrada a ~1/10. Las conversaciones cortas del Playground son demasiado breves para cachearse.

Generación de vídeo (asíncrona)

Texto a vídeo e imagen a vídeo son trabajos asíncronos: la llamada devuelve al instante HTTP 202 y un id de trabajo ({"id":"img_...","object":"video.generation.job","status":"queued"}); consulta GET /v1/videos/jobs/{id} hasta status=succeeded y lee el resultado en data[0].url (un mp4 rehospedado). De 1 a 12 minutos por clip. Hay dos modos de facturación: Veo 3.1 se factura por clip; Seedance 2.x y MiniMax H3 se facturan por segundo (tarifa x duración). Ambos retienen exactamente lo que cobran y reembolsan por completo si falla. Fija la relación de aspecto con size (16:9 horizontal es la predeterminada); para imagen a vídeo pasa una referencia de primer fotograma en image.

curl · enviar
curl https://nezhagate.com/v1/videos/generations -H 'Authorization: Bearer YOUR_API_KEY' -H 'Content-Type: application/json' -d '{"model": "veo-3.1", "prompt": "un gato surfeando al atardecer", "tier": "quality", "resolution": "1080p", "size": "16:9", "duration": "8s"}'
curl · consultar
curl https://nezhagate.com/v1/videos/jobs/img_3f9a...c2 -H 'Authorization: Bearer YOUR_API_KEY'

Modelos de vídeo: veo-3.1 seedance-2.5 seedance-2.0 seedance-2.0-fast seedance-2.0-mini wan3.0-video wan3.0-video-prime minimax-h3 grok-imagine-video-1.5

Notas de integración para copiar a una IA

Envía todo el bloque de abajo a Codex / Claude Code / Cursor y sabrá cómo integrarlo. También puedes usar «Copiar página» arriba a la derecha para copiar el documento entero.

AI Integration Prompt
Integrate NezhaGate through its OpenAI-compatible API.
Base URL: https://nezhagate.com/v1
API Key: read it from the environment variable NEZHAAPI_KEY.
Claude models can also use the native Anthropic protocol (for Claude Code / the Anthropic SDK): ANTHROPIC_BASE_URL=https://nezhagate.com/anthropic, headers x-api-key=API Key and anthropic-version: 2023-06-01, POST /anthropic/v1/messages (max_tokens is required), models claude-sonnet-4-6 / claude-opus-5 / claude-fable-5.
Chat models (/chat/completions): gpt-5.6-sol / gpt-5.6-terra / gpt-5.6-luna / gpt-5.5 / gpt-6-astra / claude-sonnet-4-6 / claude-opus-5 / claude-fable-5 / gemini-3.1-pro / gemini-3.8-flash / gemini-3.7-flash / gemini-3.6-flash / gemini-3.6-flash-high / gemini-3.6-flash-low / gemini-3.6-flash-tiered / gemini-3-flash-preview / gemini-3.5-flash / gemini-2.5-flash
Image models (text-to-image /images/generations; image-to-image /images/edits or add an image parameter): gpt-image-2 / gpt-image-2.5-flare / gpt-image-2.5-sunburst / nano-banana-2 / nano-banana-pro
Video models (text-to-video /videos/generations, async jobs; add an image parameter for image-to-video, the image becomes the first frame): veo-3.1 / seedance-2.5 / seedance-2.0 / seedance-2.0-fast / seedance-2.0-mini / wan3.0-video / wan3.0-video-prime / minimax-h3 / grok-imagine-video-1.5
Auth: Authorization: Bearer YOUR_API_KEY
Requirements (chat): return choices[0].message.content; on 401 check the key, 402 means insufficient balance, 429/5xx can be retried.
Requirements (images, async): POST /images/generations or /images/edits returns HTTP 202 with a job id right away ({"id":"img_...","object":"image.generation.job","status":"queued"}); then poll GET /v1/images/jobs/{id} until status=succeeded and read data[0].url (a stable link on img.nezhagate.com). Do not read data right after submitting.
Requirements (video, async): POST /videos/generations returns HTTP 202 with a job id (object=video.generation.job); then poll GET /v1/videos/jobs/{id} until status=succeeded and read data[0].url (a stable re-hosted mp4 link). About 1-2 minutes per clip; failed jobs are refunded in full.

Consultar saldo y uso

Usa cualquier clave API para leer el saldo restante y el gasto de la cuenta, sin iniciar sesión en el panel. Lo más sencillo: GET /v1/usage. También compatible con OpenAI: /v1/dashboard/billing/credit_grants (el saldo es total_available).

curl · /v1/usage
curl https://nezhagate.com/v1/usage -H "Authorization: Bearer YOUR_API_KEY"
curl · /v1/dashboard/billing/credit_grants
curl https://nezhagate.com/v1/dashboard/billing/credit_grants -H "Authorization: Bearer YOUR_API_KEY"

Códigos de error

Código de estadoSignificadoQué hacer
401Falta la clave API o no es válidaRevisa la cabecera Authorization
402Saldo insuficiente o clave por encima de su cuotaContacta con el administrador para recargar
400Modelo o parámetro no soportadoUsa solo gpt-5.5 / gpt-image-2
429Límite de tasa del proveedorReinténtalo más tarde
502Fallaron todas las rutas de proveedorEspera a que se recupere o contacta con el administrador