Una pasarela de IA compatible con OpenAI: un solo endpoint para todo el catálogo, con GPT-5.5, la familia de chat Gemini y la generación de imágenes gpt-image. Legible para personas y copiable de un clic para asistentes de programación con IA.
Inicio rápido
Solo tienes que cambiar la Base URL y la clave API, y tu SDK de OpenAI actual funciona sin tocar nada más.
https://nezhagate.com/v1
curl https://nezhagate.com/v1/chat/completions -H "Authorization: Bearer YOUR_API_KEY" -H "Content-Type: application/json" -d '{"model": "gpt-5.5", "messages": [{"role": "user", "content": "Escribe una breve presentación de producto para una API de IA"}], "stream": false}'
Los parámetros completos de la petición, los ejemplos y el uso asíncrono de cada modelo están en su propia página de documentación: ábrela desde la tabla de modelos y precios de abajo.
Más ejemplos ejecutables (Python / Node / curl, incluido el flujo asíncrono de imagen y vídeo): github.com/gaoorange/nezhagate-api-examples
Autenticación
Todas las llamadas a la API requieren un Bearer Token.
Authorization: Bearer YOUR_API_KEY Content-Type: application/json
Modelos y precios
Los parámetros completos de la petición, los ejemplos y el uso asíncrono de cada modelo están en su propia página de documentación: ábrela desde la tabla de modelos y precios de abajo.
| Modelo | Capacidad | Endpoint | Precio | |
|---|---|---|---|---|
| gpt-5.6-sol | Razonamiento de frontera, programación agéntica, tareas de largo recorrido, salida estructurada | /chat/completions | Entrada $2.0/1M · Salida $12.0/1M | Documentación → |
| gpt-5.6-terra | Chat cotidiano, programación agéntica, razonamiento, salida estructurada | /chat/completions | Entrada $1.2/1M · Salida $7.0/1M | Documentación → |
| gpt-5.6-luna | Chat a alta velocidad, programación agéntica, gran volumen con baja latencia, salida estructurada | /chat/completions | Entrada $0.8/1M · Salida $4.8/1M | Documentación → |
| gpt-5.5 | Chat, razonamiento, agentes, salida estructurada | /chat/completions | Entrada $0.7/1M · Salida $4.2/1M | Documentación → |
| gpt-6-astra | Razonamiento profundo, programación agéntica, contexto muy largo, entrada de imagen, salida estructurada | /chat/completions | Entrada $2.8/1M · Salida $14.0/1M | Documentación → |
| gpt-image-2 | Texto a imagen, imagen a imagen, portadas, carteles, ilustraciones | /images/generations | 1K $0.015 · 2K $0.025 · 4K $0.04 | Documentación → |
| gpt-image-2.5-flare | Texto a imagen, imagen a imagen, portadas, carteles, ilustración, tipografía | /images/generations | 1K $0.015 · 2K $0.025 · 4K $0.04 | Documentación → |
| gpt-image-2.5-sunburst | Texto a imagen, imagen a imagen, portadas, carteles, ilustración, tipografía | /images/generations | 1K $0.015 · 2K $0.025 · 4K $0.04 | Documentación → |
| nano-banana-2 | Texto a imagen, imagen a imagen, portadas, carteles, ilustraciones | /images/generations | 1K $0.025 · 2K $0.0375 · 4K $0.0625 | Documentación → |
| nano-banana-pro | Texto a imagen, imagen a imagen, portadas, carteles, ilustraciones, infografías | /images/generations | 1K $0.04 · 2K $0.06 · 4K $0.1 | Documentación → |
| claude-sonnet-4-6 | Chat, código, razonamiento, contexto largo | /chat/completions | Entrada $1.5/1M · Salida $7.5/1M | Documentación → |
| claude-opus-5 | Razonamiento profundo, código, agentes, contexto largo, comprensión de imágenes | /chat/completions | Entrada $4.0/1M · Salida $20.0/1M | Documentación → |
| claude-fable-5 | Escritura en chino, creación narrativa, textos largos, chat, código, comprensión de imágenes | /chat/completions | Entrada $8.0/1M · Salida $40.0/1M | Documentación → |
| gemini-3.1-pro | Chat, razonamiento, contexto muy largo, multimodal | /chat/completions | Entrada $0.5/1M · Salida $3.0/1M | Documentación → |
| gemini-3.8-flash | Chat, razonamiento, razonamiento adaptativo, entrada de imagen, contexto muy largo | /chat/completions | Entrada $0.6/1M · Salida $3.6/1M | Documentación → |
| gemini-3.7-flash | Chat, razonamiento, razonamiento adaptativo, entrada de imagen, contexto muy largo | /chat/completions | Entrada $0.6/1M · Salida $3.6/1M | Documentación → |
| gemini-3.6-flash | Chat, razonamiento, entrada de imagen, contexto muy largo | /chat/completions | Entrada $0.6/1M · Salida $3.6/1M | Documentación → |
| gemini-3.6-flash-high | Razonamiento profundo, tareas complejas, entrada de imagen, contexto muy largo | /chat/completions | Entrada $0.6/1M · Salida $3.6/1M | Documentación → |
| gemini-3.6-flash-low | Chat a alta velocidad, gran volumen, baja latencia, entrada de imagen | /chat/completions | Entrada $0.6/1M · Salida $3.6/1M | Documentación → |
| gemini-3.6-flash-tiered | Razonamiento adaptativo, chat, razonamiento, entrada de imagen | /chat/completions | Entrada $0.6/1M · Salida $3.6/1M | Documentación → |
| gemini-3-flash-preview | Chat, razonamiento, alta concurrencia, baja latencia | /chat/completions | Entrada $0.3/1M · Salida $1.2/1M | Documentación → |
| gemini-3.5-flash | Chat, razonamiento, alta concurrencia, baja latencia, razonamiento interno | /chat/completions | Entrada $0.45/1M · Salida $2.7/1M | Documentación → |
| gemini-2.5-flash | Chat, alta concurrencia, baja latencia, multimodal | /chat/completions | Entrada $0.3/1M · Salida $1.2/1M | Documentación → |
| veo-3.1 | Texto a vídeo, imagen a vídeo, clips cortos, material comercial | /videos/generations | $0.075 /clip+ | Documentación → |
| seedance-2.5 | Cortos de plano largo, entrada con varias referencias, material comercial | /videos/generations | $0.158 /s | Documentación → |
| seedance-2.0 | Clips cortos, material comercial | /videos/generations | $0.15 /s | Documentación → |
| seedance-2.0-fast | Material en lote, validación rápida de ideas | /videos/generations | $0.1 /s | Documentación → |
| seedance-2.0-mini | Borradores en volumen, iteración de bajo coste | /videos/generations | $0.066 /s | Documentación → |
| wan3.0-video | Narrativa de plano largo, composición con varios materiales, reescritura de vídeo | /videos/generations | $0.12 /s | Documentación → |
| wan3.0-video-prime | Material con plazo ajustado, pruebas de plano en lote | /videos/generations | $0.16 /s | Documentación → |
| minimax-h3 | Metraje en alta definición, clips cortos con sonido | /videos/generations | $0.036 /s | Documentación → |
| grok-imagine-video-1.5 | Vídeos cortos en volumen, comprobación rápida de ideas | /videos/generations | $0.3 /clip+ | Documentación → |
Úsalo en una aplicación (sin código)
En cualquier aplicación que hable la API de OpenAI, rellena estos tres campos; no hace falta programar:
| Base URL de la API | https://nezhagate.com/v1 |
| Clave API | la clave que creas en la consola (Consola → Claves API → Copiar) |
| Nombre del modelo | gpt-5.6-sol gpt-5.6-terra gpt-5.6-luna gpt-5.5 gpt-6-astra gpt-image-2 gpt-image-2.5-flare gpt-image-2.5-sunburst nano-banana-2 nano-banana-pro claude-sonnet-4-6 claude-opus-5 claude-fable-5 gemini-3.1-pro gemini-3.8-flash gemini-3.7-flash gemini-3.6-flash gemini-3.6-flash-high gemini-3.6-flash-low gemini-3.6-flash-tiered gemini-3-flash-preview gemini-3.5-flash gemini-2.5-flash veo-3.1 seedance-2.5 seedance-2.0 seedance-2.0-fast seedance-2.0-mini wan3.0-video wan3.0-video-prime minimax-h3 grok-imagine-video-1.5 |
Verificado con ChatBox, Cherry Studio, NextChat, LobeChat, Immersive Translate, Open WebUI, etc.
API nativa de Anthropic (Claude Code)
Además de la ruta compatible con OpenAI, los modelos Claude exponen la API nativa de mensajes de Anthropic. Apunta Claude Code (o cualquier SDK de Anthropic) a la Base URL de abajo y usa tu clave de la pasarela como x-api-key: el razonamiento, el uso de herramientas y la caché de prompts se conservan de forma nativa.
export ANTHROPIC_BASE_URL=https://nezhagate.com/anthropic export ANTHROPIC_API_KEY=YOUR_API_KEY # claude-sonnet-4-6 / claude-opus-5 / claude-fable-5
curl https://nezhagate.com/anthropic/v1/messages -H "x-api-key: YOUR_API_KEY" -H "anthropic-version: 2023-06-01" -H "Content-Type: application/json" -d '{"model": "claude-sonnet-4-6", "max_tokens": 1024, "messages": [{"role": "user", "content": "Hello"}]}'
Modelos: claude-opus-5, claude-fable-5, claude-sonnet-4-6. Se factura exactamente igual que /v1, por token.
Facturación de la caché de prompts: los aciertos de caché (lectura) se facturan a 1/10 (0,1×) de la tarifa de entrada y las escrituras a 1,25× (las tarifas por modelo están en la página de precios). Para acertar hace falta un prefijo estable y lo bastante largo (Claude Opus ≥ 4096 tokens, Sonnet ≥ 2048) repetido en poco tiempo: Claude Code con un CLAUDE.md o system prompt grande sobre un repositorio real acierta en cada turno y reduce el coste de entrada a ~1/10. Las conversaciones cortas del Playground son demasiado breves para cachearse.
Generación de vídeo (asíncrona)
Texto a vídeo e imagen a vídeo son trabajos asíncronos: la llamada devuelve al instante HTTP 202 y un id de trabajo ({"id":"img_...","object":"video.generation.job","status":"queued"}); consulta GET /v1/videos/jobs/{id} hasta status=succeeded y lee el resultado en data[0].url (un mp4 rehospedado). De 1 a 12 minutos por clip. Hay dos modos de facturación: Veo 3.1 se factura por clip; Seedance 2.x y MiniMax H3 se facturan por segundo (tarifa x duración). Ambos retienen exactamente lo que cobran y reembolsan por completo si falla. Fija la relación de aspecto con size (16:9 horizontal es la predeterminada); para imagen a vídeo pasa una referencia de primer fotograma en image.
curl https://nezhagate.com/v1/videos/generations -H 'Authorization: Bearer YOUR_API_KEY' -H 'Content-Type: application/json' -d '{"model": "veo-3.1", "prompt": "un gato surfeando al atardecer", "tier": "quality", "resolution": "1080p", "size": "16:9", "duration": "8s"}'curl https://nezhagate.com/v1/videos/jobs/img_3f9a...c2 -H 'Authorization: Bearer YOUR_API_KEY'
Modelos de vídeo: veo-3.1 seedance-2.5 seedance-2.0 seedance-2.0-fast seedance-2.0-mini wan3.0-video wan3.0-video-prime minimax-h3 grok-imagine-video-1.5
Notas de integración para copiar a una IA
Envía todo el bloque de abajo a Codex / Claude Code / Cursor y sabrá cómo integrarlo. También puedes usar «Copiar página» arriba a la derecha para copiar el documento entero.
Integrate NezhaGate through its OpenAI-compatible API.
Base URL: https://nezhagate.com/v1
API Key: read it from the environment variable NEZHAAPI_KEY.
Claude models can also use the native Anthropic protocol (for Claude Code / the Anthropic SDK): ANTHROPIC_BASE_URL=https://nezhagate.com/anthropic, headers x-api-key=API Key and anthropic-version: 2023-06-01, POST /anthropic/v1/messages (max_tokens is required), models claude-sonnet-4-6 / claude-opus-5 / claude-fable-5.
Chat models (/chat/completions): gpt-5.6-sol / gpt-5.6-terra / gpt-5.6-luna / gpt-5.5 / gpt-6-astra / claude-sonnet-4-6 / claude-opus-5 / claude-fable-5 / gemini-3.1-pro / gemini-3.8-flash / gemini-3.7-flash / gemini-3.6-flash / gemini-3.6-flash-high / gemini-3.6-flash-low / gemini-3.6-flash-tiered / gemini-3-flash-preview / gemini-3.5-flash / gemini-2.5-flash
Image models (text-to-image /images/generations; image-to-image /images/edits or add an image parameter): gpt-image-2 / gpt-image-2.5-flare / gpt-image-2.5-sunburst / nano-banana-2 / nano-banana-pro
Video models (text-to-video /videos/generations, async jobs; add an image parameter for image-to-video, the image becomes the first frame): veo-3.1 / seedance-2.5 / seedance-2.0 / seedance-2.0-fast / seedance-2.0-mini / wan3.0-video / wan3.0-video-prime / minimax-h3 / grok-imagine-video-1.5
Auth: Authorization: Bearer YOUR_API_KEY
Requirements (chat): return choices[0].message.content; on 401 check the key, 402 means insufficient balance, 429/5xx can be retried.
Requirements (images, async): POST /images/generations or /images/edits returns HTTP 202 with a job id right away ({"id":"img_...","object":"image.generation.job","status":"queued"}); then poll GET /v1/images/jobs/{id} until status=succeeded and read data[0].url (a stable link on img.nezhagate.com). Do not read data right after submitting.
Requirements (video, async): POST /videos/generations returns HTTP 202 with a job id (object=video.generation.job); then poll GET /v1/videos/jobs/{id} until status=succeeded and read data[0].url (a stable re-hosted mp4 link). About 1-2 minutes per clip; failed jobs are refunded in full.
Consultar saldo y uso
Usa cualquier clave API para leer el saldo restante y el gasto de la cuenta, sin iniciar sesión en el panel. Lo más sencillo: GET /v1/usage. También compatible con OpenAI: /v1/dashboard/billing/credit_grants (el saldo es total_available).
curl https://nezhagate.com/v1/usage -H "Authorization: Bearer YOUR_API_KEY"
curl https://nezhagate.com/v1/dashboard/billing/credit_grants -H "Authorization: Bearer YOUR_API_KEY"
Códigos de error
| Código de estado | Significado | Qué hacer |
|---|---|---|
| 401 | Falta la clave API o no es válida | Revisa la cabecera Authorization |
| 402 | Saldo insuficiente o clave por encima de su cuota | Contacta con el administrador para recargar |
| 400 | Modelo o parámetro no soportado | Usa solo gpt-5.5 / gpt-image-2 |
| 429 | Límite de tasa del proveedor | Reinténtalo más tarde |
| 502 | Fallaron todas las rutas de proveedor | Espera a que se recupere o contacta con el administrador |