NezhaGate
Chat

GPT-6 Astra

gpt-6-astra

GPT-6 Astra es el buque insignia de nueva generación que OpenAI lanzó en septiembre de 2026: ventana de contexto de 1 050 000 tokens, hasta 128 000 tokens de salida, reasoning_effort hasta xhigh, entrada de imagen, llamada a herramientas y caché de prompts. Totalmente compatible con el SDK de OpenAI —pon model en gpt-6-astra— y disponible tanto en /chat/completions como en /responses. Pago por uso, las llamadas fallidas nunca se facturan; la entrada cacheada se cobra a una décima parte y no aplicamos el recargo por contexto largo que sí aplica la API oficial.

ChatBuque insigniaContexto 1,05MCaché de promptsEntrada de imagen

Prueba en directo · Playground

Prueba GPT-6 Astra aquí mismo (disponible tras iniciar sesión)。

Input

Avanzado

Este modelo se sirve a través de un proveedor con suscripción de ChatGPT que no acepta temperature / top_p / max_tokens (los ignora en silencio). Usa reasoning_effort más abajo para la profundidad de razonamiento y la redacción del prompt para la longitud.

Búsqueda web
Memoria · multiturno

Conversación

Empieza una conversaciónEscribe un mensaje abajo para empezar

Acerca de GPT-6 Astra

GPT-6 Astra es el buque insignia de nueva generación que OpenAI lanzó en septiembre de 2026, servido en NezhaGate por la API compatible con OpenAI: ventana de contexto de 1 050 000 tokens, hasta 128 000 tokens de salida, reasoning_effort para la profundidad de razonamiento (hasta xhigh), entrada de imagen, llamada a herramientas y caché de prompts, tanto en /chat/completions como en /responses. Pon model en gpt-6-astra y conserva tu SDK y la forma de tus peticiones. Pago por uso, las llamadas fallidas nunca se facturan y la entrada cacheada se liquida a una décima parte de la tarifa de entrada.

Casos de uso

Análisis de contexto muy largo

1 050 000 tokens sostienen un repositorio entero, un conjunto de contratos o un informe largo en una sola llamada, sin que tengas que trocear y recomponer por tu cuenta.

Programación agéntica

Habla el endpoint compatible con OpenAI, así que Codex, Cursor y Claude Code cambian a GPT-6 Astra modificando solo el campo model.

Trabajo de razonamiento profundo

reasoning_effort llega hasta xhigh, así que puedes gastar el presupuesto de razonamiento en la parte más difícil y dejar las peticiones sencillas en low.

Entrada mixta de imagen y texto

Entrada de imagen con salida de texto: la comprensión de capturas de pantalla, las preguntas sobre gráficos y el análisis de documentos usan el mismo endpoint.

Cómo elegir

Elige GPT-6 Astra cuando necesites el razonamiento más potente o un contexto muy largo; gpt-5.6-terra es más barato para el desarrollo del día a día y gpt-5.6-luna para trabajo de gran volumen y baja latencia. Los tres usan el endpoint compatible con OpenAI, así que cambiar es modificar un solo campo.

Preguntas frecuentes

¿Cuáles son los límites de contexto y de salida?
Una ventana de contexto de 1 050 000 tokens y hasta 128 000 tokens de salida por llamada. Los system prompts y demás sobrecarga cuentan dentro de la ventana de contexto.
¿Cómo consigo aciertos de caché?
La caché de prompts es automática: el prefijo cacheable debe tener al menos 1024 tokens y ser idéntico byte a byte al inicio de tu petición anterior. Pon las partes fijas —system prompt, definiciones de herramientas, documentos largos— justo al principio y la entrada variable del usuario al final, y la tasa de acierto será la más alta posible. La parte cacheada se liquida a una décima parte de la tarifa de entrada ($0,28 / 1M) y el registro de llamadas de la consola muestra el número de tokens leídos de caché.
¿Cómo se compara el precio con la API oficial?
La lista oficial es de $10 por 1M de entrada y $50 por 1M de salida, y duplica la entrada y añade un 50 % a la salida en cuanto un prompt supera los 272K tokens. NezhaGate cobra $2,80 / $14,00 planos, sin recargo por contexto largo, y las lecturas de caché a $0,28.
¿Se admite reasoning_effort?
Sí: low / medium / high / xhigh. Razonar más significa más tokens de salida, facturados según el consumo real; si lo omites, el modelo decide por sí mismo.
¿Puedo usar /v1/responses?
Sí. El mismo nombre de modelo funciona en /v1/chat/completions y en /v1/responses, y ambos endpoints admiten streaming.

Modelos relacionados

Descubre otros modelos que puedes integrar.

Ver todo →
GPT-5.6 Sol Chat

GPT-5.6 Sol

gpt-5.6-sol

Buque insignia de frontera para programación agéntica

$2.00/1M entrada · $12.00/1M salida ↓75% Ver →
GPT-5.6 Terra Chat

GPT-5.6 Terra

gpt-5.6-terra

Modelo equilibrado de programación agéntica para el día a día

$1.20/1M entrada · $7.00/1M salida ↓77% Ver →
GPT-5.6 Luna Chat

GPT-5.6 Luna

gpt-5.6-luna

Modelo rápido y económico de programación agéntica

$0.80/1M entrada · $4.80/1M salida ↓68% Ver →
GPT-5.5 Chat

GPT-5.5

gpt-5.5

Modelo insignia de chat y razonamiento

$0.70/1M entrada · $4.20/1M salida ↓86% Ver →
GPT Image 2 Imagen

GPT Image 2

gpt-image-2

Modelo de alta calidad para texto a imagen e imagen a imagen

$0.015/img y más Ver →
GPT Image 2.5 Flare Imagen

GPT Image 2.5 Flare

gpt-image-2.5-flare

Modelo de imagen de nueva generación · limpio y suave

$0.015/img y más Ver →
GPT Image 2.5 Sunburst Imagen

GPT Image 2.5 Sunburst

gpt-image-2.5-sunburst

Modelo de imagen de nueva generación · más textura

$0.015/img y más Ver →
Nano Banana 2 Imagen

Nano Banana 2

nano-banana-2

Modelo de alta calidad para texto a imagen e imagen a imagen

$0.025/img y más Ver →
Nano Banana Pro Imagen

Nano Banana Pro

nano-banana-pro

Modelo insignia para texto a imagen e imagen a imagen

$0.040/img y más Ver →
Claude Sonnet 4.6 Chat

Claude Sonnet 4.6

claude-sonnet-4-6

Modelo equilibrado y eficiente para chat y código

$1.50/1M entrada · $7.50/1M salida ↓50% Ver →
Claude Opus 5 Chat

Claude Opus 5

claude-opus-5

Buque insignia de nueva generación de Anthropic

$4.00/1M entrada · $20.00/1M salida Ver →
Claude Fable 5 Chat

Claude Fable 5

claude-fable-5

Serie Fable de Anthropic · narrativa y textos largos

$8.00/1M entrada · $40.00/1M salida Ver →
Gemini 3.1 Pro Chat

Gemini 3.1 Pro

gemini-3.1-pro

Modelo insignia de razonamiento de nueva generación de Google

$0.50/1M entrada · $3.00/1M salida ↓75% Ver →
Gemini 3.8 Flash Chat

Gemini 3.8 Flash

gemini-3.8-flash

El Flash más reciente · razonamiento adaptativo

$0.60/1M entrada · $3.60/1M salida ↓7% Ver →
Gemini 3.7 Flash Chat

Gemini 3.7 Flash

gemini-3.7-flash

Flash anterior · razonamiento adaptativo

$0.60/1M entrada · $3.60/1M salida ↓7% Ver →
Gemini 3.6 Flash Chat

Gemini 3.6 Flash

gemini-3.6-flash

Modelo rápido de nueva generación · cuatro presupuestos de razonamiento

$0.60/1M entrada · $3.60/1M salida Ver →
Gemini 3.6 Flash High Chat

Gemini 3.6 Flash High

gemini-3.6-flash-high

Nivel de razonamiento profundo

$0.60/1M entrada · $3.60/1M salida Ver →
Gemini 3.6 Flash Low Chat

Gemini 3.6 Flash Low

gemini-3.6-flash-low

El nivel más rápido y económico

$0.60/1M entrada · $3.60/1M salida Ver →
Gemini 3.6 Flash Tiered Chat

Gemini 3.6 Flash Tiered

gemini-3.6-flash-tiered

Razonamiento por niveles automático

$0.60/1M entrada · $3.60/1M salida Ver →
Gemini 3 Flash Chat

Gemini 3 Flash

gemini-3-flash-preview

Modelo de chat rápido, de baja latencia y económico

$0.30/1M entrada · $1.20/1M salida ↓57% Ver →
Gemini 3.5 Flash Chat

Gemini 3.5 Flash

gemini-3.5-flash

Modelo rápido con razonamiento de nueva generación

$0.45/1M entrada · $2.70/1M salida ↓70% Ver →
Gemini 2.5 Flash Chat

Gemini 2.5 Flash

gemini-2.5-flash

Chat rápido, de baja latencia y económico

$0.30/1M entrada · $1.20/1M salida ↓46% Ver →
Veo 3.1 Vídeo

Veo 3.1

veo-3.1

Texto / imagen a vídeo · varios niveles · varias resoluciones

$0.075/clip+ Ver →
Seedance 2.5 Vídeo

Seedance 2.5

seedance-2.5

Texto / imagen a vídeo · hasta 30 segundos

$0.158/s Ver →
Seedance 2.0 Vídeo

Seedance 2.0

seedance-2.0

Texto / imagen a vídeo · de 5 a 15 segundos

$0.150/s Ver →
Seedance 2.0 Fast Vídeo

Seedance 2.0 Fast

seedance-2.0-fast

Baja latencia · el coste más bajo

$0.100/s Ver →
Seedance 2.0 Mini Vídeo

Seedance 2.0 Mini

seedance-2.0-mini

Nivel de entrada · el coste más bajo

$0.066/s Ver →
Wan 3.0 Vídeo

Wan 3.0

wan3.0-video

Un endpoint, cinco modos · hasta 30 segundos

$0.120/s Ver →
Wan 3.0 Prime Vídeo

Wan 3.0 Prime

wan3.0-video-prime

Las mismas capacidades · varias veces más rápido

$0.160/s Ver →
MiniMax H3 Vídeo

MiniMax H3

minimax-h3

1080P · audio nativo

$0.036/s Ver →
Grok Imagine Video 1.5 Vídeo

Grok Imagine Video 1.5

grok-imagine-video-1.5

Facturado por clip · hasta 15 segundos

$0.300/clip+ Ver →