GPT-6 Astra
⧉GPT-6 Astra es el buque insignia de nueva generación que OpenAI lanzó en septiembre de 2026: ventana de contexto de 1 050 000 tokens, hasta 128 000 tokens de salida, reasoning_effort hasta xhigh, entrada de imagen, llamada a herramientas y caché de prompts. Totalmente compatible con el SDK de OpenAI —pon model en gpt-6-astra— y disponible tanto en /chat/completions como en /responses. Pago por uso, las llamadas fallidas nunca se facturan; la entrada cacheada se cobra a una décima parte y no aplicamos el recargo por contexto largo que sí aplica la API oficial.
Prueba en directo · Playground
Prueba GPT-6 Astra aquí mismo (disponible tras iniciar sesión)。
Input
Avanzado
Este modelo se sirve a través de un proveedor con suscripción de ChatGPT que no acepta temperature / top_p / max_tokens (los ignora en silencio). Usa reasoning_effort más abajo para la profundidad de razonamiento y la redacción del prompt para la longitud.
Conversación
Acerca de GPT-6 Astra
GPT-6 Astra es el buque insignia de nueva generación que OpenAI lanzó en septiembre de 2026, servido en NezhaGate por la API compatible con OpenAI: ventana de contexto de 1 050 000 tokens, hasta 128 000 tokens de salida, reasoning_effort para la profundidad de razonamiento (hasta xhigh), entrada de imagen, llamada a herramientas y caché de prompts, tanto en /chat/completions como en /responses. Pon model en gpt-6-astra y conserva tu SDK y la forma de tus peticiones. Pago por uso, las llamadas fallidas nunca se facturan y la entrada cacheada se liquida a una décima parte de la tarifa de entrada.
Casos de uso
1 050 000 tokens sostienen un repositorio entero, un conjunto de contratos o un informe largo en una sola llamada, sin que tengas que trocear y recomponer por tu cuenta.
Habla el endpoint compatible con OpenAI, así que Codex, Cursor y Claude Code cambian a GPT-6 Astra modificando solo el campo model.
reasoning_effort llega hasta xhigh, así que puedes gastar el presupuesto de razonamiento en la parte más difícil y dejar las peticiones sencillas en low.
Entrada de imagen con salida de texto: la comprensión de capturas de pantalla, las preguntas sobre gráficos y el análisis de documentos usan el mismo endpoint.
Cómo elegir
Elige GPT-6 Astra cuando necesites el razonamiento más potente o un contexto muy largo; gpt-5.6-terra es más barato para el desarrollo del día a día y gpt-5.6-luna para trabajo de gran volumen y baja latencia. Los tres usan el endpoint compatible con OpenAI, así que cambiar es modificar un solo campo.
Preguntas frecuentes
¿Cuáles son los límites de contexto y de salida?
¿Cómo consigo aciertos de caché?
¿Cómo se compara el precio con la API oficial?
¿Se admite reasoning_effort?
¿Puedo usar /v1/responses?
Modelos relacionados
Descubre otros modelos que puedes integrar.
GPT-5.6 Sol
Buque insignia de frontera para programación agéntica
GPT-5.6 Terra
Modelo equilibrado de programación agéntica para el día a día
GPT-5.6 Luna
Modelo rápido y económico de programación agéntica
GPT-5.5
Modelo insignia de chat y razonamiento
GPT Image 2
Modelo de alta calidad para texto a imagen e imagen a imagen
GPT Image 2.5 Flare
Modelo de imagen de nueva generación · limpio y suave
GPT Image 2.5 Sunburst
Modelo de imagen de nueva generación · más textura
Nano Banana 2
Modelo de alta calidad para texto a imagen e imagen a imagen
Nano Banana Pro
Modelo insignia para texto a imagen e imagen a imagen
Claude Sonnet 4.6
Modelo equilibrado y eficiente para chat y código
Claude Opus 5
Buque insignia de nueva generación de Anthropic
Claude Fable 5
Serie Fable de Anthropic · narrativa y textos largos
Gemini 3.1 Pro
Modelo insignia de razonamiento de nueva generación de Google
Gemini 3.8 Flash
El Flash más reciente · razonamiento adaptativo
Gemini 3.7 Flash
Flash anterior · razonamiento adaptativo
Gemini 3.6 Flash
Modelo rápido de nueva generación · cuatro presupuestos de razonamiento
Gemini 3.6 Flash High
Nivel de razonamiento profundo
Gemini 3.6 Flash Low
El nivel más rápido y económico
Gemini 3.6 Flash Tiered
Razonamiento por niveles automático
Gemini 3 Flash
Modelo de chat rápido, de baja latencia y económico
Gemini 3.5 Flash
Modelo rápido con razonamiento de nueva generación
Gemini 2.5 Flash
Chat rápido, de baja latencia y económico
Veo 3.1
Texto / imagen a vídeo · varios niveles · varias resoluciones
Seedance 2.5
Texto / imagen a vídeo · hasta 30 segundos
Seedance 2.0
Texto / imagen a vídeo · de 5 a 15 segundos
Seedance 2.0 Fast
Baja latencia · el coste más bajo
Seedance 2.0 Mini
Nivel de entrada · el coste más bajo
Wan 3.0
Un endpoint, cinco modos · hasta 30 segundos
Wan 3.0 Prime
Las mismas capacidades · varias veces más rápido
MiniMax H3
1080P · audio nativo
Grok Imagine Video 1.5
Facturado por clip · hasta 15 segundos