NezhaGate
Chat

GPT-6 Astra

gpt-6-astra
24시간 상태 성공률: 100.0%
-24h현재
성공과 당사 책임의 실패만 집계합니다. 초록은 해당 시간대의 성공, 빨강은 실패 비율입니다. 두 가지는 집계에서 제외됩니다 — 클라이언트 측 오류(잘못된 요청, 인증 실패, 잔액 부족 등 4xx)와 아직 진행 중인 요청. 막대 하나가 1시간이며, 실제 게이트웨이 호출 로그에서 집계합니다.

GPT-6 Astra는 OpenAI가 2026년 9월에 공개한 차세대 플래그십입니다. 1,050,000 토큰 컨텍스트, 최대 128,000 출력 토큰, xhigh까지 올라가는 reasoning_effort, 이미지 입력, 도구 호출, 프롬프트 캐싱을 지원합니다. OpenAI SDK와 완전히 호환되며(model을 gpt-6-astra로 지정) /chat/completions와 /responses 양쪽에서 제공됩니다. 사용한 만큼 과금하고 실패한 호출에는 과금하지 않으며, 캐시에 적중한 입력은 1/10 단가로 계산합니다. 공식 API가 붙이는 롱 컨텍스트 할증은 저희는 받지 않습니다.

채팅차세대 플래그십105만 컨텍스트프롬프트 캐싱이미지 입력

온라인 테스트 · 플레이그라운드

GPT-6 Astra 바로 여기서 사용해 보기 (로그인 후 사용 가능)。

Input

고급 설정

이 모델은 ChatGPT 구독 기반 업스트림으로 제공되며, 그 경로는 temperature / top_p / max_tokens를 받지 않습니다(조용히 무시됩니다). 사고 깊이는 아래의 reasoning_effort로, 길이는 프롬프트 문구로 조절하세요.

웹 검색
메모리 · 멀티턴

대화

대화를 시작해 보세요아래에 메시지를 입력해 시작하세요

소개: GPT-6 Astra

GPT-6 Astra는 OpenAI가 2026년 9월에 공개한 차세대 플래그십이며, NezhaGate에서 OpenAI 호환 API로 제공됩니다. 1,050,000 토큰 컨텍스트 창, 최대 128,000 출력 토큰, 사고 깊이를 조절하는 reasoning_effort(xhigh까지), 이미지 입력, 도구 호출, 프롬프트 캐싱을 지원하며 /chat/completions와 /responses 양쪽에서 쓸 수 있습니다. model만 gpt-6-astra로 바꾸면 되고 SDK와 요청 형태는 그대로 둡니다. 사용한 만큼 과금하고 실패한 호출에는 과금하지 않으며, 캐시에 적중한 입력은 입력 단가의 1/10로 정산됩니다.

활용 사례

초장문 컨텍스트 분석

1,050,000 토큰이면 저장소 하나, 계약서 묶음, 긴 보고서를 한 번의 호출에 담을 수 있어 직접 잘라 붙일 필요가 없습니다.

에이전트 코딩

OpenAI 호환 엔드포인트를 쓰므로 Codex, Cursor, Claude Code는 model 필드만 바꾸면 GPT-6 Astra로 전환됩니다.

심층 추론 작업

reasoning_effort가 xhigh까지 올라가므로 가장 어려운 부분에만 사고 예산을 쓰고 간단한 요청은 low로 둘 수 있습니다.

이미지와 텍스트 혼합 입력

이미지를 넣고 텍스트로 받습니다. 스크린샷 이해, 차트 질의, 문서 파싱을 모두 같은 엔드포인트로 처리합니다.

어떻게 고를까

가장 강한 추론이나 초장문 컨텍스트가 필요할 때 GPT-6 Astra를 고르세요. 일상적인 개발에는 gpt-5.6-terra가, 대량 · 저지연 작업에는 gpt-5.6-luna가 더 저렴합니다. 셋 다 OpenAI 호환 엔드포인트를 쓰므로 전환은 필드 하나만 바꾸면 됩니다.

자주 묻는 질문

컨텍스트와 출력 한도는 얼마인가요?
컨텍스트 창은 1,050,000 토큰, 한 번의 호출당 출력은 최대 128,000 토큰입니다. 시스템 프롬프트 등 부가 입력도 컨텍스트 창에 포함됩니다.
캐시는 어떻게 적중시키나요?
프롬프트 캐싱은 자동입니다. 캐시 가능한 접두부가 1,024 토큰 이상이어야 하고, 직전 요청의 앞부분과 바이트 단위로 같아야 합니다. 시스템 프롬프트, 도구 정의, 긴 문서처럼 고정된 부분을 맨 앞에 두고 매번 바뀌는 사용자 입력을 맨 뒤에 두면 적중률이 가장 높습니다. 적중한 부분은 입력 단가의 1/10($0.28 / 1M)로 정산되며, 콘솔의 호출 로그에서 캐시 읽기 토큰 수를 확인할 수 있습니다.
공식 API와 가격을 비교하면 어떤가요?
공식 정가는 입력 100만 토큰당 $10, 출력 $50이며, 프롬프트가 272K 토큰을 넘으면 입력이 2배, 출력이 1.5배가 됩니다. NezhaGate는 롱 컨텍스트 할증 없이 $2.80 / $14.00 고정이고 캐시 읽기는 $0.28입니다.
reasoning_effort를 지원하나요?
지원합니다. low / medium / high / xhigh를 쓸 수 있습니다. 더 생각할수록 출력 토큰이 늘고 실제 사용량으로 과금되며, 생략하면 모델이 알아서 정합니다.
/v1/responses도 쓸 수 있나요?
가능합니다. 같은 모델 이름이 /v1/chat/completions와 /v1/responses 양쪽에서 동작하고, 두 엔드포인트 모두 스트리밍을 지원합니다.

관련 모델

연동할 수 있는 다른 모델도 둘러보세요.

전체 보기 →
GPT-5.6 Sol Chat

GPT-5.6 Sol

gpt-5.6-sol

에이전트 코딩을 위한 프런티어 플래그십

$2.00/1M 입력 · $12.00/1M 출력 ↓75% 보기 →
GPT-5.6 Terra Chat

GPT-5.6 Terra

gpt-5.6-terra

일상용 균형형 에이전트 코딩 모델

$1.20/1M 입력 · $7.00/1M 출력 ↓77% 보기 →
GPT-5.6 Luna Chat

GPT-5.6 Luna

gpt-5.6-luna

빠르고 저렴한 에이전트 코딩 모델

$0.80/1M 입력 · $4.80/1M 출력 ↓68% 보기 →
GPT-5.5 Chat

GPT-5.5

gpt-5.5

플래그십 채팅 · 추론 모델

$0.70/1M 입력 · $4.20/1M 출력 ↓86% 보기 →
GPT Image 2 이미지

GPT Image 2

gpt-image-2

고품질 텍스트-투-이미지 / 이미지-투-이미지 모델

$0.015/장부터 보기 →
GPT Image 2.5 Flare 이미지

GPT Image 2.5 Flare

gpt-image-2.5-flare

차세대 이미지 모델 — 깔끔하고 매끄러운

$0.015/장부터 보기 →
GPT Image 2.5 Sunburst 이미지

GPT Image 2.5 Sunburst

gpt-image-2.5-sunburst

차세대 이미지 모델 — 질감이 더 진한

$0.015/장부터 보기 →
Nano Banana 2 이미지

Nano Banana 2

nano-banana-2

고품질 텍스트-투-이미지 / 이미지-투-이미지 모델

$0.025/장부터 보기 →
Nano Banana Pro 이미지

Nano Banana Pro

nano-banana-pro

플래그십 텍스트-투-이미지 / 이미지-투-이미지 모델

$0.040/장부터 보기 →
Claude Sonnet 4.6 Chat

Claude Sonnet 4.6

claude-sonnet-4-6

균형 잡히고 효율적인 채팅 · 코딩 모델

$1.50/1M 입력 · $7.50/1M 출력 ↓50% 보기 →
Claude Opus 5 Chat

Claude Opus 5

claude-opus-5

Anthropic의 차세대 플래그십

$4.00/1M 입력 · $20.00/1M 출력 보기 →
Claude Fable 5 Chat

Claude Fable 5

claude-fable-5

Anthropic Fable 시리즈 · 서사와 장문 글쓰기

$8.00/1M 입력 · $40.00/1M 출력 보기 →
Gemini 3.1 Pro Chat

Gemini 3.1 Pro

gemini-3.1-pro

Google의 차세대 플래그십 추론 모델

$0.50/1M 입력 · $3.00/1M 출력 ↓75% 보기 →
Gemini 3.8 Flash Chat

Gemini 3.8 Flash

gemini-3.8-flash

최신 Flash · 적응형 사고

$0.60/1M 입력 · $3.60/1M 출력 ↓7% 보기 →
Gemini 3.7 Flash Chat

Gemini 3.7 Flash

gemini-3.7-flash

이전 세대 Flash · 적응형 사고

$0.60/1M 입력 · $3.60/1M 출력 ↓7% 보기 →
Gemini 3.6 Flash Chat

Gemini 3.6 Flash

gemini-3.6-flash

차세대 고속 사고 모델 · 사고 예산 4단계

$0.60/1M 입력 · $3.60/1M 출력 보기 →
Gemini 3.6 Flash High Chat

Gemini 3.6 Flash High

gemini-3.6-flash-high

심층 사고 등급

$0.60/1M 입력 · $3.60/1M 출력 보기 →
Gemini 3.6 Flash Low Chat

Gemini 3.6 Flash Low

gemini-3.6-flash-low

가장 빠르고 가장 저렴한 등급

$0.60/1M 입력 · $3.60/1M 출력 보기 →
Gemini 3.6 Flash Tiered Chat

Gemini 3.6 Flash Tiered

gemini-3.6-flash-tiered

사고량 자동 조절

$0.60/1M 입력 · $3.60/1M 출력 보기 →
Gemini 3 Flash Chat

Gemini 3 Flash

gemini-3-flash-preview

빠르고 지연이 낮은 비용 효율형 채팅 모델

$0.30/1M 입력 · $1.20/1M 출력 ↓57% 보기 →
Gemini 3.5 Flash Chat

Gemini 3.5 Flash

gemini-3.5-flash

차세대 고속 사고 모델

$0.45/1M 입력 · $2.70/1M 출력 ↓70% 보기 →
Gemini 2.5 Flash Chat

Gemini 2.5 Flash

gemini-2.5-flash

빠르고 지연이 낮은 비용 효율형 채팅

$0.30/1M 입력 · $1.20/1M 출력 ↓46% 보기 →
Veo 3.1 영상

Veo 3.1

veo-3.1

텍스트 / 이미지 투 비디오 · 다중 등급 · 다중 해상도

$0.075/건부터 보기 →
Seedance 2.5 영상

Seedance 2.5

seedance-2.5

텍스트 / 이미지 투 비디오 · 최대 30초

$0.158/초 보기 →
Seedance 2.0 영상

Seedance 2.0

seedance-2.0

텍스트 / 이미지 투 비디오 · 5~15초

$0.150/초 보기 →
Seedance 2.0 Fast 영상

Seedance 2.0 Fast

seedance-2.0-fast

낮은 지연 · 최저 비용

$0.100/초 보기 →
Seedance 2.0 Mini 영상

Seedance 2.0 Mini

seedance-2.0-mini

엔트리 등급 · 최저 비용

$0.066/초 보기 →
Wan 3.0 영상

Wan 3.0

wan3.0-video

엔드포인트 하나에 다섯 가지 모드 · 최대 30초

$0.120/초 보기 →
Wan 3.0 Prime 영상

Wan 3.0 Prime

wan3.0-video-prime

성능은 동일 · 속도는 몇 배

$0.160/초 보기 →
MiniMax H3 영상

MiniMax H3

minimax-h3

1080P · 네이티브 오디오

$0.036/초 보기 →
Grok Imagine Video 1.5 영상

Grok Imagine Video 1.5

grok-imagine-video-1.5

건당 과금 · 최대 15초

$0.300/건부터 보기 →