GPT-6 Astra
⧉GPT-6 Astra는 OpenAI가 2026년 9월에 공개한 차세대 플래그십입니다. 1,050,000 토큰 컨텍스트, 최대 128,000 출력 토큰, xhigh까지 올라가는 reasoning_effort, 이미지 입력, 도구 호출, 프롬프트 캐싱을 지원합니다. OpenAI SDK와 완전히 호환되며(model을 gpt-6-astra로 지정) /chat/completions와 /responses 양쪽에서 제공됩니다. 사용한 만큼 과금하고 실패한 호출에는 과금하지 않으며, 캐시에 적중한 입력은 1/10 단가로 계산합니다. 공식 API가 붙이는 롱 컨텍스트 할증은 저희는 받지 않습니다.
온라인 테스트 · 플레이그라운드
GPT-6 Astra 바로 여기서 사용해 보기 (로그인 후 사용 가능)。
Input
고급 설정
이 모델은 ChatGPT 구독 기반 업스트림으로 제공되며, 그 경로는 temperature / top_p / max_tokens를 받지 않습니다(조용히 무시됩니다). 사고 깊이는 아래의 reasoning_effort로, 길이는 프롬프트 문구로 조절하세요.
대화
소개: GPT-6 Astra
GPT-6 Astra는 OpenAI가 2026년 9월에 공개한 차세대 플래그십이며, NezhaGate에서 OpenAI 호환 API로 제공됩니다. 1,050,000 토큰 컨텍스트 창, 최대 128,000 출력 토큰, 사고 깊이를 조절하는 reasoning_effort(xhigh까지), 이미지 입력, 도구 호출, 프롬프트 캐싱을 지원하며 /chat/completions와 /responses 양쪽에서 쓸 수 있습니다. model만 gpt-6-astra로 바꾸면 되고 SDK와 요청 형태는 그대로 둡니다. 사용한 만큼 과금하고 실패한 호출에는 과금하지 않으며, 캐시에 적중한 입력은 입력 단가의 1/10로 정산됩니다.
활용 사례
1,050,000 토큰이면 저장소 하나, 계약서 묶음, 긴 보고서를 한 번의 호출에 담을 수 있어 직접 잘라 붙일 필요가 없습니다.
OpenAI 호환 엔드포인트를 쓰므로 Codex, Cursor, Claude Code는 model 필드만 바꾸면 GPT-6 Astra로 전환됩니다.
reasoning_effort가 xhigh까지 올라가므로 가장 어려운 부분에만 사고 예산을 쓰고 간단한 요청은 low로 둘 수 있습니다.
이미지를 넣고 텍스트로 받습니다. 스크린샷 이해, 차트 질의, 문서 파싱을 모두 같은 엔드포인트로 처리합니다.
어떻게 고를까
가장 강한 추론이나 초장문 컨텍스트가 필요할 때 GPT-6 Astra를 고르세요. 일상적인 개발에는 gpt-5.6-terra가, 대량 · 저지연 작업에는 gpt-5.6-luna가 더 저렴합니다. 셋 다 OpenAI 호환 엔드포인트를 쓰므로 전환은 필드 하나만 바꾸면 됩니다.
자주 묻는 질문
컨텍스트와 출력 한도는 얼마인가요?
캐시는 어떻게 적중시키나요?
공식 API와 가격을 비교하면 어떤가요?
reasoning_effort를 지원하나요?
/v1/responses도 쓸 수 있나요?
관련 모델
연동할 수 있는 다른 모델도 둘러보세요.
GPT-5.6 Sol
에이전트 코딩을 위한 프런티어 플래그십
GPT-5.6 Terra
일상용 균형형 에이전트 코딩 모델
GPT-5.6 Luna
빠르고 저렴한 에이전트 코딩 모델
GPT-5.5
플래그십 채팅 · 추론 모델
GPT Image 2
고품질 텍스트-투-이미지 / 이미지-투-이미지 모델
GPT Image 2.5 Flare
차세대 이미지 모델 — 깔끔하고 매끄러운
GPT Image 2.5 Sunburst
차세대 이미지 모델 — 질감이 더 진한
Nano Banana 2
고품질 텍스트-투-이미지 / 이미지-투-이미지 모델
Nano Banana Pro
플래그십 텍스트-투-이미지 / 이미지-투-이미지 모델
Claude Sonnet 4.6
균형 잡히고 효율적인 채팅 · 코딩 모델
Claude Opus 5
Anthropic의 차세대 플래그십
Claude Fable 5
Anthropic Fable 시리즈 · 서사와 장문 글쓰기
Gemini 3.1 Pro
Google의 차세대 플래그십 추론 모델
Gemini 3.8 Flash
최신 Flash · 적응형 사고
Gemini 3.7 Flash
이전 세대 Flash · 적응형 사고
Gemini 3.6 Flash
차세대 고속 사고 모델 · 사고 예산 4단계
Gemini 3.6 Flash High
심층 사고 등급
Gemini 3.6 Flash Low
가장 빠르고 가장 저렴한 등급
Gemini 3.6 Flash Tiered
사고량 자동 조절
Gemini 3 Flash
빠르고 지연이 낮은 비용 효율형 채팅 모델
Gemini 3.5 Flash
차세대 고속 사고 모델
Gemini 2.5 Flash
빠르고 지연이 낮은 비용 효율형 채팅
Veo 3.1
텍스트 / 이미지 투 비디오 · 다중 등급 · 다중 해상도
Seedance 2.5
텍스트 / 이미지 투 비디오 · 최대 30초
Seedance 2.0
텍스트 / 이미지 투 비디오 · 5~15초
Seedance 2.0 Fast
낮은 지연 · 최저 비용
Seedance 2.0 Mini
엔트리 등급 · 최저 비용
Wan 3.0
엔드포인트 하나에 다섯 가지 모드 · 최대 30초
Wan 3.0 Prime
성능은 동일 · 속도는 몇 배
MiniMax H3
1080P · 네이티브 오디오
Grok Imagine Video 1.5
건당 과금 · 최대 15초