NezhaGate
Chat

GPT-6 Astra

gpt-6-astra
24 小时状态 成功率: 100.0%
-24h现在
本条只统计成功与我方失败:绿色为该时段成功,红色为该时段失败占比。不计入统计的有两类——客户端错误(参数错误、鉴权失败、余额不足等 4xx)以及仍在进行中的请求。每格一小时,数据取自真实网关调用日志。

GPT-6 Astra 是 OpenAI 于 2026 年 9 月发布的新一代旗舰模型:105 万 token 上下文、最高 12.8 万 token 输出,支持 reasoning_effort 五档调节(最高 xhigh)、图片输入、工具调用与提示缓存。完全兼容 OpenAI SDK,把 model 改成 gpt-6-astra 即可接入,同时支持 /chat/completions 与 /responses。按量计费、失败不计费;命中缓存的输入按 1/10 计价,且不加收官方在超长上下文上的附加费。

文本对话新一代旗舰105 万上下文提示缓存图片理解

在线测试 · Playground

直接试一下 GPT-6 Astra 的效果(登录后可用)。

Input

高级设置

该模型经 ChatGPT 订阅通路提供,上游不接受 temperature / top_p / max_tokens 等采样参数(传了会被静默忽略)。请用下面的 reasoning_effort 控制思考深度,用提示词约束输出长度。

联网搜索
记忆 · 多轮上下文

对话

开始对话在下方输入消息开始

关于 GPT-6 Astra

GPT-6 Astra 是 OpenAI 于 2026 年 9 月发布的新一代旗舰模型,在 NezhaGate 以 OpenAI 兼容接口提供:105 万 token 上下文、最高 12.8 万 token 输出,支持 reasoning_effort 调节思考深度(最高 xhigh)、图片输入、工具调用与提示缓存,/chat/completions 与 /responses 两个端点都可用。把 model 改成 gpt-6-astra 即可接入,SDK 与请求形状不变。按量计费、失败不计费,命中缓存的输入按输入价的 1/10 结算。

应用场景

超长上下文分析

105 万 token 足以一次装下整个代码仓库、成套合同或长篇报告,不必再自己切片拼接。

Agentic 编程

走 OpenAI 兼容接口,Codex / Cursor / Claude Code 等工具只改 model 字段即可切换到 GPT-6 Astra。

深度推理任务

reasoning_effort 最高可到 xhigh,把思考预算交给最难的那部分问题,简单请求仍可用 low 压成本。

图文混合输入

支持图片输入与文本输出,截图理解、图表问答与文档解析走同一个接口。

如何选择

需要最强推理或超长上下文时选 GPT-6 Astra;日常开发用 gpt-5.6-terra 更省,大批量低延迟用 gpt-5.6-luna。三者都是 OpenAI 兼容接口,切换只改 model 字段。

常见问题

上下文和输出上限是多少?
上下文 1,050,000 token,单次最高输出 128,000 token。系统提示等开销也计入上下文窗口。
缓存怎么才能命中?
提示缓存自动生效,条件是可缓存前缀至少 1,024 token 且与上一次请求的开头完全一致。把系统提示、工具定义、长文档等固定内容放在消息最前面、把每次变化的用户输入放在最后,命中率最高。命中部分按输入价的 1/10($0.28 / 1M)结算,控制台的调用日志会显示缓存读 token 数。
和官方 API 的价格差多少?
官方标价为每百万 token 输入 $10、输出 $50,且在提示超过 272K token 时对输入加倍、输出加价 50%。NezhaGate 为 $2.80 / $14.00 统一价,不随上下文长度加价,缓存读 $0.28。
支持 reasoning_effort 吗?
支持,可传 low / medium / high / xhigh。思考得越多输出 token 越多,按实际用量计费;不传则由模型自适应决定。
可以走 /v1/responses 吗?
可以。同一个 model 名在 /v1/chat/completions 与 /v1/responses 上都能用,两个端点都支持流式输出。

相关模型

探索其它可接入的模型。

查看全部 →
GPT-5.6 Sol Chat

GPT-5.6 Sol

gpt-5.6-sol

前沿旗舰 Agentic 编程模型

$2.00/1M 输入 · $12.00/1M 输出 ↓75% 查看 →
GPT-5.6 Terra Chat

GPT-5.6 Terra

gpt-5.6-terra

日常均衡 Agentic 编程模型

$1.20/1M 输入 · $7.00/1M 输出 ↓77% 查看 →
GPT-5.6 Luna Chat

GPT-5.6 Luna

gpt-5.6-luna

快而省的 Agentic 编程模型

$0.80/1M 输入 · $4.80/1M 输出 ↓68% 查看 →
GPT-5.5 Chat

GPT-5.5

gpt-5.5

旗舰对话与推理模型

$0.70/1M 输入 · $4.20/1M 输出 ↓86% 查看 →
GPT Image 2 生图

GPT Image 2

gpt-image-2

高质量文生图 / 图生图模型

$0.015/张 起 查看 →
GPT Image 2.5 Flare 生图

GPT Image 2.5 Flare

gpt-image-2.5-flare

新一代生图 · 干净平滑

$0.015/张 起 查看 →
GPT Image 2.5 Sunburst 生图

GPT Image 2.5 Sunburst

gpt-image-2.5-sunburst

新一代生图 · 质感更重

$0.015/张 起 查看 →
Nano Banana 2 生图

Nano Banana 2

nano-banana-2

高质量文生图 / 图生图模型

$0.025/张 起 查看 →
Nano Banana Pro 生图

Nano Banana Pro

nano-banana-pro

旗舰级文生图 / 图生图模型

$0.040/张 起 查看 →
Claude Sonnet 4.6 Chat

Claude Sonnet 4.6

claude-sonnet-4-6

均衡高效的对话 / 代码模型

$1.50/1M 输入 · $7.50/1M 输出 ↓50% 查看 →
Claude Opus 5 Chat

Claude Opus 5

claude-opus-5

Anthropic 新一代旗舰模型

$4.00/1M 输入 · $20.00/1M 输出 查看 →
Claude Fable 5 Chat

Claude Fable 5

claude-fable-5

Anthropic Fable 系列 · 叙事与长文特化

$8.00/1M 输入 · $40.00/1M 输出 查看 →
Gemini 3.1 Pro Chat

Gemini 3.1 Pro

gemini-3.1-pro

Google 新一代旗舰推理模型

$0.50/1M 输入 · $3.00/1M 输出 ↓75% 查看 →
Gemini 3.8 Flash Chat

Gemini 3.8 Flash

gemini-3.8-flash

最新一代 Flash · 自适应思考

$0.60/1M 输入 · $3.60/1M 输出 ↓7% 查看 →
Gemini 3.7 Flash Chat

Gemini 3.7 Flash

gemini-3.7-flash

上一代 Flash · 自适应思考

$0.60/1M 输入 · $3.60/1M 输出 ↓7% 查看 →
Gemini 3.6 Flash Chat

Gemini 3.6 Flash

gemini-3.6-flash

新一代高速思考模型 · 四档思考预算

$0.60/1M 输入 · $3.60/1M 输出 查看 →
Gemini 3.6 Flash High Chat

Gemini 3.6 Flash High

gemini-3.6-flash-high

深度思考档

$0.60/1M 输入 · $3.60/1M 输出 查看 →
Gemini 3.6 Flash Low Chat

Gemini 3.6 Flash Low

gemini-3.6-flash-low

极速低耗档

$0.60/1M 输入 · $3.60/1M 输出 查看 →
Gemini 3.6 Flash Tiered Chat

Gemini 3.6 Flash Tiered

gemini-3.6-flash-tiered

自动调档

$0.60/1M 输入 · $3.60/1M 输出 查看 →
Gemini 3 Flash Chat

Gemini 3 Flash

gemini-3-flash-preview

高速低延迟,高性价比对话模型

$0.30/1M 输入 · $1.20/1M 输出 ↓57% 查看 →
Gemini 3.5 Flash Chat

Gemini 3.5 Flash

gemini-3.5-flash

新一代高速思考模型

$0.45/1M 输入 · $2.70/1M 输出 ↓70% 查看 →
Gemini 2.5 Flash Chat

Gemini 2.5 Flash

gemini-2.5-flash

高速低延迟,高性价比对话

$0.30/1M 输入 · $1.20/1M 输出 ↓46% 查看 →
Veo 3.1 生视频

Veo 3.1

veo-3.1

文生 / 图生视频 · 多档 · 多分辨率

$0.075/条起 查看 →
Seedance 2.5 生视频

Seedance 2.5

seedance-2.5

文生 / 图生视频 · 最长 30 秒

$0.158/秒 查看 →
Seedance 2.0 生视频

Seedance 2.0

seedance-2.0

文生 / 图生视频 · 5–15 秒

$0.150/秒 查看 →
Seedance 2.0 Fast 生视频

Seedance 2.0 Fast

seedance-2.0-fast

低延迟 · 最省

$0.100/秒 查看 →
Seedance 2.0 Mini 生视频

Seedance 2.0 Mini

seedance-2.0-mini

入门档 · 最省

$0.066/秒 查看 →
Wan 3.0 生视频

Wan 3.0

wan3.0-video

一个接口五种玩法 · 最长 30 秒

$0.120/秒 查看 →
Wan 3.0 Prime 生视频

Wan 3.0 Prime

wan3.0-video-prime

同能力 · 出片快数倍

$0.160/秒 查看 →
MiniMax H3 生视频

MiniMax H3

minimax-h3

1080P · 原生音频

$0.036/秒 查看 →
Grok Imagine Video 1.5 生视频

Grok Imagine Video 1.5

grok-imagine-video-1.5

按条计费 · 最长 15 秒

$0.300/条起 查看 →