GPT-6 Luna
⧉GPT-6 Luna 是 GPT-6 家族中最高效的型号,专为专注、大批量的任务设计:同样拥有 105 万 token 上下文与最高 12.8 万 token 输出,reasoning_effort 支持 none 到 max 六档,支持图片输入与工具调用。完全兼容 OpenAI SDK,把 model 改成 gpt-6-luna 即可接入,同时支持 /chat/completions 与 /responses。按量计费、失败不计费;命中缓存的输入按 1/10 计价。
在线测试
直接试一下 GPT-6 Luna 的效果(登录后可用)。
Input
高级设置
该模型经 ChatGPT 订阅通路提供,上游不接受 temperature / top_p / max_tokens 等采样参数(传了会被静默忽略)。请用下面的 reasoning_effort 控制思考深度,用提示词约束输出长度。
对话
关于 GPT-6 Luna
GPT-6 Luna 是 OpenAI GPT-6 家族中最高效的型号,专为专注、大批量的任务设计,在 NezhaGate 以 OpenAI 兼容接口提供:同样拥有 1,050,000 token 上下文、单次最高 128,000 token 输出,reasoning_effort 支持 none 到 max 六档,支持图片输入与工具调用,/chat/completions 与 /responses 都能用。把 model 改成 gpt-6-luna 即可接入。按量计费、失败不计费,命中缓存的输入按输入价的 1/10 结算。
应用场景
客服回复、意图识别、标签抽取等规模化任务,成本与延迟优先时交给 Luna。
Agent 流程中大量的判断、格式整理步骤用 Luna,省时间也省预算。
105 万 token 上下文加上极低单价,适合批量摘要、抽取与改写长文档。
先用 Luna 把整条流程跑通,再把关键步骤升级到 GPT-6 Sol 或 Astra。
如何选择
简单、量大、对延迟敏感的任务交给 GPT-6 Luna;需要更强的编码与推理时换 GPT-6 Sol,最难的任务交给 GPT-6 Astra。三者同属 GPT-6 家族,切换只改 model 字段。
常见问题
和 GPT-6 Sol 有什么区别?
reasoning_effort 支持哪些档位?
支持流式输出吗?
失败的调用会扣费吗?
相关模型
探索其它可接入的模型。
GPT-6 Sol
面向复杂编码与 Agent 工作流 · 105 万上下文
GPT-6 Astra
OpenAI 新一代旗舰 · 105 万上下文
GPT-5.6 Luna
快而省的 Agentic 编程模型
GPT-5.6 Terra
日常均衡 Agentic 编程模型
Gemini 3.8 Flash
最新一代 Flash · 自适应思考