NezhaGateNezhaGate
对话

GPT-6.1 Sol

⧉
gpt-6.1-sol
模型类型 Astra6.1 SolSolLuna

GPT-6.1 Sol 是 OpenAI 于 2026 年 9 月 29 日发布的 GPT-6 Sol 升级版。OpenAI 称它在 Agentic 编程、计算机操作与专业工作上接近 GPT-6 Astra,而官方标价只有 Astra 的五分之一。105 万 token 上下文、最高 12.8 万 token 输出,reasoning_effort 支持 low / medium / high / xhigh / max 五档,支持图片输入与工具调用。完全兼容 OpenAI SDK,把 model 改成 gpt-6.1-sol 即可接入,同时支持 /chat/completions 与 /responses。按量计费、失败不计费;命中缓存的输入按 1/10 计价,且不加收官方在超长上下文上的附加费。

文本对话GPT-6 家族Agentic 编程105 万上下文提示缓存

在线测试

直接试一下 GPT-6.1 Sol 的效果(登录后可用)。

Input

高级设置

该模型经 ChatGPT 订阅通路提供,上游不接受 temperature / top_p / max_tokens 等采样参数(传了会被静默忽略)。请用下面的 reasoning_effort 控制思考深度,用提示词约束输出长度。

联网搜索
记忆 · 多轮上下文

对话

开始对话在下方输入消息开始

关于 GPT-6.1 Sol

GPT-6.1 Sol 是 OpenAI 在 2026 年 9 月 29 日 DevDay 上发布的 GPT-6 Sol 升级版,在 NezhaGate 以 OpenAI 兼容接口提供。OpenAI 称它在 Agentic 编程、计算机操作与专业工作上接近 GPT-6 Astra,而官方标价只有 Astra 的五分之一。上下文 1,050,000 token、单次最高 128,000 token 输出,reasoning_effort 支持 low / medium / high / xhigh / max 五档,支持图片输入与工具调用,/chat/completions 与 /responses 两个端点都能用。把 model 改成 gpt-6.1-sol 即可,SDK 与请求格式不用动。按量计费、失败不计费,命中缓存的输入按输入价的 1/10 结算。

应用场景

接近 Astra 的编码能力

多文件重构、跨模块排查、按需求写完整功能:需要持续推理的编码任务交给 6.1 Sol,花费只有 Astra 的一小部分。

Agentic 工作流

Codex / Cursor / Claude Code 等工具走 OpenAI 兼容接口,只改 model 字段就能切到 GPT-6.1 Sol,工具调用按 OpenAI 格式返回。

专业文档与分析

报告撰写、表格与数据分析、长文档审阅等专业工作,也是 OpenAI 称其接近 Astra 的领域之一。

长上下文工程任务

105 万 token 足以一次装下整个代码仓库和相关文档,不必再自己切片、拼接上下文。

如何选择

想要接近 Astra 的编码与 Agent 能力、又要控制成本,选 GPT-6.1 Sol;最难、最需要深度推理的任务仍交给 GPT-6 Astra,大批量、低延迟的简单任务用 GPT-6 Luna 更省。它们同属 GPT-6 家族、同享 105 万 token 上下文,切换只改 model 字段。

常见问题

和 GPT-6 Sol 有什么区别?
GPT-6.1 Sol 是 GPT-6 Sol 的升级版,OpenAI 称它在 Agentic 编程、计算机操作与专业工作上接近 GPT-6 Astra。推理档位也不同:GPT-6.1 Sol 从 low 起步,没有 none 和 minimal(传这两个值时网关会按 low 处理,不会报错)。
和 GPT-6 Astra 比怎么样?
Astra 仍是 GPT-6 家族能力最强的旗舰,适合最难的推理与研究型任务。OpenAI 称 GPT-6.1 Sol 在上述三类工作上接近 Astra,官方标价只有 Astra 的五分之一;两者上下文与接入方式完全相同。
reasoning_effort 支持哪些档位?
支持 low / medium / high / xhigh / max 五档。none 和 minimal 上游不接受,网关会自动按 low 处理。不传时网关按 medium(模型默认档)请求并返回思考摘要;思考越多输出 token 越多,按实际用量计费。
上下文、输出上限和知识截止时间是多少?
上下文 1,050,000 token,单次最高输出 128,000 token;OpenAI 公布的知识截止时间是 2026 年 4 月 30 日。系统提示等开销也计入上下文窗口。
可以走 /v1/responses 吗?
可以。同一个 model 名在 /v1/chat/completions 与 /v1/responses 上都能用,两个端点都支持流式输出。
失败的调用会扣费吗?
不会。只有正常返回的调用才按实际用量结算,上游报错与超时不会动你的余额。

相关模型

探索其它可接入的模型。

查看全部 →