NezhaGate
Chat

Gemini 3.6 Flash

gemini-3.6-flash
模型类型 MediumHighLowTiered

Gemini 3.6 Flash 是 Google 新一代高速思考模型,1M token 上下文、最高 64K 输出,支持图片输入。标准档(Medium)思考预算均衡,适合日常对话与 Agent 工作流。完全兼容 OpenAI 接口,把 model 改成 gemini-3.6-flash 即可接入。

文本对话思考1M 上下文OpenAI 兼容

在线测试 · Playground

直接试一下 Gemini 3.6 Flash 的效果(登录后可用)。

Input

高级设置
联网搜索 · Web search
记忆 · 多轮上下文

对话

开始对话在下方输入消息开始

关于 Gemini 3.6 Flash

Gemini 3.6 Flash 是 Google 新一代高速思考模型,在 Flash 级的延迟与成本下提供显式的思考(推理)步骤,支持 100 万 token 超长上下文、最高 64K 输出,并可接受图片输入。它在 NezhaGate 上提供四个思考预算档位:标准档 gemini-3.6-flash、深度档 gemini-3.6-flash-high、极速档 gemini-3.6-flash-low,以及由模型自行判断难度的动态档 gemini-3.6-flash-tiered。四档同价,思考得多少直接体现在输出 token 数上。通过 OpenAI 兼容接口提供:把 base_url 指向 NezhaGate、将 model 设为 "gemini-3.6-flash" 即可复用现有 OpenAI SDK 代码,按用量计费,失败的请求不计费。

应用场景

需要思考的日常对话与 Agent

标准档在速度与推理之间均衡,适合既要响应快、又需要一定逻辑推理的客服、助手与 Agent 工作流。

百万 token 长文档处理

1M 上下文窗口可一次性读入大部头代码库、长报告或多份合同,做摘要、检索与交叉比对。

图文混合理解

支持图片输入,可用于截图问答、表单/图表读取与多模态分析。

难度不均的混合流量

动态档(tiered)由模型按问题难度自行决定思考多少,简单问题快答、难题多想,适合请求难度差异大的生产流量。

如何选择

日常使用直接选标准档 gemini-3.6-flash;遇到多步推理的难题换 gemini-3.6-flash-high;分类、抽取、改写这类大批量轻任务用 gemini-3.6-flash-low 最快也最省;不确定请求难度时用 gemini-3.6-flash-tiered 交给模型自己判断。四档单价相同,换档只需改 model 字段。若需要更强的推理深度,可升级到 Gemini 3.1 Pro。

常见问题

Gemini 3.6 Flash 的四个档位有什么区别?
只差在思考预算:low 思考最少、响应最快,标准档(不带后缀)居中,high 思考最多、适合多步推理,tiered 则由模型按问题难度自行决定。四者能力同源,上下文和多模态支持完全一致。
为什么四个档位卖同一个价?
因为档位差异已经体现在用量上:思考时产生的 token 计入输出,high 档天然比 low 档耗更多输出 token。再叠一层单价差会重复收费,所以四档统一单价,实付多少取决于你选的档位实际思考了多少。
上下文窗口多大?
约 100 万 token 输入,单次最高 64K token 输出,四个档位一致。
支持图片输入和流式输出吗?
都支持。图片按 OpenAI 的 image_url 写法传入;请求里设 stream=true 即可逐 token 流式返回。
如何用 OpenAI SDK 调用?
把 base_url 指向 NezhaGate、填入你的 NezhaGate API Key,将 model 设为 "gemini-3.6-flash"(或带档位后缀的 id)即可,其余调用方式与现有 OpenAI 代码完全一致。

相关模型

探索其它可接入的模型。

查看全部 →
GPT-5.6 Sol Chat

GPT-5.6 Sol

gpt-5.6-sol

前沿旗舰 Agentic 编程模型

$2.00/1M tokens ↓75% 查看 →
GPT-5.6 Terra Chat

GPT-5.6 Terra

gpt-5.6-terra

日常均衡 Agentic 编程模型

$1.20/1M tokens ↓77% 查看 →
GPT-5.6 Luna Chat

GPT-5.6 Luna

gpt-5.6-luna

快而省的 Agentic 编程模型

$0.80/1M tokens ↓68% 查看 →
GPT-5.5 Chat

GPT-5.5

gpt-5.5

旗舰对话与推理模型

$0.70/1M tokens ↓86% 查看 →
GPT Image 2 生图

GPT Image 2

gpt-image-2

高质量文生图 / 图生图模型

$0.015/张 起 查看 →
Nano Banana 2 生图

Nano Banana 2

nano-banana-2

高质量文生图 / 图生图模型

$0.025/张 起 查看 →
Nano Banana Pro 生图

Nano Banana Pro

nano-banana-pro

旗舰级文生图 / 图生图模型

$0.040/张 起 查看 →
Claude Sonnet 4.6 Chat

Claude Sonnet 4.6

claude-sonnet-4-6

均衡高效的对话 / 代码模型

$1.50/1M tokens ↓50% 查看 →
Gemini 3.1 Pro Chat

Gemini 3.1 Pro

gemini-3.1-pro

Google 新一代旗舰推理模型

$0.50/1M tokens ↓75% 查看 →
Gemini 3.6 Flash High Chat

Gemini 3.6 Flash High

gemini-3.6-flash-high

深度思考档

$0.60/1M tokens 查看 →
Gemini 3.6 Flash Low Chat

Gemini 3.6 Flash Low

gemini-3.6-flash-low

极速低耗档

$0.60/1M tokens 查看 →
Gemini 3.6 Flash Tiered Chat

Gemini 3.6 Flash Tiered

gemini-3.6-flash-tiered

自动调档

$0.60/1M tokens 查看 →
Gemini 3 Flash Chat

Gemini 3 Flash

gemini-3-flash-preview

高速低延迟,高性价比对话模型

$0.30/1M tokens ↓60% 查看 →
Gemini 3.5 Flash Chat

Gemini 3.5 Flash

gemini-3.5-flash

新一代高速思考模型

$0.45/1M tokens ↓70% 查看 →
Gemini 2.5 Flash Chat

Gemini 2.5 Flash

gemini-2.5-flash

高速低延迟,高性价比对话

$0.30/1M tokens ↓52% 查看 →
Veo 3.1 生视频

Veo 3.1

veo-3.1

文生 / 图生视频 · 多档 · 多分辨率

$0.075/条 起 查看 →