在线测试 · Playground
直接试一下 Gemini 3.6 Flash 的效果(登录后可用)。
Input
高级设置
对话
关于 Gemini 3.6 Flash
Gemini 3.6 Flash 是 Google 新一代高速思考模型,在 Flash 级的延迟与成本下提供显式的思考(推理)步骤,支持 100 万 token 超长上下文、最高 64K 输出,并可接受图片输入。它在 NezhaGate 上提供四个思考预算档位:标准档 gemini-3.6-flash、深度档 gemini-3.6-flash-high、极速档 gemini-3.6-flash-low,以及由模型自行判断难度的动态档 gemini-3.6-flash-tiered。四档同价,思考得多少直接体现在输出 token 数上。通过 OpenAI 兼容接口提供:把 base_url 指向 NezhaGate、将 model 设为 "gemini-3.6-flash" 即可复用现有 OpenAI SDK 代码,按用量计费,失败的请求不计费。
应用场景
标准档在速度与推理之间均衡,适合既要响应快、又需要一定逻辑推理的客服、助手与 Agent 工作流。
1M 上下文窗口可一次性读入大部头代码库、长报告或多份合同,做摘要、检索与交叉比对。
支持图片输入,可用于截图问答、表单/图表读取与多模态分析。
动态档(tiered)由模型按问题难度自行决定思考多少,简单问题快答、难题多想,适合请求难度差异大的生产流量。
如何选择
日常使用直接选标准档 gemini-3.6-flash;遇到多步推理的难题换 gemini-3.6-flash-high;分类、抽取、改写这类大批量轻任务用 gemini-3.6-flash-low 最快也最省;不确定请求难度时用 gemini-3.6-flash-tiered 交给模型自己判断。四档单价相同,换档只需改 model 字段。若需要更强的推理深度,可升级到 Gemini 3.1 Pro。
常见问题
Gemini 3.6 Flash 的四个档位有什么区别?
为什么四个档位卖同一个价?
上下文窗口多大?
支持图片输入和流式输出吗?
如何用 OpenAI SDK 调用?
相关模型
探索其它可接入的模型。
GPT-5.6 Sol
前沿旗舰 Agentic 编程模型
GPT-5.6 Terra
日常均衡 Agentic 编程模型
GPT-5.6 Luna
快而省的 Agentic 编程模型
GPT-5.5
旗舰对话与推理模型
GPT Image 2
高质量文生图 / 图生图模型
Nano Banana 2
高质量文生图 / 图生图模型
Nano Banana Pro
旗舰级文生图 / 图生图模型
Claude Sonnet 4.6
均衡高效的对话 / 代码模型
Gemini 3.1 Pro
Google 新一代旗舰推理模型
Gemini 3.6 Flash High
深度思考档
Gemini 3.6 Flash Low
极速低耗档
Gemini 3.6 Flash Tiered
自动调档
Gemini 3 Flash
高速低延迟,高性价比对话模型
Gemini 3.5 Flash
新一代高速思考模型
Gemini 2.5 Flash
高速低延迟,高性价比对话
Veo 3.1
文生 / 图生视频 · 多档 · 多分辨率