NezhaGate
Chat

Gemini 3.5 Flash

gemini-3.5-flash

Gemini 3.5 Flash 是 Google 新一代高速模型,内置思考能力,速度快、性价比高,适合大批量对话与 Agent 场景。完全兼容 OpenAI 接口,把 model 改成 gemini-3.5-flash 即可接入。

文本对话高速思考OpenAI 兼容

在线测试 · Playground

直接试一下 Gemini 3.5 Flash 的效果(登录后可用)。

Input

高级设置
联网搜索 · Web search
记忆 · 多轮上下文

对话

开始对话在下方输入消息开始

关于 Gemini 3.5 Flash

Gemini 3.5 Flash 是 Google 推出的新一代高速思考模型,在保持低延迟与高并发的同时引入了显式的思考(推理)步骤,适合既要响应快、又需要一定逻辑推理能力的对话与处理任务。在 NezhaGate 上,它通过 OpenAI 兼容接口提供:把 base_url 指向 NezhaGate、将 model 参数设为 "gemini-3.5-flash",即可复用现有的 OpenAI SDK 代码,按用量计费,失败的请求不计费。

应用场景

高并发对话服务

为客服机器人、问答助手等高流量场景提供低延迟应答,在高并发压力下保持稳定的对话体验。

轻量推理任务

借助思考能力处理需要简单逻辑推断的问题,如数据归类、条件判断和多步骤问答,而无需调用更重的旗舰模型。

批量文本处理

对大量文档进行摘要、改写、抽取或分类,凭借高吞吐与按量计费控制单位成本。

实时 Agent 编排

在工具调用与多轮编排循环中作为快速决策节点,缩短每一步的等待时间。

原型与快速迭代

在产品验证阶段快速搭建对话功能,验证后可平滑切换到旗舰或均衡模型。

如何选择

当你需要在速度、成本与一定推理能力之间取得平衡时,选择 Gemini 3.5 Flash:它比旗舰 Gemini 3.1 Pro 更快、更省,又比偏纯速度的 Gemini 3 Flash、Gemini 2.5 Flash 多了显式的思考能力。若任务需要最深度的推理,改用 Gemini 3.1 Pro;若想要更新一代的高速思考模型,可升级到 Gemini 3.6 Flash;偏好 OpenAI 生态的高速模型则可对比 GPT-5.6 Luna。

常见问题

Gemini 3.5 Flash 是什么?
Gemini 3.5 Flash 是 Google 的新一代高速思考模型,属于快速(fast)档位。它在低延迟、高并发的基础上加入了显式的思考(推理)步骤,适合既要响应快、又要具备一定逻辑能力的对话与处理任务。
Gemini 3.5 Flash 支持流式输出吗?
支持。它通过 OpenAI 兼容接口提供流式响应,在请求中设置 stream=true 即可逐 token 接收输出,便于在对话界面中实现打字机效果并降低首字延迟。
如何用 OpenAI SDK 调用 Gemini 3.5 Flash?
把 OpenAI SDK 的 base_url 指向 NezhaGate、填入你的 NezhaGate API Key,并将 model 参数设为 "gemini-3.5-flash" 即可,其余调用方式与你现有的 OpenAI 代码完全一致。按用量计费,失败的请求不计费。
Gemini 3.5 Flash 最适合哪些场景?
它最适合高并发对话、轻量推理、批量文本处理和实时 Agent 编排等既看重速度、又需要一定推理能力的场景。需要最深度推理时,建议改用旗舰的 Gemini 3.1 Pro。
Gemini 3.5 Flash 和 Gemini 3 Flash 怎么选?
两者都属高速档位;Gemini 3 Flash 偏向纯速度与高性价比对话,而 Gemini 3.5 Flash 额外强调显式的思考能力。若任务包含逻辑推断或多步骤判断,优先选 Gemini 3.5 Flash;若只需快速作答,Gemini 3 Flash 同样合适。

相关模型

探索其它可接入的模型。

查看全部 →
GPT-5.6 Sol Chat

GPT-5.6 Sol

gpt-5.6-sol

前沿旗舰 Agentic 编程模型

$2.00/1M tokens ↓75% 查看 →
GPT-5.6 Terra Chat

GPT-5.6 Terra

gpt-5.6-terra

日常均衡 Agentic 编程模型

$1.20/1M tokens ↓77% 查看 →
GPT-5.6 Luna Chat

GPT-5.6 Luna

gpt-5.6-luna

快而省的 Agentic 编程模型

$0.80/1M tokens ↓68% 查看 →
GPT-5.5 Chat

GPT-5.5

gpt-5.5

旗舰对话与推理模型

$0.70/1M tokens ↓86% 查看 →
GPT Image 2 生图

GPT Image 2

gpt-image-2

高质量文生图 / 图生图模型

$0.015/张 起 查看 →
Nano Banana 2 生图

Nano Banana 2

nano-banana-2

高质量文生图 / 图生图模型

$0.025/张 起 查看 →
Nano Banana Pro 生图

Nano Banana Pro

nano-banana-pro

旗舰级文生图 / 图生图模型

$0.040/张 起 查看 →
Claude Sonnet 4.6 Chat

Claude Sonnet 4.6

claude-sonnet-4-6

均衡高效的对话 / 代码模型

$1.50/1M tokens ↓50% 查看 →
Gemini 3.1 Pro Chat

Gemini 3.1 Pro

gemini-3.1-pro

Google 新一代旗舰推理模型

$0.50/1M tokens ↓75% 查看 →
Gemini 3.6 Flash Chat

Gemini 3.6 Flash

gemini-3.6-flash

新一代高速思考模型 · 四档思考预算

$0.60/1M tokens 查看 →
Gemini 3.6 Flash High Chat

Gemini 3.6 Flash High

gemini-3.6-flash-high

深度思考档

$0.60/1M tokens 查看 →
Gemini 3.6 Flash Low Chat

Gemini 3.6 Flash Low

gemini-3.6-flash-low

极速低耗档

$0.60/1M tokens 查看 →
Gemini 3.6 Flash Tiered Chat

Gemini 3.6 Flash Tiered

gemini-3.6-flash-tiered

自动调档

$0.60/1M tokens 查看 →
Gemini 3 Flash Chat

Gemini 3 Flash

gemini-3-flash-preview

高速低延迟,高性价比对话模型

$0.30/1M tokens ↓60% 查看 →
Gemini 2.5 Flash Chat

Gemini 2.5 Flash

gemini-2.5-flash

高速低延迟,高性价比对话

$0.30/1M tokens ↓52% 查看 →
Veo 3.1 生视频

Veo 3.1

veo-3.1

文生 / 图生视频 · 多档 · 多分辨率

$0.075/条 起 查看 →