Gemini 3.5 Flash
⧉Gemini 3.5 Flash 是 Google 新一代高速模型,内置思考能力,速度快、性价比高,适合大批量对话与 Agent 场景。完全兼容 OpenAI 接口,把 model 改成 gemini-3.5-flash 即可接入。
在线测试 · Playground
直接试一下 Gemini 3.5 Flash 的效果(登录后可用)。
Input
高级设置
对话
关于 Gemini 3.5 Flash
Gemini 3.5 Flash 是 Google 推出的新一代高速思考模型,在保持低延迟与高并发的同时引入了显式的思考(推理)步骤,适合既要响应快、又需要一定逻辑推理能力的对话与处理任务。在 NezhaGate 上,它通过 OpenAI 兼容接口提供:把 base_url 指向 NezhaGate、将 model 参数设为 "gemini-3.5-flash",即可复用现有的 OpenAI SDK 代码,按用量计费,失败的请求不计费。
应用场景
为客服机器人、问答助手等高流量场景提供低延迟应答,在高并发压力下保持稳定的对话体验。
借助思考能力处理需要简单逻辑推断的问题,如数据归类、条件判断和多步骤问答,而无需调用更重的旗舰模型。
对大量文档进行摘要、改写、抽取或分类,凭借高吞吐与按量计费控制单位成本。
在工具调用与多轮编排循环中作为快速决策节点,缩短每一步的等待时间。
在产品验证阶段快速搭建对话功能,验证后可平滑切换到旗舰或均衡模型。
如何选择
当你需要在速度、成本与一定推理能力之间取得平衡时,选择 Gemini 3.5 Flash:它比旗舰 Gemini 3.1 Pro 更快、更省,又比偏纯速度的 Gemini 3 Flash、Gemini 2.5 Flash 多了显式的思考能力。若任务需要最深度的推理,改用 Gemini 3.1 Pro;若想要更新一代的高速思考模型,可升级到 Gemini 3.6 Flash;偏好 OpenAI 生态的高速模型则可对比 GPT-5.6 Luna。
常见问题
Gemini 3.5 Flash 是什么?
Gemini 3.5 Flash 支持流式输出吗?
如何用 OpenAI SDK 调用 Gemini 3.5 Flash?
Gemini 3.5 Flash 最适合哪些场景?
Gemini 3.5 Flash 和 Gemini 3 Flash 怎么选?
相关模型
探索其它可接入的模型。
GPT-5.6 Sol
前沿旗舰 Agentic 编程模型
GPT-5.6 Terra
日常均衡 Agentic 编程模型
GPT-5.6 Luna
快而省的 Agentic 编程模型
GPT-5.5
旗舰对话与推理模型
GPT Image 2
高质量文生图 / 图生图模型
Nano Banana 2
高质量文生图 / 图生图模型
Nano Banana Pro
旗舰级文生图 / 图生图模型
Claude Sonnet 4.6
均衡高效的对话 / 代码模型
Gemini 3.1 Pro
Google 新一代旗舰推理模型
Gemini 3.6 Flash
新一代高速思考模型 · 四档思考预算
Gemini 3.6 Flash High
深度思考档
Gemini 3.6 Flash Low
极速低耗档
Gemini 3.6 Flash Tiered
自动调档
Gemini 3 Flash
高速低延迟,高性价比对话模型
Gemini 2.5 Flash
高速低延迟,高性价比对话
Veo 3.1
文生 / 图生视频 · 多档 · 多分辨率