Gemini 3 Flash
⧉Gemini 3 Flash 主打高速与高性价比,适合大批量、低延迟的对话与 Agent 场景。完全兼容 OpenAI 接口,支持流式输出,把 model 改成 gemini-3-flash-preview 即可接入。
在线测试 · Playground
直接试一下 Gemini 3 Flash 的效果(登录后可用)。
Input
高级设置
对话
关于 Gemini 3 Flash
Gemini 3 Flash 是 Google 推出的高速对话模型,主打低延迟、高并发与高性价比,适合需要快速响应的实时交互和大批量请求场景。它在保留多轮对话与日常推理能力的同时,把响应速度和单位成本放在首位。在 NezhaGate 上,它通过 OpenAI 兼容接口提供服务:只需把 model 设为 "gemini-3-flash-preview"、把 base_url 指向 NezhaGate,即可复用现有的 OpenAI SDK,按用量计费,失败的请求不计费。
应用场景
为客服机器人、网站问答和应用内助手提供低延迟应答,在用户等待敏感的交互中保持流畅体验。
适合标签生成、文本分类、信息抽取等大批量任务,以较低的单位成本快速跑完海量请求。
支持流式返回,逐字呈现回答,让聊天界面和写作工具拥有打字机式的即时反馈。
快速生成邮件、文案、会议纪要的初稿,或对长文档做要点提炼,作为后续人工或旗舰模型精修的起点。
在多渠道系统中快速判断用户意图并分流,把复杂请求再转交给更强的旗舰模型处理。
如何选择
当你追求速度与成本、需要应对大批量或实时请求时,选 Gemini 3 Flash;若任务涉及更复杂的多步推理或长链路思考,可升级到旗舰的 Gemini 3.1 Pro;若想要新一代的高速思考型模型,可考虑 Gemini 3.5 Flash。在同一高速档位上,Gemini 3.6 Flash Low 与 GPT-5.6 Luna(OpenAI)是对应的轻量选择,都能在同一个 OpenAI 兼容接口下按需切换。
常见问题
Gemini 3 Flash 是什么?
Gemini 3 Flash 支持流式输出吗?
如何用 OpenAI SDK 调用 Gemini 3 Flash?
Gemini 3 Flash 最适合哪些场景?
Gemini 3 Flash 和 Gemini 3.5 Flash 怎么选?
相关模型
探索其它可接入的模型。
GPT-5.6 Sol
前沿旗舰 Agentic 编程模型
GPT-5.6 Terra
日常均衡 Agentic 编程模型
GPT-5.6 Luna
快而省的 Agentic 编程模型
GPT-5.5
旗舰对话与推理模型
GPT Image 2
高质量文生图 / 图生图模型
Nano Banana 2
高质量文生图 / 图生图模型
Nano Banana Pro
旗舰级文生图 / 图生图模型
Claude Sonnet 4.6
均衡高效的对话 / 代码模型
Gemini 3.1 Pro
Google 新一代旗舰推理模型
Gemini 3.6 Flash
新一代高速思考模型 · 四档思考预算
Gemini 3.6 Flash High
深度思考档
Gemini 3.6 Flash Low
极速低耗档
Gemini 3.6 Flash Tiered
自动调档
Gemini 3.5 Flash
新一代高速思考模型
Gemini 2.5 Flash
高速低延迟,高性价比对话
Veo 3.1
文生 / 图生视频 · 多档 · 多分辨率