OpenAI 兼容的 AI Gateway,一个端点统一接入 GPT-5.5、Gemini 系列对话与 gpt-image 生图等全部模型。面向人阅读,也面向 AI 编程助手一键复制。
快速接入
替换 Base URL 和 API Key 后,现有 OpenAI SDK 可直接使用。
https://nezhagate.com/v1
curl https://nezhagate.com/v1/chat/completions -H "Authorization: Bearer YOUR_API_KEY" -H "Content-Type: application/json" -d '{"model": "gpt-5.5", "messages": [{"role": "user", "content": "写一段 AI API 产品介绍"}], "stream": false}'
每个模型的完整接口参数、示例与异步用法,见下方「模型与价格」表里对应模型的文档。
认证方式
所有 API 调用都需要 Bearer Token。
Authorization: Bearer YOUR_API_KEY Content-Type: application/json
模型与价格
每个模型的完整接口参数、示例与异步用法,见下方「模型与价格」表里对应模型的文档。
| 模型 | 能力 | 端点 | 价格 | |
|---|---|---|---|---|
| gpt-5.6-sol | 前沿推理、Agentic 编程、长链路任务、结构化输出 | /chat/completions | 输入 $2.0/1M · 输出 $12.0/1M | API 文档 → |
| gpt-5.6-terra | 日常对话、Agentic 编程、推理、结构化输出 | /chat/completions | 输入 $1.2/1M · 输出 $7.0/1M | API 文档 → |
| gpt-5.6-luna | 高速对话、Agentic 编程、大批量低延迟、结构化输出 | /chat/completions | 输入 $0.8/1M · 输出 $4.8/1M | API 文档 → |
| gpt-5.5 | 对话、推理、Agent、结构化输出 | /chat/completions | 输入 $0.7/1M · 输出 $4.2/1M | API 文档 → |
| gpt-image-2 | 文生图、图生图、封面、海报、插画 | /images/generations | 1K $0.015 · 2K $0.025 · 4K $0.04 | API 文档 → |
| nano-banana-2 | 文生图、图生图、封面、海报、插画 | /images/generations | 1K $0.025 · 2K $0.0375 · 4K $0.0625 | API 文档 → |
| nano-banana-pro | 文生图、图生图、封面、海报、插画、信息图 | /images/generations | 1K $0.04 · 2K $0.06 · 4K $0.1 | API 文档 → |
| claude-sonnet-4-6 | 对话、代码、推理、长上下文 | /chat/completions | 输入 $1.5/1M · 输出 $7.5/1M | API 文档 → |
| gemini-3.1-pro | 对话、推理、超长上下文、多模态 | /chat/completions | 输入 $0.5/1M · 输出 $3.0/1M | API 文档 → |
| gemini-3.6-flash | 对话、推理、思考、图片输入、超长上下文 | /chat/completions | 输入 $0.6/1M · 输出 $3.6/1M | API 文档 → |
| gemini-3.6-flash-high | 深度推理、复杂任务、思考、图片输入、超长上下文 | /chat/completions | 输入 $0.6/1M · 输出 $3.6/1M | API 文档 → |
| gemini-3.6-flash-low | 高速对话、大批量、低延迟、图片输入 | /chat/completions | 输入 $0.6/1M · 输出 $3.6/1M | API 文档 → |
| gemini-3.6-flash-tiered | 自适应思考、对话、推理、图片输入 | /chat/completions | 输入 $0.6/1M · 输出 $3.6/1M | API 文档 → |
| gemini-3-flash-preview | 对话、推理、高并发、低延迟 | /chat/completions | 输入 $0.3/1M · 输出 $1.2/1M | API 文档 → |
| gemini-3.5-flash | 对话、推理、高并发、低延迟、思考 | /chat/completions | 输入 $0.45/1M · 输出 $2.7/1M | API 文档 → |
| gemini-2.5-flash | 对话、高并发、低延迟、多模态 | /chat/completions | 输入 $0.3/1M · 输出 $1.2/1M | API 文档 → |
| veo-3.1 | 文生视频、图生视频、短片、商业成片 | /videos/generations | $0.075 /条 | API 文档 → |
在 App 里直接使用(无需写代码)
在任意支持 OpenAI 接口的客户端里,填入下面三项即可使用,无需编程:
| API 地址 / Base URL | https://nezhagate.com/v1 |
| API 密钥 | 你在控制台创建的 Key(控制台 → API Keys → 复制) |
| 模型名 | gpt-5.6-sol gpt-5.6-terra gpt-5.6-luna gpt-5.5 gpt-image-2 nano-banana-2 nano-banana-pro claude-sonnet-4-6 gemini-3.1-pro gemini-3.6-flash gemini-3.6-flash-high gemini-3.6-flash-low gemini-3.6-flash-tiered gemini-3-flash-preview gemini-3.5-flash gemini-2.5-flash veo-3.1 |
已验证可用:ChatBox、Cherry Studio、NextChat、LobeChat、沉浸式翻译、Open WebUI 等。
原生 Anthropic 接口(Claude Code 直连)
Claude 模型除 OpenAI 兼容口径外,还提供原生 Anthropic Messages API:把 Claude Code 等工具的 ANTHROPIC_BASE_URL 指到下面地址、用你的网关 Key 作 x-api-key 即可直连,thinking、工具调用、提示缓存等原生特性完整保留。
export ANTHROPIC_BASE_URL=https://nezhagate.com/anthropic export ANTHROPIC_API_KEY=YOUR_API_KEY # claude-opus-4-8 / claude-sonnet-4-6 / claude-haiku-4-5
curl https://nezhagate.com/anthropic/v1/messages -H "x-api-key: YOUR_API_KEY" -H "anthropic-version: 2023-06-01" -H "Content-Type: application/json" -d '{"model": "claude-sonnet-4-6", "max_tokens": 1024, "messages": [{"role": "user", "content": "Hello"}]}'
可用模型:claude-sonnet-4-6。计费与 /v1 完全一致,按 token 计价。
提示缓存计费:缓存命中(缓存读)按输入价 1/10(0.1×)计、缓存写入按 1.25× 计(各模型单价见价格页)。命中需前缀稳定且足够长(Claude Opus ≥ 4096 tokens、Sonnet ≥ 2048)并在短时间内重复调用 —— Claude Code 带大 CLAUDE.md / 系统提示跑真实代码库时通常每轮命中,输入成本降至约 1/10;在线测试台的短问答前缀过短不会命中,属正常。
视频生成(异步任务)
文生视频 / 图生视频统一为异步任务:提交后立刻返回 HTTP 202 与任务号({"id":"img_...","object":"video.generation.job","status":"queued"}),再轮询 GET /v1/videos/jobs/{id} 直到 status=succeeded,结果在 data[0].url(重托管的 mp4 稳定直链)。单条约 1-2 分钟,按条计费、失败全额退。方向用 size 传 16:9(横屏,默认)或 9:16(竖屏);图生视频在 image 里传参考图作为首帧。
curl https://nezhagate.com/v1/videos/generations -H 'Authorization: Bearer YOUR_API_KEY' -H 'Content-Type: application/json' -d '{"model": "veo-3.1", "prompt": "一只猫在日落时冲浪", "tier": "quality", "resolution": "1080p", "size": "16:9", "duration": "8s"}'curl https://nezhagate.com/v1/videos/jobs/img_3f9a...c2 -H 'Authorization: Bearer YOUR_API_KEY'
可用视频模型:veo-3.1
复制给 AI 的接入说明
把下面整段发给 Codex / Claude Code / Cursor,它就知道怎么接。也可以用右上角「复制页面」复制整篇文档。
请使用 OpenAI-compatible API 接入 NezhaAPI。
Base URL: https://nezhagate.com/v1
API Key: 从环境变量 NEZHAAPI_KEY 读取。
Claude 模型可选原生 Anthropic 口径(适合 Claude Code / Anthropic SDK 直连):ANTHROPIC_BASE_URL=https://nezhagate.com/anthropic,请求头 x-api-key=API Key + anthropic-version: 2023-06-01,POST /anthropic/v1/messages(必填 max_tokens),模型 claude-opus-4-8 / claude-sonnet-4-6 / claude-haiku-4-5。
对话模型(/chat/completions):gpt-5.6-sol / gpt-5.6-terra / gpt-5.6-luna / gpt-5.5 / claude-sonnet-4-6 / gemini-3.1-pro / gemini-3.6-flash / gemini-3.6-flash-high / gemini-3.6-flash-low / gemini-3.6-flash-tiered / gemini-3-flash-preview / gemini-3.5-flash / gemini-2.5-flash
生图模型(文生图 /images/generations,图生图 /images/edits 或加 image 参数):gpt-image-2 / nano-banana-2 / nano-banana-pro
生视频模型(文生视频 /videos/generations,异步任务;图生视频加 image 参数传首帧):veo-3.1
认证:Authorization: Bearer YOUR_API_KEY
要求(对话):返回 choices[0].message.content;401 检查 Key,402 余额不足,429/5xx 可重试。
要求(图片,异步任务):提交 /images/generations 或 /images/edits 立刻返回 HTTP 202 与任务号({"id":"img_...","object":"image.generation.job","status":"queued"});随后轮询 GET /v1/images/jobs/{id} 直到 status=succeeded,再读取 data[0].url(img.nezhagate.com 稳定直链)。不要在提交后直接读取 data。
要求(视频,异步任务):提交 /videos/generations 立刻返回 HTTP 202 与任务号(object=video.generation.job);随后轮询 GET /v1/videos/jobs/{id} 直到 status=succeeded,再读取 data[0].url(重托管 mp4 稳定直链)。单条约 1-2 分钟,失败全额退。
查询余额 / 用量
用任意一个 API Key 就能查本账户的剩余额度和消费,无需登录后台。最简单是 GET /v1/usage;也兼容 OpenAI 风格的 /v1/dashboard/billing/credit_grants(余额 = total_available)。
curl https://nezhagate.com/v1/usage -H "Authorization: Bearer YOUR_API_KEY"
curl https://nezhagate.com/v1/dashboard/billing/credit_grants -H "Authorization: Bearer YOUR_API_KEY"
错误码
| 状态码 | 含义 | 处理方式 |
|---|---|---|
| 401 | API Key 缺失或无效 | 检查 Authorization Header |
| 402 | 余额不足或 Key 超出限额 | 联系管理员充值 |
| 400 | 模型或参数不支持 | 只用 gpt-5.5 / gpt-image-2 |
| 429 | 上游限流 | 稍后重试 |
| 502 | 所有上游线路失败 | 等待恢复或联系管理员 |