NezhaGate

OpenAI 互換の AI Gateway。GPT-5.5 と GPT Image 2 へのアクセスを統一。人が読めるだけでなく、AI コーディングアシスタント向けにワンクリックでコピーできます。

クイックスタート

Base URL と API Key を差し替えるだけで、既存の OpenAI SDK がそのまま使えます。

Base URL
https://nezhagate.com/v1
curl · 対話 API:Chat Completions
curl https://nezhagate.com/v1/chat/completions -H "Authorization: Bearer YOUR_API_KEY" -H "Content-Type: application/json" -d '{"model": "gpt-5.5", "messages": [{"role": "user", "content": "AI API の短い製品紹介を書いてください"}], "stream": false}'

モデルごとの完全なリクエストパラメータ、サンプル、非同期の使い方は、そのモデル専用のドキュメントにあります。下のモデルと料金の表から開いてください。

そのまま動かせるサンプルはこちら(Python / Node / curl。画像と動画の非同期フローを含みます): github.com/gaoorange/nezhagate-api-examples

認証方式

すべての API 呼び出しには Bearer Token が必要です。

Header
Authorization: Bearer YOUR_API_KEY
Content-Type: application/json

モデルと価格

モデルごとの完全なリクエストパラメータ、サンプル、非同期の使い方は、そのモデル専用のドキュメントにあります。下のモデルと料金の表から開いてください。

モデル能力エンドポイント価格
gpt-5.6-sol最前線の推論、エージェント型コーディング、長期タスク、構造化出力/chat/completions 入力 $2.0/1M · 出力 $12.0/1M API ドキュメント →
gpt-5.6-terra日常のチャット、エージェント型コーディング、推論、構造化出力/chat/completions 入力 $1.2/1M · 出力 $7.0/1M API ドキュメント →
gpt-5.6-luna高速なチャット、エージェント型コーディング、大量かつ低レイテンシ、構造化出力/chat/completions 入力 $0.8/1M · 出力 $4.8/1M API ドキュメント →
gpt-5.5チャット、推論、エージェント、構造化出力/chat/completions 入力 $0.7/1M · 出力 $4.2/1M API ドキュメント →
gpt-6-astra深い推論、エージェント型コーディング、非常に長いコンテキスト、画像入力、構造化出力/chat/completions 入力 $2.8/1M · 出力 $14.0/1M API ドキュメント →
gpt-image-2テキストから画像、画像から画像、カバー、ポスター、イラスト/images/generations 1K $0.015 · 2K $0.025 · 4K $0.04 API ドキュメント →
gpt-image-2.5-flareテキストから画像、画像から画像、カバー、ポスター、イラスト、文字組み/images/generations 1K $0.015 · 2K $0.025 · 4K $0.04 API ドキュメント →
gpt-image-2.5-sunburstテキストから画像、画像から画像、カバー、ポスター、イラスト、文字組み/images/generations 1K $0.015 · 2K $0.025 · 4K $0.04 API ドキュメント →
nano-banana-2テキストから画像、画像から画像、カバー、ポスター、イラスト/images/generations 1K $0.025 · 2K $0.0375 · 4K $0.0625 API ドキュメント →
nano-banana-proテキストから画像、画像から画像、カバー、ポスター、イラスト、インフォグラフィック/images/generations 1K $0.04 · 2K $0.06 · 4K $0.1 API ドキュメント →
claude-sonnet-4-6チャット、コード、推論、長いコンテキスト/chat/completions 入力 $1.5/1M · 出力 $7.5/1M API ドキュメント →
claude-opus-5深い推論、コード、エージェント、長いコンテキスト、画像理解/chat/completions 入力 $4.0/1M · 出力 $20.0/1M API ドキュメント →
claude-fable-5中国語の執筆、物語の創作、長文生成、チャット、コード、画像理解/chat/completions 入力 $8.0/1M · 出力 $40.0/1M API ドキュメント →
gemini-3.1-proチャット、推論、非常に長いコンテキスト、マルチモーダル/chat/completions 入力 $0.5/1M · 出力 $3.0/1M API ドキュメント →
gemini-3.8-flashチャット、推論、適応的な思考、画像入力、非常に長いコンテキスト/chat/completions 入力 $0.6/1M · 出力 $3.6/1M API ドキュメント →
gemini-3.7-flashチャット、推論、適応的な思考、画像入力、非常に長いコンテキスト/chat/completions 入力 $0.6/1M · 出力 $3.6/1M API ドキュメント →
gemini-3.6-flashチャット、推論、思考、画像入力、非常に長いコンテキスト/chat/completions 入力 $0.6/1M · 出力 $3.6/1M API ドキュメント →
gemini-3.6-flash-high深い推論、複雑なタスク、思考、画像入力、非常に長いコンテキスト/chat/completions 入力 $0.6/1M · 出力 $3.6/1M API ドキュメント →
gemini-3.6-flash-low高速なチャット、大量処理、低レイテンシ、画像入力/chat/completions 入力 $0.6/1M · 出力 $3.6/1M API ドキュメント →
gemini-3.6-flash-tiered適応的な思考、チャット、推論、画像入力/chat/completions 入力 $0.6/1M · 出力 $3.6/1M API ドキュメント →
gemini-3-flash-previewチャット、推論、高い同時実行、低レイテンシ/chat/completions 入力 $0.3/1M · 出力 $1.2/1M API ドキュメント →
gemini-3.5-flashチャット、推論、高い同時実行、低レイテンシ、思考/chat/completions 入力 $0.45/1M · 出力 $2.7/1M API ドキュメント →
gemini-2.5-flashチャット、高い同時実行、低レイテンシ、マルチモーダル/chat/completions 入力 $0.3/1M · 出力 $1.2/1M API ドキュメント →
veo-3.1テキストから動画、画像から動画、短編クリップ、商用映像/videos/generations $0.075 /本+ API ドキュメント →
seedance-2.5長回しの短編、複数参照素材の入力、商用映像/videos/generations $0.158 /秒 API ドキュメント →
seedance-2.0短編クリップ、商用素材/videos/generations $0.15 /秒 API ドキュメント →
seedance-2.0-fast大量の素材制作、アイデアの素早い検証/videos/generations $0.1 /秒 API ドキュメント →
seedance-2.0-mini大量の下書き、低コストの試行錯誤/videos/generations $0.066 /秒 API ドキュメント →
wan3.0-video長回しの語り、複数素材の合成、動画の書き換え/videos/generations $0.12 /秒 API ドキュメント →
wan3.0-video-prime締め切りのある映像、まとめてのテスト撮影/videos/generations $0.16 /秒 API ドキュメント →
minimax-h3高精細な映像、音声付きの短編クリップ/videos/generations $0.036 /秒 API ドキュメント →
grok-imagine-video-1.5大量の短尺動画、アイデアの素早い確認/videos/generations $0.3 /本+ API ドキュメント →

アプリで使う(コード不要)

OpenAI API に対応したアプリなら、次の 3 つを入力するだけで使えます。プログラミングは不要です。

API の Base URLhttps://nezhagate.com/v1
API キーコンソールで作成したキー(コンソール → API キー → コピー)
モデル名gpt-5.6-sol gpt-5.6-terra gpt-5.6-luna gpt-5.5 gpt-6-astra gpt-image-2 gpt-image-2.5-flare gpt-image-2.5-sunburst nano-banana-2 nano-banana-pro claude-sonnet-4-6 claude-opus-5 claude-fable-5 gemini-3.1-pro gemini-3.8-flash gemini-3.7-flash gemini-3.6-flash gemini-3.6-flash-high gemini-3.6-flash-low gemini-3.6-flash-tiered gemini-3-flash-preview gemini-3.5-flash gemini-2.5-flash veo-3.1 seedance-2.5 seedance-2.0 seedance-2.0-fast seedance-2.0-mini wan3.0-video wan3.0-video-prime minimax-h3 grok-imagine-video-1.5

ChatBox、Cherry Studio、NextChat、LobeChat、Immersive Translate、Open WebUI などで動作を確認しています。

ネイティブ Anthropic API(Claude Code)

OpenAI 互換のルートに加えて、Claude モデルはネイティブの Anthropic Messages API でも提供しています。Claude Code(または任意の Anthropic SDK)を下の Base URL に向け、ゲートウェイのキーを x-api-key として使うだけです。thinking、ツール呼び出し、プロンプトキャッシュはいずれもそのまま利用できます。

Claude Code · env
export ANTHROPIC_BASE_URL=https://nezhagate.com/anthropic
export ANTHROPIC_API_KEY=YOUR_API_KEY
# claude-sonnet-4-6 / claude-opus-5 / claude-fable-5
curl · /anthropic/v1/messages
curl https://nezhagate.com/anthropic/v1/messages -H "x-api-key: YOUR_API_KEY" -H "anthropic-version: 2023-06-01" -H "Content-Type: application/json" -d '{"model": "claude-sonnet-4-6", "max_tokens": 1024, "messages": [{"role": "user", "content": "Hello"}]}'

モデル:claude-opus-5、claude-fable-5、claude-sonnet-4-6。課金は /v1 とまったく同じトークン単位です。

プロンプトキャッシュの課金:キャッシュヒット(読み取り)は入力単価の 1/10(0.1×)、書き込みは 1.25× で課金します(モデルごとの単価は料金ページをご覧ください)。ヒットさせるには、十分に長く安定した接頭部(Claude Opus は 4096 トークン以上、Sonnet は 2048 以上)を短い間隔で繰り返す必要があります。大きな CLAUDE.md やシステムプロンプトを抱えた Claude Code で実際のコードベースを扱うと毎ターンヒットし、入力コストは約 1/10 になります。プレイグラウンドの短いやり取りは短すぎてキャッシュされません。

動画生成(非同期)

テキストから動画・画像から動画はいずれも非同期ジョブです。呼び出すと即座に HTTP 202 とジョブ ID が返り({"id":"img_...","object":"video.generation.job","status":"queued"})、GET /v1/videos/jobs/{id} を status=succeeded になるまでポーリングして、結果を data[0].url から取得します(再ホストした mp4)。1 本あたり 1〜12 分です。課金方式は 2 種類あり、Veo 3.1 は 1 本ごと、Seedance 2.x と MiniMax H3 は秒単位(単価 x 長さ)です。どちらも確保額と請求額は一致し、失敗時は全額返金します。画面比率は size で指定し(既定は横向きの 16:9)、画像から動画にする場合は image に最初のフレームとなる参照画像を渡してください。

curl · 送信
curl https://nezhagate.com/v1/videos/generations -H 'Authorization: Bearer YOUR_API_KEY' -H 'Content-Type: application/json' -d '{"model": "veo-3.1", "prompt": "夕暮れにサーフィンをする猫", "tier": "quality", "resolution": "1080p", "size": "16:9", "duration": "8s"}'
curl · ポーリング
curl https://nezhagate.com/v1/videos/jobs/img_3f9a...c2 -H 'Authorization: Bearer YOUR_API_KEY'

動画モデル: veo-3.1 seedance-2.5 seedance-2.0 seedance-2.0-fast seedance-2.0-mini wan3.0-video wan3.0-video-prime minimax-h3 grok-imagine-video-1.5

AI に渡す統合用の説明

下のブロック全体を Codex / Claude Code / Cursor に送れば、統合方法を理解します。右上の「ページをコピー」でドキュメント全文をコピーすることもできます。

AI Integration Prompt
Integrate NezhaGate through its OpenAI-compatible API.
Base URL: https://nezhagate.com/v1
API Key: read it from the environment variable NEZHAAPI_KEY.
Claude models can also use the native Anthropic protocol (for Claude Code / the Anthropic SDK): ANTHROPIC_BASE_URL=https://nezhagate.com/anthropic, headers x-api-key=API Key and anthropic-version: 2023-06-01, POST /anthropic/v1/messages (max_tokens is required), models claude-sonnet-4-6 / claude-opus-5 / claude-fable-5.
Chat models (/chat/completions): gpt-5.6-sol / gpt-5.6-terra / gpt-5.6-luna / gpt-5.5 / gpt-6-astra / claude-sonnet-4-6 / claude-opus-5 / claude-fable-5 / gemini-3.1-pro / gemini-3.8-flash / gemini-3.7-flash / gemini-3.6-flash / gemini-3.6-flash-high / gemini-3.6-flash-low / gemini-3.6-flash-tiered / gemini-3-flash-preview / gemini-3.5-flash / gemini-2.5-flash
Image models (text-to-image /images/generations; image-to-image /images/edits or add an image parameter): gpt-image-2 / gpt-image-2.5-flare / gpt-image-2.5-sunburst / nano-banana-2 / nano-banana-pro
Video models (text-to-video /videos/generations, async jobs; add an image parameter for image-to-video, the image becomes the first frame): veo-3.1 / seedance-2.5 / seedance-2.0 / seedance-2.0-fast / seedance-2.0-mini / wan3.0-video / wan3.0-video-prime / minimax-h3 / grok-imagine-video-1.5
Auth: Authorization: Bearer YOUR_API_KEY
Requirements (chat): return choices[0].message.content; on 401 check the key, 402 means insufficient balance, 429/5xx can be retried.
Requirements (images, async): POST /images/generations or /images/edits returns HTTP 202 with a job id right away ({"id":"img_...","object":"image.generation.job","status":"queued"}); then poll GET /v1/images/jobs/{id} until status=succeeded and read data[0].url (a stable link on img.nezhagate.com). Do not read data right after submitting.
Requirements (video, async): POST /videos/generations returns HTTP 202 with a job id (object=video.generation.job); then poll GET /v1/videos/jobs/{id} until status=succeeded and read data[0].url (a stable re-hosted mp4 link). About 1-2 minutes per clip; failed jobs are refunded in full.

残高と利用状況の確認

任意の API キーで、アカウントの残高と消費額を取得できます。管理画面へのログインは不要です。いちばん簡単なのは GET /v1/usage です。OpenAI 互換の /v1/dashboard/billing/credit_grants も使えます(残高は total_available)。

curl · /v1/usage
curl https://nezhagate.com/v1/usage -H "Authorization: Bearer YOUR_API_KEY"
curl · /v1/dashboard/billing/credit_grants
curl https://nezhagate.com/v1/dashboard/billing/credit_grants -H "Authorization: Bearer YOUR_API_KEY"

エラーコード

ステータスコード意味対処方法
401API Key が欠落または無効Authorization ヘッダーを確認
402残高不足または Key が上限超過管理者に連絡してチャージ
400モデルまたはパラメータが非対応gpt-5.5 / gpt-image-2 のみ使用
429上流のレート制限後で再試行
502すべての上流回線が失敗回復を待つか管理者に連絡