Kimi K3
⧉Kimi K3 は Moonshot AI の新しいフラッグシップモデルで、長文の理解、複数文書の分析、中国語の文章作成に強く、エージェントとツール呼び出しの能力にも優れています。常に考えてから答え、推論の過程は reasoning_content に返ります。サンプリング温度はモデル側で固定されているため、リクエストの temperature / top_p は無視されます。ツール呼び出し、ストリーミング、プロンプトキャッシュ(繰り返される長いプレフィックスはキャッシュ価格で精算)に対応。OpenAI 互換なので model に kimi-k3 を指定するだけで使えます。従量課金・失敗した呼び出しは課金しません。
このモデルを選ぶ理由
Moonshot の新フラッグシップ:2.8 兆パラメータ、重み公開、約 100 万トークンのコンテキスト
主な特長
- 2.8 兆パラメータで重み公開。現時点で最大級のオープンウェイトモデル
- 約 100 万トークンのコンテキスト(1,048,576)。長い資料も丸ごと渡せます
- 既定で思考し、思考内容は reasoning_content に分けて返るため回答本文に混ざりません
- ツール呼び出し、ストリーミング、プロンプトキャッシュに対応。繰り返す長い接頭部はキャッシュ価格で課金
- OpenAI 互換:既存の SDK コードは base_url と model を変えるだけ
公式価格との比較
100 万トークンあたり(米ドル) · 節約額 ↓40%
コピーしてすぐ呼び出す
curl https://nezhagate.com/v1/chat/completions -H "Authorization: Bearer YOUR_API_KEY" -H "Content-Type: application/json" -d '{"model": "kimi-k3", "messages": [{"role": "user", "content": "Hello"}]}'from openai import OpenAI
client = OpenAI(api_key="YOUR_API_KEY", base_url="https://nezhagate.com/v1")
r = client.chat.completions.create(model="kimi-k3", messages=[{"role": "user", "content": "Hello"}])
print(r.choices[0].message.content)YOUR_API_KEY をコンソールで作成したキーに置き換えてください。
オンラインテスト
今すぐ Kimi K3 を試す(ログイン後に利用可能)。
入力
詳細設定
会話
モデル紹介:Kimi K3
Kimi K3 は Moonshot AI の新しいフラッグシップモデルで、NezhaGate では OpenAI 互換の API から提供しています。長文の理解、複数文書の分析、中国語の文章作成に強く、エージェントとツール呼び出しの能力にも優れています。常に考えてから答え、推論の過程は message.reasoning_content に、回答は content に返ります。サンプリング温度はモデル側で固定されているため、リクエストの temperature / top_p はゲートウェイが無視し、エラーにもなりません。ツール呼び出し、ストリーミング、プロンプトキャッシュに対応。model に kimi-k3 を指定すればそのまま使え、従量課金・失敗した呼び出しは課金しません。
ユースケース
契約書、論文、決算資料などの長い資料の要約・比較・質疑応答に。10 万トークンを超える文書でも情報を正確に見つけられることを確認しています。
OpenAI 形式の tools / tool_calls に対応し、検索拡張、関数呼び出し、多段階タスクの制御に向いています。
長文、レポート、マーケティングコピー、推敲まで、自然で流れるような中国語で書けます。
考えてから答えるので、数学、論理、多段階の推論が必要な問題に向いています。推論の過程は reasoning_content で確認できます。
選び方
長文、複数文書、エージェントのタスクなら Kimi K3 を優先してください。より低コストの日常会話なら DeepSeek V4.1 Flash や GLM-5.3 も選べます。切り替えは model フィールドを変えるだけです。
よくある質問
temperature パラメータは効きますか?
思考モードをオフにできますか?
長い回答を受け取るときの注意点は?
プロンプトキャッシュに対応していますか?
失敗した呼び出しにも課金されますか?
関連モデル
統合できる他のモデルを探索しましょう。
GLM-5.3
Z.ai の新フラッグシップ · コーディングとエージェント
Qwen3.7 Max
Alibaba Qwen のフラッグシップ · 推論とコーディング
Grok 4.7
xAI のフラッグシップ推論モデル · 長いコンテキスト
DeepSeek V4.1 Flash
DeepSeek の現行 Flash モデル · 思考モードのオン/オフ
Claude Sonnet 4.6
バランスと効率に優れたチャット・コーディングモデル
Gemini 3.1 Pro
Google 次世代の旗艦推論モデル