NezhaGateNezhaGate
チャット

Qwen3.7 Max

⧉
qwen3.7-max

Qwen3.7 Max は Alibaba Cloud の Qwen 3.7 世代のフラッグシップモデルで、推論、コーディング、エージェント作業に強く、中国語と英語のどちらも安定しています。常に考えてから答え、推論の過程は reasoning_content に返ります。ツール呼び出し、ストリーミング、プロンプトキャッシュに対応。OpenAI 互換なので model に qwen3.7-max を指定するだけで使えます。従量課金・失敗した呼び出しは課金しません。

チャット推論コーディングツール呼び出しOpenAI 互換

オンラインテスト

今すぐ Qwen3.7 Max を試す(ログイン後に利用可能)。

入力

詳細設定
ウェブ検索
メモリ · マルチターン

会話

会話をはじめる下にメッセージを入力してはじめましょう

モデル紹介:Qwen3.7 Max

Qwen3.7 Max は Alibaba Cloud の Qwen 3.7 世代のフラッグシップモデルで、NezhaGate では OpenAI 互換の API から提供しています。推論、コーディング、エージェント作業に強く、中国語と英語のどちらも安定しています。常に考えてから答え、推論の過程は message.reasoning_content に、回答は content に返るので、content だけを読むクライアントは変更不要です。ツール呼び出し、ストリーミング、プロンプトキャッシュ(繰り返される長いプレフィックスはキャッシュ価格で精算)に対応。model に qwen3.7-max を指定すればそのまま使え、従量課金・失敗した呼び出しは課金しません。

ユースケース

複雑な推論と数学

考えてから答えるので、多段階の推論、数学、論理の問題に向いています。

コード生成とレビュー

コードの作成、リファクタリング、解説、レビュー、構造化出力まで対応します。

エージェントとツール呼び出し

OpenAI 形式の tools / tool_calls に対応し、さまざまなエージェントフレームワークにつなげます。

長文書の質疑応答

10 万トークンを超える文書でも情報を正確に見つけられることを確認しています。同じ文書への繰り返しの質問はキャッシュに当たり、コストが下がります。

選び方

強い推論とコーディング能力が必要なら Qwen3.7 Max を選んでください。長文や複数文書の分析は Kimi K3 と比べてみてください。コスト重視なら DeepSeek V4.1 Flash です。切り替えは model フィールドを変えるだけです。

よくある質問

思考をオフにしたり、思考の長さを調整したりできますか?
できません。NezhaGate 経由では Qwen3.7 Max は常に思考モードがオンで、reasoning_effort、enable_thinking、thinking_budget などのパラメータでは思考の長さは変わりません。推論トークンは usage.completion_tokens の中で出力価格で課金されます。
max_tokens で費用を制限できますか?
max_tokens は推論部分を制限しません。とても小さく設定しても、モデルが先に数千トークン考えることがあり、usage に記録された実際のトークン数で課金されます。費用を抑えたい場合は、プロンプトで短い回答を求めてください。
プロンプトキャッシュに対応していますか?
対応しています。繰り返される長いプレフィックスはキャッシュに当たり、当たった部分はキャッシュ価格で精算されます。同じ長い文書への 2 回目の質問で、費用がおよそ 5 分の 1 になることを確認しています。
ツール呼び出しとストリーミングに対応していますか?
どちらも対応しています。tools / tool_calls は OpenAI 形式で、stream=true を送ると SSE のチャンクで返り、推論の内容は delta.reasoning_content でストリーミングされます。
失敗した呼び出しにも課金されますか?
いいえ。正常に応答した呼び出しだけを実際の使用量で精算します。上流のエラーやタイムアウトで残高が減ることはありません。

関連モデル

統合できる他のモデルを探索しましょう。

すべて見る →