NezhaGateNezhaGate
チャット

Qwen3.8 Max 0902

⧉
qwen3.8-max-0902
モデルの種類 Max0902Flash

Qwen3.8 Max 0902 は Qwen3.8 Max の 0902 スナップショットです。バージョンが固定され上流の更新で変わらないため、プロンプトを調整済みで安定した再現性のある出力が必要な用途に向いています。能力と価格は Qwen3.8 Max と同じです。常に考えてから答え(推論の過程は reasoning_content に返ります)、ツール呼び出し、ストリーミング、画像入力(base64 の data URI)に対応。繰り返される長いプレフィックスは自動でキャッシュに当たり、その部分はキャッシュ価格で精算されます。OpenAI 互換なので model に qwen3.8-max-0902 を指定するだけで使えます。

チャットバージョン固定推論プロンプトキャッシュOpenAI 互換

オンラインテスト

今すぐ Qwen3.8 Max 0902 を試す(ログイン後に利用可能)。

入力

詳細設定
ウェブ検索
メモリ · マルチターン

会話

会話をはじめる下にメッセージを入力してはじめましょう

モデル紹介:Qwen3.8 Max 0902

Qwen3.8 Max 0902 は Qwen3.8 Max の 0902 スナップショットで、NezhaGate では OpenAI 互換の API から提供しています。バージョンが固定され上流の更新で変わらないため、プロンプトを調整済みで、安定した再現性のある出力が必要な用途に向いています。能力と価格は Qwen3.8 Max と同じです。常に考えてから答え、推論の過程は message.reasoning_content に返ります。ツール呼び出し、ストリーミング、画像入力に対応し、繰り返される長いプレフィックスは自動でキャッシュに当たります。model に qwen3.8-max-0902 を指定すればそのまま使え、従量課金・失敗した呼び出しは課金しません。

ユースケース

本番環境での固定バージョン

サービス本番、評価のベースライン、回帰テストなど、モデルの挙動を変えたくない場面で、上流の更新による出力の揺れを避けられます。

長い文書への繰り返しの質問

同じ長い文書や長いシステムプロンプトを繰り返し使うと自動でキャッシュに当たります。約 1 万トークンのプレフィックスで、2 回目の呼び出しの 97% がキャッシュに当たることを確認しており、その部分はキャッシュ価格で精算されます。

推論とコード

Qwen3.8 Max と同じ推論、コーディング、エージェント能力で、OpenAI 形式のツール呼び出しと JSON 出力に対応します。

画像の理解

スクリーンショット、レシート、グラフの文字や内容を読み取ります。画像は base64 の data URI で送ってください。

選び方

バージョンを固定して結果を再現したい場合や、同じ長いプレフィックスを繰り返し使う場合は 0902 スナップショットを選んでください。常に Qwen3.8 Max の現行版を使いたいなら Qwen3.8 Max、大量処理でコストを重視するなら Qwen3.8 Flash です。3 つとも Qwen3.8 ファミリーなので、切り替えは model フィールドを変えるだけです。

よくある質問

Qwen3.8 Max とは何が違いますか?
Qwen3.8 Max は現行版、0902 は固定されたスナップショットで、上流の更新で挙動が変わりません。価格も組み込み方も同じです。計測では、0902 は繰り返される長いプレフィックスを自動でキャッシュしますが、Qwen3.8 Max は今のところキャッシュしません。
キャッシュはどう課金されますか?
繰り返される長いプレフィックスは自動でキャッシュに当たり、その部分は usage.prompt_tokens_details.cached_tokens に表示され、キャッシュ価格で精算されます。残りの入力は入力価格です。追加のパラメータは不要です。
思考をオフにできますか?
できません。0902 は常に考えてから答え、enable_thinking、reasoning_effort、thinking_budget でも変わりません。推論トークンは usage.completion_tokens の中で出力価格で課金されます。
画像はどう送ればよいですか?
messages の content に image_url として base64 の data URI(data:image/png;base64,...)を入れてください。公開画像のリンクは先に base64 に変換するか、リンクをそのまま受け付ける Qwen3.8 Flash を使ってください。
失敗した呼び出しにも課金されますか?
いいえ。正常に応答した呼び出しだけを実際の使用量で精算します。上流のエラーやタイムアウトで残高が減ることはありません。

関連モデル

統合できる他のモデルを探索しましょう。

すべて見る →