Qwen3.8 Flash
⧉Qwen3.8 Flash は Qwen3.8 ファミリーの軽量・高速版で、単価が低くスループットが高いため、バッチ処理や高い同時実行に向いています。計測では短い質問に 2.5〜6 秒で応答しました。常に考えてから答え(推論の過程は reasoning_content に返ります)、ツール呼び出し、JSON 出力、ストリーミング、画像入力(公開画像のリンクと base64 のどちらも可)に対応。テキストブロックの cache_control も受け付け、繰り返される長いプレフィックスを上流がキャッシュから返すことがあります。ヒットするかどうかは上流が決め、課金は返された usage に従います(キャッシュヒットと報告された部分はキャッシュ価格で精算)。OpenAI 互換なので model に qwen3.8-flash を指定するだけで使えます。従量課金・失敗した呼び出しは課金しません。
オンラインテスト
今すぐ Qwen3.8 Flash を試す(ログイン後に利用可能)。
入力
詳細設定
会話
モデル紹介:Qwen3.8 Flash
Qwen3.8 Flash は Alibaba Cloud の Qwen3.8 ファミリーの軽量・高速版で、NezhaGate では OpenAI 互換の API から提供しています。単価が低くスループットが高いため、バッチ処理や高い同時実行に向いており、計測では短い質問に 2.5〜6 秒で応答しました。常に考えてから答え、推論の過程は message.reasoning_content に返ります。ツール呼び出し、JSON 出力、ストリーミング、画像入力(公開リンクと base64)に対応します。cache_control も受け付け、繰り返される長いプレフィックスを上流がキャッシュから返すことがありますが、ヒットするかどうかは上流が決め、課金は返された usage に従います(キャッシュヒットと報告された部分はキャッシュ価格で精算)。model に qwen3.8-flash を指定すればそのまま使え、従量課金・失敗した呼び出しは課金しません。
ユースケース
分類、抽出、要約、書き換えなどの大量タスクに。単価が低く、高い同時実行でのバッチ処理に向いています。
スクリーンショット、レシート、商品写真の文字や内容を読み取ります。公開画像のリンクも base64 もそのまま送れます。
ナレッジ Q&A や文章作成アシスタントなど、速く安い応答が必要な場面に。
OpenAI 形式の tools / tool_calls と JSON 出力に対応し、軽量なエージェントの実行ステップに使えます。
選び方
タスクが単純で量が多く、コストと速度を重視するなら Qwen3.8 Flash を選んでください。より強い推論、コーディング、エージェント能力が必要なら Qwen3.8 Max、バージョンを固定したいなら 0902 スナップショットに切り替えます。3 つとも Qwen3.8 ファミリーなので、切り替えは model フィールドを変えるだけです。
よくある質問
プロンプトキャッシュはどう有効にしますか?
思考をオフにできますか?
画像はどう送ればよいですか?
Qwen3.8 Max とは何が違いますか?
失敗した呼び出しにも課金されますか?
関連モデル
統合できる他のモデルを探索しましょう。
Qwen3.8 Max
Alibaba Qwen 3.8 世代のフラッグシップ · 推論・コーディング・エージェント
Qwen3.8 Max 0902
Qwen3.8 Max の固定スナップショット · 変わらないバージョン
DeepSeek V4.1 Flash
DeepSeek の現行 Flash モデル · 思考モードのオン/オフ
GLM-5.3 Flash
軽量版 GLM-5.3 · 大量処理を低コストで
Gemini 3.6 Flash
次世代の高速思考モデル · 4 段階の思考バジェット