NezhaGateNezhaGate
チャット

DeepSeek V4 Flash 0731

⧉
deepseek-v4-flash-0731
モデルの種類 V4.10731

DeepSeek V4 Flash 0731 は V4 Flash の 0731 スナップショットです。バージョンが固定されていて上流の更新で変わらないため、プロンプトを V4 Flash に合わせて調整済みで、安定した再現性のある出力が必要な用途に向いています。思考モードは既定でオン(推論の過程は reasoning_content で返ります)で、thinking={"type":"disabled"} でオフにできます。ツール呼び出しとストリーミングに対応。OpenAI 互換なので model に deepseek-v4-flash-0731 を指定するだけで使え、価格は V4.1 と同じです。

チャットバージョン固定思考モードツール呼び出しOpenAI 互換

オンラインテスト

今すぐ DeepSeek V4 Flash 0731 を試す(ログイン後に利用可能)。

入力

詳細設定
ウェブ検索
メモリ · マルチターン

会話

会話をはじめる下にメッセージを入力してはじめましょう

モデル紹介:DeepSeek V4 Flash 0731

DeepSeek V4 Flash 0731 は DeepSeek V4 Flash の 0731 固定スナップショットで、NezhaGate では OpenAI 互換の API から提供しています。バージョンが固定されていて上流のモデル更新でも変わらないため、プロンプトを V4 Flash に合わせて調整済みで、安定した再現性のある出力が必要な用途に向いています。既定では考えてから答え、推論の過程は message.reasoning_content に返ります。thinking={"type":"disabled"} を送ると思考をオフにできます。ツール呼び出しとストリーミングに対応。model に deepseek-v4-flash-0731 を指定すればそのまま使え、従量課金・失敗した呼び出しは課金しません。

ユースケース

稼働中の安定したサービス

プロンプトを V4 Flash に合わせて調整済みで、モデルの更新によって挙動が変わっては困る本番サービスに。

評価と回帰テスト

バージョンが固定されているので A/B 評価や回帰比較が公平になり、結果の違いは自分の変更だけから生まれます。

大量の抽出と分類

出力形式の一貫性が大切な一括処理は、思考をオフにして構造化された結果を直接受け取れます。

ツール呼び出しのパイプライン

エージェントや関数呼び出しの流れの中で呼び出しの挙動を安定させ、上流のアップグレードによる想定外を減らします。

選び方

DeepSeek の最新の Flash を使いたいなら V4.1、バージョン固定と再現性が必要なら 0731 を選んでください。どちらも同じ価格で、model フィールドを変えるだけで切り替えられます。

よくある質問

0731 とはどういう意味ですか?
DeepSeek V4 Flash の固定スナップショットのバージョン名です。スナップショットは変わらないため、長く同じ挙動が必要な用途に向いています。最新版を使いたい場合は DeepSeek V4.1 Flash を選んでください。
V4.1 Flash と同じ価格ですか?
同じです。NezhaGate ではどちらも同じ価格で、ピーク割増のない終日同一の単価により、実際のトークン使用量で課金されます。
思考モードはどうやってオフにしますか?
リクエストに "thinking": {"type": "disabled"} を加えると、推論のステップを飛ばしてそのまま答えます。このフィールドを省くと思考モードはオンで、推論の内容は reasoning_content に返ります。
max_tokens をとても小さくするとどうなりますか?
思考型のモデルなので推論トークンも出力として数えます。上流は 1024 未満の max_tokens を 1024 として扱うため、実際の出力(推論を含む)が指定した値を超えることがあり、usage に記録された実際のトークン数で課金されます。短い回答だけが必要なら思考をオフにすることをおすすめします。
失敗した呼び出しにも課金されますか?
いいえ。正常に応答した呼び出しだけを実際の使用量で精算します。上流のエラーやタイムアウトで残高が減ることはありません。

関連モデル

統合できる他のモデルを探索しましょう。

すべて見る →