NezhaGateNezhaGate
Anthropic ● 近日公開

Claude Haiku 5.5

claude-haiku-5-5

Claude Haiku 5.5 API:Anthropic 史上最速・最安・最高性能の小型モデル。100万トークンのコンテキスト、Haiku 初の effort 調整に対応し、公式単価は Haiku 4.5 より最大 90% 安い

Claude Haiku 5.5 は、Anthropic が 2026年10月7日に公開した新しい Haiku で、Claude Haiku 4.5 の後継モデルです。Anthropic は「これまでで最も安く、最も速く、最も高性能な小型モデル」と位置づけており、現行の Claude ラインアップで最も低レイテンシです。速度とコストが重視される大量処理向けに設計されており、分類、ルーティング、情報抽出、要約やコンテキストの圧縮、リアルタイムのカスタマーサポート、そして Claude Opus 5.5 / Sonnet 5.5 が主導するコーディングエージェントのサブエージェントに適しています。コンテキストは100万トークン、1回の出力は最大12.8万トークン。適応型思考がデフォルトで有効で、effort を調整できる初めての Haiku です(low から max までの5段階、デフォルトは medium)。プロンプトが10万トークン以下なら、公式価格は100万トークンあたり入力 $0.10・出力 $0.50 で、Haiku 4.5 より 90% 安くなります。現在接続作業を進めています。メールアドレスを登録いただければ、公開当日にお知らせします。

公式リリース:2026-10-07 · NezhaGate ではまだ呼び出せません

主な特長

前世代 Haiku 4.5 からの改善点

コンテキストは5倍、出力は2倍、Haiku で初めて effort に対応し、エージェント系のスコアも大きく向上。それでいて価格は下がりました。

Claude Haiku 4.5Claude Haiku 5.5
公開日2025-10-152026-10-07
コンテキストウィンドウ20万トークン100万トークン
1回あたりの最大出力6.4万トークン12.8万トークン
思考手動の予算設定(budget_tokens)適応型思考(デフォルトで有効)
effort 調整非対応low / medium / high / xhigh / max(デフォルト medium)
信頼できる知識のカットオフ2025年2月2026年6月
ブラウザー操作ツール非対応対応
公式価格:入力(100万トークンあたり)$1$0.10(プロンプト10万トークン以下)/ $0.50(10万超)
公式価格:出力(100万トークンあたり)$5$0.50 / $2.50
公式価格:キャッシュ読み取り(100万トークンあたり)$0.10$0.01 / $0.05
OSWorld 2.1 オフラインサブセット(コンピューター操作)15.7%72.4%
Terminal-Bench 4.0(コマンドラインのエージェント作業)0.0%39.2%
Humanity’s Last Exam(ツールなし / ツールあり)10.2% / 18.7%45.9% / 57.4%
GDPval-AA v2.1(実務タスク、Elo)7351620
AA-Briefcase v1.1(エージェント型ナレッジワーク、Elo)6141578

仕様と価格は Anthropic の公式ドキュメント、ベンチマークは2026年10月7日の Anthropic の発表によるものです。表中の価格は Anthropic の公式価格で、当サイトの料金ではありません。Haiku 5.5 は新しいトークナイザーを使うため同じテキストで約 30% 多くトークンを数えますが、Anthropic によれば平均的な実行コストは Haiku 4.5 より約 75% 低くなります。

活用シーン

大量の分類、タグ付け、意図判定、リクエストのルーティング
情報抽出:契約書・Web ページ・チャット履歴から項目を取り出し、構造化 JSON で出力
長い文書や長い会話の要約、コンテキストの圧縮
コーディングエージェントのサブエージェント:コード検索、ファイルの読み込み、コマンド実行、結果の取りまとめ
リアルタイムのカスタマーサポート、チャットボット、データベース問い合わせ型の Q&A
ブラウザー操作・コンピューター操作エージェント:フォーム入力、ページ操作、複数サイトからの情報収集

よくある質問

Claude Haiku 5.5 は Haiku 4.5 から何が改善されましたか?
主に5点です。① コンテキストが20万から100万トークンに、出力上限が6.4万から12.8万トークンに拡大。② 思考が手動の予算設定(budget_tokens)から適応型思考に変わり、Haiku で初めて effort を調整できるように。③ エージェント性能が大幅に向上し、OSWorld 2.1 は 15.7% から 72.4%、Terminal-Bench 4.0 は 0.0% から 39.2%、Humanity’s Last Exam(ツールなし)は 10.2% から 45.9% に。④ 信頼できる知識のカットオフが2025年2月から2026年6月に更新され、ブラウザー操作ツールが新たに使えるように。⑤ 価格は、プロンプト10万トークン以下で単価が 90%、それを超える場合も 50% 下がりました。Anthropic は、ほぼすべてのアライメント評価で Haiku 4.5 から大きく改善したとも発表しています。
Claude Haiku 5.5 の公式価格はいくらですか?
Anthropic はプロンプトの長さに応じて2段階の料金を設定しています(100万トークンあたり)。プロンプト10万トークン以下:入力 $0.10、出力 $0.50、5分キャッシュ書き込み $0.125、1時間キャッシュ書き込み $0.20、キャッシュ読み取り $0.01。10万トークン超:すべて5倍で、入力 $0.50、出力 $2.50、キャッシュ読み取り $0.05。Batch API ならさらに 50% 節約できます。参考までに、Haiku 4.5 は入力 $1・出力 $5 です。いずれも Anthropic の公式価格で、当サイトの料金は公開時にお知らせします。
Haiku 5.5 はトークンを多く使いますか?
知っておきたい点が2つあります。まず、Claude Opus 4.7 から採用された新しいトークナイザーを使うため、同じテキストでも Haiku 4.5 より約 30% 多くトークンとして数えられます。次に、思考がデフォルトで有効で、思考トークンは出力として課金され max_tokens にも含まれます。effort を上げるほど多く考えます。独立系の評価機関 Artificial Analysis は、max 設定で Intelligence Index の1タスクあたり約16.2万の出力トークンを計測しました。大量の簡単なリクエストには、low かデフォルトの medium で十分なことがほとんどです。こうした点を踏まえても、Anthropic によれば平均的な実行コストは Haiku 4.5 より約 75% 低くなります。
effort はどう選べばよいですか?思考はオフにできますか?
Anthropic の推奨は次のとおりです。コーディングエージェントを含むほとんどの作業は、デフォルトの medium から始めます。チャット、短いツール作業、大量の簡単なリクエストには最速・最安の low を使います。ただし長いエージェント用プロンプトでは、low だと検索を省いたり早めに終えたりしやすくなります。ナレッジワーク、長めのエージェントタスク、指示に厳密に従う必要がある場面では high を使います。xhigh と max は評価で効果が確認できた場合に限り、Sonnet 5.5 と品質・コスト・速度を比べたうえで使います。思考は effort が high 以下なら thinking: disabled でオフにできますが、xhigh と max ではオフにできません。思考の内容はデフォルトでは返されず、thinking.display を summarized にすると要約を受け取れます。
Haiku 4.5 から移行するには何を変えればよいですか?
主な変更点は次のとおりです。モデル ID は claude-haiku-5-5(日付サフィックスなし)。思考予算(budget_tokens)の指定は 400 エラーになるため、適応型思考と effort を使います。temperature・top_p・top_k は外してください(top_k、またはデフォルト以外の temperature・top_p は 400 エラー)。アシスタントメッセージのプレフィルは使えなくなったため、構造化出力を使うか、システムプロンプトで形式を指定します。応答が思考ブロックから始まることがあるので、テキストは位置ではなく type で取り出します。同じテキストでもトークン数が増えるため、max_tokens とコスト見積もりを見直します。コンピューター操作は computer_toolset_20260801 ツールセットに移行します。また、安全性分類器がリクエストを断ることがあるため、stop_reason の refusal を処理してください。
ここで Claude Haiku 5.5 を呼び出せるのはいつですか?
現在、接続とテストを進めています。安定して呼び出せるようになった時点で、このページを公開済みに切り替え、料金を表示します。メールアドレスを登録いただければ、公開当日にお知らせします。
公開後はどう呼び出せますか?Claude Code でも使えますか?
2種類の API が使えます。OpenAI 互換 API(/v1/chat/completions)と、ネイティブの Anthropic Messages API(/anthropic)で、モデル名には claude-haiku-5-5 を指定します。Claude Code はバックグラウンドの細かいタスクの多くを Haiku モデルに任せています。Haiku 5.5 の公開後は、Claude Code の Haiku モデルを claude-haiku-5-5 に設定してください。設定方法はドキュメントの Claude Code ページで説明しています。
今すぐ使える Claude モデルはありますか?
あります。Claude Sonnet 5.5、Claude Opus 5.5、Claude Sonnet 5 はすでに公開済みで、すぐに呼び出せます。それまでの間に安くて速い小型モデルを使いたい場合は、Gemini 3.8 Flash、DeepSeek V4.1 Flash、GPT-6 Luna も利用できます。

今すぐ使えるモデル

次のモデルは NezhaGate ですぐに呼び出せます:

すべて見る →