NezhaGateNezhaGate
Anthropic ● 即将上线 · Coming Soon

Claude Haiku 5.5

claude-haiku-5-5

Claude Haiku 5.5 API:Anthropic 迄今最快、最便宜、能力最强的小模型,100 万 token 上下文,首款支持 effort 的 Haiku,官方单价最多比 Haiku 4.5 低 90%

Claude Haiku 5.5 是 Anthropic 于 2026 年 10 月 7 日发布的新一代 Haiku 小模型,接替 Claude Haiku 4.5。官方称它是“迄今最便宜、最快、能力最强的小模型”,也是目前 Claude 全系列中延迟最低的型号,专为高并发、对速度和成本敏感的工作设计:分类、路由、信息抽取、摘要与上下文压缩、实时客服,以及在 Claude Opus 5.5 / Sonnet 5.5 主导的编程 Agent 里当子代理。它有 100 万 token 上下文、单次最多 12.8 万 token 输出,默认开启自适应思考,也是第一款可以调 effort 的 Haiku(low 到 max 五档,默认 medium)。提示词不超过 10 万 token 时,官方价每百万 token 输入 $0.10、输出 $0.50,比 Haiku 4.5 低 90%。我们正在接入,留下邮箱,上线当天通知你。

官方发布:2026-10-07 · NezhaGate 尚未开放调用

能力亮点

较上一代 Haiku 4.5 的改进

上下文扩大到 5 倍、输出上限翻倍、首次支持 effort,Agent 类基准大幅提升,价格反而更低。

Claude Haiku 4.5Claude Haiku 5.5
发布时间2025-10-152026-10-07
上下文窗口20 万 token100 万 token
单次最大输出6.4 万 token12.8 万 token
思考手动设思考预算(budget_tokens)自适应思考,默认开启
effort 调节不支持low / medium / high / xhigh / max,默认 medium
可靠知识截止2025 年 2 月2026 年 6 月
浏览器操作工具不支持支持
官方价 · 输入(每百万 token)$1$0.10(提示词 ≤10 万 token)/ $0.50(超过 10 万)
官方价 · 输出(每百万 token)$5$0.50 / $2.50
官方价 · 缓存读取(每百万 token)$0.10$0.01 / $0.05
OSWorld 2.1 离线子集(电脑操作)15.7%72.4%
Terminal-Bench 4.0(命令行 Agent 任务)0.0%39.2%
Humanity’s Last Exam(不用工具 / 用工具)10.2% / 18.7%45.9% / 57.4%
GDPval-AA v2.1(真实工作任务,Elo)7351620
AA-Briefcase v1.1(Agent 知识工作,Elo)6141578

规格与价格来自 Anthropic 官方文档,跑分来自 Anthropic 2026 年 10 月 7 日的发布公告。表中价格是 Anthropic 官方标价,不是本站售价。Haiku 5.5 换用了新分词器,同样的文本约多算 30% token;Anthropic 称它的平均运行成本仍比 Haiku 4.5 低约 75%。

适用场景

大批量分类、打标签、意图识别与请求路由
信息抽取:从合同、网页、聊天记录中提取字段,输出结构化 JSON
长文档、长对话的摘要与上下文压缩
编程 Agent 的子代理:搜代码、读文件、跑命令、整理结果,给主模型打下手
实时客服、对话机器人与数据库查询类问答
浏览器与电脑操作类 Agent:网页填表、点选、跨页面收集信息

常见问题

Claude Haiku 5.5 和 Haiku 4.5 相比有哪些改进?
主要有五方面:① 上下文从 20 万扩大到 100 万 token,单次输出上限从 6.4 万提高到 12.8 万 token;② 思考从手动设预算(budget_tokens)改为自适应思考,并首次支持 effort 调节;③ Agent 类能力大幅提升,OSWorld 2.1 从 15.7% 到 72.4%,Terminal-Bench 4.0 从 0.0% 到 39.2%,Humanity’s Last Exam(不用工具)从 10.2% 到 45.9%;④ 可靠知识截止从 2025 年 2 月更新到 2026 年 6 月,并新增浏览器操作工具;⑤ 价格更低:提示词不超过 10 万 token 时单价低 90%,超过时低 50%。Anthropic 还表示,它在几乎所有对齐评估上都明显好于 Haiku 4.5。
Claude Haiku 5.5 的官方价格是多少?
Anthropic 按提示词长度分两档计价(每百万 token)。提示词不超过 10 万 token:输入 $0.10、输出 $0.50、5 分钟缓存写入 $0.125、1 小时缓存写入 $0.20、缓存读取 $0.01。超过 10 万 token:各项都是 5 倍,即输入 $0.50、输出 $2.50、缓存读取 $0.05。批处理接口再省 50%。作为对比,Haiku 4.5 是输入 $1、输出 $5。以上是 Anthropic 官方标价,本站售价会在上线时公布。
Haiku 5.5 会更费 token 吗?
有两点要心里有数。第一,它换用了 Claude Opus 4.7 起使用的新分词器,同样的文本约多算 30% token。第二,思考默认开启,思考 token 按输出计费,也计入 max_tokens;effort 越高想得越多,第三方评测机构 Artificial Analysis 测得它在 max 档跑 Intelligence Index 时,每个任务约输出 16.2 万 token。大批量的简单请求,用 low 或默认的 medium 通常就够了。综合下来,Anthropic 称它的平均运行成本仍比 Haiku 4.5 低约 75%。
effort 怎么选?可以关掉思考吗?
Anthropic 的建议是:多数工作(包括编程 Agent)从默认的 medium 开始;聊天、简短的工具任务和大批量简单请求用 low,最快也最省,但在很长的 Agent 提示词里,low 档更容易跳过搜索或提前结束;知识类工作、较长的 Agent 任务和要求严格遵循指令的场景用 high;xhigh 和 max 只在评测确实有提升时再用,并和 Sonnet 5.5 比较效果、成本和速度。思考可以在 high 及以下档位用 thinking: disabled 关闭,xhigh 和 max 档不能关。默认不返回思考内容,需要的话把 thinking.display 设为 summarized 获取摘要。
从 Haiku 4.5 迁移要改什么?
主要几处:模型名改为 claude-haiku-5-5(没有日期后缀);thinking 的 budget_tokens 写法会返回 400,改用自适应思考加 effort;去掉 temperature、top_p 和 top_k(top_k 和非默认的 temperature、top_p 都会返回 400);不能再用助手消息预填(prefill),改用结构化输出或在系统提示里写明格式;回复可能以思考块开头,按 type 取文本,不要按位置取;同样的文本 token 数更多,重新估算 max_tokens 和成本;电脑操作要换成 computer_toolset_20260801 工具集;安全分类器可能拒绝请求(stop_reason 为 refusal),代码里要处理。
什么时候能在这里调用 Claude Haiku 5.5?
我们正在接入和实测。能稳定调用的那一刻,本页会切换为已上线并公布价格。留下邮箱,上线当天会发邮件通知你。
上线后怎么调用?Claude Code 能用吗?
两种接口都可以:OpenAI 兼容接口(/v1/chat/completions)和原生 Anthropic Messages 接口(/anthropic),模型名填 claude-haiku-5-5。Claude Code 的不少后台小任务默认交给 Haiku 模型处理,上线后把 Claude Code 的 Haiku 模型设为 claude-haiku-5-5 即可,设置方法见文档中心的 Claude Code 接入页。
现在有能用的 Claude 模型吗?
有。Claude Sonnet 5.5、Claude Opus 5.5 和 Claude Sonnet 5 已经上线,可以直接调用。想先用便宜、响应快的小模型,也可以选 Gemini 3.8 Flash、DeepSeek V4.1 Flash 或 GPT-6 Luna。

现在就能用

这些模型已经可以在 NezhaGate 直接调用:

查看全部 →