Claude Haiku 5.5
Claude Haiku 5.5 API:Anthropic 迄今最快、最便宜、能力最强的小模型,100 万 token 上下文,首款支持 effort 的 Haiku,官方单价最多比 Haiku 4.5 低 90%
Claude Haiku 5.5 是 Anthropic 于 2026 年 10 月 7 日发布的新一代 Haiku 小模型,接替 Claude Haiku 4.5。官方称它是“迄今最便宜、最快、能力最强的小模型”,也是目前 Claude 全系列中延迟最低的型号,专为高并发、对速度和成本敏感的工作设计:分类、路由、信息抽取、摘要与上下文压缩、实时客服,以及在 Claude Opus 5.5 / Sonnet 5.5 主导的编程 Agent 里当子代理。它有 100 万 token 上下文、单次最多 12.8 万 token 输出,默认开启自适应思考,也是第一款可以调 effort 的 Haiku(low 到 max 五档,默认 medium)。提示词不超过 10 万 token 时,官方价每百万 token 输入 $0.10、输出 $0.50,比 Haiku 4.5 低 90%。我们正在接入,留下邮箱,上线当天通知你。
官方发布:2026-10-07 · NezhaGate 尚未开放调用
能力亮点
- Anthropic 迄今最便宜、最快、能力最强的小模型,目前 Claude 全系列中延迟最低
- 官方价大幅下调:提示词不超过 10 万 token 时,每百万 token 输入 $0.10、输出 $0.50、缓存读取 $0.01,比 Haiku 4.5 低 90%;超过 10 万 token 为 $0.50 / $2.50,仍低 50%;批处理接口再省 50%
- 100 万 token 上下文(Haiku 4.5 为 20 万),单次最多输出 12.8 万 token(原为 6.4 万);支持图片输入,可靠知识截止到 2026 年 6 月
- 第一款支持 effort 的 Haiku:low、medium、high、xhigh、max 五档,默认 medium;自适应思考默认开启,简单请求可以不思考直接回答
- Agent 能力大幅提升:电脑操作 OSWorld 2.1 从 15.7% 升到 72.4%,命令行任务 Terminal-Bench 4.0 从 0.0% 升到 39.2%,两项都高于 GPT-6 Luna(48.9%、16.4%)
- 工具支持齐全:工具调用(可强制指定工具)、结构化输出、提示缓存、批处理、电脑操作工具集,并新增浏览器操作工具
- 官方推荐的用法:在 Opus 5.5 或 Sonnet 5.5 主导的编程 Agent 里当子代理,分担检索、阅读、汇总等大量小任务,降低整体成本和延迟
- 早期客户反馈(Anthropic 发布页):Box 测得得分比 Haiku 4.5 高 11 分、延迟约减半;Asana 测得任务完成延迟降低 30% 以上
较上一代 Haiku 4.5 的改进
上下文扩大到 5 倍、输出上限翻倍、首次支持 effort,Agent 类基准大幅提升,价格反而更低。
| Claude Haiku 4.5 | Claude Haiku 5.5 | |
|---|---|---|
| 发布时间 | 2025-10-15 | 2026-10-07 |
| 上下文窗口 | 20 万 token | 100 万 token |
| 单次最大输出 | 6.4 万 token | 12.8 万 token |
| 思考 | 手动设思考预算(budget_tokens) | 自适应思考,默认开启 |
| effort 调节 | 不支持 | low / medium / high / xhigh / max,默认 medium |
| 可靠知识截止 | 2025 年 2 月 | 2026 年 6 月 |
| 浏览器操作工具 | 不支持 | 支持 |
| 官方价 · 输入(每百万 token) | $1 | $0.10(提示词 ≤10 万 token)/ $0.50(超过 10 万) |
| 官方价 · 输出(每百万 token) | $5 | $0.50 / $2.50 |
| 官方价 · 缓存读取(每百万 token) | $0.10 | $0.01 / $0.05 |
| OSWorld 2.1 离线子集(电脑操作) | 15.7% | 72.4% |
| Terminal-Bench 4.0(命令行 Agent 任务) | 0.0% | 39.2% |
| Humanity’s Last Exam(不用工具 / 用工具) | 10.2% / 18.7% | 45.9% / 57.4% |
| GDPval-AA v2.1(真实工作任务,Elo) | 735 | 1620 |
| AA-Briefcase v1.1(Agent 知识工作,Elo) | 614 | 1578 |
规格与价格来自 Anthropic 官方文档,跑分来自 Anthropic 2026 年 10 月 7 日的发布公告。表中价格是 Anthropic 官方标价,不是本站售价。Haiku 5.5 换用了新分词器,同样的文本约多算 30% token;Anthropic 称它的平均运行成本仍比 Haiku 4.5 低约 75%。
适用场景
常见问题
Claude Haiku 5.5 和 Haiku 4.5 相比有哪些改进?
Claude Haiku 5.5 的官方价格是多少?
Haiku 5.5 会更费 token 吗?
effort 怎么选?可以关掉思考吗?
从 Haiku 4.5 迁移要改什么?
什么时候能在这里调用 Claude Haiku 5.5?
上线后怎么调用?Claude Code 能用吗?
现在有能用的 Claude 模型吗?
现在就能用
这些模型已经可以在 NezhaGate 直接调用:
Claude Sonnet 5.5
Anthropic 新一代 Sonnet · 速度与智能的最佳组合
Claude Opus 5.5
Anthropic 新一代 Opus · 100 万上下文 · 自适应思考
Claude Sonnet 5
Anthropic 新一代 Sonnet · 代码能力接近 Opus
Gemini 3.8 Flash
最新一代 Flash · 自适应思考
DeepSeek V4.1 Flash
DeepSeek 当前主力 Flash 模型 · 思考可开关
GPT-6 Luna
GPT-6 家族最高效的大批量款