NezhaGateNezhaGate
对话

Claude Sonnet 5

⧉
claude-sonnet-5

Claude Sonnet 5 是 Anthropic 新一代 Sonnet 模型:保持 Sonnet 档的速度与价格,代码与 Agent 能力接近 Opus。默认开启自适应思考,可用 low 到 max 五档思考强度在深度与速度之间取舍,支持图片理解、工具调用与提示缓存。完全兼容 OpenAI 接口,把 model 改成 claude-sonnet-5 即可;也可走原生 Anthropic Messages 接口,Claude Code 直连。

文本对话代码Agent图片理解提示缓存

在线测试

直接试一下 Claude Sonnet 5 的效果(登录后可用)。

Input

高级设置
联网搜索
记忆 · 多轮上下文
思考过程

对话

开始对话在下方输入消息开始

关于 Claude Sonnet 5

Claude Sonnet 5 是 Anthropic Sonnet 系列的最新型号,也是 Claude 5 这一代的 Sonnet。它保持 Sonnet 档的速度与价格,把代码与 Agent 任务的水准拉到接近 Opus。默认开启自适应思考:模型自行判断一道题该想多久,简单请求直接答,难题先推演再作答;还可以用 low / medium / high / xhigh / max 五档思考强度在深度与速度之间取舍。它支持图片理解、工具调用(tool_use)与提示缓存。在 NezhaGate 上有两种接法:一是 OpenAI 兼容接口,把 base_url 指向 NezhaGate、model 设为 claude-sonnet-5,现有 OpenAI SDK 零改造;二是原生 Anthropic Messages 接口,把 Claude Code 等工具的 ANTHROPIC_BASE_URL 指到 NezhaGate 的 /anthropic 即可直连,thinking、tool_use、提示缓存等原生特性完整保留。计费按用量结算,失败的请求不计费。

应用场景

日常编码与 Agent

写代码、重构、排查 bug,配合工具调用跑多步 Agent 循环;适合每天调用量大的编程助手与机器人。

规模化生产流量

客服回复、信息抽取、摘要与分类等大批量任务:想要接近 Opus 的质量,又不想付 Opus 的价钱。

长文档与代码库

合同、论文、技术手册与代码仓库的摘要、抽取与问答;配合提示缓存,对同一份材料反复提问的成本大幅下降。

按需调节推理深度

日常对话用 low 求快,疑难 bug 与方案规划调到 high 或 xhigh;各档 token 单价相同。

图文混合任务

读截图、图表、设计稿并结合文字给出分析或代码,支持 base64 与远程图片两种传法。

如何选择

大多数场景可以把 Claude Sonnet 5 当作默认的 Claude:比 Claude Opus 5 更快、更省,代码与 Agent 任务上又接近它。遇到最难的推理与大型代码工程再换 Claude Opus 5;偏叙事与长文写作换 Claude Fable 5;已针对 Claude Sonnet 4.6 调好的老流程可以继续用 4.6。它们在同一接口下只需更换 model 字段即可切换。

常见问题

Claude Sonnet 5 是什么?
Claude Sonnet 5 是 Anthropic 最新的 Sonnet 模型,属于 Claude 5 这一代。它以 Sonnet 的速度与价格提供接近 Opus 的代码与 Agent 能力,默认自适应思考,支持图片理解、工具调用与提示缓存。在 NezhaGate 上可通过 OpenAI 兼容接口或原生 Anthropic Messages 接口调用。
和 Claude Sonnet 4.6 有什么区别?
它是新一代模型:代码与 Agent 更强;默认开启自适应思考(Sonnet 4.6 不指定就不思考);思考强度多了 xhigh 一档;图片理解支持更高分辨率。Anthropic 官方标价也更低:每百万 token 输入 $2、输出 $10,Sonnet 4.6 为 $3 / $15。对比账单时注意:Sonnet 5 换了新的分词器,同样的文本大约多算 30% 的 token,建议按完成一件任务的总花费来比较,而不是只看单价。
为什么传 temperature 会被忽略?
Anthropic 在这一代模型上不再接受 temperature / top_p / top_k。为了让现有 OpenAI SDK 代码零改造可用,网关会自动去掉这三个参数再转发,请求正常执行、不会报错,采样按模型默认设置进行。想调节输出,请改用 reasoning_effort(low / medium / high / xhigh / max)控制思考强度——各档同价,思考越多输出 token 越多。
能关掉思考吗?
可以。用原生 Anthropic Messages 接口时传 thinking: {"type": "disabled"},模型会直接作答,最快也最省;OpenAI 兼容接口用 reasoning_effort: low 可以达到接近的效果。只要模型思考了,思考 token 就按输出计费。
能让 Claude Code 直连吗?
可以。把 ANTHROPIC_BASE_URL 指到 NezhaGate 的 /anthropic,用网关 Key 作 x-api-key,model 填 claude-sonnet-5 即可,thinking、tool_use、提示缓存与流式 SSE 全部原样保留。

相关模型

探索其它可接入的模型。

查看全部 →