模型使用指南
Claude Sonnet 5.5:Hermes Agent 与 OpenClaw 使用指南
Anthropic 发布 Claude 5.5 系列第二款模型,价格与 Sonnet 5 相同($2/$10),编程和知识工作基准接近 Opus 5.5。本文说明托管实例怎么切换、Hermes 与 OpenClaw 各自该选哪一行提供商、一个现在会报错的思考设置,以及两种框架的自托管配置。
在托管实例上使用 Sonnet 5.5
Anthropic 于 2026 年 9 月 28 日发布 Claude Sonnet 5.5,这是继 Opus 5.5 之后 Claude 5.5 系列的第二款模型。Hermes Agent 与 OpenClaw 的现有实例都可以在实例卡片上直接切换,无需新建实例。两种框架的操作步骤相同,但该选哪一行提供商并不相同,而且这决定了由哪个账户付费。
- 打开控制台,找到正在运行的实例。
- 点击实例卡片「文本」或「模型」一行中的当前模型。
- 按框架选择提供商那一行:Hermes 且已保存自己的 Anthropic Key,就选 Anthropic;否则选 OpenRouter。原因见下一节。
- 搜索 sonnet 5.5。在 OpenRouter 那一行显示为
anthropic/claude-sonnet-5.5,在 Anthropic 那一行显示为 Claude Sonnet 5.5。精选的 Anthropic 列表目前最新只到 Sonnet 5,所以请直接用搜索框,不要只看高亮的几个模型。 - 等待切换完成、实例恢复就绪,确认卡片已显示新模型。如果旧对话仍停留在原模型,请开启新会话。
完整模型目录面向符合条件的付费实例,试用账户使用受限列表。账户额度用尽时,可以补充额度,或在 API 密钥页面 配置自己的 OpenRouter Key,此后费用由对应的 OpenRouter 账户承担。
该选哪一行提供商
- Hermes,且已保存自己的 Anthropic Key:选 Anthropic 那一行。Hermes 会把
anthropic/开头的选择直接发往api.anthropic.com,模型 ID 为claude-sonnet-5-5,由你自己的 Key 付费。Hermes 会把没见过的新 Claude 模型默认按 adaptive thinking 处理,所以无需等待更新,发出的请求格式已经符合 Sonnet 5.5 的要求。唯一要避开的设置见下文「关闭思考的方式变了」。 - Hermes,但没有保存 Anthropic Key:同样的选择会回落到 OpenRouter,消耗 OpenRouter 额度。这样也能用,但建议明确选择 OpenRouter 那一行,免得账单出乎意料。
- OpenClaw:请使用 OpenRouter 那一行。OpenClaw 容器按自身版本内置的模型目录解析模型。最新的 OpenClaw 2026.9.6 已经收录
claude-opus-5-5,但还没有claude-sonnet-5-5,因为 Sonnet 5.5 是在它之后才发布的。走 OpenRouter 则不受这个目录限制。
选 Sonnet 5.5 还是 Opus 5.5?
Anthropic 对 Sonnet 5.5 的定位,是 Opus 5.5 更快、更便宜的搭档:最擅长范围明确的日常任务、修 bug,以及做文档、幻灯片和表格。Opus 5.5 则面向需要审慎判断的复杂工作。
如果你的智能体主要是回消息、调用工具、处理日常事务,Sonnet 5.5 以 Opus 一半的 token 单价,是更合理的默认选择。耗时长、开放式、一旦判断失误代价很高的任务,仍然交给 Opus 5.5。这一点 Anthropic 自己也说得很清楚:无论内部测试还是外部测试者的结果,「在需要持续判断的复杂开放式工作上,Opus 5.5 仍然明显更强」,哪怕基准分数很接近。
基准测试
以下数据来自 Anthropic 的官方发布说明:
| 基准测试 | Sonnet 5.5 | Sonnet 5 | Opus 5.5 |
|---|---|---|---|
| Terminal-Bench 4.0(智能体编程) | 70.6% | 10.3% | 66.4% |
| FrontierCode 1.1(主榜) | xhigh 档 52.1%,max 档 46.2% | 42.4% | 54.4% |
| CursorBench 4.0 | 55.5% | 34.1% | 57.8% |
| GDPval-AA v2.1(知识工作,Elo) | 1844 | 1449 | 1846 |
| AA-Briefcase v1.1 | 1811 | 1359 | 1822 |
| Humanity's Last Exam(可用工具) | 64.5% | 54.9% | 67.7% |
| OSWorld 2.1(计算机操作,partial) | 80.1% | 57.0% | 81.8% |
| Chartography(图表识别,无工具) | 61.6% | 15.6% | 64.4% |
在把这张表理解成「Sonnet 追平了 Opus」之前,有三个细节值得知道:
- Sonnet 5.5 只在 Terminal-Bench 4.0 上超过 Opus 5.5。 其余各项都是 Opus 5.5 领先,不过在 GDPval-AA、AA-Briefcase、OSWorld 和 CursorBench 上差距很小。Opus 的 66.4% 是它在 xhigh 档的成绩,也是它在这项测试上的最好成绩。
- 思考档位不是越高越好。 在 FrontierCode 上,Sonnet 5.5 的 max 档分数反而低于 xhigh 档。Anthropic 在脚注里解释:max 档下它更常调用 Claude Code 的代码审查技能,把审查拆给大量子 Agent 执行,部分运行因此超时,或者改动超出了任务范围,而这两种情况都会被这项测试扣分。
- 「十分之一成本」有明确的前提。 Anthropic 的说法是:在多项基准上,Sonnet 5.5 用 low 或 medium 档,就能超过 Sonnet 5 的最好成绩,而单个任务成本只有大约十分之一。这是拿低档位去比 Sonnet 5 的最高档,不代表所有任务都能省下九成。
Anthropic 还提到,Sonnet 5.5 比 Sonnet 5 更常把多个工具调用合并成一批,完成同一任务的步骤更少。对需要长串工具调用的智能体来说,这一点很实用。它也是第一款只看截图就通关《宝可梦 红》的 Sonnet 模型,说明它在长时程任务和图像理解上都有进步。
价格
| 每百万 token | Sonnet 5.5 | Sonnet 5 | Opus 5.5 |
|---|---|---|---|
| 输入 | $2 | $2 | $4 |
| 输出 | $10 | $10 | $20 |
| 缓存读取 | $0.20 | $0.20 | $0.20 |
| 缓存写入 | $2.50 | $2.50 | $5 |
单价与 Sonnet 5 完全相同,省钱靠的是完成同样的工作用的 token 更少:Anthropic 测得单个任务成本最多低 30%,Slack 在自己的评测中看到输出 token 少了约 14%。输出速度也快了 30% 以上。
OpenRouter 上 anthropic/claude-sonnet-5.5 的价格同为 $2 与 $10,上下文窗口 100 万 token,最多输出 12.8 万 token(2026 年 9 月 29 日 UTC 核实)。另有价格减半的 :batch 条目,但它用于异步批处理,不适合实时聊天。以上是 token 单价,不是托管订阅费用;长任务前请先查看模型页面。
真正影响账单的是思考档位。Sonnet 5.5 有 low、medium、high、xhigh、max 五档,Claude 官方应用默认 medium,API 默认 high。档位越高,思考越久,输出 token 也越多,请按实际打算使用的档位,在自己的任务上做对比。
关闭思考的方式变了
这是最容易让现有配置出错的变化。在 Sonnet 5 上,可以用 thinking: {"type": "disabled"} 关闭思考;Sonnet 5.5 会直接返回 400 错误。现在最低的设置是 thinking: {"type": "between_tools"},而且只能搭配 low、medium、high 三档。根据 Anthropic 的迁移指南,以下写法在 Sonnet 5.5 上同样会返回 400:思考预算(budget_tokens)、非默认的 temperature/top_p/top_k、assistant prefill,以及强制 tool choice。
对我们的用户来说,这意味着:
- Hermes 走 Anthropic 直连时:Hermes 会把
reasoning_effort: "none"转成上面那个disabled请求,结果每一轮对话都会失败。目前的上游代码和 Hermes 2026.9.24 都是这样。OpenClaw Launch 托管的实例不会设置reasoning_effort,使用的是默认值,只要你没有自己改过就不受影响。想让思考尽量少,请改用low。辅助任务(视觉、上下文压缩等)如果在claude-sonnet-5-5上设置了reasoning_effort: "none",也是同样的问题。 - 安全类任务:Sonnet 5.5 是第一款上线就带有网络安全防护的 Sonnet 模型,这套防护此前只用在 Anthropic 最强的模型上。日常找 bug、修 bug 不受影响。Anthropic 的发布说明称高风险的网络安全请求会明确回退到 Sonnet 5,但通过 API 调用时默认行为不同,这类请求会被直接拒绝:返回的是正常响应,
stop_reason为"refusal",只有请求里主动开启 beta 的fallbacks设置,才会自动换用其他模型重试。Hermes 没有开启这个设置,所以如果安全类任务被拒绝,请把这个任务换到其他模型上执行。 - 在不同账户之间迁移对话:Sonnet 5.5 的思考块只能在生成它的账户中使用。在较新的账户上,修改了早先的历史再回放思考块会返回 400,所以请保持对话历史只追加、不修改。
自托管 Hermes Agent 配置
在自己的 Hermes 环境中运行 hermes model 选择提供商和模型,或直接编辑 ~/.hermes/config.yaml 的 model 段。使用自己的 Anthropic Key 时:
model:
provider: anthropic
default: claude-sonnet-5-5
提供商单独写在 provider 字段里,因此模型值保持原样,不需要 anthropic/ 前缀。这条路径需要在环境变量或 Hermes 凭据中提供 ANTHROPIC_API_KEY。如果改走 OpenRouter,default 要写成 OpenRouter 带点号的 slug:
model:
provider: openrouter
default: anthropic/claude-sonnet-5.5
思考档位单独配置,位置在 agent 下,而不是 model 下:
agent:
reasoning_effort: "medium"
日常智能体任务用 low、medium 或 high 即可。走 Anthropic 直连时不要用 none,原因见上文。修改默认模型后对新会话生效;如需重启网关,命令是 hermes gateway restart。字段以上游配置示例为准。
自托管 OpenClaw 配置
截至 2026.9.6,还没有任何 OpenClaw 版本在 Anthropic 目录中收录 claude-sonnet-5-5,所以请通过 OpenRouter 使用。先在配置向导中添加 OpenRouter Key,再设置模型:
openclaw onboard --auth-choice openrouter-api-key
openclaw models set openrouter/anthropic/claude-sonnet-5.5
~/.openclaw/openclaw.json 中对应的字段如下,请合并进现有配置,不要覆盖整个文件:
{
"agents": {
"defaults": {
"model": { "primary": "openrouter/anthropic/claude-sonnet-5.5" }
}
}
}
等 OpenClaw 新版本把该模型加入 Anthropic 目录后,直连写法就是 anthropic/claude-sonnet-5-5,配合 --auth-choice anthropic-api-key。注意拼写差异:Anthropic 官方 ID 用连字符(claude-sonnet-5-5),OpenRouter 的 slug 用点号(claude-sonnet-5.5)。使用 OpenClaw Launch 托管的用户无需编辑这些文件,按前面的实例卡片步骤操作即可。
官方来源与延伸阅读
- Anthropic:Claude Sonnet 5.5 发布说明
- Anthropic:迁移到 Claude Sonnet 5.5
- OpenRouter:anthropic/claude-sonnet-5.5
- Claude Opus 5.5 中文指南与 Claude Opus 5 中文指南
- Hermes Agent + Anthropic与 OpenClaw + Anthropic
- Hermes 托管与 OpenClaw 托管
常见问题
Hermes Agent 能用 Claude Sonnet 5.5 吗?
可以。保存自己的 Anthropic Key 后,在 Anthropic 那一行选择 Sonnet 5.5,会直接发往 api.anthropic.com,模型 ID 为 claude-sonnet-5-5;没有 Anthropic Key 时,则通过 OpenRouter 以 anthropic/claude-sonnet-5.5 路由。自托管 Hermes 使用 provider: anthropic 搭配 default: claude-sonnet-5-5。走直连时不要把 reasoning_effort 设为 none,Sonnet 5.5 会拒绝由此产生的关闭思考请求。
OpenClaw 能用 Claude Sonnet 5.5 吗?
可以,通过 OpenRouter 使用。在实例卡片选择 OpenRouter 那一行并搜索 sonnet 5.5;自托管则设置 openrouter/anthropic/claude-sonnet-5.5。截至 2026.9.6,OpenClaw 各版本内置的 Anthropic 目录都还没有 claude-sonnet-5-5,所以 Anthropic 直连暂时无法解析。
为什么控制台精选的 Anthropic 模型里没有 Sonnet 5.5?
精选列表是人工维护的,目前最新只到 Claude Sonnet 5。现在就可以使用 Sonnet 5.5:在 OpenRouter 那一行搜索完整目录中的 sonnet 5.5;如果你用的是 Hermes 且保存了自己的 Anthropic Key,也可以在 Anthropic 那一行搜索。
Sonnet 5.5 比 Sonnet 5 便宜吗?
按单价不便宜:两者都是每百万 token 输入 $2、输出 $10、缓存读取 $0.20。Sonnet 5.5 便宜在单个任务上,因为完成同样的工作用的 token 更少,Anthropic 测得单任务成本最多低 30%。思考档位越高,思考 token 越多,请按实际使用的档位对比。
智能体该用 Sonnet 5.5 还是 Opus 5.5?
日常智能体工作用 Sonnet 5.5:回消息、调用工具、修 bug、写文档。它的 token 单价只有 Opus 5.5 的一半,多数基准也很接近。耗时长、开放式、需要持续判断的任务用 Opus 5.5,Anthropic 表示在这类工作上 Opus 5.5 仍明显更强。
已有的 Sonnet 5 实例会自动升级吗?
不会。Sonnet 5.5 是独立的模型 ID,需要在实例卡片手动选择并等待切换完成;如果旧对话仍使用原模型,请开启新会话。