← 中文指南

模型使用指南

Claude Sonnet 5.5:Hermes Agent 与 OpenClaw 使用指南

Anthropic 发布 Claude 5.5 系列第二款模型,价格与 Sonnet 5 相同($2/$10),编程和知识工作基准接近 Opus 5.5。本文说明托管实例怎么切换、Hermes 与 OpenClaw 各自该选哪一行提供商、一个现在会报错的思考设置,以及两种框架的自托管配置。

发布于 2026 年 9 月 29 日 · 价格与目录核实于 9 月 29 日(UTC)

在托管实例上使用 Sonnet 5.5

Anthropic 于 2026 年 9 月 28 日发布 Claude Sonnet 5.5,这是继 Opus 5.5 之后 Claude 5.5 系列的第二款模型。Hermes Agent 与 OpenClaw 的现有实例都可以在实例卡片上直接切换,无需新建实例。两种框架的操作步骤相同,但该选哪一行提供商并不相同,而且这决定了由哪个账户付费。

  1. 打开控制台,找到正在运行的实例。
  2. 点击实例卡片「文本」或「模型」一行中的当前模型。
  3. 按框架选择提供商那一行:Hermes 且已保存自己的 Anthropic Key,就选 Anthropic;否则选 OpenRouter。原因见下一节。
  4. 搜索 sonnet 5.5。在 OpenRouter 那一行显示为 anthropic/claude-sonnet-5.5,在 Anthropic 那一行显示为 Claude Sonnet 5.5。精选的 Anthropic 列表目前最新只到 Sonnet 5,所以请直接用搜索框,不要只看高亮的几个模型。
  5. 等待切换完成、实例恢复就绪,确认卡片已显示新模型。如果旧对话仍停留在原模型,请开启新会话。

完整模型目录面向符合条件的付费实例,试用账户使用受限列表。账户额度用尽时,可以补充额度,或在 API 密钥页面 配置自己的 OpenRouter Key,此后费用由对应的 OpenRouter 账户承担。

该选哪一行提供商

  • Hermes,且已保存自己的 Anthropic Key:选 Anthropic 那一行。Hermes 会把 anthropic/ 开头的选择直接发往 api.anthropic.com,模型 ID 为 claude-sonnet-5-5,由你自己的 Key 付费。Hermes 会把没见过的新 Claude 模型默认按 adaptive thinking 处理,所以无需等待更新,发出的请求格式已经符合 Sonnet 5.5 的要求。唯一要避开的设置见下文「关闭思考的方式变了」。
  • Hermes,但没有保存 Anthropic Key:同样的选择会回落到 OpenRouter,消耗 OpenRouter 额度。这样也能用,但建议明确选择 OpenRouter 那一行,免得账单出乎意料。
  • OpenClaw:请使用 OpenRouter 那一行。OpenClaw 容器按自身版本内置的模型目录解析模型。最新的 OpenClaw 2026.9.6 已经收录 claude-opus-5-5,但还没有 claude-sonnet-5-5,因为 Sonnet 5.5 是在它之后才发布的。走 OpenRouter 则不受这个目录限制。

选 Sonnet 5.5 还是 Opus 5.5?

Anthropic 对 Sonnet 5.5 的定位,是 Opus 5.5 更快、更便宜的搭档:最擅长范围明确的日常任务、修 bug,以及做文档、幻灯片和表格。Opus 5.5 则面向需要审慎判断的复杂工作。

如果你的智能体主要是回消息、调用工具、处理日常事务,Sonnet 5.5 以 Opus 一半的 token 单价,是更合理的默认选择。耗时长、开放式、一旦判断失误代价很高的任务,仍然交给 Opus 5.5。这一点 Anthropic 自己也说得很清楚:无论内部测试还是外部测试者的结果,「在需要持续判断的复杂开放式工作上,Opus 5.5 仍然明显更强」,哪怕基准分数很接近。

基准测试

以下数据来自 Anthropic 的官方发布说明:

基准测试Sonnet 5.5Sonnet 5Opus 5.5
Terminal-Bench 4.0(智能体编程)70.6%10.3%66.4%
FrontierCode 1.1(主榜)xhigh 档 52.1%,max 档 46.2%42.4%54.4%
CursorBench 4.055.5%34.1%57.8%
GDPval-AA v2.1(知识工作,Elo)184414491846
AA-Briefcase v1.1181113591822
Humanity's Last Exam(可用工具)64.5%54.9%67.7%
OSWorld 2.1(计算机操作,partial)80.1%57.0%81.8%
Chartography(图表识别,无工具)61.6%15.6%64.4%

在把这张表理解成「Sonnet 追平了 Opus」之前,有三个细节值得知道:

  • Sonnet 5.5 只在 Terminal-Bench 4.0 上超过 Opus 5.5。 其余各项都是 Opus 5.5 领先,不过在 GDPval-AA、AA-Briefcase、OSWorld 和 CursorBench 上差距很小。Opus 的 66.4% 是它在 xhigh 档的成绩,也是它在这项测试上的最好成绩。
  • 思考档位不是越高越好。 在 FrontierCode 上,Sonnet 5.5 的 max 档分数反而低于 xhigh 档。Anthropic 在脚注里解释:max 档下它更常调用 Claude Code 的代码审查技能,把审查拆给大量子 Agent 执行,部分运行因此超时,或者改动超出了任务范围,而这两种情况都会被这项测试扣分。
  • 「十分之一成本」有明确的前提。 Anthropic 的说法是:在多项基准上,Sonnet 5.5 用 low 或 medium 档,就能超过 Sonnet 5 的最好成绩,而单个任务成本只有大约十分之一。这是拿低档位去比 Sonnet 5 的最高档,不代表所有任务都能省下九成。

Anthropic 还提到,Sonnet 5.5 比 Sonnet 5 更常把多个工具调用合并成一批,完成同一任务的步骤更少。对需要长串工具调用的智能体来说,这一点很实用。它也是第一款只看截图就通关《宝可梦 红》的 Sonnet 模型,说明它在长时程任务和图像理解上都有进步。

价格

每百万 tokenSonnet 5.5Sonnet 5Opus 5.5
输入$2$2$4
输出$10$10$20
缓存读取$0.20$0.20$0.20
缓存写入$2.50$2.50$5

单价与 Sonnet 5 完全相同,省钱靠的是完成同样的工作用的 token 更少:Anthropic 测得单个任务成本最多低 30%,Slack 在自己的评测中看到输出 token 少了约 14%。输出速度也快了 30% 以上。

OpenRouter 上 anthropic/claude-sonnet-5.5 的价格同为 $2 与 $10,上下文窗口 100 万 token,最多输出 12.8 万 token(2026 年 9 月 29 日 UTC 核实)。另有价格减半的 :batch 条目,但它用于异步批处理,不适合实时聊天。以上是 token 单价,不是托管订阅费用;长任务前请先查看模型页面。

真正影响账单的是思考档位。Sonnet 5.5 有 low、medium、high、xhigh、max 五档,Claude 官方应用默认 medium,API 默认 high。档位越高,思考越久,输出 token 也越多,请按实际打算使用的档位,在自己的任务上做对比。

关闭思考的方式变了

这是最容易让现有配置出错的变化。在 Sonnet 5 上,可以用 thinking: {"type": "disabled"} 关闭思考;Sonnet 5.5 会直接返回 400 错误。现在最低的设置是 thinking: {"type": "between_tools"},而且只能搭配 low、medium、high 三档。根据 Anthropic 的迁移指南,以下写法在 Sonnet 5.5 上同样会返回 400:思考预算(budget_tokens)、非默认的 temperature/top_p/top_k、assistant prefill,以及强制 tool choice。

对我们的用户来说,这意味着:

  • Hermes 走 Anthropic 直连时:Hermes 会把 reasoning_effort: "none" 转成上面那个 disabled 请求,结果每一轮对话都会失败。目前的上游代码和 Hermes 2026.9.24 都是这样。OpenClaw Launch 托管的实例不会设置 reasoning_effort,使用的是默认值,只要你没有自己改过就不受影响。想让思考尽量少,请改用 low。辅助任务(视觉、上下文压缩等)如果在 claude-sonnet-5-5 上设置了 reasoning_effort: "none",也是同样的问题。
  • 安全类任务:Sonnet 5.5 是第一款上线就带有网络安全防护的 Sonnet 模型,这套防护此前只用在 Anthropic 最强的模型上。日常找 bug、修 bug 不受影响。Anthropic 的发布说明称高风险的网络安全请求会明确回退到 Sonnet 5,但通过 API 调用时默认行为不同,这类请求会被直接拒绝:返回的是正常响应,stop_reason 为 "refusal",只有请求里主动开启 beta 的 fallbacks 设置,才会自动换用其他模型重试。Hermes 没有开启这个设置,所以如果安全类任务被拒绝,请把这个任务换到其他模型上执行。
  • 在不同账户之间迁移对话:Sonnet 5.5 的思考块只能在生成它的账户中使用。在较新的账户上,修改了早先的历史再回放思考块会返回 400,所以请保持对话历史只追加、不修改。

自托管 Hermes Agent 配置

在自己的 Hermes 环境中运行 hermes model 选择提供商和模型,或直接编辑 ~/.hermes/config.yaml 的 model 段。使用自己的 Anthropic Key 时:

model:
  provider: anthropic
  default: claude-sonnet-5-5

提供商单独写在 provider 字段里,因此模型值保持原样,不需要 anthropic/ 前缀。这条路径需要在环境变量或 Hermes 凭据中提供 ANTHROPIC_API_KEY。如果改走 OpenRouter,default 要写成 OpenRouter 带点号的 slug:

model:
  provider: openrouter
  default: anthropic/claude-sonnet-5.5

思考档位单独配置,位置在 agent 下,而不是 model 下:

agent:
  reasoning_effort: "medium"

日常智能体任务用 low、medium 或 high 即可。走 Anthropic 直连时不要用 none,原因见上文。修改默认模型后对新会话生效;如需重启网关,命令是 hermes gateway restart。字段以上游配置示例为准。

自托管 OpenClaw 配置

截至 2026.9.6,还没有任何 OpenClaw 版本在 Anthropic 目录中收录 claude-sonnet-5-5,所以请通过 OpenRouter 使用。先在配置向导中添加 OpenRouter Key,再设置模型:

openclaw onboard --auth-choice openrouter-api-key
openclaw models set openrouter/anthropic/claude-sonnet-5.5

~/.openclaw/openclaw.json 中对应的字段如下,请合并进现有配置,不要覆盖整个文件:

{
  "agents": {
    "defaults": {
      "model": { "primary": "openrouter/anthropic/claude-sonnet-5.5" }
    }
  }
}

等 OpenClaw 新版本把该模型加入 Anthropic 目录后,直连写法就是 anthropic/claude-sonnet-5-5,配合 --auth-choice anthropic-api-key。注意拼写差异:Anthropic 官方 ID 用连字符(claude-sonnet-5-5),OpenRouter 的 slug 用点号(claude-sonnet-5.5)。使用 OpenClaw Launch 托管的用户无需编辑这些文件,按前面的实例卡片步骤操作即可。

官方来源与延伸阅读

常见问题

Hermes Agent 能用 Claude Sonnet 5.5 吗?

可以。保存自己的 Anthropic Key 后,在 Anthropic 那一行选择 Sonnet 5.5,会直接发往 api.anthropic.com,模型 ID 为 claude-sonnet-5-5;没有 Anthropic Key 时,则通过 OpenRouter 以 anthropic/claude-sonnet-5.5 路由。自托管 Hermes 使用 provider: anthropic 搭配 default: claude-sonnet-5-5。走直连时不要把 reasoning_effort 设为 none,Sonnet 5.5 会拒绝由此产生的关闭思考请求。

OpenClaw 能用 Claude Sonnet 5.5 吗?

可以,通过 OpenRouter 使用。在实例卡片选择 OpenRouter 那一行并搜索 sonnet 5.5;自托管则设置 openrouter/anthropic/claude-sonnet-5.5。截至 2026.9.6,OpenClaw 各版本内置的 Anthropic 目录都还没有 claude-sonnet-5-5,所以 Anthropic 直连暂时无法解析。

为什么控制台精选的 Anthropic 模型里没有 Sonnet 5.5?

精选列表是人工维护的,目前最新只到 Claude Sonnet 5。现在就可以使用 Sonnet 5.5:在 OpenRouter 那一行搜索完整目录中的 sonnet 5.5;如果你用的是 Hermes 且保存了自己的 Anthropic Key,也可以在 Anthropic 那一行搜索。

Sonnet 5.5 比 Sonnet 5 便宜吗?

按单价不便宜:两者都是每百万 token 输入 $2、输出 $10、缓存读取 $0.20。Sonnet 5.5 便宜在单个任务上,因为完成同样的工作用的 token 更少,Anthropic 测得单任务成本最多低 30%。思考档位越高,思考 token 越多,请按实际使用的档位对比。

智能体该用 Sonnet 5.5 还是 Opus 5.5?

日常智能体工作用 Sonnet 5.5:回消息、调用工具、修 bug、写文档。它的 token 单价只有 Opus 5.5 的一半,多数基准也很接近。耗时长、开放式、需要持续判断的任务用 Opus 5.5,Anthropic 表示在这类工作上 Opus 5.5 仍明显更强。

已有的 Sonnet 5 实例会自动升级吗?

不会。Sonnet 5.5 是独立的模型 ID,需要在实例卡片手动选择并等待切换完成;如果旧对话仍使用原模型,请开启新会话。