← 首页

模型指南

Agnes 3.0 Flash:免费的新一代智能体模型

Agnes 3.0 Flash 是 Agnes AI(Sapiens AI)最新的文本模型,面向真实场景下的智能体任务:执行稳定、工具调用可靠、长任务中能记住上下文。目前已正式在 Agnes API 上线,调用免费。OpenClaw 和 Hermes Agent 两个框架都支持,下面讲怎么用——另外有一个地方值得先说清楚。

Agnes 3.0 Flash 是什么?

Agnes 3.0 Flash(agnes-3.0-flash)是 Agnes 2.5 Flash 的下一代。官方定位是新一代文本模型,重点是执行稳定、工具调用可靠、长任务上下文保持和交付质量——换句话说,它更侧重需要多步骤执行和工具调用的任务。

它支持文本和图片 URL 输入,支持函数调用和多步工具编排,还有一个可选的思考模式。走的是和其他 Agnes 模型相同的 OpenAI 兼容网关(https://apihub.agnes-ai.com/v1),所以只要你已经存了 Agnes API key,不需要额外配置。

实测出来的限制,不是抄参数表

Agnes 还没公布 3.0 Flash 的上下文长度,我们没有猜,而是直接对线上接口做了一次实测(2026 年 9 月 7 日):

  • 上下文 524,288 tokens。520,354 tokens 的输入能通过;600,354 tokens 会被拒绝,接口也会明确指出原因:输入长度超过模型上下文长度(524288 tokens)。
  • 我们采用的输出上限是 65,536 tokens——设成 65,536 能通过,131,072 会报错,所以这是一个已知可用的取值,不是模型的确切上限。这是我们在 OpenClaw 配置里声明的值;自建 Hermes 我们没有给 Agnes 设输出上限,以你自己的配置为准。
  • 它是推理模型。思考模式是可选的、可按请求控制,我们测试的回复都生成了内部思考,这部分同样计入输出 tokens。

这个上下文和 Agnes 官方给 Agnes 2.5 Flash 标的 512K 属于同一档。

真的免费吗?

免费。今天调用 agnes-3.0-flash 不会产生任何 Agnes 余额扣费。这一点我们对着计费接口验证过,同时用一个付费 Agnes 模型做了对照:同样的请求,付费模型让计费数字动了,3.0 Flash 没有。

但有一个需要如实说明的地方,也是我们把它标为预览版的原因。Agnes 官方文档在 3.0 Flash 的价格一栏写的是「价格另行公布」——根本没有公开价格。对比 Agnes 2.5 Flash 和 2.0 Flash,它们标的是每百万输入 tokens 0.03 美元、每百万输出 tokens 0.15 美元,当前价都是 0 美元,那是有数字可以跟踪的促销价;而 3.0 Flash 还没有这个数字,官方说价格另行公布。

这不影响你现在用它——今天就是免费的,点一下就能选。这也正是 3.0 Flash 让你自己选,而不是默认给所有人打开的原因。

在 OpenClaw Launch 上它是怎么呈现的

在 OpenClaw Launch 的托管实例里,Agnes 3.0 Flash 会出现在模型列表中,名字是 Agnes 3.0 Flash (Preview),价格显示 0。有三件事是刻意这么做的:

  • 它不是推荐的默认模型。推荐项仍是 Agnes 2.5 Flash,因为它有公开价格也有公开上下文长度。没有任何已有实例被切换到 3.0 Flash。
  • 它是按实例手动选的。要一个实例一个实例地挑;选了才对那个实例生效,换到别的模型后这个声明会被撤掉,但你随时可以再选回来;另外如果它还被某个 agent 固定为主模型,就会保留。
  • 标的是 Preview,不是 Paid。它今天确实免费,所以价格照实显示 0,而不是藏起一个我们报不出来的价。

托管方式怎么用

托管方式下,OpenClaw 和 Hermes Agent 的操作完全相同——两种实例用的是同一个模型选择器,步骤不因框架而异。

  1. 去 Agnes AI 申请一个免费的 API key,完整步骤见 Agnes API key 接入指南
  2. API Keys 页面的 Agnes 卡片里保存这个 key。一个 key 同时覆盖 Agnes 的文本、图片和视频模型。
  3. 打开控制台,在你要改的实例上打开模型选择器,选 Agnes 这个供应商,然后挑 Agnes 3.0 Flash (Preview)。
  4. 选完就生效,不用再点保存,运行中的实例也不用重新部署。

自建部署的配置

如果你是自己搭网关,两个框架的配置写法不同,下面分别给出完整配置,不要互相套用。

OpenClaw(openclaw.json)

OpenClaw 把 Agnes 声明成一个供应商,主模型用「供应商/模型」的字符串形式。agnes/ 这个前缀的作用是让 OpenClaw 走你刚声明的 Agnes 供应商,而不是去用默认供应商解析这个模型名,所以前缀要留着。

{
  "models": {
    "providers": {
      "agnes": {
        "baseUrl": "https://apihub.agnes-ai.com/v1",
        "apiKey": "YOUR_AGNES_KEY",
        "api": "openai-completions",
        "models": [
          {
            "id": "agnes-3.0-flash",
            "name": "Agnes 3.0 Flash (Preview)",
            "input": ["text", "image"],
            "contextWindow": 524288,
            "maxTokens": 65536
          }
        ]
      }
    }
  },
  "agents": {
    "defaults": {
      "model": { "primary": "agnes/agnes-3.0-flash" }
    }
  }
}

Hermes Agent(~/.hermes/config.yaml)

Hermes 没有原生的 Agnes 供应商,它走通用的 custom(OpenAI 兼容)通道,模型名写裸名,网关地址放在 base_url 里。

model:
  default: agnes-3.0-flash
  provider: custom
  base_url: https://apihub.agnes-ai.com/v1
  api_key: YOUR_AGNES_KEY

这里有两点容易写错。模型名要写成不带供应商前缀的 agnes-3.0-flash,不是 agnes/agnes-3.0-flash——带前缀那种写法是 OpenClaw 的,Hermes 不需要。另外 base_url 一旦设了就以它为准,请求最终发到哪里由这个地址决定。改完用 hermes gateway restart 生效,注意命令里有 gateway 这个词。新会话不重启也会用上新模型。

和 Agnes 2.5 Flash 怎么选

两个都免费,上下文也都是 524,288,所以这不是性能和价格之间的取舍,差别在成熟度。

  • 日常任务继续用 Agnes 2.5 Flash。它有公开价格、公开上下文长度,也已经在生产里跑了几个月,作为推荐默认项是有道理的。
  • 想试 Agnes 3.0 Flash 的话,优先放在频繁调用工具、多步骤长任务的场景上,这正是这一代的设计目标。
  • 有空的时候可以从 Agnes 2.0 Flash 迁走:官方已把它标为弃用,建议新接入改用 2.5 Flash。它还能用,我们也还留着,不用急,但官方没有公布停用时间,它是这几个里唯一被正式标为弃用的。

付费的 Agnes 模型呢?

Agnes 2.5 Pro Alpha 的托管 API 已经弃用,官方建议改用 Agnes 2.5 Pro,我们现在把它作为付费的 Agnes 选项提供。它是支持文本和图片输入的推理模型,官方定价为每百万输入 tokens 0.45 美元、每百万输出 tokens 0.90 美元,从你自己的 Agnes 余额中扣除。

付费模型永远不会替你选,也不会自动生效。它们在列表中带有 (Paid) 标记,只有你自己主动选择了才会用上。

常见问题排查

模型列表里看不到 Agnes 3.0 Flash

Agnes 那一栏只有存入 Agnes API key 后才会出现。去 API Keys 页面添加或刷新一下 key,再打开选择器。3.0 Flash 排在两个免费 Flash 模型下方、付费项上方。

提示模型不存在(404)

先确认模型 id 就是 agnes-3.0-flash。如果是 Hermes,还要确认你没有写成 OpenClaw 那种 agnes/agnes-3.0-flash——Hermes 要的是裸名,网关地址放在 base_url 里。

401 未授权

key 没填、填错,或者粘贴时带了空格。去 API Keys 页面重新保存一次。同一个 Agnes key 文本、图片、视频模型通用,只需要一个。

回复为空或被截断

Agnes 3.0 Flash 是推理模型,会先花输出 tokens 生成内部思考,再返回可见的答案。如果最大输出设得太小,整个额度可能都用在了思考上,最后什么都没剩下。给它留够空间,我们在 OpenClaw 配置里允许的输出上限是 65,536 tokens。

长任务报上下文超限

硬上限是连同提示词一起 524,288 tokens,超过之后接口会直接拒绝请求,不会帮你截断。如果真的撞上了,就得靠压缩上下文或者缩小工作集。

常见问题

Agnes 3.0 Flash 是什么?

Agnes AI 最新的文本模型,面向真实场景下的智能体任务:执行稳定、工具调用可靠、长任务中能记住上下文。支持文本和图片 URL 输入,支持函数调用和多步工具编排,走 Agnes 的 OpenAI 兼容接口。

Agnes 3.0 Flash 免费吗?

今天调用不会产生任何 Agnes 余额扣费,这一点我们对着计费接口验证过。但 Agnes 没有公布它的价格,官方只写了「价格另行公布」,所以不像 Agnes 2.5 Flash 那样有公开价格可以跟踪。账号权限和调用频率限制依然适用。

Hermes Agent 也能用吗?

能。同一个 Agnes key、同一个模型,在 OpenClaw 和 Hermes Agent 上都能用;托管方式下两边步骤完全一样,因为用的是同一个模型选择器。自建的 Hermes 因为没有原生 Agnes 供应商,需要走 custom(OpenAI 兼容)通道,把 base_url 设成 Agnes 网关,模型名写裸的 agnes-3.0-flash

Agnes 3.0 Flash 的上下文有多大?

上下文是 524,288 tokens;输出方面,我们在 OpenClaw 的供应商配置里声明了 65,536 tokens 的上限,这是实测可用的取值,不是 Agnes 公布的模型上限。Agnes 这两个数字都没公布,都是实测出来的:输入超过上限时接口自己会指出模型上下文长度是 524288 tokens。自建 Hermes 我们没有给 Agnes 设输出上限,以你自己的配置为准。

要从 Agnes 2.5 Flash 换到 3.0 Flash 吗?

不用急着换。两个今天都免费、上下文也一样,所以日常任务继续用 2.5 Flash——它有公开价格,也跑得更久。频繁调用工具、多步骤长任务的场景可以试试 3.0 Flash。

为什么 Agnes 3.0 Flash 标成 Preview,而不是设为默认?

因为 Agnes 既没公布它的价格,也没公布上下文长度。它现在确实免费,Agnes 还没公布它将来会怎么收费,所以它是让你按实例主动选,而不是给所有人默认打开。你已有的模型选择不会被自动改动。

Agnes 2.0 Flash 还能用吗?

能。官方已把它标为弃用,建议新接入改用 2.5 Flash,但它仍然可用、仍然可选,正在用它的实例也没有被动过。方便的时候再迁到 2.5 Flash 就行。

接下来

在自己的智能体上免费用 Agnes 3.0 Flash

部署一个 OpenClaw 或 Hermes Agent 实例,存入免费的 Agnes key,在模型列表里选 Agnes 3.0 Flash —— 524,288 上下文,今天不花钱。

用 OpenClaw Launch 部署