最近我把 Hermes Agent 从 v0.18 升级到了 v0.19 Quicksilver,本以为又是一次平缓迭代,结果第一印象就被锤了——以前启动 Agent 等个好几秒才出现提示符,现在几乎是刚按下回车就出现欢迎消息。官方发布说明显示全平台冷启动首 Token 延迟从大约 4.3 秒降到了 0.9 秒,直接砍掉了 80%。这还只是其中一个变化。Quicksilver 版本累计合并了超过 1000 个 PR,关掉了 3300 多个 Issue,450+ 社区贡献者参与。如果你也在用 Hermes Agent 做日常开发或者跑自动化任务,这次的升级可能有几项功能会直接改变你的使用习惯。

我们按痛点→新写法→收益的顺序,挑几个最实用的大功能拆开说说。

再也不用盯着 spinner 等了

以前用 Hermes Agent 最烦的一件事就是慢。输入一个指令,然后就看终端光标在那闪,少则两三秒多则六七秒才有反应。这不是说模型推理慢,而是框架本身在启动时做了太多阻塞操作:检测当前平台能力、检查 Ollama 是否可用、执行 agent-init 初始化……这些东西全都堆在关键路径上。

Quicksilver 把这些东西移出了关键路径。官方把 Discord 能力检测做成了 token-keyed 磁盘缓存,有效期 24 小时,后台异步刷新。Ollama 探针如果发现当前 Provider 不是 Ollama 就跳过。agent-init 阻塞工作干脆移到了后台。结果是 cold-start 从 ~4.3s 降到 ~0.9s。不光这样,推理流现在默认显示(display.show_reasoning 默认 ON),你不再需要看着 spinner 瞎猜 Agent 在干嘛,它会实时把思考过程流式打印出来。

如果你用桌面端,提升更明显。官方为 Desktop 做了 20+ 个性能 PR:流式 Markdown 解析器的 CPU 占用降低了 14 倍,处理超大 diff 时不会把界面卡死,会话切换不再触发布局震荡。流式渲染不再每来一个 token 就重绘侧边栏和工具行,profile 后端 hover 预加载,隐藏面板在空闲时挂载而不是冷启动路径。整体感觉就是大负载下桌面端突然像原生应用一样丝滑了。

你升级后第一件事可以试试开一个耗时任务,感受一下 tail -f 实时日志加上推理流的组合,过去那种“等反馈”的焦躁感基本消失了。

升级命令也很简单,如果你是 v0.18 用户:

hermes update
# 或者从源码安装
git pull origin main && cargo build --release

智能审批:弹窗少 80%,但安全没妥协

用过 Agent 的人都知道那种频繁弹窗的烦躁。每条高危命令都要你“确认”,久了你不看内容直接按回车——安全反而成了形式。Hermes v0.19 默认开启了智能审批(Smart Approvals),它的做法是不再每件事都问你,而是在执行标记命令前,由 LLM 审查器独立评估风险。

举个例子:你要执行一条 sudo rm -rf /tmp/cache,审查器会分析这条命令的上下文,如果风险低就直接放行,只有高风险操作才会弹出确认框。而且每条命令独立审查——即使同一模式再次触发也会重新评估,不偷懒。你还可以通过 /deny <原因> 告诉 Agent 为什么拒绝,它会理解你的担心并在后续调整行为。

更进一步,智能审批支持自定义 deny 规则。即使你开了 yolo 模式(信任模式),也能通过规则阻止某些操作。比方说你可以写一条规则:任何带有 --forcepip install 都默认拒绝。这些规则可以覆盖模型判断,真正做到了“信任但验证”。

实际体验下来,弹窗频率大约下降了 80%,但你不会因此觉得不安全——因为被放行的都是你本来就会放行的操作。如果你是个需要频繁与 Agent 协作的开发,这个功能值得升级后立刻开启。

密钥管理:告别 .env 明文文件

这可能是最容易被忽视但最有长期价值的功能。以前你在 .env 文件里放 API Key,不仅不安全,还容易被不小心提交到仓库。v0.19 新增了 SecretSource 接口,一个可插拔的密码管理器源。官方直接集成了 Bitwarden 和 1Password(op:// 引用格式),Hermes 启动时从这些密码管理器获取密钥。

你可以同时启用多个 vault,有确定性优先级和冲突警告。每个变量来源可追溯。另外这个功能统一了 11 个社区 PR,未来其他密码管理器可以以插件形式接入。

对开发者来说,这意味着你可以在团队中安全地共享配置文件:把 .env 内容删掉,改成从 Bitwarden 的共享 vault 里自动拉取。代码仓库里只保留配置结构,真正敏感的值不落地。如果你已经在用 Bitwarden 或 1Password 管理凭证,迁移成本几乎为零——只要在启动时指定对应的引用路径就行。

这个特性可能不会让你立刻觉得“哇”,但长期看它让 Agent 的生产部署变得正规多了。

配置示例(在 config.yaml 中):

secrets:
  bitwarden:
    vault: "personal"
    # 自动从 Bitwarden 获取 OPENAI_API_KEY
  onepassword:
    vault: "work-vault"
    # 通过 op:// 引用格式获取
    # op://work-vault/hermes-api/credential

子 Agent 实时追踪:同时调度多个任务也不慌

这个功能我第一时间就觉得解渴:delegate_task 调度现在返回实时日志文件,子 Agent 启动后你就可以 tail -f 查看每个工具调用、结果和流式回复。以前你只能收到最终结果,中间过程完全黑盒。现在你可以同时启动多个子 Agent,在终端里开几个窗口分别 tail,实时观察每一个 Worker 在干什么。

更关键的是后台任务持久化了。如果 Agent 进程意外重启,之前分配的并行任务不会丢——结果会自动恢复并重新交付。官方称之为 Delivery-Obligation Ledger,一个持久化的 state.db。网关在生成响应和确认平台交付之间如果崩溃,重启后响应自动重新投递,不会静默丢失。这个机制关闭了 Telegram、Discord、Slack 等平台上长期存在的 P1 丢消息窗口。

如果你在跑一些需要数分钟甚至更长的自动化任务,比如代码审查、批量测试、数据清洗,这个特性让长任务的操作体验从“高风险赌一把”变成了“可以放心去睡觉”。

网关多 Profile 路由:一个 bot 切工作切生活

以前要在一个 Discord 服务器里同时服务十几个频道,你可能得开多个 bot token,管理起来很痛苦。v0.19 引入了单网关多 Profile 路由:单个 multiplexed 网关共享一个 bot token,可以把特定 Discord 服务器/频道/线程路由到不同 profile。每个 profile 有完全隔离的配置、技能、记忆和密钥。

比如你可以在工作频道关联一个 profile,使用专业模型(如 GPT-5.6 Pro)和严格的安全策略;在个人频道关联另一个 profile,用轻量模型并允许娱乐指令。第二轮加固还确保一个 profile 的配置错误不会拖垮整个网关。

这听起来是大规模部署的功能,但个人开发者也能受益:同一个 bot 可以同时服务你的工作 Slack 和个人 Discord,不再需要维护两份配置。

新模型与推理强度

v0.19 也跟进了一波新模型:GPT-5.6 全系(Sol/Terra/Luna + Pro)端到端接入,Kimi K3 在 Nous Portal 和 OpenRouter 上架,Claude Fable 5 / Sonnet 5 精筛接入,grok-4.5 GA,Fireworks AI 和 DeepInfra 成为一等公民 Provider。你需要哪个模型就跑哪个,不再需要写第三方适配层。

推理强度新增了 maxultra 级别,适用于 GPT-5.6 和 Codex 顶级模型。你可以为每个模型单独配置 reasoning_effort 覆盖,甚至在 MoA 预设中为每个 slot 独立设置(Advisor 深度思考、合成器保持快速)。这意味着你可以在同一个任务里让不同 Agent 角色用不同强度的推理。

你可以在 CLI 里临时切换模型:

# 单次会话使用 Claude Fable 5
/model --once claude-fable-5

# 查看并变更订阅
/subscription

# 拒绝 Agent 的建议并说明原因
/deny 这个操作会删除生产数据,请用归档方案替代

终端里也能用 /subscription/topup 直接管理 Nous 套餐。

升级建议

如果你是 v0.18 的用户,建议直接升到 v0.19。升级后优先做三件事:第一,体验智能审批,设置你自己的 deny 规则;第二,把密钥从 .env 迁移到 Bitwarden 或 1Password;第三,开一个需要子 Agent 的任务,感受 tail -f 实时追踪的透明感。Desktop 用户可以趁缓存清空后的第一次启动感受一下速度差异。

如果你还没用过 Hermes Agent,现在是个好节点。v0.19 去掉了很多劝退的痛点——慢、弹窗多、密钥裸奔、子任务黑盒。开源 MIT 协议,你自己搭一个端口就能跑,不需要任何云订阅。如果你需要云端的模型 API,可以用 Nous Portal 的按需套餐,直接在终端用 /subscription 查看额度,不必切页面。

Hermes Agent 的价值不在于它有多少模型支持,而在于它把“如何把模型能力编排进日常工具链”这个问题解到了这个程度:启动够快,安全够稳,密钥够安全,任务够透明。升级不是为了追新版本号,是让 Agent 真正变成一个可以信任的工作伙伴。不是功能堆得越多越好,而是每个功能都解决了你日常的某个烦躁点。如果你还在等一个让 Agent 看起来“真正可用”的版本,Quicksilver 就是那个版本。

项目地址:https://github.com/NousResearch/hermes-agent(MIT 开源,可以直接跑)

Logo

这里是“一人公司”的成长家园。我们提供从产品曝光、技术变现到法律财税的全栈内容,并连接云服务、办公空间等稀缺资源,助你专注创造,无忧运营。

更多推荐