
作者|毕伟豪
编辑|漠影
智东西 7 月 21 日报道,一觉醒来,Hermes Agent 用户圈子直接炸了锅,官方放出了最新的版本:水银。恰如其名,最新版本主打一个 " 快 ",丝滑流畅如水银泻地,冷启动速度提高了 80%,但这次更新," 快 " 仅仅是开胃菜。
官方的版本介绍视频还是一如既往的艺术:
这次更新的量级可以用一串数字说清楚:2245 次提交,1065 个合并 PR,2465 个文件改动,30 万行新增代码,关掉了 3300 个 Issue,450 多个社区贡献者参与,而这一切距离上一版 v0.18.0 不过 20 天。
作为 Hermes 的忠实用户,在经历了多次更新失败以及 v0.18 版本的小 Bug 之后,我终于更新到了最新版本,接下来我将会结合实际体验,将本次更新中最重磅的内容一一列举(包括 7 月 20 日小版本更新)
重点功能如下:
1、冷启动速度提高 80%,对话开头的小卡顿 " 思考中 " 几乎消失;
2、默认实时流式思考模式,可以清晰看到思考过程;
3、Markdown 渲染 CPU 使用量减少 14 倍,负载更小,速率更快;
4、桌面版 UI 升级,支持多个会话分布式排列,同时查看不同会话;
5、默认智能审批,不会在每次执行任务时都进行询问;
6、新增 xhigh 和 maximum 思考强度,可以在单个任务以及模型中进行调节,不走全局;
7、密码管理器集成,Bitwarden 和 1Password 直连 Hermes,密钥不再裸放;
8、虚拟化 diff,动态渲染,大文件修改面板不会卡死,只渲染当前屏幕上的部分;
9、会话切换更丝滑,不再闪白屏重绘侧边栏布局;
10、子 Agent 实时监控,一条命令即可查看日志;
11、任务进度、生成结果自动保存,网关挂了回复不丢失。
一、思考如水银泻地般丝滑,冷启动速度提高 80%,快到不用等
水银版要解决的第一个问题,就是 " 慢 "。
之前的冷启动——输入第一句话之后、模型真正开始工作之前,要经历4.3 秒左右的 Agent 初始化,也就是我们常见的 " 思考中 ",而现在这个时间被压缩到了 0.9 秒,实际体验中几乎无感的程度,CLI、桌面版、网关、cron 任务全线生效,不是某个平台的局部优化。
比如在下面我的实际使用过程中,可以看到 Hermes 的响应速度非常快,几乎是瞬间就开始执行,以前输入提示词以后的" 卡顿时间 " 几乎消失了(PS:我的绘梨衣很好看叭)。

实际上中大型任务的整体执行时间变化不大,但一开始不用等这件事对于使用体验感来说是个非常大的提升。
冷启动速度快了,执行过程也有相应更新,之前 Hermes 默认状态下的思考过程也是 " 等着 ",用过的应该明白,很多思考过程都是一闪而过然后隐藏的,用户不仅需要在冷启动时等,在任务执行过程中也只能看宠物跳舞。
水银版本更新解决了这个问题,Hermes 默认采用实时流式输出,你能看到它在想什么,不再是干等,比如下方我用 Kimi K3 开发坦克大战游戏,就能清晰地看到所有思考过程。
桌面版的渲染性能也动了大手术。Markdown 渲染器的 CPU 负载降了 14 倍,长回复不再卡顿,每 Token 的流式渲染也不再触发整个侧边栏和工具行的重绘。大文件 diff 面板做了虚拟化处理,只渲染当前屏幕可见的部分,以前那种打开大文件直接卡死的情况基本消失。
切换会话也不闪白屏了,之前每切一次,整个侧边栏布局重绘一次,闪得人眼花。水银版修复了这个问题,加上 profile 后端鼠标悬停即预热的优化,桌面版的操作体感明显贴近原生应用。
下图中我飞速点击不同会话,切换非常丝滑没有白屏现象,甚至我还切换了不同的 profile 以及桌宠,也没有卡顿现象。
" 如果 Hermes 以前给你的感觉像是每次回答问题前都要深吸一口气,现在那口气咽下去了。" 官方 release notes 里这句话,一点都不夸张。
二、分布式会话排列,智能审批上线,思考强度随意调节
在桌面版的功能上,Hermes 有几项非常便利的更新,首先是 v0.18 版本后期更新的一个分布式会话排列功能,这个功能听起来好像是一个简单的 UI 更新,但在实际使用中给人很大的惊喜。
在上次 Hermes 密集更新的时候,我曾介绍过其中一个功能:会话独立小窗 Hermes 上线 3000 多种电子宠物,8 大更新必看,当时那个功能其实我后面使用的并不频繁,因为小窗事实上有点挡地方,只有需要在浏览器预览的任务才会使用,这样可以一边提要求一边直接看改动,不用切应用。
而上版本更新的分布式会话排列是小窗功能的进化版,用户可以在 Hermes 应用内部调整和排列会话位置,就像 win 系统的多窗口排列功能一样,能并排也能四分,屏幕够大的话就可以同时打开多个会话窗口,真正在视觉上实现多 Agent 协同工作。

首先是审批,我们都知道诸如 Codex、Claude Code 这些工具都有一个自动模式,也被称为无视风险模式,打开这个模式就能全自动运行,几乎不需要手动确认权限。
之前的 Hermes 在权限上管理非常严格,连编写脚本都需要手动确认,而这次水银版更新后,桌面应用上出现了一个审批模式的选项,用户可以自由选择手动、智能和关闭审批三种模式,智能模式是默认状态下的设置。

第二个优化就是思考强度,本次Hermes 水银版增加了 xhigh 和 maximum 思考强度,对齐 GPT 和 Claude 的顶级思考级别。但这不是重点,最主要的优化是思考强度可以在每个任务、每个模型、每个 profile 上进行独立调整,比如你的你的顾问 Agent 可以进行深度思考,你的摘要 Agent 轻量运行省点 Token。

这部分功能是 Hermes 水银版对" 你的 Agent 在干什么 " 和 " 你的 Agent 干的结果到底送到没有 "这两件事的优化。
先说子 Agent 监控。之前派一个子 Agent 出去干活,它跑它的,你只能干等。出错了你不知道卡在哪一步,跑完了你也不知道中间发生了什么。
水银版改了调度机制:子 Agent 启动的瞬间,系统就会返回实时记录文件,每个子 Agent 对应一个独立的、人类可读的日志。工具调用、返回结果、流式回复全都能看到。你可以用 tail-f(具体文件名)实时盯着任何一个子 Agent 干活,把一个小集群的并行任务状态全部拉到眼皮底下。

水银版把这个 Bug 补上了,后台任务现在会自动保存状态,即使 Hermes 中途崩溃、重启,恢复后也能把之前完成的结果继续交回来,不用担心辛辛苦苦跑了十几分钟,最后因为一次闪退全部归零。
另一个容易被忽略的问题,发生在 " 最后一步 "。
以前,Hermes 已经生成好回复,但还没来得及发到飞书、微信等聊天平台时,如果在这几秒钟程序突然挂掉,消息就没了,但更让人难受的是,模型已经完成了推理,钱花了,结果丢了。
现在,Hermes 会先把最终回复保存下来,再发送出去。如果发送过程中出现异常,下次启动时会自动补发,不会再出现 "AI 明明想好了答案,却死活收不到回复 " 的情况。

此前 Hermes 会把 API Key 放在 .env 文件里,时间一长,里面会塞满各种平台的密钥,不仅管理麻烦,一不小心还可能误传到 GitHub。
水银版支持直接连接 Bitwarden 和 1Password 两大密码管理器,Hermes 启动时会自动读取里面保存的密钥,不用再手动复制粘贴,也不用担心 API Key 散落在各个文件里。以后如果支持更多密码管理器,也可以直接通过插件接入。

这两天 Hermes 的集中更新让无数用户都感到震撼,官方合并了上千条 PR,让整个 Hermes 的使用体验和稳定性都有了长足的提高,有用户甚至直言这就是 AGI。
从我个人感受上来看,Hermes 此次迭代更新对于这款开源 Agent 的意义是非常重大的,核心在于它变得更快、更顺手、更安全,也更有趣了。
Hermes 并不是一味地增加新功能,而是在新功能、用户体验以及稳定性中寻找平衡,让整个应用的体验感不断上升。
其实很多时候,让用户喜欢上某个应用的原因,可能就在于对话开头那减少的几秒等待时间。


登录后才可以发布评论哦
打开小程序可以发布评论哦