跳到主要内容

Hermes Agent v0.19.0 发布说明

发布日期:2026 年 7 月 20 日 官方标签:v2026.7.20 与上一主版本对比:v2026.7.1...v2026.7.20

本页基于官方 GitHub Release 做了结构化中文整理,便于快速浏览。

一句话概览

官方将本次更新命名为 The Quicksilver Release。如果说 v0.18.0 的主题是让 Hermes 更会判断工作是否真正完成,那么 v0.19.0 的主线就是让它在每一个入口都更快、更可观察,也更不容易丢失结果。

重点变化:

  • 全平台首轮响应约提速 80%:冷启动提交到派发从约 4.3 秒降到约 0.9 秒,覆盖 CLI、Gateway、TUI、桌面端和 cron。
  • 等待过程不再是黑箱:推理模型默认实时展示思考流,回复框按 token 刷新,TUI 按块增量渲染 Markdown。
  • 桌面端性能专项:20+ 项定向优化,流式 Markdown 分割 CPU 开销降低约 14 倍,大型 diff 虚拟化,长会话切换和流式渲染更流畅。
  • 终端内管理 Nous 订阅:新增 /subscription/topup,可查看额度、预览升级或降级影响并完成套餐操作;桌面端同步加入账单设置页。
  • 智能审批默认开启:高风险命令先由独立 LLM 审核;新增用户自定义拒绝规则和 /deny <原因>,即使在 yolo 模式下也能强制阻断指定操作。
  • 密码管理器成为原生密钥源:通过统一的 SecretSource 接口从 Bitwarden 与 1Password(op://)读取密钥,并记录变量来源与冲突。
  • 子代理可实时观察且结果可恢复delegate_task 返回可直接查看的实时转录;后台委派在进程重启后可以恢复并继续交付结果。
  • 最终回复可靠投递:Gateway 使用持久化投递义务账本记录平台发送状态,崩溃重启后会补发尚未确认送达的最终回复。
  • 一个 Gateway 路由多个 Profile:可按 guild、channel 或 thread 把消息路由到不同 Profile,各自隔离配置、Skills、记忆和密钥。
  • 模型与推理能力扩展:新增 Fireworks AI、DeepInfra、Upstage Solar,补充 GPT-5.6、grok-4.5、Kimi K3、Claude Sonnet 5 等模型,并加入 maxultra 推理档位及按模型、MoA 槽位、辅助任务分别配置推理强度的能力。
  • 会话数据可完整导出hermes sessions export 支持 Markdown、Quarto、HTML、仅提示词和 Hugging Face trace 等格式,并提供过滤、脱敏、归档与压缩会话谱系拼接。
  • 安全与可靠性继续加固:统一本地文件凭据读取守卫、限制 Webhook 请求体、扩大 token 脱敏覆盖,并修复浏览器、媒体、.env 和 CI 不可信引用等风险面。

规模数据(自 v0.18.0 起):约 2,245 次提交 · 1,065 个合并 PR · 2,465 个文件变更 · 约 300,000 行新增 · 约 36,000 行删除 · 约 3,300 个 issue 关闭 · 450+ 位社区贡献者。本版本同时汇总了 v0.18.1 与 v0.18.2 的基础设施补丁。

我应该升级吗?

如果你属于以下任一场景,建议优先升级 v0.19.0

  1. 你觉得 Hermes 第一次回复启动太慢 —— 本次直接压缩初始化关键路径,所有入口都能受益。
  2. 你经常使用推理模型 —— 思考过程默认实时显示,长推理期间不会只看到等待动画。
  3. 你在桌面端处理长会话或大型代码 diff —— 流式 Markdown、评审面板、会话切换和侧栏渲染都有针对性优化。
  4. 你使用 Nous 套餐 —— 可以不离开 CLI/TUI 完成额度查看、套餐变更和充值。
  5. 你希望减少命令审批疲劳,但仍要保留安全边界 —— 智能审批、拒绝规则和带原因的 /deny 提供了更细粒度的控制。
  6. 你不想把 API Key 明文放在 .env —— Bitwarden 与 1Password 已经可以直接作为密钥来源。
  7. 你大量使用后台子代理或消息 Gateway —— 实时子代理转录、可恢复委派和最终回复补发能显著减少“任务做完但结果丢了”的情况。
  8. 你用一个 Bot 服务多套工作或生活配置 —— Profile 路由可以在共享 Gateway 下保持配置、记忆和密钥隔离。
  9. 你希望把历史会话沉淀为文档或训练数据 —— 新的会话导出覆盖常见文档格式、trace 和 Hugging Face 工作流。

升级前仍建议备份 SOUL.mdMEMORY.mdskills/、Profile 配置、Gateway 配置和长期会话数据。使用多 Profile、远程 Gateway、桌面端或消息平台的用户,建议先在一台实例上验证再推广。

重点亮点

速度主线:从初始化到渲染一起提速

这次优化并不只是在某个客户端“看起来更快”。Hermes 把 Discord 能力探测移出关键路径,为探测结果增加按 token 缓存;对已知非 Ollama provider 跳过无意义的本地探测;同时移除 Agent 初始化中的阻塞工作。官方基准中,冷启动提交到派发从约 4.3 秒下降到约 0.9 秒。

体感侧也做了第二轮优化:display.show_reasoning 默认开启,推理过程实时流出;回复框从按行刷新改为按 token 刷新;提示词构建和时区解析增加缓存。TUI 则按 Markdown 块增量渲染,不必等待整个回复完成。

主要 PR:#59332#59389#67236

桌面端:20+ 项性能优化与更完整的工作台

桌面端对长回复、大型 diff 和复杂会话做了系统性性能治理:流式 Markdown 使用增量块词法分析,分割 CPU 开销降低约 14 倍;评审面板对 diff 进行虚拟化;切换大型会话不再反复触发布局抖动。流式生成期间不再让侧栏和所有工具行随每个 token 重渲染,Profile 后端和 Gateway socket 可以在悬停意图出现时预热,启动时不可见的面板延迟到空闲阶段挂载。

功能上新增统一 Capabilities 页面,把 Skills、Tools、MCP 与 Hub 集中到一个入口;Hermes Cloud 连接模式、Gateway 软切换和终端执行后端健康探测也同步落地。

主要 PR:#67154#67818#65898#66747#67742

订阅与审批:在终端里管套餐,也让风险判断更聪明

/subscription/topup 把 Nous 计划管理带进 TUI 与经典 CLI:查看当前套餐和剩余额度,预览立即升级的实际价格或降级生效时间,确认变更,并查看或撤销已经排期的调整。桌面端有对应的账单设置页。

高风险命令审批现在默认先交给独立 LLM 判断,而且每次结论只覆盖当前精确命令,不会把一次批准无限扩展到后续相似操作。用户自定义 deny 规则即使在 yolo 模式下也会阻断命令;/deny <原因> 会把拒绝理由反馈给 Agent,让它主动调整方案。

主要 PR:#51639#61054#62661#59164

密钥管理:Bitwarden 与 1Password 一等接入

新的可插拔 SecretSource 接口允许同时启用多个密码库。Hermes 可以在加载配置时从 Bitwarden 和 1Password 的 op:// 引用读取密钥,按确定性优先级合并,并提示冲突及每个变量的来源。未来其他密码库也可以按同一接口接入。

主要 PR:#59498

子代理与 Gateway:过程看得见,结果不会丢

delegate_task 现在会为每个子代理生成可读的实时转录文件,工具调用、结果和流式回复都能在运行时直接查看。后台委派完成信息写入带所有权检查的持久化账本,进程重启后仍能恢复并交付。

消息侧新增最终回复投递义务账本:平台发送前后都会更新 state.db 中的状态。如果 Gateway 恰好在生成回复后、确认平台送达前崩溃,下一次启动会重新投递,而不是静默丢失已经付费生成的结果。

多 Profile Gateway 还可以按 guild、channel 或 thread 路由消息,让工作和个人场景共享 Bot token,同时保持 Profile 配置、Skills、记忆和密钥完全隔离。

主要 PR:#67479#63494#67181#64835

模型、推理与会话数据

Provider 侧新增 Fireworks AI、DeepInfra 与 Upstage Solar,并扩展 GPT-5.6(Sol / Terra / Luna 及 Pro 变体)、grok-4.5、Kimi K3、Claude Sonnet 5、Claude Fable 5 和腾讯 HY3 等目录。maxultra 推理档位贯穿 CLI、桌面端与各条路由,还可以按模型、MoA 预设槽位和辅助任务分别覆盖推理强度。

hermes sessions export 可以导出 Markdown、Quarto、HTML、仅提示词和 Hugging Face trace,支持按时间、工作区和平台过滤,可选 --redact 脱敏,并把压缩前后的会话谱系拼接成一条逻辑记录。会话清理也补齐筛选、批量归档和恢复工作目录等能力。

主要 PR:#62593#63969#61616#62650#60186

其他值得注意的变化

  • Telegram、Discord 与 Matrix 的 /reasoning/fast 支持原生单击选项按钮。
  • WhatsApp 支持原生投票、位置、更多入站元数据和 Dashboard 配对流程;Discord、Slack 等平台继续补强断线恢复与工具状态展示。
  • CLI / TUI 新增 /model --once,可只在下一轮临时切换模型;多个 slash skill 可以按顺序叠加调用。
  • Dashboard 补齐 Skills Hub、MCP 测试与开关、维护操作和日志筛选等桌面端同类能力。
  • Gateway 的会话状态与路由索引进一步收敛到 state.db,会话租约、重置边界、每频道模型与系统提示词覆盖更加一致。
  • Vertex、媒体、视觉和图像生成相关文件读取统一经过凭据守卫;Webhook 统一限制请求体大小;Telegram 与 Fireworks token 脱敏覆盖扩大;CI 避免把不可信引用直接插入脚本。
  • 本次 Release 已包含 v0.18.1 与 v0.18.2 的基础设施补丁,无需单独逐级安装。

升级建议

常规升级仍然使用:

hermes update

如果你使用包管理器、Docker、Nix 或 Windows 原生安装,请按对应安装方式升级到当前稳定版。

升级后建议做六件事:

  1. 运行 hermes --version,确认版本已经到 v0.19.0。
  2. 发起一次新会话,确认首轮响应与推理流式展示符合预期;不希望显示推理时,再调整 display.show_reasoning
  3. 检查智能审批与自定义 deny 规则,确认它们符合你的团队安全策略。
  4. 如果接入 Bitwarden 或 1Password,验证变量来源、优先级和冲突提示,不要立即删除原有密钥备份。
  5. 如果使用多 Profile Gateway,分别验证常用 guild、channel 或 thread 是否路由到正确 Profile。
  6. 在桌面端、后台子代理和消息平台各做一次常用流程,确认转录、恢复和最终回复投递符合预期。

参考链接