Hermes Agent v0.19.0 — The Quicksilver Release(水银版本)
概览
v0.19.0 — The Quicksilver Release(水银版本),2026 年 7 月 20 日发布。~2,245 次提交 · ~1,065 个合并 PR · ~2,465 个文件变更 · ~300,000 行新增 · ~36,000 行删除 · ~3,300 个 issue 关闭 · 450+ 社区贡献者。
Hermes 是众神的信使,这个版本我们让他名副其实地快了起来。水银版本的核心理念只有一个:反应迟钝的自主 Agent,没人会用。首发 token 时间在所有平台上暴降 ~80%——冷启动从 ~4.3 秒压到 ~0.9 秒。推理模型默认实时流式展示思考过程,不再让你对着转圈圈发呆。桌面端拿下 20+ 个定向性能 PR(流式 Markdown 渲染 CPU 占用降 14 倍、diff 虚拟化、秒切会话)。TUI 也实现了 Markdown 增量渲染。
在这条速度脊梁骨上,这个版本还塞进了大量硬核功能:终端订阅管理(/subscription 和 /topup)、密码管理器集成(Bitwarden 和 1Password)、智能审批(LLM 自动审查命令,默认开启)、子 Agent 实时监控窗口、消息投递义务账本(Gateway 崩了也能恢复投递)、以及基于 Profile 的多租户消息路由。新 Provider(Fireworks AI、DeepInfra)和最新前沿模型(GPT-5.6、grok-4.5、kimi-k3、Claude Sonnet 5)也一并到位。
本次发版同时整合了 v0.18.1 和 v0.18.2 两个基础设施补丁标签的全部内容。
核心亮点
1. Hermes 速度暴增——首发 Token 立等可取
冷启动 “Initializing agent…” 阶段以前要吃掉 ~4.3 秒,你的第一句话才送到模型。现在只需 ~0.9 秒——提速 ~80%,CLI、Gateway、TUI、桌面端、Cron 全覆盖。
底层做了什么:
- Discord 能力检测移出关键路径,用 token-keyed 24 小时磁盘缓存 + 后台刷新代替
- 已知非 Ollama provider 跳过 Ollama 探活
- Agent 初始化阻塞工作移出冷路径
- Prompt 构建缓存 + mtime 缓存时区解析
感知延迟第二波专门针对你等待时看到的画面下刀:
display.show_reasoning默认开启——推理模型实时流式展示思考过程,不再盯着转圈圈 30 秒- 回复框逐 token 上色而非逐行,配合宽度感知的强制刷新
- 混合工具批次拆分,恢复被浪费的并发
- 每次调用的 base64 重序列化从请求体积估算中移除
如果以前你觉得 Hermes 每次回答前都要深吸一口气——那口气已经没了。
2. 桌面端速度浪潮——20+ 定向性能 PR
@OutThisLife 主导了一场专注的性能翻新,效果就是桌面端在压力下也跟原生 App 一样流畅,哪怕开着海量对话记录、跑着忙碌的 Agent。
| 模块 | 提升 |
|---|---|
| 流式 Markdown | 增量块级词法分析,CPU 占用降 14 倍 |
| Diff 渲染 | 审查面板 diff 虚拟化——大文件不再卡死 Shiki |
| 会话切换 | 超长对话也能秒切,布局抖动级联彻底消除 |
| 启动 | 序列化裁剪 + 移除每次轮询的 REST 放大量;Profile 后端 hover 即预热 |
| 启动时隐藏面板 | 空闲时挂载,不挤占冷启动关键路径 |
| 逐 token 重渲染 | 侧边栏和工具行在流式期间不再重新渲染;消除工具参数/结果的快速 JSON.stringify |
| 性能工程 | 系统化性能基准测试框架,取代 12 个一次性的测量脚本 |
一句话:Hermes 桌面端史上最快、最丝滑的体验。
3. 终端内管理 Nous 订阅——/subscription 和 /topup
以前改订阅得上 billing 网站。现在直接终端搞定:
# 在 TUI 或经典 CLI 中打开完整订阅流程
/subscription
# 你能看到:
# - 当前套餐和剩余额度
# - 升级预览:"支付 $46.30 立刻升级"
# - 降级生效日期:"降级将于 8 月 1 日生效"
# - 计划变更横幅 + 撤销选项
# 充值
/topup
桌面端也加了配套的账单设置 Tab。你的钱包从此不用离开键盘。
4. 智能审批——LLM 默认审查危险命令
当 Hermes 想执行被标记的命令时,现在会有一个独立的 LLM 审查员先评估,而不是每条都弹出来让你点确认。每条判决只覆盖当前那条命令——后面匹配同样模式的命令会有自己的独立审查。
决策流程:
- 安全 → 自动放行,无打断
- 危险 → 自动拒绝,记录原因
- 不确定 → 升级到人工决策
配合用户自定义拒绝规则(yolo 模式下也生效)和 /deny <reason>(告诉 Agent 为什么拒绝,让它纠偏),日常审批疲劳大幅下降,但控制权没有让步。
# 附带理由拒绝——Agent 会从你的拒绝中学习
/deny 这会把生产数据库删掉
# 配置文件中定义拒绝规则,yolo 下也强制执行
deny_rules:
- pattern: "rm -rf /"
reason: "绝不允许删除根目录"
- pattern: "DROP (DATABASE|TABLE)"
reason: "数据库操作需要人工审查"
5. 密码管理器集成——Bitwarden 和 1Password 密钥源
API 密钥再也不用明文躺在 .env 文件里了。全新的可插拔 SecretSource 接口让 Hermes 在启动时从 Bitwarden 和 1Password(op:// 引用)拉取密钥。
# hermes.config.yaml
secret_sources:
- provider: bitwarden
vault: "dev-creds"
priority: 1
- provider: onepassword
vault: "Production"
priority: 2
# op:// 引用在加载时解析:
# op://Production/OpenAI/credential → OPENAI_API_KEY
关键设计决策:
- 多个 Vault 同时启用,确定性优先级排序
- 冲突告警——两个源提供了同一个变量时主动提示
- 每个变量的来源追踪——你永远知道密钥从哪来的
- 合并了社区 11 个竞争 PR 到一个统一接口
- 未来的 Vault Provider(HashiCorp Vault、AWS Secrets Manager 等)以插件形式接入
6. 实时围观子 Agent 干活——日志流 + 持久化后台委派
委派出去的子 Agent 不再是消失在转圈圈背后的隐形打工人了。
# delegate_task 现在返回实时的日志文件
/delegate_task "并行调研竞品 A、B、C"
# 在另一个终端实时围观任意子 Agent
tail -f /tmp/hermes-delegate-abc123.log
# 每个工具调用、结果、流式回复——每个子进程一个人性化可读的日志
持久化后台委派意味着即使进程中途重启,结果也会通过所有权校验的账本恢复并投递,而不是凭空消失。尽管撒出一队兵力、随便围观哪个工人、结果永不丢失。
7. 投递义务账本——Gateway 崩溃也不丢回复
如果 Gateway 在生成回复和确认平台投递成功之间宕机了——以前这条回复就悄无声息地丢了,而你已经为这轮对话付了费。不会再有了。
最终回复现在在平台发送环节被记录到 state.db 中的持久化账本里,并在下次启动时重新投递。这修复了 Telegram、Discord、Slack 以及所有其他消息渠道的 P1 级静默丢消息窗口。已经生成好的回复再也不会丢了。
8. 一个 Gateway,多个 Profile——基于 Profile 的消息路由
单个复用 Gateway 共享一个机器人 Token,现在可以把特定服务器、频道、线程路由到不同的 Profile——每个 Profile 拥有完全隔离的配置、技能、记忆和密钥。
# 一个机器人,工作 Discord 指到 'work' profile,个人服务器指到 'personal'
gateway:
multiplex_profiles:
- profile: work
discord:
guilds: ["123456789"]
channels: ["987654321"]
- profile: personal
discord:
guilds: ["111111111"]
第二波复用加固后,一个配置错误的 Profile 再也不会拖垮整个 Gateway。
9. 新 Provider 和前沿模型
| 新增 | 详情 |
|---|---|
| Fireworks AI | 一级 Provider,带成本估算,Provider 选择器排到第 2 位 |
| DeepInfra | 加固集成,完整模型目录接线 |
| Upstage Solar | 从社区 PR salvage 而来的新 Provider |
| GPT-5.6 | Sol/Terra/Luna + Pro 全系列,全路由端到端贯通 |
| grok-4.5 | GA 目录条目,推理模型白名单 |
| kimi-k3 | Nous Portal、OpenRouter、Kimi Coding 端点全面上线;kimi-k2.x 退役 |
| Claude Sonnet 5 | 精选目录,首发定价,全路由元数据 |
| Claude Fable 5 | 与 Sonnet 5 并列精选 |
| LM Studio | 本地部署 JIT 模型加载 |
| Bedrock 目录波次 | 从实况端点探测真实上下文窗口;当前代 Claude + Fable 1M 上下文行 |
你现在可以隐藏不用的 Provider——通过 enabled: false 逐个禁用或 excluded_providers 从模型选择器中彻底清除。
10. 推理深度拨盘——max 和 ultra 级别
推理深度不再是一个全局开关,而是一个可调旋钮:
# CLI:会话级推理深度控制
/reasoning # 交互式选择器:off → low → medium → high → max → ultra
# 配置文件中按模型覆盖
reasoning:
models:
"gpt-5.6-sol": ultra
"claude-sonnet-5": max
# MoA preset 中按槽位设置——顾问深度思考,汇总者保持轻快
moa:
presets:
deep-council:
references:
- model: gpt-5.6-sol
reasoning_effort: max
- model: claude-sonnet-5
reasoning_effort: max
aggregator:
model: gpt-5.6-luna
reasoning_effort: medium
GPT-5.6 和 Codex 的最高推理级别完全支持,较小规模的 Provider 做了合理的级别封顶。支持按模型、按任务和按 MoA 槽位的推理深度控制。
性能——速度脊梁
首发延迟(全平台)
- TTFT 暴降 ~80%:冷提交→分发从 ~4.3s 压到 ~0.9s,覆盖 CLI、Gateway、TUI、桌面端、Cron
- 推理流式默认开启:看模型思考,不再盯转圈圈
- 逐 token 回复渲染,配合宽度感知强制刷新
- Prompt 构建缓存 + mtime 缓存时区解析
- 混合工具批次拆分,恢复并发能力
桌面端速度浪潮
- Markdown 分词器 CPU 降 14 倍,流式渲染采用增量块级词法分析
- 审查面板 diff 虚拟化——不再全量 Shiki 冻结
- 超长对话秒切会话,布局抖动级联彻底干掉
- 启动优化:序列化裁剪、移除每次轮询的 REST 放大量
- Profile 后端 hover 即预热;隐藏面板空闲挂载
- 消除逐 token 重渲染:流式期间侧边栏 + 工具行停止重渲染
- 系统化性能基准测试框架
全局提效
- TUI 流式 Markdown 逐块增量渲染
- 技能发现按扫描签名缓存;快照清单构建提速 ~5 倍
- 写时复制消息准备取代全量深拷贝
- 模型元数据探测缓存集群——切换模型更快
- Gateway:字节级稳定的系统 Prompt,跨轮次保持 Prompt 缓存命中
hermes update:Node 清单未变时跳过 npm install
重磅功能
Gateway、集群和中继
投递义务账本——最终回复记录在 state.db,若 Gateway 在平台确认前崩溃,下次启动重新投递。
基于 Profile 的路由——一个机器人 Token,多个 Profile。将特定 Discord 服务器/频道、Telegram 聊天或 Slack 工作区路由到不同 Profile,配置、技能、记忆、密钥完全隔离。
每会话轮次租约——防止同一消息被重复处理。会话级漏斗和统一会话重置边界。
中继架构成熟——通用 OIDC 客户端凭据供给(无需 NAS),从连接器线路源携带路由 Profile,从连接器消费频道上下文,Nous 认证溯源 + /api/status 上的 nous_session_valid 用于托管自愈。
消息平台
| 平台 | 关键更新 |
|---|---|
| Telegram、Discord、Matrix | 内联选择按钮支持 /reasoning 和 /fast——点一下就行 |
| 原生 Baileys 投票(澄清问题渲染为投票)、位置、富入站元数据、仪表板配对流程 | |
| Discord | 重连后恢复丢失消息;自动创建的帖子重命名为会话标题;可配置交互视图超时;可选执行审批时的所有者提及 |
| Slack | Agent 执行期间工具状态栏实时更新 |
| Telegram | 按话题的自由回复白名单 |
| Google Chat | 澄清提示渲染为卡片 |
| 语音 | stt.echo_transcripts 开关;独立发送时 MEDIA 附带字幕 |
桌面端
- 贡献驱动的 Shell 架构,基于布局树模型——面板、区域、布局皆为数据
- 能力页面:技能/工具/MCP + Hub 一页汇聚,带响应式覆盖导航
- Hermes Cloud 连接模式,支持软 Gateway 切换和 Gateway 设置打磨
- 快捷键提示+ 快捷键设置 Tab + 统一工作树弹窗
- 会话 + 项目颜色系统——从项目继承,每会话可覆盖,侧边栏/Tab 共享
- 声明式记忆 Provider 面板 + 完整配置模态框
- 配置定义的 TTS/STT Provider,带 xAI TTS 参数
- UI 缩放设置、Ctrl/Cmd+滚轮缩放、聊天背景开关
- 桌面端树全面 TypeScript 化
CLI 和 TUI
/model --once——一次性模型切换,完成后自动恢复- 斜杠技能叠加调用——
/skill-a /skill-b 做 XYZ按顺序加载两个技能 --safe-mode故障排查标志;卸载预演;TLS 失败快速报错并给出修复建议/compact别名 + 预览标志- Hermes Console REPL 含性能跟进
- TUI:模型选择器刷新支持;自定义技能包作为 Agent 轮次发送
工具系统、技能和 MCP
- MCP:
mcp__server__tool命名规范;服务器日志通知显示在 agent.log;Dashboard + 桌面端的托管 OAuth 全面完工;可配置redirect_uri/redirect_host支持代理/WAF 环境 - 技能:
security/unbroker(自主数据经纪人移除);blender-mcp围绕目录条目重做;unreal-mcp配套技能;人性化模式扩展 - 浏览器:截断时保存完整快照;eval 拒绝列表可选加入
- 看板:模态创建任务弹窗 + 可编辑看板项目目录;拖拽平移看板滚动;附件工具集 + 带 SSRF 防护的 CLI URL 抓取
- Cron:持久化执行审计历史;一次性过期移除竞态修复;运行声明 TTL 从
HERMES_CRON_TIMEOUT派生
会话和数据导出
# 多种格式导出会话
hermes sessions export --format markdown
hermes sessions export --format html
hermes sessions export --format quarto
hermes sessions export --format prompt-only
hermes sessions export --format hf-trace # 可直接上 Hugging Face
# 敏感信息脱敏
hermes sessions export --redact
# 按时间、工作区、平台过滤
hermes sessions export --older-than 30d --workspace my-project
你的对话历史现在是一个真正的数据集,不再是黑箱。
密钥和配置
- 可插拔
SecretSource接口,含 Bitwarden 和 1Password Provider hermes config get/unset配置管理命令- 未知根配置键告警 + 诊断工具废弃键报告
- 辅助模型用量按任务记录到会话账本
- 会话级 Nous Portal 用量标签覆盖 aux/MoA/delegate 调用
MoA 改进
reference_max_tokens限制顾问输出并削减延迟- 按 preset 的分发节奏——
user_turn每个用户轮次只跑一次顾问 - 过期 preset 上浮展示,不重试;半填充 preset 保存在 API 边界拒绝
- 聚合器像行为模型一样处理推理
安全与可靠性
凭证面加固
- Vertex 凭证隔离出子进程环境,通过 Profile 密钥范围管理
- 六个 P1 加固 PR 一次性 salvage——浏览器防护、MEDIA 锚定、.env 锁定、委派 ACP 传输
- 媒体/视觉/图像生成本地文件读取统一走共享的凭证读取守卫
- Webhook 请求体上限扫荡覆盖所有 aiohttp 服务器
- Telegram 传输错误中的机器人 Token 脱敏
- Fireworks Token 前缀加入脱敏器
- CI 加固防御不受信任引用注入
脱敏和安全默认值
- 修复
KEY=value和 JSON/YAML 配置字段的环境变量查找假阳性 - Telegram 连接/发送错误中的机器人 Token 清理
computer_use子进程环境变量在所有五个 cua-driver 生成点全面净化
Gateway 和 Agent 可靠性
tool_call_id去重贯穿 API 前净化器- 后台审查继承父级 reasoning_config,保证 Anthropic 缓存对等
- Anthropic 请求级本地客户端,防止过期/中断看门狗损坏 SQLite
- OAuth 登录 429 修复——UA 不能是
claude-code/
Dashboard 安全
- 托管文件凭证守卫扩展到
.env以外 + 目录树缺口闭合 - OAuth Token TOCTOU 通过原子化
0o600写入修复 - 过期 Dashboard 无法重建已删除的 Profile
本窗口回滚项
- iron-proxy 凭证注入出口防火墙——已回滚,不随本次发送
- dynamic-workflow 编排技能——已合入,后回滚
- memory provider-actions 扩展点——已合入,后回滚
- 备注:插件
pre_tool_call审批升级在窗口中回滚,但已重新合入并随本次版本发布
升级
hermes update
全新安装:
# macOS / Linux / WSL2
curl -fsSL https://hermes-agent.nousresearch.com/install.sh | bash
# Windows(PowerShell)
iex (irm https://hermes-agent.nousresearch.com/install.ps1)
← Hermes Agent Changelog