v0.8.0

Hermes Agent v0.8.0 — The Intelligence Release(智能版本)


概览

v0.8.0 — The Intelligence Release(智能版本),2026 年 4 月 8 日发布。距 v0.7.0 仅 5 天:209 个合并 PR · 82 个已解决 issue · 数百文件变更 · 众多社区贡献者。

如果说 v0.7.0 是“韧性版本”(内存可交换、Camofox 反检测浏览器、Gateway 深度加固),那 v0.8.0 的主题就是——变聪明。Hermes 学会了诊断自己的失败模式并自我修补;学会了在后台任务完成时主动通知你;学会了根据实际活动而非墙上时钟来决定是否超时。这些不是功能的堆砌,而是 Agent 智能水平的系统性抬升。


重磅功能

1. 后台任务自动通知(notify_on_complete)—— 告别轮询

后台任务完成后,Agent 会自动收到通知。启动一个长时间运行的进程——模型训练、测试套件、部署、构建——Agent 收到完成信号后自动处理结果。你不需要反复 pstail,Agent 自己会回来告诉你“搞定了”。

# 启动一个后台训练任务
hermes run "python train.py --epochs 100" --background

# 继续让 Agent 做其他事情
# 训练完成后,Agent 会自动收到通知并报告结果

(#5779)

2. 免费小米 MiMo v2 Pro 上线 Nous Portal

Nous Portal 免费层现在包含小米 MiMo v2 Pro 模型,用于压缩、视觉和摘要等辅助任务。模型选择界面同步展示定价信息,免费层有明确的使用门槛提示。对于预算敏感的开发者来说,这是实打实的降本。

(#6018, #5880)

3. 实时模型切换(/model 命令)—— 会话中途换模型

在 CLI、Telegram、Discord、Slack 或任何 Gateway 平台的会话中途切换模型和 Provider。切换逻辑聚合器感知——如果当前通过 OpenRouter 或 Nous Portal 使用模型,优先保持在聚合器内切换;只有聚合器没有的模型,才直连 Provider。Telegram 和 Discord 还提供了交互式按钮选择器,点选即可,无需手动输入模型名。

# 会话中随时切换
/model claude-sonnet-4-20250514

# 或直接打开交互选择器
/model

(#5181, #5742)

4. GPT/Codex 工具调用自我优化 —— Agent 自己给自己打补丁

这是 v0.8.0 最令人兴奋的技术突破。Hermes 团队搭建了一套自动化行为基准测试流水线,用它对 GPT 和 Codex 模型进行系统测试,识别出 5 个具体的工具调用失败模式,自动生成针对性的修复指导(guidance strings),验证修复效果,然后作为系统提示词的一部分发布。整个流程中人类充当的是审查者而非提示工程师——Agent 自己诊断自己、自己修补自己。

配合此举,系统提示词中还加入了执行纪律指导思维预填充延续(thinking-only prefill continuation),显著提升了 OpenAI 模型在工具调用场景下的可靠性。

(#6120, #5414, #5931)

5. Google AI Studio (Gemini) 原生 Provider

直接通过 Google AI Studio API 访问 Gemini 模型。集成 models.dev 注册表,自动实时检测上下文长度——不再需要手动配置 token 上限。

(#5577)

6. 基于非活跃度的智能超时 —— 干活的 Agent 永不超时

Gateway 和 Cron 的超时机制从“墙钟时间”改为“实际工具活动追踪”。长时间运行的任务如果在持续产出(执行命令、读写文件),就永不被 kill。只有真正闲置的 Agent 才会超时退出。

(#5389, #5440)

7. Slack & Telegram 审批按钮 —— 告别手敲 /approve

危险命令的审批现在通过原生平台按钮完成。Slack 端保留线程上下文、Telegram 端显示 Emoji 反应审批状态。比以前打字输入 /approve 快多了。

(#5890, #5975)

8. MCP OAuth 2.1 PKCE + OSV 恶意软件扫描

完整的 OAuth 2.1 PKCE 标准合规客户端,用于 MCP 服务器的安全认证。同时,MCP 扩展包在安装时自动通过 OSV 漏洞数据库扫描,防范恶意代码。

(#5420, #5305)

9. 集中化日志 & 配置验证

结构化日志写入 ~/.hermes/logs/ 目录(agent.log + errors.log),新增 hermes logs 命令用于查看和过滤日志。配置文件结构验证——在启动时就捕获 YAML 格式错误,抛出可操作的错误信息,避免“神秘崩溃”。

# 查看最近日志
hermes logs

# 只看错误
hermes logs --level WARNING

(#5430, #5426)

10. 插件系统大幅扩展

插件现在可以:

  • 注册独立的 CLI 子命令,无需修改核心代码
  • 接收请求级 API 钩子,带 correlation ID 追踪
  • 安装时提示必填环境变量
  • 挂钩会话生命周期事件(finalize / reset)

(#5295, #5427, #5470, #6129)

11. Matrix 升级为 Tier 1 平台

Matrix 获得 reactions、已读回执、富文本格式化和房间管理,达到与 Telegram/Discord 同等的一级支持水平。

12. 全面安全加固

SSRF 防护、时序攻击缓解、tar 路径遍历防护、凭证泄露防护、跨会话隔离——这是一次系统性的安全审计和加固。

(#5944, #5613, #5629)


核心 Agent 与架构

Provider & 模型支持

  • Google AI Studio (Gemini) 原生 Provider,集成 models.dev 自动检测上下文长度
  • /model 命令:Provider+模型系统全面重写,跨 CLI 和所有 Gateway 平台实时切换
  • Telegram / Discord 交互式模型选择器:inline 按钮点选
  • Nous Portal 免费层模型门槛,模型选择中展示定价
  • xAI (Grok) prompt 缓存:通过 x-grok-conv-id header
  • MiniMax TTS Provider (speech-2.8)
  • 非 agentic 模型警告:加载不适用于工具使用的 Hermes LLM 时提醒用户
  • Ollama Cloud auth、模型切换持久化、别名 Tab 补全
  • Model 定价展示:OpenRouter + Nous Portal Provider
  • Auxiliary client 付费回退:402 时切换到下一个 Provider
  • Auxiliary client 解析具名自定义 Provider 和 ‘main’ 别名
  • Provider 凭据重置窗口:池化故障转移中正确处理
  • OAuth token 同步:凭据池与凭据文件双向同步
  • 过时 OAuth 凭据不再阻塞 OpenRouter 自动检测
  • Codex OAuth 凭据池多种修复、auth.json 同步
  • Vision 自动检测优先尝试主 Provider
  • MiniMax 上下文长度修正、thinking guard、aux model、config base_url
  • Z.AI 端点自动探测:probe + 缓存
  • 社区 Provider/模型分辨率修复:合并 4 个社区 PR

Agent 循环与会话

  • GPT/Codex 工具调用自我优化:自动化行为基准测试识别并修复 5 个失败模式
  • GPT/Codex 执行纪律指导:加入系统提示词
  • 思维预填充延续:结构化推理响应
  • 接受仅推理响应:不再无限重试,设为 “(empty)”
  • 带抖动的指数退避重试
  • 智能 thinking block 签名管理:跨轮次保持 Anthropic thinking 签名
  • 工具调用参数类型强制转换:符合 JSON Schema(修复模型将数字/布尔值发成字符串的问题)
  • 超大工具结果存入文件:不再截断
  • 流式回退改进
  • Codex 空输出覆盖:fallback + normalizer + auxiliary client 全面补齐
  • Codex 流式输出 backfill:从 output_item.done 事件补充
  • 流消费者在工具边界后创建新消息
  • 过滤只含 transcript 角色的消息:不发给 chat-completions
  • Sanitize tool_calls:对所有 strict API (Fireworks, Mistral 等) 清理格式
  • 桥接 tool-calls:copilot-acp 适配器

记忆与会话

  • Supermemory 新内存 Provider:多容器、search_mode、identity 模板、env var 覆盖
  • 默认共享线程会话:Gateway 多用户线程支持
  • 子 Agent 会话链接到父级:会话列表中隐藏
  • Profile 级内存隔离 + clone 支持
  • 将 Gateway user_id 传递到 memory plugins:按用户区分
  • Honcho 插件漂移大修 + 插件 CLI 注册系统
  • mem0 API v2 兼容、prefetch context 围栏、secret 脱敏
  • RetainDB:API 路由、写队列、dialectic、agent model 多项修复
  • Hindsight memory 插件大修 + memory setup wizard 修复
  • OpenViking atexit 安全网、租户作用域 header
  • ByteRover brv 查询在 LLM 调用前同步执行
  • 清理后用户消息用于所有 memory provider 操作

消息平台(Gateway)

Gateway 核心

  • 基于非活跃度的超时替代墙钟超时,活跃任务永不终止
  • Slack & Telegram 审批按钮 + Slack 线程上下文保留
  • 实时流式 /update 输出 + 交互式提示转发给用户
  • 无限超时支持 + 周期性通知 + 可操作错误信息
  • 重复消息防护:Gateway 去重 + 部分流守卫
  • Webhook delivery_info 持久化 + /status 显示完整 session id
  • 工具预览截断遵守 tool_preview_length 配置
  • 审批 session key 按 turn 隔离
  • 活跃 session 守卫绕过:允许 /approve、/deny、/stop、/new
  • 打字指示器在审批等待时暂停
  • Caption 检查改为逐行精确匹配(所有平台)
  • MEDIA: tags 在流式 Gateway 消息中剥离、在 cron 投递前提取
  • Profile 感知的服务单元 + 语音转录清理
  • 线程安全的 PairingStore 原子写入
  • Cron 静态方法包装器防止自绑定

各平台改进

平台 主要变更
Telegram 群组话题 Skill 绑定、Emoji 反应审批状态、重复消息防护、命令名清理、每个平台禁用 Skill 支持
Discord 频道控制(ignored_channels / no_thread_channels)、Skill 注册为原生 slash 命令、/approve 等注册为 slash 命令、移除不必要的 members intent
Slack 线程自动参与、mrkdwn 编辑消息、线程回复无 @mention
Matrix Tier 1 升级:reactions、已读回执、富文本、房间管理、CJK 输入、E2EE、Reconnect
Signal 完整 MEDIA: tag 投递
Mattermost 文件附件支持
飞书 交互式卡片审批按钮、Reconnect + ACL 修复
Webhooks {__raw__} 模板 token、thread_id 透传 for 论坛话题

CLI 与用户体验

交互式 CLI

  • 推理完成后才展示响应内容
  • 终端 resize 时清除幽灵状态栏
  • 粘贴文本中的 \r\n 和 \r 行尾标准化
  • Windows 原生图片粘贴支持
  • --yolo 等 flag 不再被静默丢弃(放在 chat 前也正确解析)
  • ChatConsole 错误、curses 滚动、主题感知 banner、git 状态修复

设置与配置

  • 配置结构验证:启动时检测 YAML 格式错误,给出可操作的错误提示
  • 集中化日志~/.hermes/logs/ (agent.log + errors.log),hermes logs 命令
  • Doctor 诊断增强:同步 Provider 检查、配置迁移、WAL 和 mem0 诊断
  • 超时调试日志和用户诊断信息改进
  • Reasoning effort 统一到仅 config.yaml
  • 永久命令白名单在启动时加载
  • hermes auth remove 现在永久清除 env-seeded 凭据
  • 更新时同步 bundled skills 到所有 profile
  • hermes update 不再 kill刚重启的 Gateway 服务
  • 所有 Gateway CLI 命令添加 subprocess.run() 超时
  • 文档链接加入 setup wizard 各章节

Cron 系统

  • 基于非活跃度的 cron 超时:活跃任务无限运行
  • 运行前脚本注入:用于数据收集和变更检测
  • 投递失败追踪记录在 job 状态中
  • 投递指导加入 cron prompt:防止 send_message 反复尝试
  • MEDIA 文件投递为原生平台附件
  • [SILENT] 抑制在响应的任意位置生效
  • Cron 路径遍历加固

工具系统

终端与执行

  • 远程后端代码执行:Docker、SSH、Modal 等远程终端后端可用 execute_code
  • 退出码上下文:常见 CLI 工具的退出码说明,帮 Agent 理解问题所在
  • 渐进式子目录提示发现:Agent 在导航过程中逐渐了解项目结构
  • notify_on_complete:后台进程完成通知
  • Docker env 配置:通过 docker_env 设置容器环境变量
  • 审批元数据包含在终端工具结果中
  • 所有后端 workdir 参数清理

浏览器

  • 浏览器 Provider 从 Browserbase 切换为 Browser Use
  • Firecrawl cloud browser Provider
  • JS 评估:通过 browser_console expression 参数
  • Windows 浏览器修复

MCP

  • MCP OAuth 2.1 PKCE:完整标准合规客户端
  • OSV 恶意软件检查:MCP 扩展包
  • 优先使用 structuredContent 替代 text + no_mcp 哨兵
  • MCP server 名称不再触发“未知工具集”警告

Web 与文件

  • .zip 文档支持 + 自动挂载缓存目录到远程后端
  • send_message 错误中脱敏 query secrets

委托

  • 凭据池共享 + 子 Agent 工作区路径提示

ACP (VS Code / Zed / JetBrains)

  • 聚合 ACP 改进:auth 兼容、协议修复、command ads、delegation、SSE 事件

技能生态

Skills 系统

  • Skill 配置接口:Skills 可声明必要的 config.yaml 设置,在 setup 时提示,负载时注入
  • 插件 CLI 注册系统:不改 main.py 即可注册子命令
  • 请求级 API 钩子:带 tool call correlation ID
  • 会话生命周期钩子:on_session_finalize / on_session_reset(CLI + Gateway)
  • 安装时提示必填 env vars
  • 插件名验证:拒绝解析到 plugins 根目录的名称
  • pre_llm_call 上下文移至 user message:保护 prompt 缓存

新增/更新 Skill

  • popular-web-designs:54 套生产级网站设计系统
  • p5js creative coding
  • manim-video:数学和技术动画
  • llm-wiki:Karpathy 的 LLM Wiki
  • gitnexus-explorer:代码库索引与知识服务
  • research-paper-writing:AI-Scientist & GPT-Researcher 模式
  • blogwatcher:更新至 JulienTant fork
  • Claude Code skill 全面重写 v2.0 + v2.2
  • Manim CE 参考文档扩展:几何、动画、LaTeX
  • 代码验证 skills 合并为统一入口

安全与可靠性

安全加固

  • 综合安全加固:SSRF 防护、时序攻击缓解、tar 遍历防护、凭证泄露防护
  • 跨会话隔离 + Cron 路径遍历加固
  • 所有后端的 workdir 参数清理
  • 审批 “once” 会话升级防护 + Cron 投递平台验证
  • Profile 级 Google Workspace OAuth token 保护

可靠性

  • 激进的工作树和分支清理:防止积累
  • O(n^2) 灾难性回溯正则修复:大输出场景 100 倍提升
  • 运行时稳定性修复:core、web、delegate、browser 工具
  • API server 流式修复 + 对话历史支持
  • OpenViking API 端点路径和响应解析修正

重点 Bug 修复

  • 批量合并 9 个社区 bug 修复:Gateway、Cron、依赖、macOS launchd
  • 批量核心 bug 修复:model config、session reset、alias fallback、launchctl、delegation
  • 批量 Gateway/平台修复:Matrix E2EE、CJK 输入、Windows 浏览器、飞书 Reconnect + ACL
  • 移除过时测试跳过、正则回溯、文件搜索 bug、测试不稳定修复
  • Nix flake:读取版本、重新生成 uv.lock、添加 hermes_logging
  • 小写变量脱敏回归测试

测试

  • 57 个失败 CI 测试修复:跨越 14 个文件
  • 测试套件重新架构 + CI 失败修复
  • 代码库全局 lint 清理:未使用的 import、死代码、低效模式
  • 移除 browser_close 工具:自动清理接管

文档

  • 全面文档审计:修复过时信息、扩展薄弱页面、增加深度
  • 40+ 处代码文档差异修复
  • 13 个上周新功能文档化
  • Guides 部分大修:修复现有 + 新增 3 个教程
  • 抢救 4 个文档 PR:docker 设置、更新后验证、本地 LLM 指南、signal-cli 安装
  • Discord 配置参考
  • 社区 FAQ:常见工作流和故障排除
  • WSL2 网络指南:本地模型服务器
  • Honcho CLI 参考 + 插件 CLI 注册文档
  • Obsidian Headless 设置(llm-wiki 中)
  • Hermes Mod 视觉皮肤编辑器加入 skins 页面

升级

hermes update

全新安装请参考安装指南


GitHub 完整 Changelog

← Hermes Agent Changelog