Hermes Agent v0.8.0 — The Intelligence Release(智能版本)
概览
v0.8.0 — The Intelligence Release(智能版本),2026 年 4 月 8 日发布。距 v0.7.0 仅 5 天:209 个合并 PR · 82 个已解决 issue · 数百文件变更 · 众多社区贡献者。
如果说 v0.7.0 是“韧性版本”(内存可交换、Camofox 反检测浏览器、Gateway 深度加固),那 v0.8.0 的主题就是——变聪明。Hermes 学会了诊断自己的失败模式并自我修补;学会了在后台任务完成时主动通知你;学会了根据实际活动而非墙上时钟来决定是否超时。这些不是功能的堆砌,而是 Agent 智能水平的系统性抬升。
重磅功能
1. 后台任务自动通知(notify_on_complete)—— 告别轮询
后台任务完成后,Agent 会自动收到通知。启动一个长时间运行的进程——模型训练、测试套件、部署、构建——Agent 收到完成信号后自动处理结果。你不需要反复 ps 或 tail,Agent 自己会回来告诉你“搞定了”。
# 启动一个后台训练任务
hermes run "python train.py --epochs 100" --background
# 继续让 Agent 做其他事情
# 训练完成后,Agent 会自动收到通知并报告结果
(#5779)
2. 免费小米 MiMo v2 Pro 上线 Nous Portal
Nous Portal 免费层现在包含小米 MiMo v2 Pro 模型,用于压缩、视觉和摘要等辅助任务。模型选择界面同步展示定价信息,免费层有明确的使用门槛提示。对于预算敏感的开发者来说,这是实打实的降本。
3. 实时模型切换(/model 命令)—— 会话中途换模型
在 CLI、Telegram、Discord、Slack 或任何 Gateway 平台的会话中途切换模型和 Provider。切换逻辑聚合器感知——如果当前通过 OpenRouter 或 Nous Portal 使用模型,优先保持在聚合器内切换;只有聚合器没有的模型,才直连 Provider。Telegram 和 Discord 还提供了交互式按钮选择器,点选即可,无需手动输入模型名。
# 会话中随时切换
/model claude-sonnet-4-20250514
# 或直接打开交互选择器
/model
4. GPT/Codex 工具调用自我优化 —— Agent 自己给自己打补丁
这是 v0.8.0 最令人兴奋的技术突破。Hermes 团队搭建了一套自动化行为基准测试流水线,用它对 GPT 和 Codex 模型进行系统测试,识别出 5 个具体的工具调用失败模式,自动生成针对性的修复指导(guidance strings),验证修复效果,然后作为系统提示词的一部分发布。整个流程中人类充当的是审查者而非提示工程师——Agent 自己诊断自己、自己修补自己。
配合此举,系统提示词中还加入了执行纪律指导和思维预填充延续(thinking-only prefill continuation),显著提升了 OpenAI 模型在工具调用场景下的可靠性。
5. Google AI Studio (Gemini) 原生 Provider
直接通过 Google AI Studio API 访问 Gemini 模型。集成 models.dev 注册表,自动实时检测上下文长度——不再需要手动配置 token 上限。
(#5577)
6. 基于非活跃度的智能超时 —— 干活的 Agent 永不超时
Gateway 和 Cron 的超时机制从“墙钟时间”改为“实际工具活动追踪”。长时间运行的任务如果在持续产出(执行命令、读写文件),就永不被 kill。只有真正闲置的 Agent 才会超时退出。
7. Slack & Telegram 审批按钮 —— 告别手敲 /approve
危险命令的审批现在通过原生平台按钮完成。Slack 端保留线程上下文、Telegram 端显示 Emoji 反应审批状态。比以前打字输入 /approve 快多了。
8. MCP OAuth 2.1 PKCE + OSV 恶意软件扫描
完整的 OAuth 2.1 PKCE 标准合规客户端,用于 MCP 服务器的安全认证。同时,MCP 扩展包在安装时自动通过 OSV 漏洞数据库扫描,防范恶意代码。
9. 集中化日志 & 配置验证
结构化日志写入 ~/.hermes/logs/ 目录(agent.log + errors.log),新增 hermes logs 命令用于查看和过滤日志。配置文件结构验证——在启动时就捕获 YAML 格式错误,抛出可操作的错误信息,避免“神秘崩溃”。
# 查看最近日志
hermes logs
# 只看错误
hermes logs --level WARNING
10. 插件系统大幅扩展
插件现在可以:
- 注册独立的 CLI 子命令,无需修改核心代码
- 接收请求级 API 钩子,带 correlation ID 追踪
- 安装时提示必填环境变量
- 挂钩会话生命周期事件(finalize / reset)
11. Matrix 升级为 Tier 1 平台
Matrix 获得 reactions、已读回执、富文本格式化和房间管理,达到与 Telegram/Discord 同等的一级支持水平。
12. 全面安全加固
SSRF 防护、时序攻击缓解、tar 路径遍历防护、凭证泄露防护、跨会话隔离——这是一次系统性的安全审计和加固。
核心 Agent 与架构
Provider & 模型支持
- Google AI Studio (Gemini) 原生 Provider,集成 models.dev 自动检测上下文长度
/model命令:Provider+模型系统全面重写,跨 CLI 和所有 Gateway 平台实时切换- Telegram / Discord 交互式模型选择器:inline 按钮点选
- Nous Portal 免费层模型门槛,模型选择中展示定价
- xAI (Grok) prompt 缓存:通过
x-grok-conv-idheader - MiniMax TTS Provider (speech-2.8)
- 非 agentic 模型警告:加载不适用于工具使用的 Hermes LLM 时提醒用户
- Ollama Cloud auth、模型切换持久化、别名 Tab 补全
- Model 定价展示:OpenRouter + Nous Portal Provider
- Auxiliary client 付费回退:402 时切换到下一个 Provider
- Auxiliary client 解析具名自定义 Provider 和 ‘main’ 别名
- Provider 凭据重置窗口:池化故障转移中正确处理
- OAuth token 同步:凭据池与凭据文件双向同步
- 过时 OAuth 凭据不再阻塞 OpenRouter 自动检测
- Codex OAuth 凭据池多种修复、auth.json 同步
- Vision 自动检测优先尝试主 Provider
- MiniMax 上下文长度修正、thinking guard、aux model、config base_url
- Z.AI 端点自动探测:probe + 缓存
- 社区 Provider/模型分辨率修复:合并 4 个社区 PR
Agent 循环与会话
- GPT/Codex 工具调用自我优化:自动化行为基准测试识别并修复 5 个失败模式
- GPT/Codex 执行纪律指导:加入系统提示词
- 思维预填充延续:结构化推理响应
- 接受仅推理响应:不再无限重试,设为 “(empty)”
- 带抖动的指数退避重试
- 智能 thinking block 签名管理:跨轮次保持 Anthropic thinking 签名
- 工具调用参数类型强制转换:符合 JSON Schema(修复模型将数字/布尔值发成字符串的问题)
- 超大工具结果存入文件:不再截断
- 流式回退改进
- Codex 空输出覆盖:fallback + normalizer + auxiliary client 全面补齐
- Codex 流式输出 backfill:从 output_item.done 事件补充
- 流消费者在工具边界后创建新消息
- 过滤只含 transcript 角色的消息:不发给 chat-completions
- Sanitize tool_calls:对所有 strict API (Fireworks, Mistral 等) 清理格式
- 桥接 tool-calls:copilot-acp 适配器
记忆与会话
- Supermemory 新内存 Provider:多容器、search_mode、identity 模板、env var 覆盖
- 默认共享线程会话:Gateway 多用户线程支持
- 子 Agent 会话链接到父级:会话列表中隐藏
- Profile 级内存隔离 + clone 支持
- 将 Gateway user_id 传递到 memory plugins:按用户区分
- Honcho 插件漂移大修 + 插件 CLI 注册系统
- mem0 API v2 兼容、prefetch context 围栏、secret 脱敏
- RetainDB:API 路由、写队列、dialectic、agent model 多项修复
- Hindsight memory 插件大修 + memory setup wizard 修复
- OpenViking atexit 安全网、租户作用域 header
- ByteRover brv 查询在 LLM 调用前同步执行
- 清理后用户消息用于所有 memory provider 操作
消息平台(Gateway)
Gateway 核心
- 基于非活跃度的超时替代墙钟超时,活跃任务永不终止
- Slack & Telegram 审批按钮 + Slack 线程上下文保留
- 实时流式 /update 输出 + 交互式提示转发给用户
- 无限超时支持 + 周期性通知 + 可操作错误信息
- 重复消息防护:Gateway 去重 + 部分流守卫
- Webhook delivery_info 持久化 + /status 显示完整 session id
- 工具预览截断遵守 tool_preview_length 配置
- 审批 session key 按 turn 隔离
- 活跃 session 守卫绕过:允许 /approve、/deny、/stop、/new
- 打字指示器在审批等待时暂停
- Caption 检查改为逐行精确匹配(所有平台)
- MEDIA: tags 在流式 Gateway 消息中剥离、在 cron 投递前提取
- Profile 感知的服务单元 + 语音转录清理
- 线程安全的 PairingStore 原子写入
- Cron 静态方法包装器防止自绑定
各平台改进
| 平台 | 主要变更 |
|---|---|
| Telegram | 群组话题 Skill 绑定、Emoji 反应审批状态、重复消息防护、命令名清理、每个平台禁用 Skill 支持 |
| Discord | 频道控制(ignored_channels / no_thread_channels)、Skill 注册为原生 slash 命令、/approve 等注册为 slash 命令、移除不必要的 members intent |
| Slack | 线程自动参与、mrkdwn 编辑消息、线程回复无 @mention |
| Matrix | Tier 1 升级:reactions、已读回执、富文本、房间管理、CJK 输入、E2EE、Reconnect |
| Signal | 完整 MEDIA: tag 投递 |
| Mattermost | 文件附件支持 |
| 飞书 | 交互式卡片审批按钮、Reconnect + ACL 修复 |
| Webhooks | {__raw__} 模板 token、thread_id 透传 for 论坛话题 |
CLI 与用户体验
交互式 CLI
- 推理完成后才展示响应内容
- 终端 resize 时清除幽灵状态栏
- 粘贴文本中的 \r\n 和 \r 行尾标准化
- Windows 原生图片粘贴支持
--yolo等 flag 不再被静默丢弃(放在chat前也正确解析)- ChatConsole 错误、curses 滚动、主题感知 banner、git 状态修复
设置与配置
- 配置结构验证:启动时检测 YAML 格式错误,给出可操作的错误提示
- 集中化日志:
~/.hermes/logs/(agent.log + errors.log),hermes logs命令 - Doctor 诊断增强:同步 Provider 检查、配置迁移、WAL 和 mem0 诊断
- 超时调试日志和用户诊断信息改进
- Reasoning effort 统一到仅 config.yaml
- 永久命令白名单在启动时加载
hermes auth remove现在永久清除 env-seeded 凭据- 更新时同步 bundled skills 到所有 profile
hermes update不再 kill刚重启的 Gateway 服务- 所有 Gateway CLI 命令添加 subprocess.run() 超时
- 文档链接加入 setup wizard 各章节
Cron 系统
- 基于非活跃度的 cron 超时:活跃任务无限运行
- 运行前脚本注入:用于数据收集和变更检测
- 投递失败追踪记录在 job 状态中
- 投递指导加入 cron prompt:防止 send_message 反复尝试
- MEDIA 文件投递为原生平台附件
- [SILENT] 抑制在响应的任意位置生效
- Cron 路径遍历加固
工具系统
终端与执行
- 远程后端代码执行:Docker、SSH、Modal 等远程终端后端可用 execute_code
- 退出码上下文:常见 CLI 工具的退出码说明,帮 Agent 理解问题所在
- 渐进式子目录提示发现:Agent 在导航过程中逐渐了解项目结构
- notify_on_complete:后台进程完成通知
- Docker env 配置:通过 docker_env 设置容器环境变量
- 审批元数据包含在终端工具结果中
- 所有后端 workdir 参数清理
浏览器
- 浏览器 Provider 从 Browserbase 切换为 Browser Use
- Firecrawl cloud browser Provider
- JS 评估:通过 browser_console expression 参数
- Windows 浏览器修复
MCP
- MCP OAuth 2.1 PKCE:完整标准合规客户端
- OSV 恶意软件检查:MCP 扩展包
- 优先使用 structuredContent 替代 text + no_mcp 哨兵
- MCP server 名称不再触发“未知工具集”警告
Web 与文件
- .zip 文档支持 + 自动挂载缓存目录到远程后端
- send_message 错误中脱敏 query secrets
委托
- 凭据池共享 + 子 Agent 工作区路径提示
ACP (VS Code / Zed / JetBrains)
- 聚合 ACP 改进:auth 兼容、协议修复、command ads、delegation、SSE 事件
技能生态
Skills 系统
- Skill 配置接口:Skills 可声明必要的 config.yaml 设置,在 setup 时提示,负载时注入
- 插件 CLI 注册系统:不改 main.py 即可注册子命令
- 请求级 API 钩子:带 tool call correlation ID
- 会话生命周期钩子:on_session_finalize / on_session_reset(CLI + Gateway)
- 安装时提示必填 env vars
- 插件名验证:拒绝解析到 plugins 根目录的名称
- pre_llm_call 上下文移至 user message:保护 prompt 缓存
新增/更新 Skill
- popular-web-designs:54 套生产级网站设计系统
- p5js creative coding
- manim-video:数学和技术动画
- llm-wiki:Karpathy 的 LLM Wiki
- gitnexus-explorer:代码库索引与知识服务
- research-paper-writing:AI-Scientist & GPT-Researcher 模式
- blogwatcher:更新至 JulienTant fork
- Claude Code skill 全面重写 v2.0 + v2.2
- Manim CE 参考文档扩展:几何、动画、LaTeX
- 代码验证 skills 合并为统一入口
安全与可靠性
安全加固
- 综合安全加固:SSRF 防护、时序攻击缓解、tar 遍历防护、凭证泄露防护
- 跨会话隔离 + Cron 路径遍历加固
- 所有后端的 workdir 参数清理
- 审批 “once” 会话升级防护 + Cron 投递平台验证
- Profile 级 Google Workspace OAuth token 保护
可靠性
- 激进的工作树和分支清理:防止积累
- O(n^2) 灾难性回溯正则修复:大输出场景 100 倍提升
- 运行时稳定性修复:core、web、delegate、browser 工具
- API server 流式修复 + 对话历史支持
- OpenViking API 端点路径和响应解析修正
重点 Bug 修复
- 批量合并 9 个社区 bug 修复:Gateway、Cron、依赖、macOS launchd
- 批量核心 bug 修复:model config、session reset、alias fallback、launchctl、delegation
- 批量 Gateway/平台修复:Matrix E2EE、CJK 输入、Windows 浏览器、飞书 Reconnect + ACL
- 移除过时测试跳过、正则回溯、文件搜索 bug、测试不稳定修复
- Nix flake:读取版本、重新生成 uv.lock、添加 hermes_logging
- 小写变量脱敏回归测试
测试
- 57 个失败 CI 测试修复:跨越 14 个文件
- 测试套件重新架构 + CI 失败修复
- 代码库全局 lint 清理:未使用的 import、死代码、低效模式
- 移除 browser_close 工具:自动清理接管
文档
- 全面文档审计:修复过时信息、扩展薄弱页面、增加深度
- 40+ 处代码文档差异修复
- 13 个上周新功能文档化
- Guides 部分大修:修复现有 + 新增 3 个教程
- 抢救 4 个文档 PR:docker 设置、更新后验证、本地 LLM 指南、signal-cli 安装
- Discord 配置参考
- 社区 FAQ:常见工作流和故障排除
- WSL2 网络指南:本地模型服务器
- Honcho CLI 参考 + 插件 CLI 注册文档
- Obsidian Headless 设置(llm-wiki 中)
- Hermes Mod 视觉皮肤编辑器加入 skins 页面
升级
hermes update
全新安装请参考安装指南。
← Hermes Agent Changelog