Hermes Agent v0.2.0 — 首次公开发布
概览
v0.2.0 — 首次公开发布。 2026 年 3 月 12 日。216 个合并 PR · 63 位贡献者 · 119 个已解决 issue · 从几乎零测试到 3,289 项。
这是 Hermes Agent 正式面世的时刻。在内部 v0.1.0 基础版本之后的短短两周内,项目从一个小型研究原型迅速演化为功能完备、社区驱动的 AI 智能体平台。这个版本令人印象深刻的不仅是功能列表——更是其惊人的迭代速度。63 位来自开源社区的贡献者为代码、测试、文档和安全修复做出了贡献,从第一天起就参与了项目架构的塑造。
v0.2.0 确立了贯穿 Hermes 所有后续版本的核心基因:自我进化的技能系统、触达各类平台的消息网关、基于 MCP 的工具可扩展性,以及从一开始就严肃对待的安全理念。
重磅功能
1. 多平台消息网关
Hermes 不只是一个 CLI 工具——它生活在您的各种通讯平台中。网关系统将完整的智能体体验带到七大消息平台上,支持统一的会话管理、媒体附件和按平台配置的工具。
| 平台 | 核心能力 |
|---|---|
| Telegram | 文件附件、文档处理(PDF/Office)、论坛话题隔离、浏览器截图、位置分享 |
| Discord | 频道话题上下文、文档/视频支持、Bot 消息过滤 |
| Slack | App 提及处理、文档/视频分享、结构化日志 |
| 原生媒体发送(图片/视频/文档)、多用户会话隔离、跨平台端口处理 | |
| Signal | 通过 signal-cli-rest-api 实现完整网关、媒体 URL 支持 |
| Email(IMAP/SMTP) | 完整邮件网关——通过任意邮件服务商收发邮件 |
| Home Assistant | REST 工具 + WebSocket 集成、服务发现 |
网关核心还引入了跨平台功能:子智能体工具调用可见性、可配置的后台进程通知、带平台降级的 edit_message(),以及 /compress、/usage、/update 等斜杠命令。
2. MCP(模型上下文协议)客户端
原生 MCP 支持是 Hermes 最早期的架构决策之一——而且极富远见。在 MCP 成为今日行业标准之前,Hermes 已经拥有了生产级的客户端。
# MCP 服务器在 config.yaml 中配置
# Hermes 自动发现工具、资源和提示
hermes tools # 在 curses UI 中浏览和启用 MCP 工具
/reload-mcp # 热重载 MCP 服务器,无需重启
核心能力:
- stdio 和 HTTP 传输——连接本地和远程 MCP 服务器
- 采样支持——MCP 服务器可通过 Hermes 发起 LLM 请求
- 资源和提示发现——自动暴露服务器能力
- 自动重连——服务器崩溃后恢复,不丢失状态
- 安全加固——MCP 服务器的工具同样受到审批策略约束
3. 技能生态——70+ 技能、自我进化的智能体
技能系统——Hermes 的标志性差异化特性——在首发时就已经相当完备。70+ 内置和可选技能,涵盖 15+ 个类别,搭配 Skills Hub 供社区发现。
技能如何工作:
技能是存储在 ~/.hermes/skills/ 中的 Markdown 文档。当 Hermes 遇到相关任务时,会将匹配的技能作为程序性指导加载到上下文中。任务完成后,一个后台“复盘分支”会评估技能是否有效——并自动编写或更新技能。
# 浏览技能中心
hermes skills browse
# 技能可按平台启用/禁用
# 支持基于工具可用性的条件激活
# 前提条件确保未满足依赖的技能保持隐藏
v0.2.0 新增技能包括:
- ASCII 艺术——pyfiglet(571 种字体)、cowsay、图片转 ASCII
- ASCII 视频——完整的终端视频制作流水线
- DuckDuckGo 搜索——隐私优先的网页搜索,支持 Firecrawl 降级
- Solana 区块链——钱包余额、美元定价、代币名称
- AgentMail——智能体专属邮箱
- Polymarket——预测市场数据(只读)
- OpenClaw 迁移——从 OpenClaw 迁移到 Hermes 的官方工具
- 域名情报——被动侦查:子域名、SSL 证书、WHOIS、DNS
- Superpowers——软件开发技能集
- Hermes-Atropos——RL 环境开发
- 以及:arXiv 搜索、OCR/文档、Excalidraw 图表、YouTube 字幕、GIF 搜索和 40+ MLOps 技能
(#743 — @teyrebaz33,#785 — @teyrebaz33)
4. 统一 Provider 路由器
在 v0.2.0 之前,Provider 逻辑分散在视觉理解、摘要、压缩和轨迹保存等模块中——每个模块通过自己的代码路径调用 LLM。统一的 Provider 路由器将所有调用整合到单一的 call_llm() / async_call_llm() API 之后。
# 所有辅助消费者现在通过同一条代码路径:
# resolve_provider_client() → call_llm()
# 自动凭证解析、错误处理和重试逻辑
首发时支持的 Provider:
- Nous Portal——原生 OAuth 集成
- OpenAI Codex——Responses API,支持 ChatGPT 订阅
- OpenRouter——200+ 模型,支持路由偏好
- Kimi Code API——月之暗面的编程专用模型
- MiniMax——更新的模型 ID
- z.ai/GLM——清华智谱的双语模型
- Azure OpenAI——企业部署支持
- 自托管 Firecrawl——在自有基础设施上运行网页抓取
(#1003)
5. ACP 服务器——编辑器集成
VS Code、Zed 和 JetBrains 编辑器现在可以通过 Agent Communication Protocol(ACP) 标准连接 Hermes。这意味着在终端和消息应用中运行的同一个智能体,可以直接在编辑器内为您提供协助。
(#949)
6. CLI 皮肤/主题引擎
数据驱动的视觉自定义系统,内置 7 款皮肤(default、ares、mono、slate、poseidon、sisyphus、charizard),同时支持自定义 YAML 皮肤。横幅、加载动画、颜色和品牌标识均可配置——无需修改代码。
# ~/.hermes/skins/my-skin.yaml
banner: "custom"
spinner: "dots"
colors:
accent: "#00E5A0"
background: "#0A0A0F"
7. Git Worktree 隔离
hermes -w 在 git worktree 中启动隔离的智能体会话,实现对同一仓库的安全并行操作。每个 worktree 拥有独立的工作目录、分支和智能体会话——同时运行多个智能体时再也不会互相干扰。
# 在 git worktree 中启动 Hermes,实现隔离的并行工作
hermes -w
(#654)
8. 文件系统快照与回滚
在破坏性文件操作之前自动创建快照。/rollback 命令将文件恢复到先前的状态——一张让您放心大胆实验的安全网。
# 智能体在破坏性操作前自动创建快照
# 在 CLI 中使用 /rollback 恢复
# 适用于所有终端后端(本地、Docker、SSH、Modal)
(#824)
核心智能体与架构
智能体循环改进
智能体循环经过大幅加固,以应对真实场景中的各种边缘情况:
- 简单降级模型——主 Provider 失败时,Hermes 自动透明切换到配置好的备选 Provider(#740)
- 共享迭代预算——父智能体和子智能体委托共享统一预算,防止子智能体无限循环
- 413 负载过大处理——不再直接中断,Hermes 压缩上下文并重试(#153)
- 工具调用修复中间件——自动小写转换和无效工具处理,修复模型产生的格式错误的工具调用
- 推理力度配置——控制模型在行动前思考的深度(
/reasoning命令) - 压缩后循环检测——防止智能体在上下文压缩后反复读取/搜索文件(#705)
会话与记忆
- 命名会话——为会话设置唯一标题,支持搜索过滤浏览,按名称恢复(#720)
- Honcho 用户建模——基于 AI 的跨会话用户画像,随时间推移持续优化(#38)
- 主动记忆刷新——会话过期时异步持久化记忆
- 智能上下文长度探测——通过持久缓存检测模型上下文限制
CLI 与用户体验
交互式 CLI
终端体验得到了全面打磨:
/personality命令——自定义智能体个性或完全禁用(#773)- 用户自定义快捷命令——绕过智能体循环,快速执行预设操作(#746)
/verbose——运行时切换调试输出(#94)/insights——使用分析、费用估算和活动模式(#552)/background——从 CLI 管理后台进程- 完成提示音——智能体完成任务时终端响铃(#738)
- 上下箭头历史——浏览之前输入的命令
- 剪贴板图片粘贴——Alt+V / Ctrl+V 粘贴图片
--quiet/-Q——最少输出的程序化单查询模式--fuck-it-ship-it——绕过所有审批提示,实现全自动工作流(#724)
安装与配置
- 模块化安装向导,支持分区子命令和工具优先的用户体验
- 配置迁移系统——跨配置格式版本无缝升级(首发时为 v7)
hermes tools——通过 curses UI 按平台启用/禁用工具hermes doctor——对所有已配置的 Provider 进行健康检查hermes update——自动重启 Gateway 服务- .env 原子写入——防止崩溃时 API 密钥丢失(#954)
安全
Hermes Agent 从第一天就严肃对待安全问题。v0.2.0 配备了全面的安全加固层:
漏洞防护
| 类别 | 描述 |
|---|---|
| 路径穿越 | 修复 skill_view 中的漏洞——阻止读取任意文件(#220) |
| Shell 注入 | 防止 sudo 密码管道(#65)、tee/进程替换模式(#280)注入 |
| 符号链接攻击 | skills_guard 边界检查修复(#386)、macOS 写入拒绝列表绕过(#61) |
| 提示注入 | 多词绕过防护(#192)、Cron 扫描器绕过修复(#63) |
| 危险命令 | 多行绕过检测(#233)、--force 标志正确阻止(#388) |
数据保护
- 原子写入覆盖会话、Cron 任务、.env 配置、进程快照、批处理和技能文件——防止崩溃导致数据丢失
- 文件权限强制——敏感文件设为 0600/0700,.env 限制为仅所有者可读
- FTS5 查询净化——防止通过全文搜索查询进行 SQL 注入
- 密钥脱敏——可扩展的模式匹配,从日志和记录中剥离敏感信息
- 内存中的永久白名单——防止敏感数据泄露到磁盘(#600)
测试——从零到 3,289
当 v0.2.0 开发开始时,项目几乎零测试覆盖。社区以巨大的测试工作量作为回应:
- 3,289 项测试,覆盖智能体、网关、工具、Cron 和 CLI 模块
- 使用 pytest-xdist 并行化测试套件(#802)
- 四批单元测试,覆盖核心模块、安全关键路径和 AIAgent 循环
- 43 项 Telegram 格式测试,确保斜体/粗体/代码渲染准确性
- 42 项视觉工具测试,包含完整类型标注
- 压缩器回归测试,覆盖工具调用边界处理
这一测试基础在项目后续的快速迭代中至关重要——3,289 项测试在回归问题触及用户之前就能将其拦截。
RL 与评估环境
Hermes Agent 始终被设计为生成智能体训练数据的平台。v0.2.0 附带:
- WebResearchEnv——多步网页研究 RL 环境(#434)
- YC-Bench——长周期智能体基准测试环境
- OpenThoughts-TBLite——评估环境和脚本
- 本地 vLLM 支持——针对本地托管模型运行评估
- Hermes-Atropos——RL 环境开发的内置技能(#815)
Windows 兼容性
Windows 支持从一开始就被认真对待:
- 为 Windows 兼容性守护 POSIX 专用进程函数
- 通过 Git Bash + 基于 ZIP 的更新降级实现原生支持
pywinpty在 Windows 上提供 PTY 支持(#457)- 所有配置/数据文件 I/O 显式使用 UTF-8 编码(#458)
- 正则搜索输出的驱动器号路径处理(#533)
升级
hermes update
新用户安装:
# Linux / macOS / WSL2
curl -fsSL https://raw.githubusercontent.com/NousResearch/hermes-agent/main/scripts/install.sh | bash
← Hermes Agent Changelog