v0.2.0

Hermes Agent v0.2.0 — 首次公开发布


概览

v0.2.0 — 首次公开发布。 2026 年 3 月 12 日。216 个合并 PR · 63 位贡献者 · 119 个已解决 issue · 从几乎零测试到 3,289 项

这是 Hermes Agent 正式面世的时刻。在内部 v0.1.0 基础版本之后的短短两周内,项目从一个小型研究原型迅速演化为功能完备、社区驱动的 AI 智能体平台。这个版本令人印象深刻的不仅是功能列表——更是其惊人的迭代速度。63 位来自开源社区的贡献者为代码、测试、文档和安全修复做出了贡献,从第一天起就参与了项目架构的塑造。

v0.2.0 确立了贯穿 Hermes 所有后续版本的核心基因:自我进化的技能系统触达各类平台的消息网关基于 MCP 的工具可扩展性,以及从一开始就严肃对待的安全理念


重磅功能

1. 多平台消息网关

Hermes 不只是一个 CLI 工具——它生活在您的各种通讯平台中。网关系统将完整的智能体体验带到七大消息平台上,支持统一的会话管理、媒体附件和按平台配置的工具。

平台 核心能力
Telegram 文件附件、文档处理(PDF/Office)、论坛话题隔离、浏览器截图、位置分享
Discord 频道话题上下文、文档/视频支持、Bot 消息过滤
Slack App 提及处理、文档/视频分享、结构化日志
WhatsApp 原生媒体发送(图片/视频/文档)、多用户会话隔离、跨平台端口处理
Signal 通过 signal-cli-rest-api 实现完整网关、媒体 URL 支持
Email(IMAP/SMTP) 完整邮件网关——通过任意邮件服务商收发邮件
Home Assistant REST 工具 + WebSocket 集成、服务发现

网关核心还引入了跨平台功能:子智能体工具调用可见性、可配置的后台进程通知、带平台降级的 edit_message(),以及 /compress/usage/update 等斜杠命令。

2. MCP(模型上下文协议)客户端

原生 MCP 支持是 Hermes 最早期的架构决策之一——而且极富远见。在 MCP 成为今日行业标准之前,Hermes 已经拥有了生产级的客户端。

# MCP 服务器在 config.yaml 中配置
# Hermes 自动发现工具、资源和提示
hermes tools  # 在 curses UI 中浏览和启用 MCP 工具
/reload-mcp   # 热重载 MCP 服务器,无需重启

核心能力:

  • stdio 和 HTTP 传输——连接本地和远程 MCP 服务器
  • 采样支持——MCP 服务器可通过 Hermes 发起 LLM 请求
  • 资源和提示发现——自动暴露服务器能力
  • 自动重连——服务器崩溃后恢复,不丢失状态
  • 安全加固——MCP 服务器的工具同样受到审批策略约束

(#291@0xbyt4#301#753)

3. 技能生态——70+ 技能、自我进化的智能体

技能系统——Hermes 的标志性差异化特性——在首发时就已经相当完备。70+ 内置和可选技能,涵盖 15+ 个类别,搭配 Skills Hub 供社区发现。

技能如何工作: 技能是存储在 ~/.hermes/skills/ 中的 Markdown 文档。当 Hermes 遇到相关任务时,会将匹配的技能作为程序性指导加载到上下文中。任务完成后,一个后台“复盘分支”会评估技能是否有效——并自动编写或更新技能。

# 浏览技能中心
hermes skills browse

# 技能可按平台启用/禁用
# 支持基于工具可用性的条件激活
# 前提条件确保未满足依赖的技能保持隐藏

v0.2.0 新增技能包括:

  • ASCII 艺术——pyfiglet(571 种字体)、cowsay、图片转 ASCII
  • ASCII 视频——完整的终端视频制作流水线
  • DuckDuckGo 搜索——隐私优先的网页搜索,支持 Firecrawl 降级
  • Solana 区块链——钱包余额、美元定价、代币名称
  • AgentMail——智能体专属邮箱
  • Polymarket——预测市场数据(只读)
  • OpenClaw 迁移——从 OpenClaw 迁移到 Hermes 的官方工具
  • 域名情报——被动侦查:子域名、SSL 证书、WHOIS、DNS
  • Superpowers——软件开发技能集
  • Hermes-Atropos——RL 环境开发
  • 以及:arXiv 搜索、OCR/文档、Excalidraw 图表、YouTube 字幕、GIF 搜索和 40+ MLOps 技能

(#743@teyrebaz33#785@teyrebaz33)

4. 统一 Provider 路由器

在 v0.2.0 之前,Provider 逻辑分散在视觉理解、摘要、压缩和轨迹保存等模块中——每个模块通过自己的代码路径调用 LLM。统一的 Provider 路由器将所有调用整合到单一的 call_llm() / async_call_llm() API 之后。

# 所有辅助消费者现在通过同一条代码路径:
# resolve_provider_client() → call_llm()
# 自动凭证解析、错误处理和重试逻辑

首发时支持的 Provider:

  • Nous Portal——原生 OAuth 集成
  • OpenAI Codex——Responses API,支持 ChatGPT 订阅
  • OpenRouter——200+ 模型,支持路由偏好
  • Kimi Code API——月之暗面的编程专用模型
  • MiniMax——更新的模型 ID
  • z.ai/GLM——清华智谱的双语模型
  • Azure OpenAI——企业部署支持
  • 自托管 Firecrawl——在自有基础设施上运行网页抓取

(#1003)

5. ACP 服务器——编辑器集成

VS Code、Zed 和 JetBrains 编辑器现在可以通过 Agent Communication Protocol(ACP) 标准连接 Hermes。这意味着在终端和消息应用中运行的同一个智能体,可以直接在编辑器内为您提供协助。

(#949)

6. CLI 皮肤/主题引擎

数据驱动的视觉自定义系统,内置 7 款皮肤(default、ares、mono、slate、poseidon、sisyphus、charizard),同时支持自定义 YAML 皮肤。横幅、加载动画、颜色和品牌标识均可配置——无需修改代码。

# ~/.hermes/skins/my-skin.yaml
banner: "custom"
spinner: "dots"
colors:
  accent: "#00E5A0"
  background: "#0A0A0F"

7. Git Worktree 隔离

hermes -w 在 git worktree 中启动隔离的智能体会话,实现对同一仓库的安全并行操作。每个 worktree 拥有独立的工作目录、分支和智能体会话——同时运行多个智能体时再也不会互相干扰。

# 在 git worktree 中启动 Hermes,实现隔离的并行工作
hermes -w

(#654)

8. 文件系统快照与回滚

在破坏性文件操作之前自动创建快照。/rollback 命令将文件恢复到先前的状态——一张让您放心大胆实验的安全网。

# 智能体在破坏性操作前自动创建快照
# 在 CLI 中使用 /rollback 恢复
# 适用于所有终端后端(本地、Docker、SSH、Modal)

(#824)


核心智能体与架构

智能体循环改进

智能体循环经过大幅加固,以应对真实场景中的各种边缘情况:

  • 简单降级模型——主 Provider 失败时,Hermes 自动透明切换到配置好的备选 Provider(#740
  • 共享迭代预算——父智能体和子智能体委托共享统一预算,防止子智能体无限循环
  • 413 负载过大处理——不再直接中断,Hermes 压缩上下文并重试(#153
  • 工具调用修复中间件——自动小写转换和无效工具处理,修复模型产生的格式错误的工具调用
  • 推理力度配置——控制模型在行动前思考的深度(/reasoning 命令)
  • 压缩后循环检测——防止智能体在上下文压缩后反复读取/搜索文件(#705

会话与记忆

  • 命名会话——为会话设置唯一标题,支持搜索过滤浏览,按名称恢复(#720
  • Honcho 用户建模——基于 AI 的跨会话用户画像,随时间推移持续优化(#38
  • 主动记忆刷新——会话过期时异步持久化记忆
  • 智能上下文长度探测——通过持久缓存检测模型上下文限制

CLI 与用户体验

交互式 CLI

终端体验得到了全面打磨:

  • /personality 命令——自定义智能体个性或完全禁用(#773
  • 用户自定义快捷命令——绕过智能体循环,快速执行预设操作(#746
  • /verbose——运行时切换调试输出(#94
  • /insights——使用分析、费用估算和活动模式(#552
  • /background——从 CLI 管理后台进程
  • 完成提示音——智能体完成任务时终端响铃(#738
  • 上下箭头历史——浏览之前输入的命令
  • 剪贴板图片粘贴——Alt+V / Ctrl+V 粘贴图片
  • --quiet/-Q——最少输出的程序化单查询模式
  • --fuck-it-ship-it——绕过所有审批提示,实现全自动工作流(#724

安装与配置

  • 模块化安装向导,支持分区子命令和工具优先的用户体验
  • 配置迁移系统——跨配置格式版本无缝升级(首发时为 v7)
  • hermes tools——通过 curses UI 按平台启用/禁用工具
  • hermes doctor——对所有已配置的 Provider 进行健康检查
  • hermes update——自动重启 Gateway 服务
  • .env 原子写入——防止崩溃时 API 密钥丢失(#954

安全

Hermes Agent 从第一天就严肃对待安全问题。v0.2.0 配备了全面的安全加固层:

漏洞防护

类别 描述
路径穿越 修复 skill_view 中的漏洞——阻止读取任意文件(#220
Shell 注入 防止 sudo 密码管道(#65)、tee/进程替换模式(#280)注入
符号链接攻击 skills_guard 边界检查修复(#386)、macOS 写入拒绝列表绕过(#61
提示注入 多词绕过防护(#192)、Cron 扫描器绕过修复(#63
危险命令 多行绕过检测(#233)、--force 标志正确阻止(#388

数据保护

  • 原子写入覆盖会话、Cron 任务、.env 配置、进程快照、批处理和技能文件——防止崩溃导致数据丢失
  • 文件权限强制——敏感文件设为 0600/0700,.env 限制为仅所有者可读
  • FTS5 查询净化——防止通过全文搜索查询进行 SQL 注入
  • 密钥脱敏——可扩展的模式匹配,从日志和记录中剥离敏感信息
  • 内存中的永久白名单——防止敏感数据泄露到磁盘(#600

测试——从零到 3,289

当 v0.2.0 开发开始时,项目几乎零测试覆盖。社区以巨大的测试工作量作为回应:

  • 3,289 项测试,覆盖智能体、网关、工具、Cron 和 CLI 模块
  • 使用 pytest-xdist 并行化测试套件#802
  • 四批单元测试,覆盖核心模块、安全关键路径和 AIAgent 循环
  • 43 项 Telegram 格式测试,确保斜体/粗体/代码渲染准确性
  • 42 项视觉工具测试,包含完整类型标注
  • 压缩器回归测试,覆盖工具调用边界处理

这一测试基础在项目后续的快速迭代中至关重要——3,289 项测试在回归问题触及用户之前就能将其拦截。


RL 与评估环境

Hermes Agent 始终被设计为生成智能体训练数据的平台。v0.2.0 附带:

  • WebResearchEnv——多步网页研究 RL 环境(#434
  • YC-Bench——长周期智能体基准测试环境
  • OpenThoughts-TBLite——评估环境和脚本
  • 本地 vLLM 支持——针对本地托管模型运行评估
  • Hermes-Atropos——RL 环境开发的内置技能(#815

Windows 兼容性

Windows 支持从一开始就被认真对待:

  • 为 Windows 兼容性守护 POSIX 专用进程函数
  • 通过 Git Bash + 基于 ZIP 的更新降级实现原生支持
  • pywinpty 在 Windows 上提供 PTY 支持(#457
  • 所有配置/数据文件 I/O 显式使用 UTF-8 编码(#458
  • 正则搜索输出的驱动器号路径处理(#533

升级

hermes update

新用户安装:

# Linux / macOS / WSL2
curl -fsSL https://raw.githubusercontent.com/NousResearch/hermes-agent/main/scripts/install.sh | bash

GitHub 完整更新日志

← Hermes Agent Changelog