AI HermesAI Agent开源版本发布

Hermes v0.18: 700 Bug 清零里程碑

📅 2026-07-17

2026 年 7 月初,Nous Research 发布了 Hermes Agent v0.18.0「The Judgment Release」。这不是一次常规迭代——开发团队在 12 天内合并了 998 个 PR,编写了超过 25 万行新代码,将仓库中所有 P0/P1 优先级问题从约 700 项降至零。

对一个开源 AI Agent 框架而言,这个数字本身就值得停下来想一想。

一次「清零」意味着什么

P0(Priority 0)和 P1(Priority 1)是 GitHub Issue 体系中最高的两个优先级,通常对应崩溃、数据丢失、核心功能不可用等必须立即修复的问题。多数开源项目常年挂着 10-20 个未解决的 P1 问题,这是常态。彻底清零,意味着维护者不仅修复了已知问题,还系统性地审视了每个遗留点。

Hermes Agent 的做法更激进:他们为这次发布设立了「零 P0/P1」的硬目标,所有新功能 PR 必须先通过已有的 P0/P1 门禁才能合入。结果是在 12 天内将高优问题从约 700 项降到零,仓库的 Issue 看板首次出现「全绿」状态。

Mixture-of-Agents 成为一等公民

v0.18.0 最核心的功能升级,是将 Mixture-of-Agents(MoA)从实验性功能提升为一级模型类型。

在此之前,用户只能在单个模型(如 Claude、GPT)或本地模型之间切换。MoA 改变了这个模型:用户选择一个「合议组」,Hermes 自动将请求路由到多个前沿模型进行并行推理,每个参考模型的推理过程可见,最后由聚合模型输出综合答案。 这意味着用户不再需要自己挑选模型——框架替你做了多模型交叉验证。合议组像 Claude、GPT 一样出现在所有模型选择器中,CLI、TUI、桌面版和网关均可直接选用。

对比来看,OpenAI 的 ChatGPT Work(同期发布)将重心放在跨应用任务编排上,但依然运行在单一模型之上。Claude Code 依赖 Anthropic 自研模型,不支持外部模型混用。MoA 的多模型合议模式是开源社区中少见的工程化实现。

自我验证:Agent 学会检查自己

另一个值得关注的特性是工作自我验证(work self-verification)。以前的 Agent 执行任务后直接返回结果,「是否真的做对了」要靠用户判断。v0.18.0 中,Agent 在执行完任务后会运行实际的工程检查——比如确认文件已写入、测试通过、服务健康——然后才标记完成。

这本质上是一种内置的验收测试机制。它让 Agent 从「执行者」向「执行 + 检查者」转变,减少了盲目信任输出带来的调试成本。

基建工程:Gateway、Mobile、多渠道

v0.18.0 也补了不少基础设施短板:

  • Gateway 支持 scale-to-zero 休眠和 drain 协调,空闲时自动释放资源,流量到来时快速热启动,适合团队托管部署场景。
  • Hermes Mobile v0.5 安全控制平面上线,支持一次性配对、可撤销的作用域设备凭证,为移动端远程管理提供了安全通道。
  • 桌面端获得一等公民的编码 Projects 支持,侧边栏集成代码库、编码轨道和代码审查面板,相当于把 IDE 的核心工作流搬进了 Agent 界面。

这些功能单独看不算惊艳,但组合起来指向一个明确方向:Hermes Agent 不再只是 CLI 玩具,而是可部署、可扩展、可嵌入团队工作流的 Agent 基础设施。

补丁节奏与社区生态

v0.18.0 之后的补丁节奏同样激进。7 月 7 日,团队在 6 天内先后发布 v0.18.1(660+ PR 稳定性打包)和 v0.18.2(WhatsApp Baileys 依赖修复)。v0.18.1 将 main 分支约 667 次提交打包为稳定标签,为 Docker 镜像和 PyPI 安装提供可靠基线;v0.18.2 修复了 Docker 构建中的 WhatsApp 依赖挂载问题,把 pinned git commit 切换为标准 npm 包。

截至 7 月 16 日,Hermes Agent GitHub 仓库已累积 215,000+ Stars、40,000+ Forks、370+ 社区贡献者。从 OpenClaw 迁移指南在 Hacker News 获得 122 票和 105 条评论,登顶当日热门。同期,Self-Evolution 项目(基于 DSPy + GEPA 实现技能与提示词的自动优化)在 GitHub 获得 4,600+ Stars。

为什么值得关注

开源 AI Agent 框架正在经历从「演示级」到「生产级」的分水岭。几个月前,多数开源 Agent 项目还停留在跑通一个 demo 就发公告的阶段。Hermes Agent v0.18.0 的 700 Bug 清零释放了一个信号:一个开源项目也可以在质量维度上做到商业级水准。

MoA 的多模型合议模式、自我验证机制、以及 Gateway 的 scale-to-zero 架构,这三者共同构成了一个与 OpenAI ChatGPT Work 和 Claude Code 有本质区别的路径——不依赖单一模型提供商,不锁定特定 API,不把 Agent 能力建立在黑盒之上。

对正在选型 AI Agent 框架的团队而言,Hermes v0.18.0 是一个值得认真评估的节点。不是因为它功能最多,而是它证明了开源社区也能做出对质量有洁癖的产品。

← ChatGPT Work:OpenAI 迈入云端 Agent → AI 频道 dcg:阻止 AI Agent 执行 rm -rf 的刹车片 →