STUDY // HERMES

返回学习频道

MODULE // HERMES AGENT

基于 Hermes Agent 实现企业编码场景的落地实践

一句话目标:选好会推理的大模型盖住 L2;用开源 Hermes Agent 把「会做事」(Agentic)跑稳;再用人审 + CI 把「能不能过关」(Reflection)做客观。下面讲我们怎么搭。

一、目标与分工:谁负责想,谁负责做,谁负责验

业界常用 L1–L5 描述通往AGI的能力台阶:聊天助手 → 推理者 → 智能体 → 创新者 → 组织者。本文重点是 L2(推理,靠 LLM) L3(智能体,靠系统);L4 / L5 只作定位,不展开。

FIG.01//AGI 能力阶梯 L1–L5(本文重点 L2 / L3)
  1. L1聊天助手会对话、会回答
  2. L2推理者会多步思考(靠 LLM)本文重点
  3. L3智能体能替你动手做事(系统)本文重点
  4. L4创新者能提出新方法、新方案
  5. L5组织者能运转一整套组织

L4 / L5 只作定位参考。本文要讲的是:选好 L2 级推理模型后,如何用 Hermes 把 L3(Agentic)跑通,并补上 Reflection 验真。

FIG.02//三层是「包含」关系:外围 ⊃ Hermes ⊃ LLM
外围环境(Reflection 发生在这里)企微 · 人审 · CI · KDOP · Dashboard

包含并约束 Hermes:入口、通知、客观验真、业务系统对接

Hermes Agent(Agentic 外壳)控环 · 工具 · Skill · Kanban

包含并调度 LLM:组装上下文、执行工具、多任务编排

大模型 LLM(Reasoning 核)覆盖 L2

负责「想」:拆问题、订计划、决定调哪个工具

读图方向:从外到内是「环境包住 Agent,Agent 包住模型」;不是三个并列平级模块。

三层不是并列,而是逐层包含:外围环境包住 Hermes,Hermes 再包住 LLM。系统闭环仍是 Thinking → Plan → Work → Reflection——前两步主要靠内层 LLM;Work 靠 Hermes 执行;Reflection 发生在最外层,做成可客观判定的验真(人对齐、CI 红绿),而不是只让模型口头说「我觉得过了」。

FIG.03//工作闭环:想 → 计划 → 执行 → 验真
Thinking
LLM 主导
Plan
计划
LLM 主导
Work
执行
Hermes 执行工具
Reflection
验真
人审 / CI

验真不过关 → 回到「想/计划」再来一轮;卡住则通知人处理。

二、用 Hermes 把 Agentic 做扎实

Hermes Agent 是 Nous Research 的开源 Agent 运行时:接上你选的 LLM,负责控环、执行工具、沉淀可复用的 Skill,并通过 Gateway 接到企微等入口。它不替代模型推理,而是让「想清楚之后」真的能一步步把活干完。

FIG.04//Hermes 做什么:把 Agentic 跑稳(不是替代 LLM 推理)
控环

把上下文喂给模型,按 Skill 推进步骤

动手

真正执行工具:读写、MCP、终端等

编排

Kanban 多 Agent 交接,一人一任务

记忆与 Skill 是「给模型更好的材料」,让推理更省事;推理能力本身仍来自接入的 LLM。

入口链路是:人(企微)→ Hermes Gateway → 编排 Agent(按场景选路由/编排模板)→ 把任务图写入 Hermes Kanban(SQLite)→ 各专责 Agent 认领执行。每个执行 Agent 只做一个具体任务;完成后 handoff。需要人拍板或检测失败时进入 blocked,再经 Gateway 通知回人。

FIG.05//从人到看板:Gateway → 编排 Agent → Kanban → 专责任务
人(企微发需求)
Hermes Gateway
Hermes 编排 Agent路由 · 选择编排模板
按模板创建任务图
Hermes Kanban(SQLite 存任务与交接)
dispatcher 认领
专责 Agent
只做:需求分析
专责 Agent
只做:详细设计
专责 Agent
只做:代码编写
专责 Agent
只做:单元测试
handoff = 结果交给下一任务
人对齐或 CI 失败 → blocked → 经 Gateway 通知回人

三、全链路:Agentic 分段推进,Reflection 设关卡

脱敏后的搭法如下:企微当入口与通知;Hermes 做编排与执行;内部需求平台写作 KDOP;GitLab CI 在旁路机器上做客观检测。

FIG.06//我们怎么搭:企微入口 + Hermes 编排 + 外围验真
企业微信
入口/通知
Hermes Gateway
路由 → Kanban 任务图
Agentic(Hermes)

多阶段 Skill · 专责 Agent · 读写 KDOP · 隔离工作区写代码

Reflection(外围)

人审 blocked · CI 异机执行 · MCP 查结果回写看板 · Dashboard

autoCode:分段 Agentic

先过路由层选编排,再进入四段:需求分析 → 详细设计 → 代码编写 → 单元测试。每一段由专责 Agent 认领 Kanban 任务;分析/设计阶段经 MCP 读写 KDOP,并在关键节点等人审。

FIG.08//autoCode:Agentic 分段执行 + Reflection 关卡
  1. 0
    路由Agentic · 编排

    按场景选编排(需求开发 / Bug / 定位…)

  2. 1
    需求分析Reflection · 人审

    拉 KDOP → 知识库 → 和人澄清盲点

  3. 2
    详细设计Reflection · 人审

    改造清单、测点、计划,和人对齐

  4. 3
    代码编写Reflection · CI

    按计划逐步写并提交;MCP 查编译结果

  5. 4
    单元测试Reflection · CI

    写 GTest 并提交;异机 Runner 跑测后回写

Reflection 关卡放在哪里
阶段Agentic(Hermes 侧)Reflection(验真)
需求分析拉需求、查知识库、准备澄清问题blocked 等人审盲点澄清 → 更新 KDOP → handoff
详细设计改造清单、测点、执行计划blocked 等人审对齐 → 更新 KDOP → handoff
代码编写Skill:worktree 隔离 + 逐步编码并提交MCP 查编译 pipeline;绿 handoff / 红 blocked+企微
单元测试按测案写 GTest 并提交异机 Runner 跑测;MCP 查结果回写看板

Reflection:人审 + CI

人审关卡:需求分析澄清、详细设计对齐——Kanban blocked,Gateway 通知企微。 机器关卡:提交与隔离写在 Skill 里;GitLab 调度异机 Runner;Agent 用 MCP 查 pipeline 红绿,再回写 Kanban(Runner 不直接改看板)。日常进度看 Kanban Dashboard。

FIG.07//Reflection 之一:用 CI 做客观验真
  1. 1
    Skill

    约定提交方式、worktree 隔离工作区

  2. 2
    Agent

    提交代码,触发 GitLab pipeline

  3. 3
    Runner

    在另一台机器跑编译 / 单测

  4. 4
    MCP 查询

    Agent 拉取 pipeline 红绿(不是 Runner 直写看板)

  5. 5
    回写 Kanban

    绿 → handoff;红 → blocked + 企微

Takeaway

L2 靠接入的 LLM;L3 靠 Hermes 把 Agentic(控环、工具、Kanban 分段)跑通;能不能放心往下走,靠人审与 CI 构成的 Reflection。三者各司其职,才是可落地的工程系统。