MODULE // HERMES AGENT
基于 Hermes Agent 实现企业编码场景的落地实践
一句话目标:选好会推理的大模型盖住 L2;用开源 Hermes Agent 把「会做事」(Agentic)跑稳;再用人审 + CI 把「能不能过关」(Reflection)做客观。下面讲我们怎么搭。
一、目标与分工:谁负责想,谁负责做,谁负责验
业界常用 L1–L5 描述通往AGI的能力台阶:聊天助手 → 推理者 → 智能体 → 创新者 → 组织者。本文重点是 L2(推理,靠 LLM) 与 L3(智能体,靠系统);L4 / L5 只作定位,不展开。
- L1聊天助手会对话、会回答
- L2推理者会多步思考(靠 LLM)本文重点
- L3智能体能替你动手做事(系统)本文重点
- L4创新者能提出新方法、新方案
- L5组织者能运转一整套组织
L4 / L5 只作定位参考。本文要讲的是:选好 L2 级推理模型后,如何用 Hermes 把 L3(Agentic)跑通,并补上 Reflection 验真。
包含并约束 Hermes:入口、通知、客观验真、业务系统对接
包含并调度 LLM:组装上下文、执行工具、多任务编排
负责「想」:拆问题、订计划、决定调哪个工具
读图方向:从外到内是「环境包住 Agent,Agent 包住模型」;不是三个并列平级模块。
三层不是并列,而是逐层包含:外围环境包住 Hermes,Hermes 再包住 LLM。系统闭环仍是 Thinking → Plan → Work → Reflection——前两步主要靠内层 LLM;Work 靠 Hermes 执行;Reflection 发生在最外层,做成可客观判定的验真(人对齐、CI 红绿),而不是只让模型口头说「我觉得过了」。
验真不过关 → 回到「想/计划」再来一轮;卡住则通知人处理。
二、用 Hermes 把 Agentic 做扎实
Hermes Agent 是 Nous Research 的开源 Agent 运行时:接上你选的 LLM,负责控环、执行工具、沉淀可复用的 Skill,并通过 Gateway 接到企微等入口。它不替代模型推理,而是让「想清楚之后」真的能一步步把活干完。
把上下文喂给模型,按 Skill 推进步骤
真正执行工具:读写、MCP、终端等
Kanban 多 Agent 交接,一人一任务
记忆与 Skill 是「给模型更好的材料」,让推理更省事;推理能力本身仍来自接入的 LLM。
入口链路是:人(企微)→ Hermes Gateway → 编排 Agent(按场景选路由/编排模板)→ 把任务图写入 Hermes Kanban(SQLite)→ 各专责 Agent 认领执行。每个执行 Agent 只做一个具体任务;完成后 handoff。需要人拍板或检测失败时进入 blocked,再经 Gateway 通知回人。
三、全链路:Agentic 分段推进,Reflection 设关卡
脱敏后的搭法如下:企微当入口与通知;Hermes 做编排与执行;内部需求平台写作 KDOP;GitLab CI 在旁路机器上做客观检测。
多阶段 Skill · 专责 Agent · 读写 KDOP · 隔离工作区写代码
人审 blocked · CI 异机执行 · MCP 查结果回写看板 · Dashboard
autoCode:分段 Agentic
先过路由层选编排,再进入四段:需求分析 → 详细设计 → 代码编写 → 单元测试。每一段由专责 Agent 认领 Kanban 任务;分析/设计阶段经 MCP 读写 KDOP,并在关键节点等人审。
- 0路由Agentic · 编排
按场景选编排(需求开发 / Bug / 定位…)
- 1需求分析Reflection · 人审
拉 KDOP → 知识库 → 和人澄清盲点
- 2详细设计Reflection · 人审
改造清单、测点、计划,和人对齐
- 3代码编写Reflection · CI
按计划逐步写并提交;MCP 查编译结果
- 4单元测试Reflection · CI
写 GTest 并提交;异机 Runner 跑测后回写
| 阶段 | Agentic(Hermes 侧) | Reflection(验真) |
|---|---|---|
| 需求分析 | 拉需求、查知识库、准备澄清问题 | blocked 等人审盲点澄清 → 更新 KDOP → handoff |
| 详细设计 | 改造清单、测点、执行计划 | blocked 等人审对齐 → 更新 KDOP → handoff |
| 代码编写 | Skill:worktree 隔离 + 逐步编码并提交 | MCP 查编译 pipeline;绿 handoff / 红 blocked+企微 |
| 单元测试 | 按测案写 GTest 并提交 | 异机 Runner 跑测;MCP 查结果回写看板 |
Reflection:人审 + CI
人审关卡:需求分析澄清、详细设计对齐——Kanban blocked,Gateway 通知企微。 机器关卡:提交与隔离写在 Skill 里;GitLab 调度异机 Runner;Agent 用 MCP 查 pipeline 红绿,再回写 Kanban(Runner 不直接改看板)。日常进度看 Kanban Dashboard。
- 1Skill
约定提交方式、worktree 隔离工作区
- 2Agent
提交代码,触发 GitLab pipeline
- 3Runner
在另一台机器跑编译 / 单测
- 4MCP 查询
Agent 拉取 pipeline 红绿(不是 Runner 直写看板)
- 5回写 Kanban
绿 → handoff;红 → blocked + 企微
Takeaway
L2 靠接入的 LLM;L3 靠 Hermes 把 Agentic(控环、工具、Kanban 分段)跑通;能不能放心往下走,靠人审与 CI 构成的 Reflection。三者各司其职,才是可落地的工程系统。