01 · Hermes Agent 是什么
它和聊天机器人、代码助手、自动化脚本有什么区别?
这是课程的第一篇。本篇不安装软件,也不配置模型。你会先获得一张地图:Hermes 能接手什么任务,它为什么能操作文件和网页,以及什么工作不能交给它自行决定。
看完会得到什么
- 用一句话解释 Hermes Agent
- 区分聊天机器人、代码助手、脚本和 Agent
- 认识使用 Hermes 时会遇到的五个概念
- 判断一个任务是否适合交给 Hermes
一句话定义
Hermes Agent 是一个可以从 Desktop 或终端调用工具、操作电脑,并连接消息平台的 AI Agent。它不只回答问题,还能读取文件、执行命令、浏览网页、保留记忆,并在指定时间完成任务。
“Agent”可以理解为“接到目标后会采取行动的软件”。模型负责判断下一步,工具负责接触文件、终端、网页和外部服务。
从“回答”到“完成”
纯对话产品围绕文字回复工作。Hermes 接收一个目标后,可以执行多步动作,并检查结果。部分聊天产品也能连接工具或本地应用,能力取决于产品设计和用户授权。
模型与工具形成一个循环:判断、行动、观察、再判断。循环在任务完成、需要你的决定或触及限制时结束。
它和四类工具有什么区别
| 工具 | 主要能力 | 适合的任务 | 限制 |
|---|---|---|---|
| 纯对话产品 | 生成文字和解释 | 问答、改写、想法整理 | 工具和本地访问能力取决于产品与授权 |
| 编辑器代码助手 | 在代码界面补全和修改 | 编写代码、解释文件 | 工作入口围绕代码项目 |
| 自动化脚本 | 按固定规则执行 | 输入和流程确定的重复任务 | 遇到新情况时缺少判断能力 |
| Hermes Agent | 使用模型选择工具和步骤 | 研究、文件处理、开发、消息机器人、定时工作流 | 需要权限、配置和验收标准 |
Hermes 不是脚本的替代品。输入固定、规则固定、输出固定的任务,用脚本成本更低。任务包含判断、资料阅读、内容整理或多步选择时,Agent 才有价值。
新手先认识的五个概念
1. 模型:负责判断
模型读取你的目标、对话和工具结果,决定下一步行动。Hermes 支持多家模型服务,模型来源称为 provider。
2. 工具:负责行动
工具让模型接触外部环境,例如读取文件、运行终端命令、搜索网页或分析图片。工具决定 Hermes 能碰什么,权限决定它能做到哪一步。
3. 会话:保存当前工作的上下文
会话记录目标、对话和工具结果。你可以继续旧会话,也可以为新任务创建会话。会话不是长期偏好仓库。
4. Memory 与 Skills:保存不同类型的经验
- Memory 保存短小、稳定、跨会话值得带入的事实、偏好和经验,例如写作语言、项目位置和工作习惯。
- Skills 是按需加载的知识或能力包,可以包含步骤、参考资料、脚本和资源,例如发布文章、检查代码或处理会议记录。
可以先用一句口诀判断:需要“记住什么”时考虑 memory,需要“按一套知识或方法做事”时考虑 skill。只服务于本次任务的背景留在会话中,不进入两者。
5. Gateway:把同一个 Agent 接到消息平台
Gateway 让 Hermes 在飞书、钉钉、企业微信和微信等消息平台接收消息。Desktop、CLI 和消息平台可以使用同一个 profile,共享配置、memory 和 skills,但默认保存各自的会话记录,也可以拥有不同的工具边界。需要延续一段对话时,应使用会话恢复或 handoff。
Hermes 的学习闭环
Hermes 不只在一次对话中完成任务。它可以从任务经历中提取值得保留的知识,把短小经验写入 memory,或创建和改进 skill,让后续会话复用这些成果。
这种学习闭环不等于 Agent 可以改写一切。写入行为受配置和审批方式约束,用户仍负责决定哪些经验值得长期保存。
Hermes 适合做什么
以下任务具备目标、输入和验收标准,适合交给 Hermes:
- 读取一组资料,整理带来源的研究摘要;
- 检查项目文件,修改代码并运行测试;
- 从截图中提取问题,再查阅文档;
- 每天检查信息源,把变化发送到已配置的消息平台;
- 记住写作偏好,把重复流程整理成 skill;
- 把三项独立研究交给子代理,再汇总结论。
什么任务需要你保留决定权
Hermes 可以准备动作,但下列决定需要人确认范围和后果:
- 删除无法恢复的数据;
- 发布公开内容;
- 转账、购买或提交交易;
- 修改生产系统和安全策略;
- 向外部账户发送消息;
- 使用来源不明的命令和插件。
这些条目是教程要求保留的人类决策权,不代表所有动作都有统一的产品弹窗。Hermes 为危险终端命令、文件写入、消息平台访问和凭据处理提供不同护栏,但审批不等于完整沙箱。本地工具仍在运行 Hermes 的系统用户权限内工作。
怎样判断一个任务能否交给 Hermes
回答四个问题:
- 目标是什么? 结果应当能被描述。
- 输入在哪里? 文件、网页、仓库或消息需要能访问。
- 允许做什么? 读、写、执行、发布需要分开说明。
- 怎样算完成? 文件存在、测试通过、消息送达或数据符合条件。
如果四个问题缺少答案,先补任务边界,再让 Agent 开始。
30 秒检查:这是不是一个 Agent 任务
判断下面三个例子:
| 需求 | 是否适合 Hermes | 原因 |
|---|---|---|
| 把 2,000 个固定格式文件改名 | 脚本更合适 | 规则固定,不需要模型判断 |
| 阅读 20 篇资料,按主题分类并附来源 | 适合 Hermes | 包含阅读、判断、整理和引用 |
| 帮我把服务器弄好 | 不能直接开始 | 缺少目标、环境、权限和验收标准 |
第三个需求可以改成:
检查这台测试服务器的磁盘、内存和服务状态,只读取信息,不修改配置。输出问题清单和建议命令,等我确认后再执行。
改写后,目标、权限和交付物都有边界。
本篇验收
读完后,你应当能回答:
- [ ] Hermes 与聊天机器人的区别是什么?
- [ ] 模型和工具分别负责什么?
- [ ] memory 与 skill 有什么区别?
- [ ] 为什么发布、删除和支付需要人确认?
- [ ] 怎样把模糊需求改成可执行任务?
下一篇
下一篇会完成安装、模型选择和环境检查。结束时,你会看到 Hermes 对第一条消息作出响应。