Skip to content

01 · Hermes Agent 是什么

它和聊天机器人、代码助手、自动化脚本有什么区别?

这是课程的第一篇。本篇不安装软件,也不配置模型。你会先获得一张地图:Hermes 能接手什么任务,它为什么能操作文件和网页,以及什么工作不能交给它自行决定。

看完会得到什么

  • 用一句话解释 Hermes Agent
  • 区分聊天机器人、代码助手、脚本和 Agent
  • 认识使用 Hermes 时会遇到的五个概念
  • 判断一个任务是否适合交给 Hermes

一句话定义

Hermes Agent 是一个可以从 Desktop 或终端调用工具、操作电脑,并连接消息平台的 AI Agent。它不只回答问题,还能读取文件、执行命令、浏览网页、保留记忆,并在指定时间完成任务。

“Agent”可以理解为“接到目标后会采取行动的软件”。模型负责判断下一步,工具负责接触文件、终端、网页和外部服务。

从“回答”到“完成”

纯对话产品围绕文字回复工作。Hermes 接收一个目标后,可以执行多步动作,并检查结果。部分聊天产品也能连接工具或本地应用,能力取决于产品设计和用户授权。

Hermes 从目标、模型判断、工具调用到执行结果和最终验收的任务循环

模型与工具形成一个循环:判断、行动、观察、再判断。循环在任务完成、需要你的决定或触及限制时结束。

它和四类工具有什么区别

工具主要能力适合的任务限制
纯对话产品生成文字和解释问答、改写、想法整理工具和本地访问能力取决于产品与授权
编辑器代码助手在代码界面补全和修改编写代码、解释文件工作入口围绕代码项目
自动化脚本按固定规则执行输入和流程确定的重复任务遇到新情况时缺少判断能力
Hermes Agent使用模型选择工具和步骤研究、文件处理、开发、消息机器人、定时工作流需要权限、配置和验收标准

Hermes 不是脚本的替代品。输入固定、规则固定、输出固定的任务,用脚本成本更低。任务包含判断、资料阅读、内容整理或多步选择时,Agent 才有价值。

新手先认识的五个概念

1. 模型:负责判断

模型读取你的目标、对话和工具结果,决定下一步行动。Hermes 支持多家模型服务,模型来源称为 provider

2. 工具:负责行动

工具让模型接触外部环境,例如读取文件、运行终端命令、搜索网页或分析图片。工具决定 Hermes 能碰什么,权限决定它能做到哪一步。

3. 会话:保存当前工作的上下文

会话记录目标、对话和工具结果。你可以继续旧会话,也可以为新任务创建会话。会话不是长期偏好仓库。

4. Memory 与 Skills:保存不同类型的经验

  • Memory 保存短小、稳定、跨会话值得带入的事实、偏好和经验,例如写作语言、项目位置和工作习惯。
  • Skills 是按需加载的知识或能力包,可以包含步骤、参考资料、脚本和资源,例如发布文章、检查代码或处理会议记录。

可以先用一句口诀判断:需要“记住什么”时考虑 memory,需要“按一套知识或方法做事”时考虑 skill。只服务于本次任务的背景留在会话中,不进入两者。

5. Gateway:把同一个 Agent 接到消息平台

Gateway 让 Hermes 在飞书、钉钉、企业微信和微信等消息平台接收消息。Desktop、CLI 和消息平台可以使用同一个 profile,共享配置、memory 和 skills,但默认保存各自的会话记录,也可以拥有不同的工具边界。需要延续一段对话时,应使用会话恢复或 handoff。

Hermes 的学习闭环

Hermes 不只在一次对话中完成任务。它可以从任务经历中提取值得保留的知识,把短小经验写入 memory,或创建和改进 skill,让后续会话复用这些成果。

Hermes 从任务完成、经验复盘到写入 Memory 或改进 Skill 的复用闭环

这种学习闭环不等于 Agent 可以改写一切。写入行为受配置和审批方式约束,用户仍负责决定哪些经验值得长期保存。

Hermes 适合做什么

以下任务具备目标、输入和验收标准,适合交给 Hermes:

  • 读取一组资料,整理带来源的研究摘要;
  • 检查项目文件,修改代码并运行测试;
  • 从截图中提取问题,再查阅文档;
  • 每天检查信息源,把变化发送到已配置的消息平台;
  • 记住写作偏好,把重复流程整理成 skill;
  • 把三项独立研究交给子代理,再汇总结论。

什么任务需要你保留决定权

Hermes 可以准备动作,但下列决定需要人确认范围和后果:

  • 删除无法恢复的数据;
  • 发布公开内容;
  • 转账、购买或提交交易;
  • 修改生产系统和安全策略;
  • 向外部账户发送消息;
  • 使用来源不明的命令和插件。

这些条目是教程要求保留的人类决策权,不代表所有动作都有统一的产品弹窗。Hermes 为危险终端命令、文件写入、消息平台访问和凭据处理提供不同护栏,但审批不等于完整沙箱。本地工具仍在运行 Hermes 的系统用户权限内工作。

怎样判断一个任务能否交给 Hermes

回答四个问题:

  1. 目标是什么? 结果应当能被描述。
  2. 输入在哪里? 文件、网页、仓库或消息需要能访问。
  3. 允许做什么? 读、写、执行、发布需要分开说明。
  4. 怎样算完成? 文件存在、测试通过、消息送达或数据符合条件。

如果四个问题缺少答案,先补任务边界,再让 Agent 开始。

30 秒检查:这是不是一个 Agent 任务

判断下面三个例子:

需求是否适合 Hermes原因
把 2,000 个固定格式文件改名脚本更合适规则固定,不需要模型判断
阅读 20 篇资料,按主题分类并附来源适合 Hermes包含阅读、判断、整理和引用
帮我把服务器弄好不能直接开始缺少目标、环境、权限和验收标准

第三个需求可以改成:

检查这台测试服务器的磁盘、内存和服务状态,只读取信息,不修改配置。输出问题清单和建议命令,等我确认后再执行。

改写后,目标、权限和交付物都有边界。

本篇验收

读完后,你应当能回答:

  • [ ] Hermes 与聊天机器人的区别是什么?
  • [ ] 模型和工具分别负责什么?
  • [ ] memory 与 skill 有什么区别?
  • [ ] 为什么发布、删除和支付需要人确认?
  • [ ] 怎样把模糊需求改成可执行任务?

下一篇

下一篇会完成安装、模型选择和环境检查。结束时,你会看到 Hermes 对第一条消息作出响应。

官方来源