hermes agent通过四层记忆架构实现持久记忆:①即时层(当前token窗口)、②工作层(单会话临时状态)、③长期层(memory.md/user.md快照固化)、④元记忆层(调度晋升策略);用户可手动配置两文件或接入外部provider突破容量限制。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

你想让Hermes Agent记住你三周前说过的“用表格呈现数据”,而不是每次对话都重复强调;你希望它清楚上次调试失败的报错路径、你偏好的时区和语气词、甚至你刚改掉又反悔的减肥计划——这些不是靠运气,而是有明确机制支撑的持久记忆能力。
理解四层记忆架构的真实分工
Hermes 不是把所有聊天记录堆进一个文件就叫“有记忆”。它的四层结构是硬性隔离设计,每层不可混用:
① 即时记忆层:只存当前token窗口内的输入与工具响应,毫秒级存在,关掉这轮对话即清空。
② 工作记忆层:维护单次会话中所有临时状态,比如未完成的任务栈、中间变量、正在运行的子代理。它不落盘,重启Agent即重置。
③ 长期记忆层:由 【MEMORY.md 和 USER.md 两个纯文本文件构成,内容在每次会话启动时冻结为 system prompt 快照】。这不是实时读取,而是“快照固化”——中途写入的新条目,要等下一次 session 才生效。
④ 元记忆层:不存事实,只调度其他三层的刷新节奏、检索权重和晋升策略。比如判断某条用户反馈是否够强,值得从工作层“晋升”到长期层。
手动配置 MEMORY.md 和 USER.md
这两个文件是你能直接干预的长期记忆锚点,必须放在 ~/.hermes/memories/ 目录下。
方法一:终端快速初始化
cd ~/.hermes/memories && touch MEMORY.md USER.md
方法二:逐条写入规范内容
打开 MEMORY.md,每条记录必须以 § 开头,例如:
§ 当前主力模型为 Qwen-Max,用于 Newsletter 生成任务
§ 项目根目录为 /Users/me/workspace/newsletter-v2
§ 禁用自动格式化工具 prettier,因与 ESLint 冲突
统一LLM网关 - 一个API对接70+AI模型,使用单一API密钥即可调用GPT、Claude、Gemini、Qwen、Deepseek、Grok等主流模型。
注意:【MEMORY.md 总容量上限为 2200 字符,USER.md 为 1375 字符】。超出部分会被静默截断,且不会报错提示。
方法三:用 Nano 编辑并保存
nano MEMORY.md → 输入内容 → Ctrl+O 回车确认保存 → Ctrl+X 退出
启用外部记忆 Provider(突破内置容量限制)
当 MEMORY.md 写满或你需要语义搜索、时效管理、多用户隔离时,必须接入外部 Provider。
第一步:运行初始化命令
hermes memory setup
第二步:从列表中选择目标方案(推荐 mem0 或 hindsight)
第三步:按提示填入 API Key 或本地模型 Endpoint 地址,例如:
https://api.deepseek.com/v1
第四步:指定唯一 user_id 和 agent_id,确保记忆归属清晰
第五步:执行 hermes restart 生效配置
这一步完成后,新写入的记忆将进入外部系统,但 【绝不会回写到 state.db 或 MEMORY.md 中】——这是防止事实污染的关键隔离机制。










