首页/新闻资讯/正文详情

自改进引擎:学习循环的五步飞轮

发布时间:2026/9/24 17:34:30 来源:云帆数科 栏目:资讯中心
自改进引擎:学习循环的五步飞轮
自改进引擎学习循环的五步飞轮为什么 Hermes 能越用越好用秘密就在这个闭环里引子一个真实的故事2026年3月一位开发者分享了他的使用体验“第一周Hermes帮我做代码巡检每次都要我手动指出哪些问题该关注、哪些该忽略。第二周它开始自动过滤掉我之前标记为’不重要’的警告。第三周它甚至主动建议了一个我之前没想到的检查维度。到了第四周我几乎不需要再纠正它了——它已经’学会’了我的巡检偏好。”这不是魔法而是 Hermes学习循环Learning Loop的实际运作效果。传统 AI Agent 做完任务就结束了——你纠正了它的错误下次新对话它可能犯同样的错。Hermes 做完任务后会自动复盘、自动沉淀经验、自动改进后续行为——你纠正一次它永远记住。学习循环的核心逻辑学习循环可以概括为五个环节形成一条连续链路记忆策划 → Skill创建 → Skill改进 → 检索召回 → 用户建模 ↑ │ └──────────────────────────────────────────────┘ 闭环这五步不是并列功能而是前后依赖的闭环。每一步的输出是下一步的输入最后一步的输出又回到第一步——形成持续运转的飞轮。用一个真实场景理解五步闭环假设你让 Hermes 帮你做每日代码巡检。第一轮冷启动步骤1记忆策划Hermes 没有相关记忆从零开始执行巡检任务。它检查了所有代码变更生成了一个包含50个问题的报告。步骤2Skill 创建你指出其中30个问题是lint警告我不关心lint。Hermes 识别到这个反馈有复用价值自动创建了一个 Skill 草稿daily_code_review其中包含规则过滤lint警告。步骤3Skill 改进你进一步指出还有5个问题是测试覆盖率下降这个我关心。Hermes 把这个偏好写入 Skill更新规则为过滤lint警告但关注测试覆盖率变化。步骤4检索召回下次巡检时Hermes 自动检索到daily_code_reviewSkill按规则过滤和排序问题。步骤5用户建模Hermes 从多轮交互中提炼出你的偏好模型“这个用户重视测试质量和安全性不关心代码风格细节。”第二轮飞轮开始转动记忆策划Hermes 已经有了你的偏好模型主动过滤掉 lint 警告重点关注测试和安全性问题。报告从50个问题缩减到15个。Skill 创建你指出安全漏洞的优先级应该高于测试覆盖率。Hermes 更新 Skill增加优先级排序规则。Skill 改进Skill 从过滤关注升级为过滤关注优先级排序。检索召回下次巡检报告不仅更精准还自动按优先级排序。用户建模偏好模型进一步细化“安全 测试 性能 风格”。第三轮飞轮加速到了第三轮你几乎不需要再纠正 Hermes 了。它已经学会了你的巡检偏好自动按你的标准过滤、排序、推送报告。你只需要偶尔微调一下——比如新增一个关注维度——Hermes 会自动把这个微调写入 Skill 和偏好模型。这就是学习循环的威力不是每次从零开始而是每次从上次的经验开始。飞轮越转越快你的投入越来越少系统的输出越来越精准。五个环节拆解环节一记忆策划——不是全量记录而是精准提炼传统 AI 的记忆策略有两种极端全量记录把所有对话塞进上下文窗口窗口满了就截断。就像把每天的每一句话都记进日记——信息量大噪音也大。短期记忆只保留当前对话的上下文新对话从零开始。就像每次开会都假装第一次来——效率极低。Hermes 的记忆策划走的是第三条路精准提炼。原始对话大量信息 │ 记忆策划筛选提炼结构化 ├── 关键决策 → 写入持久记忆 ├── 可复用方法 → 写入 Skill ├── 用户偏好 → 写入用户模型 └── 噪音信息 → 丢弃核心原则降低噪音保留可复用信号。它像一个聪明的编辑——不是把所有素材都放进最终稿件而是只选最有价值的部分。环节二Skill 创建——从经验到方法的自动化当 Hermes 识别到某个反馈或操作模式有复用价值时它会自动创建一个 Skill 草稿。创建条件同一个问题被纠正 2 次以上用户明确说每次都这样做某操作模式在 3 次以上对话中出现Skill 是可执行的方法论。不是一段代码而是一份结构化的操作指南告诉 AI在什么场景下、按什么步骤、用哪些工具完成什么任务。环节三Skill 改进——持续优化的能力Skill 不是一次创建就固定不变的。Hermes 会在每次使用后评估效果自动优化新增规则用户的新偏好调整优先级用户显示出的偏好排序删除规则不再适用的旧规则合并 Skill相关 Skill 自动合并环节四检索召回——精准匹配上下文当 Hermes 面对新任务时它会自动检索最相关的 Skill 和记忆。检索策略语义匹配基于语义相似度找到最相关的 Skill场景匹配基于当前任务的上下文特征时效性加权近期使用的 Skill 权重更高环节五用户建模——从偏好到人格这是最智能的一步。Hermes 不仅记住你做了什么还提炼出你是什么样的人。用户建模的输出包含偏好画像你喜欢什么风格、关注什么维度决策模式你做决策时通常考虑哪些因素知识边界你擅长什么、不擅长什么沟通习惯你喜欢详细还是简洁、正式还是随意飞轮效应从量变到质变学习循环的真正价值在于时间的复利时间飞轮状态你的投入系统输出质量第1周冷启动高频繁纠正一般第2周起步中少量微调良好第3周加速低偶尔检查优秀第4周稳定极低很少干预卓越使用时间越长你的投入越少系统的表现越好。这是 Hermes 区别于所有其他 Agent 的核心差异。写在最后学习循环是 Hermes 的灵魂。没有它Hermes 就是一个普通的 Agent 框架有了它Hermes 变成了一个能持续进化的 AI 伙伴。但学习循环离不开两个关键支撑——记忆架构和Skill 系统。下一篇我们深入记忆架构看看 Hermes 如何用三层记忆实现从金鱼到老友的进化。关注「AI拉呱」一起探索 AI 技术的前沿落地。本文是《Hermes Agent 从入门到精通》系列第4篇。

相关推荐

Activity启动流程(五):从窗口 Buffer 到 SurfaceFlinger 合成与屏幕显示
Activity启动流程(五):从窗口 Buffer 到 SurfaceFlinger 合成与屏幕显示

书接上回,上文是 Activity 启动流程(四):从 setContentView 到 View 树创建与 Window 挂载,距离最后合成图像显示在屏幕上还有一段距离。 一. 在 Activity 的 resume 中,已经进行 Window 的 addView&#… · 2026/9/24 17:34:23

Roo Code API Streaming Failed 400 InternalError.Algo.InvalidParameter:input content must be string 报
Roo Code API Streaming Failed 400 InternalError.Algo.InvalidParameter:input content must be string 报

/* MD / 富文本中的 .toc(含博客园搬家等嵌套结构);.toc-box 在侧栏,不受影响 */#content_views .toc,/* 编辑器常在目录前后插入空 p(:empty 仍占 20px),一并去掉避免顶空隙 */#content_views.markdown_views > p:empty:has(+ .toc),#content_views.markdown_views … · 2026/9/24 17:34:17

Ansible Playbook 实战:批量配置 Linux 主机
Ansible Playbook 实战:批量配置 Linux 主机

前言 在云原生运维、服务器集群管理场景中,我们经常需要对多台 Linux 主机做统一初始化、基线配置、环境标准化。 如果采用手动逐台操作,会出现大量重复劳动,同时极易产生配置不一致、漏配置、配置错误等问题,后续集群运维、K8s 部… · 2026/9/24 17:34:11

AI智能体协同编程实战:Qoder使用经验与高效协作技巧
AI智能体协同编程实战:Qoder使用经验与高效协作技巧

程序员圈子里最近讨论得比较多的,是阿里巴巴出的这个Qoder,定位是AI智能体协同编程工具。我把它装进IDE用了大概三周,从最开始只会让它补全函数,到后面让它独立跨文件改代码、做代码审查、处理异常日志,中间踩了不少坑… · 2026/9/24 19:13:47

10款免费工具实测:如何让AI生成内容更像人写的
10款免费工具实测:如何让AI生成内容更像人写的

聊到“降ai率”这三个字,我以前挺抗拒的,总觉得它像某种“擦边操作”。但到了2026年,这个看法必须改一改。不管是自媒体创作者还是做运营、跨境电商文案的朋友,应该都遇到过同样的尴尬:自己用AI生成的初稿明明逻辑通顺… · 2026/9/24 19:13:47

CompletableFuture 超时重试并行流实战:线程池调优与批量任务兜底方案
CompletableFuture 超时重试并行流实战:线程池调优与批量任务兜底方案

做 Java 后端开发,只要跟外部接口打过交道,就绕不开三个词:超时、重试、并行。尤其用 CompletableFuture 做异步编排之后,很多同事容易把它当成一个“更高级的线程池工具”,结果线上一压测就出现线程堆积、任务卡死、批… · 2026/9/24 19:13:41

OpenHarmony+Flutter跨端状态管理:MobX四层契约实践
OpenHarmony+Flutter跨端状态管理:MobX四层契约实践

1. 为什么要在OpenHarmony上跑Flutter?这不是“技术炫技”,而是真实产线里的生存策略我第一次在LiteOS-M设备上把Flutter UI渲染出来时,手边正摆着三台样机:一台是客户指定的OpenHarmony 3.2 LTS轻量系统设备(主控为Co… · 2026/9/24 19:13:41

Linux 上部署 Ollama 本地大模型:从零安装到模型选型与加速实践
Linux 上部署 Ollama 本地大模型:从零安装到模型选型与加速实践

我先说明一下这篇要写什么:Ollama 是目前在 Linux 上本地跑大语言模型最顺手的工具,没有之一。它的安装、模型拉取、API 调用、服务管理,全部集中在一个命令行工具里,对刚接触本地大模型的人来说,几乎是门槛最低的一条… · 2026/9/24 19:13:34

SpringBoot+Vue乡村政务办公系统:从源码到部署全流程解析
SpringBoot+Vue乡村政务办公系统:从源码到部署全流程解析

拿这个SpringBootVue 乡村政务办公系统平台的项目源码当毕设或者练手项目,说实话是挺聪明的选择。前后端分离是目前 Java Web 岗位的主流工作模式,技术栈又是 SpringBoot Vue 这种面试常聊的组合,而且题目里带了完整的 SQL 脚本和接口文档&a… · 2026/9/24 19:13:34

基于YOLOv8的渔船作业监控系统:从环境搭建到边缘部署全流程
基于YOLOv8的渔船作业监控系统:从环境搭建到边缘部署全流程

简介:这是一套面向计算机、人工智能、自动化等专业学生与教师的毕业设计级项目资源,围绕YOLOv8实现渔船作业监控系统,可用于毕设、课程设计、大作业或项目立项演示。压缩包共97个文件,约24.21MB,以70个Python源码文件为… · 2026/9/24 0:00:13

1D-CNN时间序列建模实战:从Conv1d原理到工业落地
1D-CNN时间序列建模实战:从Conv1d原理到工业落地

简介:面向时间序列数据建模的一维卷积神经网络完整实现,适合深度学习入门者及需要快速验证时序模型的研究者,能够从音频、文本、传感器或股价等序列中挖掘局部特征与时间依赖。压缩包体积很小,只有3KB,内含3个Python脚… · 2026/9/24 0:00:26

柔软的L:汉语语流中被忽视的舌肌张力控制
柔软的L:汉语语流中被忽视的舌肌张力控制

1. 这个“L”不是字母表里的L,而是舌尖上的L最近在几个方言群和语音教学社群里,反复看到有人发一句:“也说字母L:柔软的长舌”。初看以为是英语发音课笔记,点开才发现全是方言爱好者、播音系学生、语言康复师甚至戏曲演… · 2026/9/24 0:00:44

了解更多?预约专属演示

我们的顾问将为您一对一讲解产品与方案

企业微信二维码