29|经验回放:让经验在复用中持续校准
黄佳

释题:经验回放把过去的轨迹整理成可追溯的经验,在新任务开始前召回,作为当前决策的背景。一条经验能不能长期留下,要看它是否真的被采用,以及采用以后有没有改善结果。
上一讲技能包模式中,我们把一条跑通的流程整理成候选技能,再用黄金题决定它有没有资格进入正式路由。技能包适合保存相对稳定、可以命名、可以执行,也能够独立验证的做法。
但不是所有经验都已经成熟到能封装成技能。比如六月结算以后,团队留下这样一句提醒:
这就是专家头脑中的隐形知识的一种体现形式,不一定是一套完整流程,也不一定能封装成工具直接调用。它就像一位做过这件事的同事,在你准备动手时提醒一句:“这里上个月出过问题,先核一下。”
到了七月,Agent 再次处理部门付款批次,它怎样在正确的时候想起这句话?想起来以后,它有没有真的照着做?任务最后成功了,又凭什么说这条经验立了功?
要回答这些问题,就需要我们把保存、召回、采用和结果回写四件事拆开,再用六月到七月的部门归属实验,看一条历史教训怎样进入当前任务,又怎样靠后续表现决定自己的去留。这个思路背后对应的模式,就是经验回放(Experience Replay),它位于反思行、层级列。
公开
同步至部落
取消
完成
0/2000
笔记
复制
AI
- 深入了解
- 翻译
- 解释
- 总结
仅可试看部分内容,如需阅读全部内容,请付费购买文章所属专栏
《Agent 设计模式之美》,新⼈⾸单¥68
《Agent 设计模式之美》,新⼈⾸单¥68
立即购买
© 版权归极客邦科技所有,未经许可不得传播售卖。 页面已增加防盗追踪,如有侵权极客邦将依法追究其法律责任。
登录 后留言
精选留言
由作者筛选后的优质留言将会公开显示,欢迎踊跃留言。
收起评论