08|语义压缩:让 200K 装下 1M 的日志
黄佳

你好,我是黄佳。
上一讲我们讲了上下文分诊:候选信息太多时,先决定什么进 Context,什么留在外面,什么只挂资源句柄(handle)。
但信息进来了只是个良好开端,后续的挑战是:Agent 只要跑得足够久,上下文一定会膨胀。对话历史、tool 返回、错误日志、代码 diff、测试结果,会一轮一轮堆起来。到了某个时刻,系统必须压缩历史,否则不是撞上 context limit,就是让模型淹在旧信息里。
这就是第二个感知模式——语义压缩(Semantic Compaction)的入场时机。压缩不是简单的省 token,而是一个更关键的问题:压缩之后,Agent 还记不记得自己为什么走到这一步。
坏的压缩,会把关键证据压没。更坏的压缩,会让 Agent 忘记哪些方案已经失败,然后在同一个坑里反复试错。
比如一个数据库故障排查 Agent,刚刚看到一条关键错误:
这里真正有价值的不是“发生了数据库错误”,而是 pool_size=20、queue_depth=347、_acquire_connection timeout 这些细节。它们暗示问题可能不是简单把连接池调大,而是连接没有被及时释放。
公开
同步至部落
取消
完成
0/2000
笔记
复制
AI
- 深入了解
- 翻译
- 解释
- 总结
仅可试看部分内容,如需阅读全部内容,请付费购买文章所属专栏
《Agent 设计模式之美》,新⼈⾸单¥68
《Agent 设计模式之美》,新⼈⾸单¥68
立即购买
© 版权归极客邦科技所有,未经许可不得传播售卖。 页面已增加防盗追踪,如有侵权极客邦将依法追究其法律责任。
登录 后留言
精选留言
由作者筛选后的优质留言将会公开显示,欢迎踊跃留言。
收起评论