11|扩展:OpenTelemetry 全链路监控与成本管理
邢云阳

你好,我是邢云阳。
上节课,我们借助 Hook 机制,在工具、SubAgent 执行前后植入了“中间件”的功能,借此加强了系统控制力。
但在公司里做产品时,用户更关心的是监控。比如,开发人员更关心调用链,也就是主 Agent 调用了哪些 SubAgent,SubAgent 又调用了哪些工具等等。通过查看调用链,可以知道问题在哪,瓶颈在哪。
至于领导,最喜欢看带有各种图表指标的监控大盘,了解他的钱花哪去了。Claude Agent SDK 是懂用户,也懂领导的,它准备好了无缝接入 OpenTelemetry 的功能,我们只需要正确配置环境变量,就能把 traces、metrics、log events 统一导出到任意 OTLP 后端。这节课,我们就把上节课的 agent_with_hooks.py 再升级一下,让它具备全链路可观测与成本管理能力。
一句话理解 OpenTelemetry
如果你之前没有接触过 OpenTelemetry,可以把它理解成一套“应用体检标准”。它由云原生计算基金会(CNCF)维护,定义了三种核心数据格式.
Traces(链路):记录一次请求从头到尾经过了哪些环节、每个环节花了多少时间,以及环节之间的父子关系。把它想象成快递的物流轨迹,你就能知道包裹从发货到签收每一步发生了什么。
Metrics(指标):记录可聚合的数值,比如 token 总数、请求次数、错误率、响应时间分位值。把它想象成体检报告里的血压、心率,适合长期趋势分析和告警。
公开
同步至部落
取消
完成
0/2000
笔记
复制
AI
- 深入了解
- 翻译
- 解释
- 总结
仅可试看部分内容,如需阅读全部内容,请付费购买文章所属专栏
《Harness Agent 脚手架实战课》,新⼈⾸单¥59
《Harness Agent 脚手架实战课》,新⼈⾸单¥59
立即购买
© 版权归极客邦科技所有,未经许可不得传播售卖。 页面已增加防盗追踪,如有侵权极客邦将依法追究其法律责任。
登录 后留言
精选留言
由作者筛选后的优质留言将会公开显示,欢迎踊跃留言。
收起评论