agent的可观测该怎么搭 手上这套简陋版实在撑不住了

业务上的agent之前就配了套特别简陋的监控,能看个大概,现在明显不够用了,想正经搭一套。

现状是链路走的是通用的那套追踪标准,麻烦在于要看的东西跟传统服务不太一样。以前看接口耗时、错误率就够了,现在得看多模态的输入输出、每个技能被调了几次、工具调用是不是在原地打转。这些塞进传统的指标面板里,看着就别扭。

手上两个选择都有点犹豫。老牌的那套面板我们本来就在用,但它天生是给指标设计的,看单条会话的完整链路很难受;专门做这个的又太重,光部署就得吃掉一堆资源,为一个还没跑起来的需求上这么大家伙有点亏。

有真在生产上做过agent可观测的兄弟吗,最后你们选了啥,踩过哪些坑

大佬轻喷 小项目有必要上这套吗

先把每次调用的输入输出原样存下来 别急着做图

没必要 打日志就行 出事再说

重的那套是真吃资源 我们最后自建了

自建工作量大吗 就怕做一半烂尾

哦是吗 存全量输出 存储费不要钱啊

看会话链路 传统面板确实不合适