AI 出了问题你连日志都没有?聊聊 Agent 可观测性
·
点击上方 前端Q,关注公众号
回复加群,加入前端Q技术交流群
前面几篇聊了怎么评测(14)、怎么做验收清单(15)、怎么加 Guardrail(16)。但有一个问题一直没展开:系统跑着跑着出了问题,你怎么知道问题出在哪?
传统后端系统有完善的日志、监控、链路追踪。一个请求 500 了,你能从 Grafana 看到是哪个服务挂了、从 Jaeger 追到是哪个调用超时了、从 ELK 翻到具体的错误日志。
但 Agent 系统呢?模型推理了 5 轮、调了 3 个工具、中间还触发了一次重试——最终输出了一个错误的结果,你连在第几步出的问题都不知道。
这就是可观测性(Observability)要解决的事。
Agent 系统为什么特别难调试
更多推荐




所有评论(0)