让运维人员沿着一条连续路径从症状走到服务、请求、Span、热点函数与事件,而不是在分离工具之间复制 ID。
这个工作流连接了通常分散在不同后端的产品界面。
找到行为开始分化的时间、服务、路由、状态或集群。
查看依赖健康,并打开关键路径上的失败 Span。
在同一时间窗口通过 SQL 与字段探索确认故障。
从慢 Span 继续进入相同服务窗口的 CPU、内存、Goroutine 或锁竞争热点。
保留每一步分析,并在无需重来的情况下返回。
工作流
改进并不是再增加一个可视化,而是去除反复重建上下文的工作。
从 Prometheus 切到链路后端,再切到日志后端,手动重建范围。
比较相邻请求或更宽窗口时,需要重新设置一遍。
进入下一种信号时,租户、服务、trace 与时间上下文已经附带。
比较帧、固定证据,并返回早期假设而无需重建。
交付证明
内置示例数据会生成共享 trace ID 的日志、指标与链路,可立即下钻。