v2.6 打通 Trace 与日志关联(一个 trace_id 两边看)、采样策略收拢到控制台中心化配置、日志稀疏索引与查询下推带来显著提速,附升级步骤和向后兼容说明。
v2.5 之前,Trace 和日志是两套系统,查一条慢请求要先把 trace 里的时间窗抄下来,再到日志里按时间过滤,来回切换。v2.6 把两者打通:在 Trace 详情页直接展示这个 Span 时间窗内的关联日志,反向也成立——看到一条报错日志,点一下就能跳到它所属的 Trace。
实现上不复杂:采集端把 trace_id 作为日志的一个字段打进去,查询引擎按 trace_id + 时间窗做关联。对已有数据,只要日志里带了 trace_id,升级后自动生效,不用重新采集。
之前采样率散落在每个 Agent 的配置里,改一个服务要登录对应机器改配置。v2.6 把采样策略收拢到控制台,按服务、按命名空间统一配置,支持:
/pay 全量采样。策略变更分钟级生效,Agent 自动拉取,不用重启。这对大促前"临时把核心链路采样率调到 100%"这种操作特别友好——以前要改几十台机器,现在控制台点一下。
实测:1 亿条日志的库,按 service + 关键词点查从 40 秒降到 3 秒;跨 30 天的时间序列聚合从 18 秒降到 5 秒。
v2.6 向后兼容 v2.5,数据格式不变,支持原地升级。升级顺序:storage → ingester → querier → gateway → agent。采样策略中心化后,老的 Agent 本地采样配置会被控制台策略覆盖,升级前记得把散落的本地配置导出存档。飞腾 + UOS + 金仓、鲲鹏 + 麒麟 + 达梦、龙芯 + 麒麟 + openGauss 三套信创镜像已同步到 2.6。