炬鲸 OBSERVE v3.2 正式发布:OTLP 原生接入,去掉独立 Collector 层;采集器支持自动发现新上线的容器与主机;新增跨集群日志查询与告警证据链。本文列出本次更新的功能明细、升级步骤与已知问题。
v3.2 是炬鲸 OBSERVE 上半年的主要版本,核心目标是把 OpenTelemetry 从「可对接」做到「原生」,并让采集层在动态环境里少一些手工配置。本版本共 3 个功能模块、2 个增强与 4 个修复。
之前 trace/metrics/logs 需要先经过一个独立的 OpenTelemetry Collector 做转换,再转发到 OBSERVE。v3.2 起,OBSERVE 网关直接暴露 OTLP 端口,应用侧可以跳过 Collector:
# 应用侧 OpenTelemetry SDK 配置
exporters:
otlp:
endpoint: "observe-gw.example.com:4317"
protocol: grpc
改动点:
K8s 里每次上线新服务都要改采集器配置,是运维最烦的重复劳动。v3.2 的采集器监听 K8s API,新 Pod 创建时自动匹配采集规则:
discovery:
enabled: true
watch:
- resource: pod
labels:
- "app"
- "tier"
rules:
- match: "label[tier] == 'backend'"
action: collect_logs
规则命中即采集,无需重启。主机侧同样支持按进程名自动发现新增服务进程。
日志检索支持跨多个后端(Elasticsearch / ClickHouse / 对象存储)的一次性查询,SQL 式语法自动下推,详见上一篇教程。
升级前请先备份配置库,并按以下顺序操作:
升级完成后执行一次 observe-cli doctor 校验:检查 OTLP 端口连通性、采样配置是否生效、跨集群查询是否路由正确。
完整变更记录见官网文档 changelog 页面。老版本用户建议在维护窗口内升级,升级过程预计 30~40 分钟。