← 返回文章列表
信创 3 分钟阅读 炬鲸团队

炬鲸 OBSERVE 信创适配实录:龙芯/飞腾 + 麒麟/统信全栈验证

记录炬鲸 OBSERVE 在龙芯、飞腾 CPU 与麒麟、统信 OS 上的全栈适配过程:架构与依赖替换、性能实测数据、迁移部署建议,为信创环境落地可观测平台提供参考。

适配范围与结论

炬鲸 OBSERVE 的后端服务、采集 Agent、前端控制台在以下组合上完成了全量功能验证:

  • CPU:龙芯 3A5000/3C5000、飞腾 FT-2000+/D2000、鲲鹏 920、海光 C86
  • OS:银河麒麟 V10(SP1/SP3)、统信 UOS 20、欧拉 openEuler 22.03

结论先行:核心链路(日志采集、检索、告警、Trace)在上述平台均可稳定运行,性能与 x86 的差异在可接受范围,具体见下文实测数据。

架构与依赖替换

国产化最大的工作量不在业务代码,而在依赖层。我们的做法:

  1. 存储层:默认 ClickHouse 在 ARM 上有官方支持,直接适配;客户指定国产库时切换到达梦 DM8 或人大金仓 KingbaseES,检索层做了 SQL 方言适配。
  2. 消息队列:Kafka 可替换为 Apache RocketMQ 或华为 DMQ,Agent 与后端都走标准协议,切换只改配置。
  3. 运行时:OpenJDK 在龙芯/飞腾上性能不佳的部分替换为毕昇 JDK 或本地化构建的 OpenJDK,GC 参数按 ARM 大页内存调整。
  4. 镜像:全部产物提供 ARM64 与 LoongArch64 架构镜像,docker pull 按架构自动匹配。

性能实测数据

在飞腾 D2000(8 核)+ 麒麟 V10 SP3 环境下压测:

  • 日志写入:单节点 12 万条/秒,相比 x86 同配置的 15 万条/秒下降约 20%。
  • 检索:1 亿条日志中 WHERE level='ERROR' 聚合查询平均 1.8 秒,x86 约 1.2 秒。
  • Trace 处理:单节点 8000 span/秒,满足绝大多数中小规模业务。

结论:CPU 单核性能差距在编译型负载上不明显,主要瓶颈在内存带宽,建议国产平台内存配到 x86 的 1.2 倍。

部署与迁移建议

  1. 从 x86 迁到信创时,先迁数据量小的告警与 Trace,日志冷数据保留在旧集群,避免一次性搬迁。
  2. 采集 Agent 优先用静态编译版本,避免目标机器缺 glibc 依赖。
  3. 麒麟/统信默认的防火墙与 SELinux 策略会拦端口,部署前先放行 4317/4318 与存储端口。
  4. 大页内存开启 transparent_hugepage=always,对 JVM 堆和数据库缓冲有 10%~15% 的吞吐提升。

信创不是「能不能跑」,而是「跑得稳不稳、出了问题谁来兜底」。适配报告与压测脚本已开源,欢迎拿去复现。