OmegaBrain 公测进行中 —— 电脑、手机、平板、电视、服务器、收银机,一个 OmegaBrain 全搞定了解公测进展 →
产品教程
· OmegaBrain 资讯组

如何把 OmegaBrain 的服务器指标接进你自己的 Grafana 看板

OmegaBrain 以标准 Prometheus 格式暴露纳管设备的 CPU、内存、磁盘、在线状态和告警数。只需在 prometheus.yml 里加一段 scrape 配置,就能把数据接进你已有的 Grafana 看板,两边同步。

阅读 101 次 · 来源:—

适用场景

你已经在用 Prometheus + Grafana 看板监控自己的基础设施,又不想放弃 OmegaBrain 的自动巡检和修复能力。不需要二选一:OmegaBrain 暴露了 Prometheus 兼容的指标端点,你的 Prometheus 直接抓取即可,OmegaBrain 继续管体检和修复,Grafana 继续管可视化。

第一步:拿到抓取地址

指标端点对每个纳管服务器自动生效,无需在设备上装任何东西:

https://omegabrain.cn/api/v1/metrics

用浏览器或 curl 打开这个地址,能看到 omegabrain_device_* 系列的指标文本,说明链路已通。

第二步:配置 Prometheus 抓取

把下面这段加进你的 prometheus.yml:

scrape_configs:
  - job_name: 'omegabrain'
    scrape_interval: 30s
    static_configs:
      - targets: ['omegabrain.cn:443']
    scheme: https
    metrics_path: /api/v1/metrics

重载 Prometheus(kill -HUP 或重启),在 Prometheus 的 Targets 页看到 omegabrain 状态为 UP 即抓取成功。

第三步:在 Grafana 里出图

可用的核心指标:

指标 含义
omegabrain_device_cpu_usage_percent CPU 使用率(%)
omegabrain_device_memory_usage_percent 内存使用率(%)
omegabrain_device_disk_usage_percent 磁盘使用率(%)
omegabrain_device_online 在线状态(1=在线,0=离线)
omegabrain_open_alerts 当前 open 状态告警数(按 severity 分组)

每条指标都带 server_id 和 device_name 标签,多台设备可以直接用 Grafana 的 by (device_name) 分图。举一个最常用的 Panel 查询:

omegabrain_device_cpu_usage_percent

选 Time series 可视化、按 device_name 分 legend,就是一张全设备 CPU 曲线图。

安全说明

  • 当前端点未设抓取令牌,建议在 Prometheus 所在网络侧用 IP 白名单限制抓取来源;
  • 需要 Bearer token 鉴权的团队,可在后台联系客服开启(配置中心 metrics_exporter.scrape_token);
  • 端点是只读的,抓取不会影响设备的巡检和修复链路。

和管理后台的关系

自助后台(portal)服务器详情页里也有「对接你的 Grafana」卡片,配置示例可以一键复制。Grafana 看板替代不了 OmegaBrain 的体检、审批和治疗病历——两边是互补关系:OmegaBrain 负责「发现问题并修好」,Grafana 负责「你想怎么看数据」。

反馈+¥50
有设备运维问题?
直接问小欧,秒回