适用场景

运维数据散在各系统里,故障时没人能快速回答"这台服务器上跑什么、谁负责、依赖谁"。CMDB 是解决这个问题的地基。

配置步骤(指标口径与命名统一)

# 1) 指标命名规范:system_metric_unit(如 host_cpu_usage_pct)
# 2) 口径统一:CPU 使用率是 1-空闲 还是 按核平均
# 3) 采集口径一致:同一类对象用同一模板
# 4) 文档化并在监控平台内可查

关键参数与建议

  • 统一 ID:资产编号 + IP + 主机名 三者绑定,作为跨系统主键
  • 配置项范围:主机、网络设备、数据库、中间件、应用、证书
  • 关系:应用部署在哪台上、依赖哪个数据库、挂哪块存储
  • 数据来源:自动采集为主(监控/扫描),人工维护为辅
  • 质量:定期核对(监控在线清单 vs CMDB),差异有处理

容易踩的坑

  • 各监控系统口径不同,同一台机器两个数字
  • 命名随意,看指标不知道含义
  • 口径无文档,新同事理解偏差

验证与巡检

# 验证:同一对象在两个平台的同名指标数值一致
  • 巡检:命名与口径文档、定期核对

小结

CMDB 的验收标准:报出一个 IP,能立刻看到主机名、负责人、承载应用、依赖关系、维保状态。做不到就还是"表格",不是 CMDB。

> 说明:文中命令为通用写法,不同型号/版本可能略有差异,落地前请对照设备实际版本的官方文档;带外管理与安全设备变更建议先在测试设备验证。