适用场景
运维数据散在各系统里,故障时没人能快速回答"这台服务器上跑什么、谁负责、依赖谁"。CMDB 是解决这个问题的地基。
配置步骤(指标口径与命名统一)
# 1) 指标命名规范:system_metric_unit(如 host_cpu_usage_pct)
# 2) 口径统一:CPU 使用率是 1-空闲 还是 按核平均
# 3) 采集口径一致:同一类对象用同一模板
# 4) 文档化并在监控平台内可查
关键参数与建议
- 统一 ID:资产编号 + IP + 主机名 三者绑定,作为跨系统主键
- 配置项范围:主机、网络设备、数据库、中间件、应用、证书
- 关系:应用部署在哪台上、依赖哪个数据库、挂哪块存储
- 数据来源:自动采集为主(监控/扫描),人工维护为辅
- 质量:定期核对(监控在线清单 vs CMDB),差异有处理
容易踩的坑
- 各监控系统口径不同,同一台机器两个数字
- 命名随意,看指标不知道含义
- 口径无文档,新同事理解偏差
验证与巡检
# 验证:同一对象在两个平台的同名指标数值一致
- 巡检:命名与口径文档、定期核对
小结
CMDB 的验收标准:报出一个 IP,能立刻看到主机名、负责人、承载应用、依赖关系、维保状态。做不到就还是"表格",不是 CMDB。
> 说明:文中命令为通用写法,不同型号/版本可能略有差异,落地前请对照设备实际版本的官方文档;带外管理与安全设备变更建议先在测试设备验证。