ITOM 的核心领域

ITOM 天然覆盖面广,涵盖:监控(对基础设施、网络与应用健康的可见性)、部署(计算、存储与网络资源的交付与配置)、自动化(面向日常运维的运行手册、编排与自愈)、分析(容量规划、事件关联,以及日益普及的 AIOps)。

ITOM 与 ITSM、AIOps 的关系

ITOM 与 ITSM 常被混淆。ITOM 面向基础设施,负责让系统运行;ITSM 面向流程,管理事件、变更等工作如何在组织中流转。一条监控告警(ITOM)会变成一张事件工单(ITSM);一个准确的 CMDB 同时为两者供数。AIOps 位于其上,将机器学习应用于 ITOM 产生的运维数据,以检测异常、关联事件、预测故障。在数据中心里,多数 ITOM 体系的薄弱点在物理层——工具能看到 CPU、内存与服务状态,却看不到底层的风扇、电源、光链路、能耗与资产变更。

深入硬件层的 ITOM

云新将 ITOM 向下延伸至物理根基。带外采集捕获硬件健康、资产、能耗与配置变更;这些数据为监控、实时 CMDB 与 AI 辅助分析供数。最终形成的运维图景,能把一个业务症状一路连到对其负责的部件、机柜与供电回路。核心优势:从硬件到业务的全栈可视、无代理的带外采集、实时的资产与配置数据、跨层告警关联、AI 辅助根因分析。

常见问题

ITOM 是 IT Operations Management(IT 运维管理)的缩写,指用于运行、监控与维护组织 IT 基础设施与服务的实践与工具。ITOM 与 ITSM 的区别在于:ITOM 面向基础设施,负责让系统持续运行(监控、部署、自动化);ITSM 面向流程,管理事件、变更、请求等工作流。ITOM 不等于 AIOps——AIOps 是将机器学习应用于运维数据以检测、关联与预测问题的能力,是现代 ITOM 平台日益具备的一部分。