跳转至内容部分

IT 术语解读

事件管理

事件管理是 IT 组织用于管理已报告事件生命周期的流程。

对于希望采用 ITIL 最佳实践的组织而言,事件管理通常是首个被列为实施或改进目标的 IT 基础架构库 (ITIL) 流程。原因很简单:提升消费化水平并实现服务价值。事件管理是组织通过服务台或自助技术进行日常运营的流程,旨在快速恢复服务。

该流程的高效运行对组织以及受影响服务的用户至关重要。没有它,就会出现混乱局面,影响用户绩效、组织绩效,以及客户和服务供应商双方的整体经济价值。事件管理本身应支持业务战略,而业务战略也应为事件管理的执行方式提供支撑,以实现价值。

在本指南中,我们将详细介绍 ITIL 的事件管理体系。我们将从该流程的定义和目标说明开始,了解 ITIL 如何定义流程流转,理解支持团队如何协作解决 IT 事件,并学习如何使用关键绩效指标 (KPI) 衡量该流程在企业中的成功程度。最后,我们将探讨新型集成服务管理软件如何促进自动化,帮助组织建立统一的服务台并更高效地解决事件。

什么是事件管理?

在 ITIL 中,“事件”一词用于描述 IT 服务出现的计划外中断或服务质量下降,这对大型组织而言可能造成巨大成本。事件管理流程的主要目标是在发生中断时尽快为用户恢复服务。

与基本请求履行一样,事件管理是 IT 组织每天管理的最重要流程之一。请求履行流程用于处理更改密码等标准用户请求,而事件管理则处理真正的服务中断,目标是解决中断并尽快为用户恢复服务。

在 ITIL 使用的五阶段服务生命周期模型中,事件管理属于“服务运营”。这是服务生命周期的第四个阶段,此时服务已由组织投入运行。该流程通过确保服务的性能、可用性以及用户访问能力,帮助组织从其支持的服务和应用中获取最大价值。

事件管理的流程和工作流有哪些?

事件管理是 IT 组织用于管理已报告事件生命周期的流程。该流程包含多个步骤,通常称为子流程,必须全部执行,以确保事件得到充分解决并记录在案。下面,我们将介绍各个子流程及其为组织带来的作用。

事件管理支持

事件管理支持的目标是提供并维护高效处理事件所需的工具、流程、技能和规则。该流程有助于确保服务台坐席或技术人员具备足够的教育和培训,能够响应并解决 IT 组织内部发生的事件。该流程还维护处理和解决事件的规则与工作流,确保技术人员始终了解下一步该做什么,以保证事件得到解决。

事件记录和分类

该子流程的目标是以适当的严谨程度记录事件报告并确定优先级,从而促进快速有效的解决。组织通常用于解决事件和其他 IT 问题的资源有限,因此对传入事件报告进行有效优先级排序,是确保人力资源适当分配到最高优先级事件的关键步骤。IT 组织需要能够熟练判断已报告事件的范围和严重程度,并据此确定优先级。事件记录和分类通常可以自动化,例如当 IT 运营监控解决方案因发生性能或可用性事件而创建事件时。

由一级支持立即解决事件

当用户首次向服务台报告事件时,通常会将问题报告给一级服务技术人员。理想结果是一级技术人员能够在首次呼叫中、并在 IT 组织设定的目标解决时间内处理事件并恢复 IT 服务。当事件无法在目标时间内解决,或需要更高程度的专业技术知识才能解决时,就会发生升级,由二级支持技术人员接手该事件。

由二级支持解决事件

一旦事件已超出一级支持的首次呼叫解决范围并被升级,二级支持技术人员便可接手该事件,并开始寻找变通方法以尽快恢复服务。在这一层级,技术人员可以灵活地让支持小组或第三方供应商参与事件解决。例如,如果事件是由应用程序故障导致,二级技术人员可能会联系开发该应用程序的公司,以获取解决事件的额外指导。如果无法处理事件的根本原因,二级支持技术人员可以创建问题记录,并将事件转交给 问题管理 流程/团队。

重大事件处理

前文提到,按紧急程度确定事件优先级非常重要,这样才能最高效地部署资源。重大事件是组织可识别的最高优先级 IT 事件,它们会对业务活动造成严重中断或威胁,需要以最高紧迫性加以解决,以防止财务损失或其他关键后果。重大事件会通过一级和二级支持人员快速升级;如果事件未能迅速解决,还可能涉及第三方供应商。同样,如果无法纠正根本原因,该事件会转交给问题管理。

事件监控和升级

遵循 ITIL 最佳实践的 IT 组织将建立并维护一个系统,用于监控每个已报告 IT 事件的状态和升级情况。负责事件管理的 IT 经理应能够跟踪当前已报告事件的数量,并查看它们在事件管理流程中的状态。当事件管理团队响应事件耗时过长时,就会违反服务级别协议,而服务中断会导致业务中断。事件监控用于确保事件管理工单能够及时得到解决并在流程中推进,从而为组织维持服务级别。

事件关闭和评估

事件得到有效解决后,事件记录将提交至最终质量控制步骤。该子流程确认事件已经解决,并且事件生命周期已被足够详细地记录。组织未来可以使用事件报告中的发现,包括作为 知识管理 流程的输入。事件关闭和评估有助于确保组织跟踪有关事件的所有重要信息,并在事件解决后从中获得经验。

主动用户信息

事件管理报告通常通过组织的服务台提交,服务台是组织内 IT 资源的单一联系点。服务台团队还可以使用该沟通门户,主动向用户通报组织内部的已知问题和服务中断情况。该子流程通过提供有关组织内部服务中断的最新信息,帮助在整个组织内分发信息,并减少服务台上的请求和咨询数量。

事件管理报告

该子流程用于从事件管理流程中捕获信息,并将其提供给其他服务管理流程,确保组织有机会基于过往事件数据改进绩效。

组织如何衡量事件管理的成功?

衡量 ITIL 服务生命周期中各流程的成功程度,是实现持续服务改进的关键。组织应确定用于监控各流程绩效的指标,并准确报告这些指标,以帮助识别最佳改进机会。下面列出了组织可衡量的五项最重要 KPI,用于确保其事件管理流程达到预期表现。

事件状态 - 组织可以使用软件跟踪当前作为事件管理流程一部分正在管理的事件状态。实时查看所有未结事件的状态,可以揭示最大积压出现在哪里,以及组织如何最合理地投入资源以改善流转并缩短解决时间。例如,如果大量事件卡在二级支持且未得到解决,公司可以采取几种潜在方案:

  1. 增加二级支持人员,以加快事件处理。
  2. 为二级支持人员增加培训,以提高事件解决效率。
  3. 为一级支持人员增加培训,以减少升级。
  4. 引入三级支持,帮助管理特定类型事件的积压(例如,如果故障打印机相关事件出现积压,可联系制造商协助解决问题)。

首次呼叫解决率 - 首次呼叫解决率说明事件由一级技术支持人员在首次呼叫中解决的频率。及时解决问题需要员工具备有效培训、充足经验,以及获取资源和知识的权限。

每个事件的平均成本/事件解决工作量 - 组织可以选择衡量每个已管理事件的平均成本,或解决每个事件所投入的平均工作量。组织希望在满足服务级别协议和客户满意度的同时,将这些成本降至最低。能够提升业务正常运行时间的 IT 投资应产生正向投资回报。

平均初始响应时间 - 该 KPI 衡量用户报告事件与服务台响应事件之间的平均时间。如果服务台可以快速解决事件,但需要三小时才响应,组织可能会考虑增加一级服务技术人员,以缩短响应时间并相应提高服务可用性。

重复事件数量 - 重复或重新打开的事件会对组织造成不利影响。这可能意味着支持技术人员尚未识别问题的根本原因,因此问题会反复发生。也许 IT 人员知道如何解决该问题,用户实际上也可以自行解决,但缺少促进自助服务的资源。通过找出问题根本原因并主动与用户沟通,帮助他们在不向 IT 报告的情况下解决问题,可以避免重复事件。

相关内容:更多 IT 术语解读

事件管理角色和职责

明确界定角色和职责对于有效执行事件管理流程至关重要。事件管理团队由以下成员组成:

事件经理

事件经理主要负责推动并持续改进事件管理流程。在中小型组织中,此角色通常由服务台经理担任;在大型组织中,这可能是一个单独定义的角色。关键职责包括:团队领导、向管理层报告关键绩效指标 (KPI)、直接管理一线和二线支持、管理事件管理系统,以及执行事件管理流程工作流。

一线支持

一线服务台技术人员是最终用户获取信息和报告服务中断的单一联系点。他们主要负责事件的初始支持和分类,并立即尝试尽快恢复故障服务。如果无法解决事件,一线服务台技术人员会将事件转交给适当的支持人员,监控活动进展,并让用户及时了解其事件状态。

二级支持

二线支持技术人员通常比一线服务台技术人员具备更高级的知识。他们可能负责一线支持无法解决的事件。这些技术人员可能会与软件或硬件供应商的第三方专家互动,以帮助尽快恢复正常服务。

事件管理 KPI

在 ITIL 生命周期的所有阶段,度量都非常重要。每个流程都有应当监控和报告的指标,以有效评估整体绩效。持续服务改进要求衡量每个流程的绩效,以识别需要改进的领域。

典型的事件管理指标包括:

  • 报告的事件总数(按类别、优先级、人员、组织单位等)
  • 事件状态
  • 事件创建到解决之间的时间
  • 事件与 SLA(达成、违反)
  • 每个事件的平均成本
  • 重新打开率
  • 未升级即处理的事件
  • 首次呼叫解决率
  • 出现重复事件的配置项
  • 按一天中不同时间统计的事件

KPI 应与关键成功因素 (CSF) 相关联,而 CSF 应与目标相关联。这种关系有助于为保持当前状态并改进到期望状态提供决策支持。虽然每个组织各不相同,但面向用户、员工和管理层的相关报告将有助于支持重要决策,用于改进流程以及整体业务。

实用指南系列:IT 服务和资产管理

实施事件管理的最佳实践

在企业内采用 ITIL 框架可能是一项艰巨任务。与任何 ITIL 流程一样,事件管理实施也需要业务部门的支持。尤为重要的是获得高管和高级管理层的认同。在开始采用流程之前,至少需要有一名专人负责整体项目管理,并统筹事件管理最佳实践的遵循。拥有一个 IT 服务管理 (ITSM) 工具 也会非常有帮助,该工具可支持当前状态流程和期望的未来状态流程,同时服务台可作为与 IT 部门对接的主要界面。

1) 了解当前事件管理流程

有时,组织并没有一致的事件处理流程,或者已有流程不够成熟。无论哪种情况,都应尽可能梳理现有流程,以了解现有服务台流程能够提供什么。

2) 确定长期事件管理流程愿景

了解组织对事件管理流程的期望同样重要。该期望可能基于 ITSM 工具随附的通用事件管理模板,也可能基于组织特定需求定制更高的流程。

3) 进行差距分析

接下来,确定组织当前事件管理流程与其长期事件管理愿景之间需要调整的内容。这将为您提供有价值的信息,帮助了解实现事件管理目标和整体服务目标所需的工作量、时间、资金和资源。

4) 制定实施路线图

采用任何 ITIL 流程都需要时间来发展,因此您需要一份路线图来帮助管理层设定预期。使用该路线图描述交付所需的活动、时间范围和工作投入。该路线图应包括快速成果、工具实施、流程变更、人员和组织赋能、沟通计划以及整体治理变更。

5) 开始项目实施

现在可以开始实施了。创建一份项目计划,明确完成所有任务所需的行动或任务、职责和时间线。在达成每个里程碑时持续沟通成功成果,展示您朝最终实施目标取得的进展。

事件管理软件功能清单

对于正在评估事件管理软件和/或提供事件管理功能的 IT 服务管理套件的 IT 组织而言,了解支持关键流程所需的功能类型非常重要。事件管理软件至少应提供以下功能:

  • 创建、修改、解决和关闭事件记录
  • 生成与每个事件记录关联的唯一记录编号
  • 将事件链接到问题记录、知识文章、已知变通方法和变更请求
  • 将配置管理数据链接到事件记录
  • 在关联问题解决时通知事件负责人
  • 在审计日志中自动记录历史数据
  • 可配置的事件分类
  • 事件搜索和报告功能
  • 根据资源可用性、时区、站点等路由事件
  • 根据分类对事件进行优先级排序、分派和升级;根据优先级或其他分类进行升级
  • 与事件监控解决方案集成,并能够自动创建、更新和关闭事件
  • 灵活的字段配置,包括自由文本、下拉菜单、日期/时间、附件和屏幕截图
  • 将事件链接到客户数据
  • 使用知识库解决方案/脚本进行诊断和解决
  • 将事件或相关任务分派给外部服务提供商
  • 将事件分派给多个处理人
  • 从事件记录创建问题或变更请求
  • 根据截止期限、SLA、关闭和其他活动自动发送事件提醒(面向 IT 员工和/或最终用户)
  • 将事件记录链接到 SLA
  • 通过客户满意度调查收集最终用户反馈
  • 代表他人发起事件
  • 提供停止 SLA 计时功能,以将事件置于暂停状态
  • 区分事件和服务请求
  • 重新激活已解决的事件
  • 根据影响和紧急程度自动确定优先级
  • 与电话/ACD 系统集成,根据来电显示预填充客户信息

此内容最初发布于 Cherwell.com,发布时尚未被 Ivanti 收购。