存储故障处理流程的演变及不同阶段问题分析.docx
《存储故障处理流程的演变及不同阶段问题分析.docx》由会员分享,可在线阅读,更多相关《存储故障处理流程的演变及不同阶段问题分析.docx(6页珍藏版)》请在优知文库上搜索。
1、存储作为存放金Mi企业数据中心各类生产数据的重要载体,其日常的安全平稳运行至关也要.特别是应对若干存储的大成告警,如何从大破告警中提取关键告警消息并及时处理异常,可谓对存储平台的稔定运行起到保驾护航的作用.存储告警处理作为常规工作,一方面需要在技术层面上及时发现告警并处理,另一方面还要在制度层面符合ITI1.流程管理的规定.存储告警中硬盘及电池的告警相对较多,此类告警出现时通常需要更换备件解决,且更换操作均属于标准流程.因此,存储硬件类告警的日常处理,如果兼顾流程、实际情况能纳入自动化管理,对于工作效率的提升将十分明显.下面分别介绍“传统、目前、未来三个阶段在发现存储故障、提交厂商信息报修、同
2、步111.流程三个方面的具体情况,旨在帮助读者更好地了解在自动化推进中各阶段亟需解决的问题.一、传统存储故障处理流程1 .发现存储故隆机房值班人员通过每天定期现场巡检,借助存储物理亮灯可以发现异常情况并告知存储运维人员进行处理.由于人工巡检频率较低,发现异常相对比较滞后,目存在漏检可能.为了能及时发现存储设备存在的告警,早期通过在各存储管理平台配首SNMPTraP,将告警信息由运行监控中心发送给存储运维人员.这类告警即时性相当高,有效辅助运维人员在第一时间发现设备异常,但告警消息数目较多且缺乏过流及压缩,也给运维人员的日常工作带来了一定的困扰.2 .提交厂商日志确认并安排维修SNMPTraP类
3、告警消息因缺少设备序列号、机柜位臂、部件位首、部件规格等明确信息,无法直接转发给厂商工程师进行设备报修,一般需要单独收集相关日志发送给厂商进一步分析,或者需要运维人员通过命令行或GUI等工具反馈具体信息给厂商.设备报修要求出具相关部件的准确信息,而基于一定规则定制的告警消息无疑将使报修流程化繁为简,在日常运维中将节省大量的时间.3 .纳入ITI1.流程存储硬件更换在制度上纳入I1.流程变更菅理,通常需要由存储运维人员在Fn1.爸理平台申请事件工单和变更工单.运维人员梳理设备告警情况,并跟厂商确认好部件更换工作,先在ITl1.管理平台中提出事件工单,然后关联此事件工单创建变更工单.事件工单经服务
- 配套讲稿:
如PPT文件的首页显示word图标,表示该PPT已包含配套word讲稿。双击word图标可打开word文档。
- 特殊限制:
部分文档作品中含有的国旗、国徽等图片,仅作为作品整体效果示例展示,禁止商用。设计者仅对作品中独创性部分享有著作权。
- 关 键 词:
- 存储 故障 处理 流程 演变 不同 阶段 问题 分析
