数据中心日常维护工作有哪些?
2021-05-04
中国电源产业网

导语:数据中心要保持稳定的运行,需要大量的专业技术人员。一般承担重要业务的数据中心都是有人24小时值守,无人值守的数据中心一般只能承担不重要业务,完全无人管理维护的数据中心几乎没有。所以数据中心日常维护工作烦琐,但又很重要。
数据中心要保持稳定的运行,需要大量的专业技术人员。一般承担重要业务的数据中心都是有人24小时值守,无人值守的数据中心一般只能承担不重要业务,完全无人管理维护的数据中心几乎没有。所以数据中心日常维护工作烦琐,但又很重要。随着人们的工作生活对数据的完全依赖,承载数据计算、运行的数据中心正发挥着越来越重要的作用,这更突显出维护工作的重要。
当一个数据中心建成投产后,维护工作就开始了,一直到数据中心的生命周期结束。一般我们可以将数据中心的维护工作分为四大类:一是日常检查类;二是应用变更、部署类;三是软、硬件升级类;四是突发故障处理类,下面就来详细说一说这些维护工作,让大家对维护工作有个了解。
日常检查
“千里之堤,溃于蚁穴”。任何的故障在出现之前都可能会有所表现,小的隐患不消除,可能导致重大的故障出现,所以数据中心日常的例行检查工作枯燥,但也很重要,可以及时发现一些运行中的隐患。根据数据中心承载业务重要性的不同,要对数据中心里的所有运行的设备进行例行检查。一些数据中心设备厂商提供了检查软件,比如网管软件,安全防护软件等。可以利用这些软件对数据中心网络进行检查,看日志是否有异常告警,网络是否出现过短时中断,端口是否出现UP/DOWN等。通过网络探测软件看网络质量如何。检查服务器应用服务是否正常,CPU内存等利用率是否正常。对应用业务进行检查,比如如果有搜索业务,就可以通过服务器进行单词搜索,看搜索的结果和延迟是否在正常的范围之内。这些检查每日都要重复检查,一旦有异常及时处理与消除,必要时将重要业务切换到备用环境中,然后排除后再切回。
对数据中心的机房环境也要进行检查,环境的温度、湿度、灰尘是否合乎要求。空调、供电系统进行运行良好,设备运行是否过热,地板、天窗、消防、监控都是检查的部分。不合理的地方要及时进行整改,而不应该偷懒。经常到一些数据中心,就会发现值班维护人员很多都抱着电脑在浏览网页,打游戏。对于日常检查应付一下,甚至根本不去检查,只要没有出现故障,就打游戏消耗时间,这样数据中心出现故障是迟早的事。一旦出现故障就毛手毛脚,甚至哪个业务走的哪个设备,哪个端口哪个网线都不清楚,本来一个小故障可能因为不熟悉导致大故障,因此日常检查绝不能应付,虽然需要不断重复,但却很重要,在持续的检查过程中,将会对数据中心的理解越来越深,这样每次检查都会有新的发现,在检查中进行学习。
应用变更
数据中心承载的业务不会是一成不变的,随着业务的多样化,经常要对业务进行调整,包括服务器和网络的设置。因此要对服务器和网络设备操作很熟悉,主要需要掌握Linux服务器命令和网络协议。要根据应用的需要,做出变更。这时就对维护人员提出了更高的要求,不仅是对数据中心原有业务要非常熟悉,还要对新上的应用业务有正确的理解,这样才能在不影响原有业务的基础上做调整。这样的应用变更每个月可能都要做几次,是数据中心维护人员的必修课,突显了一个技术人员的基本技能水平。这时要对设备操作命令比较熟悉,懂得如何实现业务,要经常和设备厂商的技术人员打交道,通过交流尽快掌握设备操作方法。同时,由于设备厂商对应用业务缺乏了解,这就需要维护人员在应用业务和设备具体实现之间做好协调,处理。以最快的时间和最小的代价完成应用业务部署。
软硬件升级
突发故障
编辑:中国电源产业网
来源:数据中心运维管理
标签:
相关信息
MORE >>-
模块化,最大程度提升数据中心效能的UPS方案
台达创立于1971年,为全球提供电源管理与散热解决方案。近年,台达已逐步从关键元器件制造商迈入整体节能解决方案提供者,深耕“电源及元器件”、“交通”、“自动化"与“基础设施"四大事业范畴。
-
备电+储能,UPS与锂电池在数据中心的新模式
台达创立于1971年,为全球提供电源管理与散热解决方案。近年,台达已逐步从关键元器件制造商迈入整体节能解决方案提供者,深耕“电源及元器件”、“交通”、“自动化"与“基础设施"四大事业范畴。
-
捷益达电子——数据中心16柜双排方案
捷益达双排方案为客户成功建设了一套高效、稳定的数据中心系统,满足了客户对数据中心安全性和可靠性的要求。
-
如何计算数据中心算力与算效
为了保证数据中心(智算中心)后期安全营运,提前规划好智算中心的算力、算效以及研究相关政策,是很关键的一步。
-
北京首个大规模存储数据中心完成转型升级!可用智能算力1000P
由北京科信盛彩云计算有限公司投资运营的科信云数据中心完成转型升级,腾退存储机柜约1000架,上架智算服务器近200台,可提供约1000P的算力服务,成为全市首个大规模存储数据中心转型智算中心的成功案例。
-
国家数据局:10个国家数据中心集群算力总规模超过146万标准机架
国家数据局数字科技和基础设施建设司司长杜巍在回答记者相关提问时表示,数字经济时代,算力是新质生产力。