开发者社区> 晚来风急> 正文

如何避免虚拟基础设施单点故障

简介:
+关注继续查看

墨菲法则提到如果某事可能会出错,那么这件事一定会出错。可能没有比服务器虚拟化更严格遵守该法则的领域了。数据中心只有物理服务器时,服务器故障通常只影响一个工作负载。而虚拟主机运行多个工作负载,这意味着可能导致很多应用会出现故障。

使用服务器虚拟化的大多数企业利用诸如故障切换集群或者复制技术作为应对hypervisor级故障的方式。然而这类技术在保护虚拟负载方面还有很长的一段路要走,因为集群往往不够。即使构建了虚拟主机高可用集群仍然可能出现故障。如果某些虚拟基础设施成为单点故障,那么故障可能会发生。

尽管消除所有能够想到的单点故障是有可能的,但这需要雄厚的资金支持。在大多数情况下,企业必须识别潜在的风险,然后评估风险转换为实际问题的可能性。企业可能要花钱应对最大的风险。

这也引发了一个问题,那就是存在的潜在单点故障是什么。真正的故障风险可能变化多端,这取决于使用哪家厂商的产品以及虚拟基础设施是如何部署的。某些风险与硬件相关,某些与软件相关。

与硬件相关的发生故障可能会影响整个虚拟基础设施的所有硬件。以电源管理为例,很多虚拟主机配置了冗余的电源模块,当一个电源模块发生故障,第二个电源模块能够在线接管,这样就不会影响主机服务器,即便这样,管理员必须考虑电源一旦出现故障带来的的后果。

虚拟主机通常连接到UPS,在电力故障时能够使用发电机发电。然而,如果在主电源发生故障时,所有的服务器连接到同一个发电机,那么该发电机也可能成为潜在的单点故障。

这时就要进行风险评估。在备用的发电机出现故障影响整个虚拟基础设施前,很多事情都会出错,此时必须中断电源。不必将备用发电机出现故障放在心上,因为备用发电机成为单点故障的可能性非常小。

正如前文所说,尽管消除所有可能的单点故障是有可能的,但代价非常大。可以想象一下为各种各样的服务器配置单独的备用发电机的场景。,即使是这样也不一定会消除潜在的单点故障。如果这些备用发电机的燃料都来自于同一个地方,而燃料恰好被水污染了,那么发电机燃料将会成为单点故障。需要注意的是,很多事情可能会在发生其他故障之前出现问题。

在集群环境中,共享存储成为单点故障更为常见。集群存储通常配置了冗余的磁盘,当冗余未达到要求时,阵列、交换机、线缆可能会出现故障。

在软件端,如果未采用冗余方式部署,那么基础设施服务器可能成为单点故障。例如,假定企业打算部署System Center Virtual Machine Manager(SCVMM)作为管理Hyper-V的工具。SCVMM可能会成为单点故障,除非被部署在高可用性虚拟机上。同样地,SCVMM依赖的SQL Server数据库也可能成为单点故障,除非数据库也是冗余的。其他潜在的单点故障可能包括DNS服务器、域控制器、DHCP服务器、备份服务器或者互联网网关。

对大多数企业来说,消除所有可能的单点故障是不可能的,更好的策略是识别出单点故障,然后针对单点故障的风险等级进行评估。


本文作者:张冀川

来源:51CTO

版权声明:本文内容由阿里云实名注册用户自发贡献,版权归原作者所有,阿里云开发者社区不拥有其著作权,亦不承担相应法律责任。具体规则请查看《阿里云开发者社区用户服务协议》和《阿里云开发者社区知识产权保护指引》。如果您发现本社区中有涉嫌抄袭的内容,填写侵权投诉表单进行举报,一经查实,本社区将立刻删除涉嫌侵权内容。

相关文章
阿里云服务器怎么设置密码?怎么停机?怎么重启服务器?
如果在创建实例时没有设置密码,或者密码丢失,您可以在控制台上重新设置实例的登录密码。本文仅描述如何在 ECS 管理控制台上修改实例登录密码。
18720 0
使用OpenApi弹性释放和设置云服务器ECS释放
云服务器ECS的一个重要特性就是按需创建资源。您可以在业务高峰期按需弹性的自定义规则进行资源创建,在完成业务计算的时候释放资源。本篇将提供几个Tips帮助您更加容易和自动化的完成云服务器的释放和弹性设置。
18323 0
如何设置阿里云服务器安全组?阿里云安全组规则详细解说
阿里云安全组设置详细图文教程(收藏起来) 阿里云服务器安全组设置规则分享,阿里云服务器安全组如何放行端口设置教程。阿里云会要求客户设置安全组,如果不设置,阿里云会指定默认的安全组。那么,这个安全组是什么呢?顾名思义,就是为了服务器安全设置的。安全组其实就是一个虚拟的防火墙,可以让用户从端口、IP的维度来筛选对应服务器的访问者,从而形成一个云上的安全域。
16564 0
阿里云服务器安全组设置内网互通的方法
虽然0.0.0.0/0使用非常方便,但是发现很多同学使用它来做内网互通,这是有安全风险的,实例有可能会在经典网络被内网IP访问到。下面介绍一下四种安全的内网互联设置方法。 购买前请先:领取阿里云幸运券,有很多优惠,可到下文中领取。
17905 0
windows server 2008阿里云ECS服务器安全设置
最近我们Sinesafe安全公司在为客户使用阿里云ecs服务器做安全的过程中,发现服务器基础安全性都没有做。为了为站长们提供更加有效的安全基础解决方案,我们Sinesafe将对阿里云服务器win2008 系统进行基础安全部署实战过程! 比较重要的几部分 1.
11479 0
使用NAT网关轻松为单台云服务器设置多个公网IP
在应用中,有时会遇到用户询问如何使单台云服务器具备多个公网IP的问题。 具体如何操作呢,有了NAT网关这个也不是难题。
34081 0
+关注
9379
文章
243
问答
文章排行榜
最热
最新
相关电子书
更多
OceanBase 入门到实战教程
立即下载
阿里云图数据库GDB,加速开启“图智”未来.ppt
立即下载
实时数仓Hologres技术实战一本通2.0版(下)
立即下载