什么是冗余储存?

虽然系统中主处理器(CPU)出现故障的频率相对较低,但采用对称多处理器(SMP)架构仍能提供一定的容错能力。通过让多个CPU分担工作任务,即使其中一个出现异常,系统仍能维持基本的处理能力,保障关键业务不中断。

在高可用的存储系统设计中,冗余储存的核心逻辑就是频繁利用数据冗余技术。这种做法的主要目的是为了确保系统具备高可用性,即使面临某些组件失效的风险,整个存储环境依然能够稳定运行,不会轻易瘫痪。

实现存储冗余的一种常见方法是磁盘镜像。其原理非常简单直接,就是将相同的数据同时写入两个不同的磁盘中。这样如果其中一个磁盘物理损坏,另一个磁盘上仍然保留着完整的数据副本,可以立即启用。

对于服务器而言,I/O卡的冗余主要指网卡和硬盘控制卡的双重备份。网卡冗余技术原本多见于大型机和中型机,现在已逐渐普及到PC服务器。例如Micron的NetFRAME9200最多支持4个网卡冗余,每个承担25%的流量。

RAID5技术则对校验信息的位置进行了优化,将校验信息分散分布在所有的5个磁盘上。这种设计使得系统可以更换任一故障磁盘,其余操作逻辑与RAID3类似,但提供了更好的读写平衡和更高的容错灵活性。

某些先进的服务器系统还进一步实现了DC(直流)供电的冗余。以Micron公司的NetFRAME 9000为例,它更是实现了AC(交流)和DC双重全冗余设计,极大地提升了电源层面的可靠性和抗风险能力。

冗余设计的根本出发点在于容错。当一个数据节点意外不可用时,系统可以立即切换,通过其他尚存活的节点继续访问所需数据。这种机制确保了服务的不间断,是保障业务连续性的关键手段。

在高端服务器硬件层面,冗余储存常常体现为双电源系统的应用。这两个电源在正常工作时处于负载均衡状态,共同供电;一旦其中一个电源发生故障,另一个电源会立即接管并承担全部的电力负载,防止系统断电。

RAID(廉价冗余磁盘阵列)是另一种广泛应用的冗余技术。以RAID3为例,它由5个磁盘构成,其中4个用于存储实际数据,1个专门存储校验信息。如果其中一个磁盘故障,可以通过其余3个数据盘和校验盘在线重建数据。

磁盘双联是在磁盘镜像基础上的进阶方案。它在镜像磁盘的基础上增加了一个I/O控制器,从而有效改善了传统镜像中可能存在的总线争用情况,使得读写操作更加高效,进一步提升了系统的整体性能表现。

在PCI总线技术方面,Micron公司的NetFRAME 9200采用了三重对等PCI技术。这一创新优化了PCI总线的带宽,显著提升了如硬盘、网卡等高速设备的数据传输速度,是高端服务器提升I/O性能的重要手段之一。

在服务器系统的各个组成部分中,存储子系统往往是故障率最高的地方。为了应对这一问题,厂商采用了多重备份策略来增加整体系统的可靠性,确保数据不会因为单一存储点的损坏而丢失,这是冗余储存的重要应用场景。

虽然数据冗余储存能提升安全性,但它对写入性能有一定的负面影响。不过好消息是,由于数据副本之间的存在,查找性能并不会因为重复存储而出现严重的性能破坏,整体读取体验依然流畅。