分布式存储的技术趋势: 双重Raid机制
Posted 道熵
tags:
篇首语:本文由小常识网(cha138.com)小编为大家整理,主要介绍了分布式存储的技术趋势: 双重Raid机制相关的知识,希望对你有一定的参考价值。
分布式存储技术探讨
在上一篇文章中我们探讨了分布式存储的基本原理,分析了三副本分布式存储的潜在隐患:
一、性能问题:三副本分布式存储受到IO分布不均匀和木桶效应的影响,导致大延迟和响应迟钝的现象;
二、稳定性问题:频繁的数据重建会导致用户业务受到影响、甚至业务中断;
三、数据丢失风险:尤其是当硬件老化,或出现大规模掉电或节点意外宕机时,可能会导致多个机械硬盘同时出现损坏,危及三副本分布式存储的数据安全。
为了解决三副本分布式存储面临的性能问题、稳定性及可靠性等缺陷,道熵的铁力士分布式存储采用双重RAID保护机制,除了继承网络RAID(节点间副本、跨节点纠删码)和一致性哈希随机分布数据的特点,铁力士将磁盘阵列特有的节点内RAID技术和存储虚拟化(池化)管理技术, 即Storage Virtualization Manager (SVM),与分布式技术相结合,如图1所示。
图1:Titlis分布式存储双重Raid机制
网络Raid技术
在铁力士分布式存储中,每个数据块按照一致性哈希算法,随机选择两个不同存储节点来保存数据的两个副本,保证当任何一个节点宕机时,仍有一个数据副本保证读写操作,确保业务高可用和数据安全。
节点内Raid技术
在铁力士分布式存储的每个节点内,通过SVM存储虚拟化技术实现节点内的RAID数据保护,RAID级别选择可以是镜像,也可以是存储效率更高的RAID5或RAID6。节点内RAID保护可抵御单个或多个硬盘损坏,故障修复限制在节点内部,无需触发网络数据重建,有效地避免了网络重建风暴。
节点内RAID结合网络Raid(跨节点的副本/EC码)技术,铁力士实现了双重RAID数据保护。在三副本架构中,一旦同时出现三块磁盘故障或受损,数据就可能丢失;而在双重RAID架构中,即使每个节点同时出现一块磁盘故障,数据仍然无忧,业务仍然持续。考虑到分布式存储可能包含数十个甚至上百个存储节点,双重RAID的数据可靠性明显超过三副本架构。
存储虚拟化技术
铁力士将每个存储节点运行在存储虚拟化管理软件(SVM)上,把该节点的存储资源整合为一个统一管理的存储池,为分布式系统提供vOSD资源。SVM采用宽条带机制(见图2),将每个vOSD的工作负载均匀分布在节点的每个磁盘上,大幅提高了单个vOSD的IOPS能力,可有效抵御三副本分布式存储中的IO分布不均匀现象。
图 2:节点内Raid条带机制
二级DRAM+Flash 缓存加速
磁盘阵列中常见的性能加速手段是共享缓存加速,中高端磁盘阵列与低端磁盘阵列的在性能方面的一个重大区别,除了控制器个数,就是缓存加速的能力。典型的中高端磁盘阵列能支持的共享缓存加速在512GB到1TB上下。铁力士借鉴了磁盘阵列的设计,通过SVM虚拟化实现DRAM与Flash相结合的二级缓存加速:通过自适应算法,自动识别动态或静态热数据(高频率读写或最近读写数据),将最热的数据保存在延迟最小的DRAM中,而将次热的数据保存在更大容量、基于Flash的固态硬盘上;并由于分布式技术的加持,形成一个容量巨大的分布式二级缓存系统。与中高端磁盘阵列相比较,铁力士分布式存储系统支持数10TB、甚至100TB以上的分布式缓存,相当于其10倍、甚至100倍的缓存容量。
数据完整性校验与数据自修复
SVM存储虚拟化管理借鉴了WAFL(NetApp) 、Btrfs(SuSE)、ZFS(Oracle)、Storage Spaces(微软)等文件系统的先进经验,对底层存储的每个数据块增加一个256比特的校验码,并单独保存在一对固态硬盘镜像中,用于快速实现在线数据完整性校验。一旦校验码检查到数据受损,通过节点内RAID功能实现数据自修复。该功能可快速定位硬件故障,并实现硬件故障自动隔离。
了解双重RAID更多信息,请关注分布式存储的技术趋势(三):双重Raid与三副本对比。
关于道熵
作为信息化领域国家高新技术企业,南京道熵信息技术有限公司是行业内领先的磁盘阵列、分布式存储、超融合与混合云的专业厂商与技术服务商。道熵秉承"万无一失、方为存储"的产品理念,持守"Do Right Thing (做正确的事)、Pursue Excellence (追求卓越) 、 Help Others Succeed (成就他人) "企业信仰,为用户构建安全可靠的新一代数据存储系统、超融合与混合云解决方案。
以上是关于分布式存储的技术趋势: 双重Raid机制的主要内容,如果未能解决你的问题,请参考以下文章