百度采用自主研发系统工具 使SATA盘返修率低于SAS盘

来源:至顶网  
2013/12/1 20:38:49
据了解,百度近三年来一直使用其主导研发的系统工具hdoctor。该创新工具的应用,使SATA 硬盘的故障返修率低于比其成本及可靠性更高的SAS硬盘,有效地解决了在大数据时代,大规模大容量SATA硬盘应用背景下的高故障率、低运维效率和存储成本控制等难题。

本文关键字: 百度 SATA盘 SAS盘
据了解,百度近三年来一直使用其主导研发的系统工具hdoctor。该创新工具的应用,使SATA硬盘的故障返修率低于比其成本及可靠性更高的SAS硬盘,有效地解决了在大数据时代,大规模大容量SATA硬盘应用背景下的高故障率、低运维效率和存储成本控制等难题,并对大幅降低云存储购置成本奠定坚实基础。
 
大数据促硬盘故障问题凸显
 
如今,数据量迅速膨胀,据IDC统计,2012年全球数据总量已达到2.8ZB,而到2020年,预计将达到40ZB,相当于地球上所有海滩沙粒数量的57倍,地球上人均将拥有5247GB数据。海量数据让全球面临着数据存储方面的严峻挑战,这里面既有技术上的难题,也有来自成本方面的压力。而硬盘作为数据中心存储数据的核心部件之一,其返修率高、成本昂贵成为众多挑战中的主要难题。
 
据统计,在数据中心中,硬盘相关的故障占全部硬件故障的85%以上。随着大数据时代的到来,服务器数量大幅度增长,更多的存储需求、更低成本硬盘的使用,以及高温、高存储密度等技术的应用,硬盘故障及报废规模呈明显增加趋势。这对业务稳定、存储成本和运维效率都造成了严重的影响。如何降低返修率一直困扰业界。
 
因为存储着上百PB数据,百度——这家全球最大的中文搜索引擎公司拥有着数百万块硬盘,解决返修率问题极其迫切。也正是在这样的背景下,百度于三年前就自主创新,主导研发了系统工具hdoctor。
 
百度hdoctor五维度融合创新
 
hdoctor最主要的成果是让SATA硬盘的返修率低于SAS硬盘。
 
众所周知,SATA硬盘的返修率高出SAS硬盘近40%以上,拿业界某知名硬盘厂商最新产品为例:企业级10kSAS硬盘的年返修率(AFR)是0.44%;近线级的7.2kSATA硬盘的AFR为0.63%。而百度使用该工具后,不仅减少了60%的SATA硬盘返修率,实现了全部硬盘故障处理及报废擦除的全流程自动化,还通过与存储系统的调度管理集成,提前处理潜在故障的硬盘,大幅缩小了故障对业务影响,有效降低运维成本,及人力、物力投入。可以说,百度用更低成本得到了更高的质量保证。
 
之所以能实现如上成果,主要得益于hdoctor从五个维度融合创新:
 
第一,硬盘故障检测。hdoctor通过日志增量监控,整合系统设置、报错类型、硬盘运行状态等检查环节,可在10秒内监控99%的故障,覆盖全部的机型;经过多次验证,准确度与硬盘厂商采用的硬件检测分析方法(FA)相当。
 
第二,硬盘故障修复。能在60秒内修复SATA硬盘60%的故障,包括潜在故障扇区修复、文件系统坏块屏蔽、硬盘及阵列状态设置校正、硬盘状态未就绪或超时的处理、数据/硬件故障排除、盘符前后漂移复位等常见的运维故障处理。而在未使用hdoctor的情况下,因业务稳定性要求,一旦出现报错,业界的通常做法是更换硬盘,这使得维护代价十分高昂。
 
第三,硬盘故障预警。基于数十万片硬盘近30个月的硬盘运行及故障大数据,使用机器学习技术,挖掘、分析海量数据,打造了可自动迭代的故障预测系统,支持全部厂商所有型号的SATA硬盘故障预测,准确率超过98%;同时与系统调度集成,能够提前避免故障对业务造成不良影响,有效降低云存储系统的平均故障修复时间(MTTR)。
 
第四,硬盘报废擦除。终捍卫云端数据安全,集成三种国际认证的安全擦除方案,可在JBOD、RAID环境下,快速、高效、安全擦除包括SATA、SAS、SSD、Flash在内的各种存储介质。
 
第五,自动运维支持。hdoctor提供所有类型硬盘的故障检测、修复、上线、下线、报修、结单检测等全方位的自动化运维API,同时定期维护和校正硬盘的状态运行信息,而且工具本身的运行机制也是自反馈和自维护的。
 
据了解,hdoctor已历经了三个年头。基于每月积累的故障记录,以及与硬盘相关的预警、负载、功耗、性能、温度等数十亿级别的大数据,该工具不断地迭代升级,在降低故障率,提升运维效率和云存储系统可靠性的同时,有效助力硬盘资源调度、功耗管理、存储分级等软硬件协同工作,大规模降低云存储运营成本。
 
业内分析人士指出,百度hdoctor的创新成果具有极为重要的产业意义。它解决了大规模大容量SATA硬盘应用背景下的高故障率、低运维效率和存储成本控制等难题,为业界实现更低成本、更高质量数据存储起到示范与引领作用;更具未来发展意义的是,该工具的使用对未来将云盘、归档盘等低成本存储介质引入数据中心奠定了基础,能够使云存储购置成本大幅降低。百度的创新技术,打破了云计算和大数据产业发展中的一大阻碍,将有效推动产业更高速成长。
责编:郑雄
vsharing微信扫一扫实时了解行业动态
portalart微信扫一扫分享本文给好友

著作权声明:畅享网文章著作权分属畅享网、网友和合作伙伴,部分非原创文章作者信息可能有所缺失,如需补充或修改请与我们联系,工作人员会在1个工作日内配合处理。
最新专题
流动存储 为大数据而生

伴随信息技术的突飞猛进,更大量级的非结构化数据与结构化数据构成的大数据成为企业级存储所面临的最大挑战:一方..

磁盘阵列及虚拟化存储

利用数组方式来作磁盘组,配合数据分散排列的设计,提升数据的安全性。虚拟化存储,对存储硬件资源进行抽象化表现。

    畅享
    首页
    返回
    顶部
    ×
      信息化规划
      IT总包
      供应商选型
      IT监理
      开发维护外包
      评估维权
    客服电话
    400-698-9918