百度技术沙龙第49期回顾:大规模分布式存储(含资料下载)

2014年4月19日,在由@百度主办、@InfoQ负责策划组织和实施的第49期百度技术沙龙活动上,来自百度运维部MFS组技术负责人程一仕,和目前负责整个搜狐云服务的后端存储和数据库系统的开发和运营陈伟,各自分享了其在大规模分布式存储的实战经验。他们的话题涉及“MooseFS和redis在海量存储下的架构改进和性能提升”和“高性能NoSQL系统BladeCube的设计与优化”这两个方面,本文将对讲师各自的分享做简单的回顾,同时提供相关资料的下载。

主题一:MooseFS和redis在海量存储下的架构改进和性能提升(下载讲稿)

程一仕通过对MooseFS的单点master的架构升级,来提升系统的性能和扩展性,进而支撑百度的众多业务。他使用redis的代理中间层构建高可用的分布式redis集群来满足产品的低延迟,大数据量的业务需求。这两个系统广泛应用于百度商业产品体系,LBS产品体系,数据库文件热备等在线业务,并支撑大量关键服务。

在线应用数据

百度技术沙龙第49期回顾:大规模分布式存储(含资料下载)_第1张图片

“MosseFS和redis大家都比较了解,因为很大的技术架构方面我讲的比较少。先介绍一下应用数据,存储量大概是10PB以上,比如说大家用百度影音,它主要应用的场景还是在商务系统,包括凤巢的报表,文件的数量大概是3亿左右,我们大概有20个群左右的数量,单个集群的规模大概可以到1000左右。”

百度技术沙龙第49期回顾:大规模分布式存储(含资料下载)_第2张图片

中心化节点的设计和问题

master的功能

  • 客户端对元数据的访问和变更请求
  • chunkserver之间的数据容量调整
  • 元数据的存储和持久化
  • 集群健康状态的维护

master的局限和隐患

  • 性能瓶颈
  • 单点故障(single point of failure)

主从架构扩展性能瓶颈

百度技术沙龙第49期回顾:大规模分布式存储(含资料下载)_第3张图片

“我们做的第一个改进就是开发一个Shadow master,我不保证它的同步是一致的。大家对存储了解一点的都知道,我的访问有延迟。客户端这边会把这个全部发到Shadow master上面去。”程一仕使用redis的代理中间层构建高可用的分布式redis集群来满足产品的低延迟,大数据量的业务需求。

主题二:高性能NoSQL系统BladeCube的设计与优化(下载讲稿)

BladeCube系统是搜狐自己开发的一套NoSQL系统,陈伟的设计参考了BigTable和HBase,使用C++实现,性能优于HBase,以下主要讲一下搜狐云服务在设计和优化这个系统时的一些心得。

百度技术沙龙第49期回顾:大规模分布式存储(含资料下载)_第4张图片

MySQL的可扩展性太差,分库分表带来的运维太大,无法搞定,主从结构的一致性也难以保证读写性能差,变schema。包括MongoDB在内的数据库,在真正面对超大规模数据时,难以保证性能和可用性。超过十亿之后性能问题,潜在的bug,丢数据等。持久化和内存放在一起,不能充分利用资源。

分层结构的优势,目标是减少运维开销,大部分错误能够自动恢复,不影响服务。

“最近一有一些比较新的开源系统宣传的很美好,但是真的用起来会有很多问题,我们有过一些测试。比如说超过10亿量级以后,在响应的性能上,以及它的某些丢数据的行为都是我们不能容忍的,因此我们抛弃了这些选择。”陈伟说。

百度技术沙龙第49期回顾:大规模分布式存储(含资料下载)_第5张图片

“C++实际上性能是非常好的,跟HBase对比的过程中,我们可以发现在架构基本一致的情况下,我们通过一些比较好的编程的实现以及内部的优化,可以在性能上做到三倍、四倍,甚至更高。但是C++也有一个问题,它的调试和开发周期都比java困难,为什么开源系统都采用Java来实现,但是实际上对于我们严肃的来完成一个基础架构的话,Java虽然有天花板,但是用C++可以更好的控制内存,可以把系统做的非常好。”

OpenSpace(开放式讨论环节)

为了促进参会者与我们每期的嘉宾以及讲师近距离交流,深入探讨在演讲过程中的疑问,本次活动依然设置了Open Space(开放式讨论)环节。在Open Space的总结环节,几位话题小组长分别对讨论的内容进行了总结。

夏粉:深度学习话题在现在大数据时代将会越来越火,我在演讲时算是为大家抛了个砖,互动过程中大家问了许多实际的问题,希望我的解释能给大家带来一些帮助。

王晓博:关注机器学习的同学热情很高,夏老师讲的干货很多,但只要不涉及关键商业化数据,比如百度广告点击的具体数字,这些模型公布出来对大家的学习还是很有好处的。希望下次主办方能准备相关话题,这样在Open Space时,讲师可提前做一些准备,为听众做更针对性的解答。

会上,一些参会者也通过新浪微博分享了他们的参会感受:

程序猿刘静:Tradeoff every details

_胡凯_:碉堡了!居然中头奖

韩占康_极简:原来技术高地在搜狐啊,哈哈。

有关百度技术沙龙的更多信息,可以通过新浪微博关注@百度技术沙龙,或者关注InfoQ官方微信:infoqchina,InfoQ上也总结了过往所有百度技术沙龙的演讲视频和资料等,感兴趣的读者可以直接浏览内容。

特别提示:第50期百度技术沙龙将在5月17日,周六,在北京车库咖啡举行,主题为前端应用相关内容,欢迎关注@InfoQ、@百度技术沙龙获取后续的活动信息。

你可能感兴趣的:(百度技术沙龙第49期回顾:大规模分布式存储(含资料下载))