开源大数据周刊-第41期-阿里云开发者社区

开发者社区> 阿里云EMR> 正文

开源大数据周刊-第41期

简介: 云数据库HBase公测开始 EMR产品价格全面优惠,价格和ECS自建一致

阿里云E-MapReduce动态

  • 云数据库HBase公测开始
  • EMR产品价格全面优惠,价格和ECS自建一致

资讯

Spark Summit East 2017 recap

随着阿里巴巴与亚马逊公司先后发布2016年第四季度的财报,云计算鼻祖亚马逊AWS与云计算新贵阿里云最新业绩之间的比较又成为了云计算领域的一个热点。亚马逊AWS季度销售额达到35亿美元,全年销售额达到122亿美元,两个数字都创下历史新高;阿里云单季度营收达到2.54亿美元,连续第7个季度保持三位数增长。一家在业绩上独领风骚,一家在增长的跑道上极速狂奔。虽然两家公司都是云计算领域的明星企业,但两者之间显然存在着差距。这种差距到底有多大?

本次分享主要介绍乐视云两代PaaS平台的变迁过程,着重介绍第二代PaaS平台LeEngine的架构设计和遇到的问题。

技术

谷歌今天宣布推出Cloud Spanner的测试版,这是一种新的全球分布式数据库服务,面向关键任务应用程序。Cloud Spanner加入了谷歌其他基于云的数据库服务的阵营,比如Bigtable、Cloud SQL和Cloud Datastore,不过其重大的区别在于,让开发人员可以同时享用传统关系数据库和NoSQL数据库两者的最大优点――也就是说,事务一致性和易于扩展性。

Yahoo Big ML团队宣布开源TensorFlowOnSpark,他们用来在大数据集群的分布式深度学习最新的开源框架。

在Hadoop集群的整个生命周期里,由于优化参数、Patch、升级等种种原因难免需要重启NameNode甚至全集群的情况,其中NameNode重启尤其比较频繁。不管是重启NameNode或者整个集群,快速的的重启会极大提升运维操作效率。 本文基于Hadoop-2.x和HA with QJM,通过梳理NameNode的重启流程,并在此基础上,基于社区当前架构和系统设计,提供几个加快NameNode重启的重要关注点,其中包括了社区已成熟的一些Patch及相关参数优化,虽然实现逻辑都很小,但是实践中的收益非常明显。

本文深入研究 HDFS 磁盘平衡的新特性,这是 Hadoop3 中加入的一个特性。

欢迎加入阿里云开源大数据交流钉钉群

screenshot

版权声明

信息都是来自互联网,都给出了原文的链接,如果侵权,请联系我们,我们负责删除。

阿里云E-MapReduce团队 出品

版权声明:本文中所有内容均属于阿里云开发者社区所有,任何媒体、网站或个人未经阿里云开发者社区协议授权不得转载、链接、转贴或以其他方式复制发布/发表。申请授权请邮件developerteam@list.alibaba-inc.com,已获得阿里云开发者社区协议授权的媒体、网站,在转载使用时必须注明"稿件来源:阿里云开发者社区,原文作者姓名",违者本社区将依法追究责任。 如果您发现本社区中有涉嫌抄袭的内容,欢迎发送邮件至:developer2020@service.aliyun.com 进行举报,并提供相关证据,一经查实,本社区将立刻删除涉嫌侵权内容。

分享:
+ 订阅

阿里巴巴开源大数据技术团队成立阿里云EMR技术圈, 每周推送前沿技术文章,直播分享经典案例、在线答疑,营造纯粹的开源大数据氛围,欢迎加入!加入钉钉群聊阿里云E-MapReduce交流2群,点击进入查看详情 https://qr.dingtalk.com/action/joingroup?code=v1,k1,cNBcqHn4TvG0iHpN3cSc1B86D1831SGMdvGu7PW+sm4=&_dt_no_comment=1&origin=11

官方博客
官网链接