扣丁学堂大数据培训分享当前国内Hadoop的使用

关于Hadoop,不少朋友都想知道到底它是如何被应用的,那么下面扣丁学堂大数据培训小编就给读者们分享一下当前国内Hadoop的使用,对大数据开发感兴趣的小伙伴就随小编来了解一下吧。编程

一、百度服务器

百度在2006年就开始关注Hadoop并开始调研和使用,在2012年其总的集群规模达到近十个,单集群超过2800台机器节点,Hadoop机器总数有上万台机器,总的存储容量超过100PB,已经使用的超过74PB,天天提交的做业数目有数千个之多,天天的输入数据量已经超过7500TB,输出超过1700TB。微信

百度的Hadoop集群为整个公司的数据团队、大搜索团队、社区产品团队、广告团队,以及LBS团体提供统一的计算和存储服务,主要应用包括:架构

数据挖掘与分析。分布式

日志分析平台。工具

数据仓库系统。oop

推荐引擎系统。学习

用户行为分析系统。大数据

同时百度在Hadoop的基础上还开发了本身的日志分析平台、数据仓库系统,以及统一的C++编程接口,并对Hadoop进行深度改造,开发了HadoopC++扩展HCE系统。优化

二、阿里巴巴

阿里巴巴的Hadoop集群截至2012年大约有3200台服务器,大约30?000物理CPU核心,总内存100TB,总的存储容量超过60PB,天天的做业数目超过150?000个,天天hivequery查询大于6000个,天天扫描数据量约为7.5PB,天天扫描文件数约为4亿,存储利用率大约为80%,CPU利用率平均为65%,峰值能够达到80%。阿里巴巴的Hadoop集群拥有150个用户组、4500个集群用户,为淘宝、天猫、一淘、聚划算、CBU、支付宝提供底层的基础计算和存储服务,主要应用包括:

数据平台系统。

搜索支撑。

广告系统。

数据魔方。

量子统计。

淘数据。

推荐引擎系统。

搜索排行榜。

为了便于开发,其还开发了WebIDE继承开发环境,使用的相关系统包括:Hive、Pig、Mahout、Hbase等。

三、腾讯

腾讯也是使用Hadoop最先的中国互联网公司之一,截至2012年年末,腾讯的Hadoop集群机器总量超过5000台,最大单集群约为2000个节点,并利用Hadoop-Hive构建了本身的数据仓库系统TDW,同时还开发了本身的TDW-IDE基础开发环境。腾讯的Hadoop为腾讯各个产品线提供基础云计算和云存储服务,其支持如下产品:

腾讯社交广告平台。

搜搜(SOSO)。

拍拍网。

腾讯微博。

腾讯罗盘。

QQ会员。

腾讯游戏支撑。

QQ空间。

朋友网。

腾讯开放平台。

财付通。

手机QQ。

QQ音乐。

四、奇虎360

奇虎360主要使用Hadoop-HBase做为其搜索引擎so.com的底层网页存储架构系统,360搜索的网页可到千亿记录,数据量在PB级别。截至2012年年末,其HBase集群规模超过300节点,region个数大于10万个,使用的平台版本以下。

HBase版本:facebook0.89-fb。

HDFS版本:facebookHadoop-20。

奇虎360在Hadoop-HBase方面的工做主要为了优化减小HBase集群的启停时间,并优化减小RS异常退出后的恢复时间。

五、华为

华为公司也是Hadoop主要作出贡献的公司之一,排在Google和Cisco的前面,华为对Hadoop的HA方案,以及HBase领域有深刻研究,并已经向业界推出了本身的基于Hadoop的大数据解决方案。

六、中国移动

中国移动于2010年5月正式推出大云BigCloud1.0,集群节点达到了1024。中国移动的大云基于Hadoop的MapReduce实现了分布式计算,并利用了HDFS来实现分布式存储,并开发了基于Hadoop的数据仓库系统HugeTable,并行数据挖掘工具集BC-PDM,以及并行数据抽取转化BC-ETL,对象存储系统BC-ONestd等系统,并开源了本身的BC-Hadoop版本。

中国移动主要在电信领域应用Hadoop,其规划的应用领域包括:

经分KPI集中运算。

经分系统ETL/DM。

结算系统。

信令系统。

云计算资源池系统。

物联网应用系统。

E-mail。

IDC服务等。

七、盘古搜索

盘古搜索(目前已和即刻搜索合并为中国搜索)主要使用Hadoop集群做为搜索引擎的基础架构支撑系统,截至2013年年初,集群中机器数量总计超过380台,存储总量总计3.66PB,主要包括的应用以下。

网页存储。

网页解析。

建索引。

Pagerank计算。

日志统计分析。

推荐引擎等。

最后想要了解更多关于大数据方面内容的小伙伴,请关注扣丁学堂大数据培训官网、微信等平台,扣丁学堂IT职业在线学习教育平台为您提供权威的大数据开发环境搭建视频,大数据培训后的前景无限,行业薪资和将来的发展会愈来愈好的,扣丁学堂老师精心推出的大数据视频教程定能让你快速掌握大数据从入门到精通开发实战技能。

相关文章
相关标签/搜索