平常的大数据使用中常常是在服务器命名行中进行操做,可视化功能仅仅依靠着各个组件自带的网页进行,那么有没有一个能够结合你们能在一个网页上的管理工具呢?答案是确定的,今天就和你们一块儿来探索大数据管理工具HUE的庐山真面目.python
附上:mysql
喵了个咪的博客:w-blog.cnc++
编译依赖web
wget http://repos.fedorapeople.org/repos/dchen/apache-maven/epel-apache-maven.repo -O /etc/yum.repos.d/epel-apache-maven.repo sudo yum install apache-maven ant asciidoc cyrus-sasl-devel cyrus-sasl-gssapi gcc gcc-c++ krb5-devel libxml2-devel libxslt-devel make mysql mysql-devel openldap-devel python-devel sqlite-devel gmp-devel libffi libffi-devel
ca /app/install wget http://archive-primary.cloudera.com/cdh5/cdh/5/hue-3.7.0-cdh5.4.2.tar.gz > chown -R root:root hue-3.7.0-cdh5.4.4 > chmod -R 777 hue-3.7.0-cdh5.4.4 # 启动方式 /app/install/hue-3.7.0-cdh5.4.4/build/env/bin/python2.7 /app/install/hue-3.7.0-cdh5.4.4/build/env/bin/hue runcherrypyserver
vim /app/install/hue-3.7.0-cdh5.4.4/desktop/conf/hue.ini
必定要增长一个hue用户sql
useradd hue
发现是webhdfs都是能够apache
curl –i "http://dev-hadoop:50070/webhdfs/v1/user?user.name=hadoop&op=GETFILESTATUS"
须要配置Hadoop访问权限vim
vim /usr/local/hadoop-2.7.3/etc/hadoop/core-site.xml <property> <name>hadoop.proxyuser.hadoop.hosts</name> <value>*</value> </property> <property> <name>hadoop.proxyuser.hadoop.groups</name> <value>*</value> </property>
vim /usr/local/hadoop-2.7.3/etc/hadoop/hdfs-site.xml <property> <name>dfs.webhdfs.enabled</name> <value>true</value> </property>
重启hadoop若是不行重启服务器api
能够在线执行Hive语句(这里注意若是是Hbase关联表是没法在HUE平台使用的解决方法能够导出到Hive中的一个表在进查询)服务器
直接查看hdfs文件系统app
管理 hadoop 做业
管理zookeeper状态
关于hbase 不支持 thrift2 须要使用 hive使用thrift1 的版本才能结合使用 启动以后就能够看到以下结果
在各类各样的组件下HUE无疑是最好的web工具的选择,HUE还有不少其余的功能包括咱们后面要说到的spark,sqoop等相关的组件均可以经过HUE进行在线管理.
注:笔者能力有限有说的不对的地方但愿你们可以指出,也但愿多多交流!
个人博客即将搬运同步至腾讯云+社区,邀请你们一同入驻:https://cloud.tencent.com/developer/support-plan