剖析管理所有大数据组件的可视化利器：Hue-白红宇

剖析管理所有大数据组件的可视化利器：Hue

阅读量：5766 次

发布时间：2019-06-18

本文共 3294 字，大约阅读时间需要 10 分钟。

日常的大数据使用都是在服务器命令行中进行的，可视化功能仅仅依靠各个组件自带的web界面来实现，不同组件对应不同的端口号，如：HDFS(50070)，Yarn(8088),Hbase(16010)等等，而大数据的组件又有很多，为了解决某个问题，常常需要结合多个组件来使用，但是每个组件又有独立的web界面进行可视化，这时，如果有一个统一的web界面来管理并可以开发所有大数据的组件是非常方便的，而Hue正是这样的工具，它管理的大数据组件包括：HDFS、HBase、Hive、Pig、Sqoop、Spark、Scala等等几乎所有常用的组件。

（一）、HUE的介绍：

HUE是一个开源的Apache hadoop UI系统，管理hadoop生态体系结构的所有组件，基于python web框架Django实现，由Cloudera开发

HUE的tar包是源码包，采用源码安装（源码安装的好处：卸载和移植软件方便）

源码安装三步骤：

1、配置：./configure --preifix=安装的目录 #检测系统配置，生成makefile文件如果有makefile文件，直接进行编译和安装

2、编译：make

3、安装：make install

HUE的http服务端口：8888

二、安装和配置HUE：

安装HUE前，需要安装它所需要的rpm包及其依赖(27个)，否则HUE运行会报错 rpm包：redhat软件包管理器存放在redhat光盘Packages目录下

rpm包与tar.gz/.tgz、.bz2的区别：

rpm形式的软件包安装、升级、卸载方便，推荐初学者使用rpm形式的软件包

安装：rpm -ivh

卸载：rpm -e

tar.gz形式的软件包安装方便，卸载麻烦，用tar工具打包、gzip/bzip2压缩，安装时直接调用gzip/bzip2解压即可。如果解压后只有单一目录

用rm -rf命令删除，如果解压后分散在多个目录，必须手动一一删除

安装：tar -zxvf *.tar.gz/ tar -yxvf *.bz2

卸载：rm -rf/手动删除

一、安装rpm包：

方法：使用yum安装rpm包

yum：能够从指定的资源库(repository)自动下载、安装、升级rpm包及其依赖，必须要有可靠的资源库(repository)

1、挂载光盘 mount /dev/cdrom /mnt

mount命令：挂载硬盘/光盘/iso文件到指定目录下，访问其中的数据

2、建立yum资源库

cd /etc/yum.repos.d #yum资源库默认所在的目录

vim redhat7.repo

[redhat-yum] 资源库的标识

name=redhat7 资源库的名字

baseurl=file:///mnt 资源库的位置

enabled=1 启用资源库

gpgcheck=0 不检查资源库中的rpm包是否是官方的

3、执行下面的语句：

yum install gcc g++ libxml2-devel libxslt-devel cyrus-sasl-devel cyrus-sasl-gssapi mysql-devel python-devel python-setuptools sqlite-devel ant ibsasl2-dev libsasl2-modules-gssapi-mit libkrb5-dev libtidy-0.99-0 mvn openldap-dev libffi-devel gmp-devel openldap-devel

（二）、安装HUE：

解压：tar -zxvf hue-4.0.1.tgz

指定安装目录安装：PREFIX=/root/training make install

注：如果不指定prefix,可执行文件默认安装到/usr/local/bin中，配置文件默认安装到/usr/local/etc中，库文件默认安装到/usr/local/lib中，其他文件默认安装到/usr/local/share中

注：HUE的tar包是源码包，采用源码安装

三、配置HUE：

剖析管理所有大数据组件的可视化利器：Hue