蓝狮平台_蓝狮注册登录云技术中心

大数据分析:学习工具Hadoop,基本安装指导

image.png


Hadoop版本主要分为原生Apache Hadoop版和Hadoop商业发行版两种,而其中商业发行版Hadoop多为原生Apache Hadoop的集群模式下的优化版,除少数社区版外,商业发行版大多需要付费使用,且对于初学者而言使用难度较大,因此本教程主要采用Apache Hadoop进行安装与使用方面教学。同时,兼顾一线企业实际使用差别和教学PC机器性能,本次课程将主要采用Apache Hadoop 2.6.5版本。


打开Hadoop官网下载地址,页面如下图所示,根据提示选择2.6.5二进制压缩版。


由于是在国内,为了保证下载速度我们可以选择清华的软件仓库下载。(url图片太小)


此时浏览器弹出下载提示窗口,选择路径下载即可。注:不同浏览器的下载提示窗口会有所不同。


打开Ubuntu虚拟机,通过Xshell连接。用户主目录(/home/hduser)下创建software目录,在Xshell终端中输入命令mkdir software。


后续用到的软件安装文件都将放在这里,便于管理。


打开WinSCP软件并连接登录ubuntu虚拟机,登录成功后默认进入当前用户主目录,双击刚创建的software目录


将下载的hadoop-2.6.5.tar.gz上传至Ubuntu虚拟机的software目录下,方法是:按下图鼠标拖动hadoop-2.6.5.tar.gz至software目录即可。


代传输完成,hadoop二进制压缩文件hadoop2.6.5.tar.gz就存在于ubuntu虚拟机software文件目录下了。


在Xshell中通过命令ls software/即可查看software目录内文件信息。蓝狮碎石机养护说明如下图所示上传成功


将hadoop-2.6.5.tar.gz解压到当前用户主目录下,方法:在用户主目录下输入命令tar -zxvf ./software/hadoop-2.6.5.tar.gz,然后回车键执行


回车开始执行后压缩文件开始解压


压缩文件会被解压到用户主目录下,蓝狮登录网址解压完成后会查看当前用户主目录下的文件,如下图所示可以看到文件hadoop-2.6.5,此文件即为解压后的文件夹。


由于解压后的文件名有些长,我们可以为其更换文件名为hadoop,改名可以有如下方式:执行命令mv hadoop-2.6.5/ ./hadoop即可。如下图所示通过ls命令查看更名已经成功。


小伙伴们有没有疑问hadoop文件目录下都有哪些文件呢,主要会用到哪几个?下面我带大家看一看。跳转到hadoop文件目录下之后执行ls -l命令


到这里Hadoop的基本安装已经完成,明天我们介绍将Hadoop路径添加到用户系统环境变量、hadoop配置。