博客
关于我
强烈建议你试试无所不能的chatGPT,快点击我
Hadoop大数据平台实战(00):Linux Ubuntu 18.04实战安装大数据Hadoop 3.1.2版本 单节点模式 ...
阅读量:5752 次
发布时间:2019-06-18

本文共 1939 字,大约阅读时间需要 6 分钟。

Linux Ubuntu 18.04实战安装大数据Hadoop 3.1.2版本。这里分别选择最新的Ubuntu系统 18.04,以及最新的Hadoop版本3.1.2

Hadoop是开源免费的大数据方案,官方网站,核心的组件都是使用Java开发,也是目前也是最流行的,使用最广泛的大数据解决方案,包括几十个框架和工具。
hadoop有3种模式,我们先使用最简单的模式,来安装实战学习Hadoop。
1)单机模式Local (Standalone) Mode
2)伪分布式Pseudo-Distributed Mode
3)完全分布式Fully-Distributed Mode
image

1、安装JDK

安装开源的JDK,免费,不会引起收费问题。

sudo apt install default-jdk

image

查看安装版本 Java -version

image

2、安装SSH

sudo apt-get install openssh-server openssh-client

ssh-keygen -t rsa -P ""cat $HOME/.ssh/id_rsa.pub >> $HOME/.ssh/authorized_keys

image

测试登录,不需要密码:
ssh localhost
3、下载最新版本Hadoop
为了速度我们选择清华大学镜像,服务器,

wget http://mirrors.tuna.tsinghua.edu.cn/apache/hadoop/common/hadoop-3.1.2/hadoop-3.1.2.tar.gz

image

4、安装Hadoop

等待下载完毕,解压,然后进行安装配置

tar xzvf hadoop-3.1.2.tar.gzmv hadoop-3.1.2 /usr/local/hadoop

image

查看hadoop是否安装成功

sudo ./bin/hadoop version

image

5、创建Hadoop账号

为hadoop创建专用账户,并设置为超级用户

sudo addgroup hadoopsudo adduser --ingroup hadoop hadoopuser//加为超级用户sudo adduser hadoopuser sudo

6、配置Hadoop环境变量

在.bashrc文件中添加hadoop环境变量,使用下面的命令

sudo vim ./.bashrc

然后塞入下面的配置,根据实际路径为准:

export HADOOP_HOME=/home/frankxulei/hadoopexport HADOOP_INSTALL=$HADOOP_HOMEexport HADOOP_MAPRED_HOME=$HADOOP_HOMEexport HADOOP_COMMON_HOME=$HADOOP_HOMEexport HADOOP_HDFS_HOME=$HADOOP_HOMEexport YARN_HOME=$HADOOP_HOMEexport HADOOP_COMMON_LIB_NATIVE_DIR=$HADOOP_HOME/lib/nativeexport PATH=$PATH:$HADOOP_HOME/sbin:$HADOOP_HOME/bin

使生效:

source ./.bashrc

7、Hadoop测试例子

我们直接Hadoop自带的示例来测试单机模式是否正常工作。创建input目录,然后拷贝测试文本文件到input中,然后执行hadoop的Job分析结果。
本地创建input文件夹:

mkdir ~/input

拷贝测试数据文件到这个文件夹中:

cp /usr/local/hadoop/etc/hadoop/*.xml ~/input

运行下面的命令,mapreduce分析出出a开头的单词频率

bin/hadoop jar /usr/local/hadoop/share/hadoop/mapreduce/hadoop-mapreduce-examples-3.1.2.jar grep ./input/ ./output 'a[a-z.]+'

等待漫长的分析计算过程结束,你会看到hadoop不断输出日志信息,读取、清洗、统计结果

image
在输出目录上运行cat来检查大数据分析的结果如下:

cat ~/output/*

结果信息安装不同的单词,频率倒序输出结果,如图所示,表示Hadoop分析过程成功执行

image
8、管理界面
启动Hadoop可以在地址,查看Hadoop服务运行状态信息
image
后续我们还有Hadoop集群模式,等复杂的实战配置。
阿里巴巴Java群超过4800人
进群方式:钉钉扫码入群
image
阿里巴巴MongoDB群
image
参考

转载地址:http://mcukx.baihongyu.com/

你可能感兴趣的文章
Swift 学习 用 swift 调用 oc
查看>>
第三章 Python 的容器: 列表、元组、字典与集合
查看>>
struct timeval
查看>>
微信小程序开发 -- 点击右上角实现转发功能
查看>>
问题解决-Failed to resolve: com.android.support.constraint:constraint-layout:1.0.0-alpha7
查看>>
与MS Project相关的两个项目
查看>>
[转载]ASP.NET MVC Music Store教程(1):概述和新项目
查看>>
css实现单行,多行文本溢出显示省略号……
查看>>
使用 SharpSvn 执行 svn 操作的Demo
查看>>
js函数大全
查看>>
刷题笔记
查看>>
iOS app exception的解决方案
查看>>
Mongodb启动命令mongod参数说明
查看>>
TCP&UDP压力测试工具
查看>>
oracle 导入数据
查看>>
首个5G智慧机场落地广州 速度是4G的50倍
查看>>
Android 最简单的自定义Dialog之一
查看>>
磨刀不误砍柴 - 配置适合工作学习的桌面环境
查看>>
自己动手写docker-3
查看>>
Java笔记-反射机制(一)
查看>>