hadoop

配置静态IP

[hadoop@localhost /]$ sudo vim /etc/sysconfig/network-scripts/ifcfg-ens33

按i键开始编辑。编辑结束后，按Esc退出，并输入:wq保存

TYPE="Ethernet"
PROXY_METHOD="none"
BROWSER_ONLY="no"
BOOTPROTO=static    //修改为静态
DEFROUTE=yes        //修改
IPV4_FAILURE_FATAL="no"
IPV6INIT="yes"
IPV6_AUTOCONF="yes"
IPV6_DEFROUTE="yes"
IPV6_FAILURE_FATAL="no"
IPV6_ADDR_GEN_MODE="stable-privacy"
NAME="ens33"
UUID="e70e461d-2e7d-43c2-ad4a-40fd60e7eeb4"
DEVICE="ens33"
//以下根据自己电脑的虚拟机-编辑-虚拟网络编辑器-VMnet8-NAT设置来配置
ONBOOT=yes
IPADDR=192.168.120.101    //这个是虚拟机hadoop101的ip地址
GATEWAY=192.168.120.2     //网关ip
DNS1=192.168.120.2        //和网关一样
NETMASK=255.255.255.0     //子网掩码



//重新启动刷新ip
[hadoop@localhost /]$ service network restart
 
//查看ip
[hadoop@localhost /]$ ifconfig

如上图所示则代表配置成功。如果使用虚拟机过程中发现网络有问题，ifconfig命令后只出现下半部分（lo:后面的部分），可以通过下列命令重新启动ip。

修改主机名

[hadoop@localhost /]$ sudo vim /etc/sysconfig/network


NETWORKING=yes
HOSTNAME=hadoop101    //这里输入自己的主机名


//刷新主机名
[hadoop@localhost /]$ hostnamectl set-hostname hadoop101
 
//查看主机名
[hadoop@localhost /]$ hostname

关闭防火墙

//查看防火墙的状态
[hadoop@hadoop101 ~]$ systemctl status firewalld.service
//关闭防火墙
[hadoop@hadoop101 ~]$ systemctl stop firewalld.service
//永久关闭防火墙
[hadoop@hadoop101 ~]$ systemctl disable firewalld.service

jdk和hadoop并配置环境变量

首先，我们需要卸载虚拟机自带的jdk。

//查看jdk
[hadoop@hadoop101 ~]$ rpm -qa | grep -i java
//切换到root用户
[hadoop@hadoop101 ~]$ su root
//卸载jdk
[root@hadoop101 hadoop]# rpm -qa | grep -i java | xargs -n1 rpm -e --nodeps
//再次查看jdk，可以看到什么也没有了

我们可以创建两个文件夹，software用来存放上传的压缩包，module用来存放解压的文件

//进入opt文件夹
[hadoop@hadoop101 ~]$ cd /opt/
//创建两个文件夹
[hadoop@hadoop101 opt]$ sudo mkdir module
[hadoop@hadoop101 opt]$ sudo mkdir software
//查看opt文件夹中的内容
[hadoop@hadoop101 opt]$ ll
//修改所在组和拥有者
[hadoop@hadoop101 opt]$ sudo chown hadoop:hadoop -R module/ software/

上传成功后，我们开始配置环境变量。

//解压jdk和hadoop到module文件夹
[hadoop@hadoop101 software]$ tar -zxvf jdk-8u212-linux-x64.tar.gz -C ../module/
[hadoop@hadoop101 software]$ tar -zxvf hadoop-3.1.3.tar.gz -C ../module/
//进入module文件夹
[hadoop@hadoop101 software]$ cd ..
[hadoop@hadoop101 opt]$ cd module
//配置环境变量
[hadoop@hadoop101 module]$ sudo vim /etc/profile.d/my_env.sh




##JAVA_HOME
export JAVA_HOME=/opt/module/jdk1.8.0_212
export PATH=$PATH:$JAVA_HOME/bin
 
##HADOOP_HOME
export HADOOP_HOME=/opt/module/hadoop-3.1.3
export PATH=$PATH:$HADOOP_HOME/bin
export Path=$path:$HADOOP_HOME/sbin



//刷新
[hadoop@hadoop101 module]$ source /etc/profile
//测试
[hadoop@hadoop101 module]$ java -version
[hadoop@hadoop101 module]$ hadoop version

至此，我们的hadoop环境搭建就完成啦。

测试MapReduce案例

到这里便可以执行一些例子来感受下 Hadoop 的运行；Hadoop 附带了丰富的例子，包括 wordcount，terasort，join，grep，pi 等

测试grep案例

在此选择运行 grep 例子 创建 input 文件夹，将 etc/hadoop 目录下的 .xml 文件全部拷贝到 input 文件夹下

[hadoop@hadoop101]$ mkdir input
[hadoop@hadoop101]$ cp etc/hadoop/*xml input


使用 hadoop-mapreduce-examples-2.10.1.jar 来运行 grep：

[hadoop@hadoop101]$ bin/hadoop jar share/hadoop/mapreduce/hadoop-mapreduce-examples-2.10.1.jar grep input output 'dfs[a-z.]+'

ls -l 查看输出的结果：可以看到生成了 output 文件夹，文件夹中包含两个文件，一个标志状态的文件 _SUCCESS，内无任何内容，success表示成功；另一个是输出结果文件 part-r-00000；进入到 output 文件夹中查看 part-r-00000 中的运行结果：

[hadoop@hadoop101 output]$ cat part-r-00000
1  dfsadmin

测试WordCount案例

切换路径到 /home/hadoop-3.1.3/share/hadoop/mapreduce目录下：

[hadoop@hadoop101 ~]$ cd /home/hadoop-3.1.3/share/hadoop/mapreduce

在 mapreduce 下创建一个测试文件 data.txt：

good better best
never let it rest
till good is better
and better best

good good study
day day up
today is a good day

使用 hadoop jar 命令来运行一个jar包，在jar包中可能存在多个可执行的类，目前需要运行的是其中的 wordcount；运行时需要两个参数：

输入路径：数据源文件或目录

输出路径：一个还不存在的目录，会自动创建

输入路径就是刚刚创建的data.txt，而输出路径必须是一个不存在路径，每次执行完成后会自动创建该目录，并生成一些结果文件：

[hadoop@hadoop101 mapreduce]$ hadoop jar hadoop-mapreduce-examples-2.10.1.jar wordcount data.txt output

人面猴
序言：七十年代末，一起剥皮案震惊了整个滨河市，随后出现的几起案子，更是在滨河造成了极大的恐慌，老刑警刘岩，带你破解...
沈念sama阅读 216,544评论 6赞 501
死咒
序言：滨河连续发生了三起死亡事件，死亡现场离奇诡异，居然都是意外死亡，警方通过查阅死者的电脑和手机，发现死者居然都...
沈念sama阅读 92,430评论 3赞 392
救了他两次的神仙让他今天三更去死
文/潘晓璐我一进店门，熙熙楼的掌柜王于贵愁眉苦脸地迎上来，“玉大人，你说我怎么就摊上这事。” “怎么了？”我有些...
开封第一讲书人阅读 162,764评论 0赞 353
道士缉凶录：失踪的卖姜人
文/不坏的土叔我叫张陵，是天一观的道长。经常有香客问我，道长，这世上最难降的妖魔是什么？我笑而不...
开封第一讲书人阅读 58,193评论 1赞 292
港岛之恋（遗憾婚礼）
正文为了忘掉前任，我火速办了婚礼，结果婚礼上，老公的妹妹穿的比我还像新娘。我一直安慰自己，他们只是感情好，可当我...
茶点故事阅读 67,216评论 6赞 388
恶毒庶女顶嫁案：这布局不是一般人想出来的
文/花漫我一把揭开白布。她就那样静静地躺着，像睡着了一般。火红的嫁衣衬着肌肤如雪。梳的纹丝不乱的头发上，一...
开封第一讲书人阅读 51,182评论 1赞 299
城市分裂传说
那天，我揣着相机与录音，去河边找鬼。笑死，一个胖子当着我的面吹牛，可吹牛的内容都是我干的。我是一名探鬼主播，决...
沈念sama阅读 40,063评论 3赞 418
双鸳鸯连环套：你想象不到人心有多黑
文/苍兰香墨我猛地睁开眼，长吁一口气：“原来是场噩梦啊……” “哼！你这毒妇竟也来了？” 一声冷哼从身侧响起，我...
开封第一讲书人阅读 38,917评论 0赞 274
万荣杀人案实录
序言：老挝万荣一对情侣失踪，失踪者是张志新（化名）和其女友刘颖，没想到半个月后，有当地人在树林里发现了一具尸体，经...
沈念sama阅读 45,329评论 1赞 310
护林员之死
正文独居荒郊野岭守林人离奇死亡，尸身上长有42处带血的脓包…… 初始之章·张勋以下内容为张勋视角年9月15日...
茶点故事阅读 37,543评论 2赞 332
白月光启示录
正文我和宋清朗相恋三年，在试婚纱的时候发现自己被绿了。大学时的朋友给我发了我未婚夫和他白月光在一起吃饭的照片。...
茶点故事阅读 39,722评论 1赞 348
活死人
序言：一个原本活蹦乱跳的男人离奇死亡，死状恐怖，灵堂内的尸体忽然破棺而出，到底是诈尸还是另有隐情，我是刑警宁泽，带...
沈念sama阅读 35,425评论 5赞 343
日本核电站爆炸内幕
正文年R本政府宣布，位于F岛的核电站，受9级特大地震影响，放射性物质发生泄漏。R本人自食恶果不足惜，却给世界环境...
茶点故事阅读 41,019评论 3赞 326
男人毒药：我在死后第九天来索命
文/蒙蒙一、第九天我趴在偏房一处隐蔽的房顶上张望。院中可真热闹，春花似锦、人声如沸。这庄子的主人今日做“春日...
开封第一讲书人阅读 31,671评论 0赞 22
一桩弑父案，背后竟有这般阴谋
文/苍兰香墨我抬头看了看天上的太阳。三九已至，却和暖如春，着一层夹袄步出监牢的瞬间，已是汗流浃背。一阵脚步声响...
开封第一讲书人阅读 32,825评论 1赞 269
情欲美人皮
我被黑心中介骗来泰国打工，没想到刚下飞机就差点儿被人妖公主榨干…… 1. 我叫王不留，地道东北人。一个月前我还...
沈念sama阅读 47,729评论 2赞 368
代替公主和亲
正文我出身青楼，却偏偏与公主长得像，于是被迫代替她去往敌国和亲。传闻我的和亲对象是个残疾皇子，可洞房花烛夜当晚...
茶点故事阅读 44,614评论 2赞 353

hadoop

配置静态IP

按i键开始编辑。编辑结束后，按Esc退出，并输入:wq保存

如上图所示则代表配置成功。如果使用虚拟机过程中发现网络有问题，ifconfig命令后只出现下半部分（lo:后面的部分），可以通过下列命令重新启动ip。

修改主机名

关闭防火墙

jdk和hadoop并配置环境变量

上传成功后，我们开始配置环境变量。

至此，我们的hadoop环境搭建就完成啦。

测试MapReduce案例

到这里便可以执行一些例子来感受下 Hadoop 的运行；Hadoop 附带了丰富的例子，包括 wordcount，terasort，join，grep，pi 等

在 mapreduce 下创建一个测试文件 data.txt：

使用 hadoop jar 命令来运行一个jar包，在jar包中可能存在多个可执行的类，目前需要运行的是其中的 wordcount；运行时需要两个参数：

输入路径：数据源文件或目录

输出路径：一个还不存在的目录，会自动创建

输入路径就是刚刚创建的data.txt，而输出路径必须是一个不存在路径，每次执行完成后会自动创建该目录，并生成一些结果文件：

推荐阅读更多精彩内容