大数据实训(三)——MapReduce编程实例:词频统计

#MapReduce#YARN#hdfs#IDEA#JDK1.8

实验三:Mapreduce词频统计

3.1启动hadoop服务,输入命令:

start-all.sh

3.2在export目录下,创建wordcount目录,在里面创建words.txt文件,向words.txt输入下面内容。

[root@bogon~]# mkdir -p /export/wordcount
[root@bogon~]# cd /export/wordcount/
[root@bogon~]# vi words.txt
[root@bogon~]# cat words.txt

3.3编辑结束,上传文件到HDFS指定目录

创建/wordcount/input目录,执行命令:

hdfs dfs -mkdir -p /wordcount/input

3.4将在本地/export/wordcount/目录下的words.txt文件,上传到HDFS的/wordcount/input目录,输入命令:

hdfs dfs -put /export/wordcount/words.txt /wordcount/input

 在Hadoop WebUI界面查看目录是否创建成功

3.5使用IDEA创建Maven项目MRWordCount

在pom.xml文件里添加hadoop和junit依赖,内容为:

<dependencies>                                   
   
评论 1
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包

打赏作者

Python+JAVA+大数据

你的鼓励将是我创作的最大动力

¥1 ¥2 ¥4 ¥6 ¥10 ¥20
扫码支付:¥1
获取中
扫码支付

您的余额不足,请更换扫码支付或充值

打赏作者

实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值