Linux环境安装Hadoop

（1）下载Hadoop安装包并上传

下载Hadoop安装包到本地，并导入到Linux服务器的/opt/software路径下

（2）解压安装包

解压安装文件并放到/opt/module下面

[root@hadoop100  ~]$ cd /opt/software
[root@hadoop100 software]$ tar -zxvf hadoop-3.1.3.tar.gz -C /opt/module/

（3）将Hadoop添加到环境变量

 [root@hadoop100  ~]$ vim /etc/profile.d/hadoop_env.sh

在hadoop_env.sh文件末尾添加如下内容：

#HADOOP_HOME
export HADOOP_HOME=/opt/module/hadoop-3.1.3
export PATH=$PATH:$HADOOP_HOME/bin
export PATH=$PATH:$HADOOP_HOME/sbin

保存并退出： :wq

（4）让修改文件生效

  [root@hadoop100 ~]$ source /etc/profile

如果命令还不能让hadoop生效，则重启虚拟机

[root@hadoop100 ~]$ sudo reboot

（5）测试是否安装成功

  [root@hadoop100 ~]$  hadoop version

（6）查看Hadoop目录结构

以下是Hadoop文件中重要的目录：

- bin 目录：存放对 Hadoop 相关服务（hdfs，yarn，mapred）进行操作的脚本
- etc 目录：Hadoop 的配置文件目录，存放 Hadoop 的配置文件
- lib 目录：存放 Hadoop 的本地库（对数据进行压缩解压缩功能）
- sbin 目录：存放启动或停止 Hadoop 相关服务的脚本
- share 目录：存放 Hadoop 的依赖 jar 包、文档、和官方案例

（7）扩展：本地测试官方案例WordCount

WordCount是一个统计文件内单词数量的程序。可以理解为MapReduce的helloword。

1）创建测试文件

 [root@hadoop100 ~]$ cd /opt/module/hadoop-3.1.3[root@hadoop100 hadoop-3.1.3]$  mkdir wcinput[root@hadoop100 hadoop-3.1.3]$  cd wcinput[root@hadoop100 wcinput]$   vim word.txt

在文件中输入以下内容：

hadoop yarn
hadoop mapreduce
test
test

保存并退出： :wq

2）执行程序

回到Hadoop目录/opt/module/hadoop-3.1.3，执行程序

  [root@hadoop100 wcinput]$   cd ../[root@hadoop100 hadoop-3.1.3]$ hadoop jar share/hadoop/mapreduce/hadoop-mapreduce-examples-3.1.3.jar wordcount wcinput wcoutput

命令结构：

hadoop jar Jar包的路径 Jar包的主类传递给主类的参数地址由主类执行后输出的结果地址

3）查看结果

[root@hadoop100 hadoop-3.1.3]$ cat wcoutput/part-r-00000

本文来自互联网用户投稿，该文观点仅代表作者本人，不代表本站立场。本站仅提供信息存储空间服务，不拥有所有权，不承担相关法律责任。如若转载，请注明出处：http://www.rhkb.cn/news/222543.html

如若内容造成侵权/违法违规/事实不符，请联系长河编程网进行投诉反馈email:809451989@qq.com，一经查实，立即删除！

Linux环境安装Hadoop

（1）下载Hadoop安装包并上传

（2）解压安装包

（3）将Hadoop添加到环境变量

（4）让修改文件生效

（5）测试是否安装成功

（6）查看Hadoop目录结构

（7）扩展：本地测试官方案例WordCount

1）创建测试文件

2）执行程序

3）查看结果

相关文章

Ubuntu 常用命令之 less 命令用法介绍

C语言数据结构-排序

智能优化算法应用：基于堆优化算法3D无线传感器网络(WSN)覆盖优化 - 附代码

简单了解一下当前火热的大数据 -- Kylin

链接未来：深入理解链表数据结构（二.c语言实现带头双向循环链表）

three.js实战模拟VR全景视图

4.3【共享源】克隆实战开发之截屏（一）

LVM系统逻辑卷

Debian在升级过程中报错

操作系统 day15（信号量）

Vue3选项式API和组合式API详解

NiNNet

AI绘画中CLIP文本-图像预训练模型

2023.12.19 关于 Redis 通用全局命令

C# SQLite基础工具类

C++的泛型编程—模板

事件和事件源

conda环境下执行conda命令提示无法识别解决方案

Transformer引领AI领域：从模型到平台，全方位探索与实践

pnpm ：无法加载文件 D:\nodejs\node_global\pnpm.ps1，因为在此系统上禁止运行脚本