温馨提示×

linux hadoop怎么安装

小樊
44
2026-09-01 14:40:32
栏目: 智能运维

下面给你一份**在 Linux 上安装 Hadoop(单机 / 伪分布式)**的简明实操教程,适合学习和开发使用。


一、环境准备

1. 系统要求

  • Linux(CentOS / Ubuntu / Rocky 等均可)
  • JDK 8 或 JDK 11(推荐 JDK 8)
  • 具备 sudo 权限的用户

2. 安装 JDK

# Ubuntu
sudo apt update
sudo apt install openjdk-8-jdk -y

# CentOS
sudo yum install java-1.8.0-openjdk-devel -y

验证:

java -version

二、创建 Hadoop 用户(可选但推荐)

sudo useradd -m hadoop
sudo passwd hadoop

三、下载并安装 Hadoop

1. 下载 Hadoop

cd /opt
sudo wget https://archive.apache.org/dist/hadoop/common/hadoop-3.3.6/hadoop-3.3.6.tar.gz
sudo tar -xzf hadoop-3.3.6.tar.gz
sudo mv hadoop-3.3.6 hadoop
sudo chown -R hadoop:hadoop hadoop

四、配置环境变量

编辑 ~/.bashrc(或 /etc/profile):

export JAVA_HOME=/usr/lib/jvm/java-8-openjdk-amd64
export HADOOP_HOME=/opt/hadoop
export PATH=$PATH:$HADOOP_HOME/bin:$HADOOP_HOME/sbin

使配置生效:

source ~/.bashrc

五、配置 Hadoop(伪分布式)

1. 配置 hadoop-env.sh

vi $HADOOP_HOME/etc/hadoop/hadoop-env.sh

添加:

export JAVA_HOME=/usr/lib/jvm/java-8-openjdk-amd64

2. 配置 core-site.xml

vi $HADOOP_HOME/etc/hadoop/core-site.xml
<configuration>
  <property>
    <name>fs.defaultFS</name>
    <value>hdfs://localhost:9000</value>
  </property>
</configuration>

3. 配置 hdfs-site.xml

vi $HADOOP_HOME/etc/hadoop/hdfs-site.xml
<configuration>
  <property>
    <name>dfs.replication</name>
    <value>1</value>
  </property>
</configuration>

4. 配置 mapred-site.xml

cp $HADOOP_HOME/etc/hadoop/mapred-site.xml.template \
   $HADOOP_HOME/etc/hadoop/mapred-site.xml
vi $HADOOP_HOME/etc/hadoop/mapred-site.xml
<configuration>
  <property>
    <name>mapreduce.framework.name</name>
    <value>yarn</value>
  </property>
</configuration>

5. 配置 yarn-site.xml

vi $HADOOP_HOME/etc/hadoop/yarn-site.xml
<configuration>
  <property>
    <name>yarn.nodemanager.aux-services</name>
    <value>mapreduce_shuffle</value>
  </property>
</configuration>

六、SSH 无密码登录

ssh-keygen -t rsa
cat ~/.ssh/id_rsa.pub >> ~/.ssh/authorized_keys
chmod 600 ~/.ssh/authorized_keys
ssh localhost

七、启动 Hadoop

1. 格式化 HDFS

hdfs namenode -format

2. 启动 HDFS 和 YARN

start-dfs.sh
start-yarn.sh

3. 查看进程

jps

应看到:

  • NameNode
  • DataNode
  • ResourceManager
  • NodeManager

八、验证

浏览器访问:

  • HDFS: http://localhost:9870
  • YARN: http://localhost:8088

九、关闭 Hadoop

stop-yarn.sh
stop-dfs.sh

如果你需要:

  • 完全分布式(多台机器)
  • Docker 安装 Hadoop
  • Ubuntu / CentOS 专属版本
  • Hadoop + Spark

告诉我你的 Linux 发行版和使用场景即可。

0