温馨提示×

如何在debian部署hadoop

小樊
52
2026-09-11 10:50:53
栏目: 智能运维

下面给你一份在 Debian(以 Debian 11/12 为例)上部署 Hadoop(单节点 / 伪分布式)的实用指南。如果你需要多节点集群,我也可以单独补充。


一、环境准备

1. 系统更新

sudo apt update
sudo apt upgrade -y

2. 安装 Java(Hadoop 依赖 JDK)

Hadoop 3.x 推荐使用 OpenJDK 8 或 11

sudo apt install -y openjdk-11-jdk

验证:

java -version

3. 配置主机名与 hosts(可选但推荐)

sudo hostnamectl set-hostname hadoop-node

编辑 /etc/hosts:

127.0.0.1   localhost
127.0.1.1   hadoop-node

二、创建 Hadoop 用户(推荐)

sudo adduser hadoop
sudo usermod -aG sudo hadoop
su - hadoop

后续操作建议在 hadoop 用户下完成。


三、下载并安装 Hadoop

cd /opt
sudo wget https://downloads.apache.org/hadoop/common/hadoop-3.3.6/hadoop-3.3.6.tar.gz
sudo tar -xzf hadoop-3.3.6.tar.gz
sudo mv hadoop-3.3.6 hadoop
sudo chown -R hadoop:hadoop /opt/hadoop

四、配置环境变量

编辑 ~/.bashrc:

export JAVA_HOME=/usr/lib/jvm/java-11-openjdk-amd64
export HADOOP_HOME=/opt/hadoop
export PATH=$PATH:$HADOOP_HOME/bin:$HADOOP_HOME/sbin

生效:

source ~/.bashrc

五、Hadoop 基本配置(伪分布式)

1. hadoop-env.sh

nano $HADOOP_HOME/etc/hadoop/hadoop-env.sh

添加:

export JAVA_HOME=/usr/lib/jvm/java-11-openjdk-amd64

2. core-site.xml

nano $HADOOP_HOME/etc/hadoop/core-site.xml
<configuration>
  <property>
    <name>fs.defaultFS</name>
    <value>hdfs://localhost:9000</value>
  </property>
</configuration>

3. hdfs-site.xml

nano $HADOOP_HOME/etc/hadoop/hdfs-site.xml
<configuration>
  <property>
    <name>dfs.replication</name>
    <value>1</value>
  </property>
</configuration>

4. mapred-site.xml

cp $HADOOP_HOME/etc/hadoop/mapred-site.xml.template $HADOOP_HOME/etc/hadoop/mapred-site.xml
nano $HADOOP_HOME/etc/hadoop/mapred-site.xml
<configuration>
  <property>
    <name>mapreduce.framework.name</name>
    <value>yarn</value>
  </property>
</configuration>

5. yarn-site.xml

nano $HADOOP_HOME/etc/hadoop/yarn-site.xml
<configuration>
  <property>
    <name>yarn.nodemanager.aux-services</name>
    <value>mapreduce_shuffle</value>
  </property>
</configuration>

六、配置 SSH 免密登录

ssh-keygen -t rsa
cat ~/.ssh/id_rsa.pub >> ~/.ssh/authorized_keys
chmod 600 ~/.ssh/authorized_keys

测试:

ssh localhost

七、启动 Hadoop

1. 格式化 HDFS

hdfs namenode -format

2. 启动 HDFS

start-dfs.sh

3. 启动 YARN

start-yarn.sh

八、验证

1. 查看进程

jps

应看到:

  • NameNode
  • DataNode
  • ResourceManager
  • NodeManager

2. 浏览器访问

  • HDFS: http://localhost:9870
  • YARN: http://localhost:8088

九、简单测试

hdfs dfs -mkdir /test
hdfs dfs -put $HADOOP_HOME/etc/hadoop/*.xml /test
hdfs dfs -ls /test

十、关闭 Hadoop

stop-yarn.sh
stop-dfs.sh

如果你需要:

  • ✅ 多节点集群部署
  • ✅ Debian + Docker 部署
  • ✅ 高可用(HA)配置
  • ✅ Hive / Spark 集成

告诉我你的使用场景即可。

0 踩