温馨提示×

怎样部署debian hadoop

小樊
41
2026-09-08 12:51:26
栏目: 智能运维

下面给你一份在 Debian 上部署 Hadoop(单节点 / 伪分布式)的实用指南,适合学习、测试环境。如果你要的是生产级集群(多节点),我也可以再单独补充。


一、环境准备(Debian)

1. 系统要求

  • Debian 11 / 12(推荐)
  • 至少 2GB 内存(单节点)
  • 已配置静态 IP 或主机名

2. 创建 Hadoop 用户(推荐)

sudo adduser hadoop
sudo usermod -aG sudo hadoop
su - hadoop

二、安装 Java

Hadoop 依赖 Java(推荐 OpenJDK 8 或 11)

sudo apt update
sudo apt install openjdk-11-jdk -y

验证:

java -version

三、配置 SSH(必须)

Hadoop 使用 SSH 启动节点

sudo apt install ssh -y
ssh-keygen -t rsa -P "" -f ~/.ssh/id_rsa
cat ~/.ssh/id_rsa.pub >> ~/.ssh/authorized_keys
chmod 600 ~/.ssh/authorized_keys

测试:

ssh localhost

四、下载并安装 Hadoop

以 Hadoop 3.3.6 为例:

wget https://downloads.apache.org/hadoop/common/hadoop-3.3.6/hadoop-3.3.6.tar.gz
tar -xzvf hadoop-3.3.6.tar.gz
mv hadoop-3.3.6 ~/hadoop

五、配置环境变量

编辑 ~/.bashrc

export JAVA_HOME=/usr/lib/jvm/java-11-openjdk-amd64
export HADOOP_HOME=~/hadoop
export PATH=$PATH:$HADOOP_HOME/bin:$HADOOP_HOME/sbin

使配置生效:

source ~/.bashrc

六、Hadoop 伪分布式配置

1. 配置 core-site.xml

$HADOOP_HOME/etc/hadoop/core-site.xml

<configuration>
  <property>
    <name>fs.defaultFS</name>
    <value>hdfs://localhost:9000</value>
  </property>
</configuration>

2. 配置 hdfs-site.xml

<configuration>
  <property>
    <name>dfs.replication</name>
    <value>1</value>
  </property>
</configuration>

3. 配置 mapred-site.xml

cp mapred-site.xml.template mapred-site.xml
<configuration>
  <property>
    <name>mapreduce.framework.name</name>
    <value>yarn</value>
  </property>
</configuration>

4. 配置 yarn-site.xml

<configuration>
  <property>
    <name>yarn.nodemanager.aux-services</name>
    <value>mapreduce_shuffle</value>
  </property>
</configuration>

七、格式化并启动 Hadoop

1. 格式化 HDFS

hdfs namenode -format

2. 启动 HDFS

start-dfs.sh

3. 启动 YARN

start-yarn.sh

八、验证部署

查看进程

jps

应看到:

  • NameNode
  • DataNode
  • ResourceManager
  • NodeManager

Web 界面

  • HDFS: http://localhost:9870
  • YARN: http://localhost:8088

九、测试 Hadoop

hdfs dfs -mkdir /input
hdfs dfs -put ~/hadoop/etc/hadoop/*.xml /input
hadoop jar $HADOOP_HOME/share/hadoop/mapreduce/hadoop-mapreduce-examples-3.3.6.jar wordcount /input /output
hdfs dfs -cat /output/part-r-00000

十、常见问题

❌ Permission denied (publickey)

→ SSH 未配置好

❌ JAVA_HOME not set

→ 检查 ~/.bashrc

❌ DataNode 未启动

→ 删除 tmp 目录并重新格式化


如果你需要:

  • Debian 多节点集群部署
  • Docker 部署 Hadoop
  • 生产环境调优

告诉我你的使用场景即可。

0