温馨提示×

debian上hadoop怎启动

小樊
33
2026-09-05 14:50:11
栏目: 智能运维

在 Debian 上启动 Hadoop,一般分为 单机/伪分布式完全分布式 两种场景。下面以最常用、最容易验证的伪分布式(Pseudo-Distributed)模式为例,说明完整启动步骤。


一、前提准备(Debian)

1. 安装 JDK

sudo apt update
sudo apt install openjdk-11-jdk -y
java -version

2. 创建 hadoop 用户(推荐)

sudo useradd -m hadoop
sudo passwd hadoop

3. 配置 SSH 免密

su - hadoop
ssh-keygen -t rsa
cat ~/.ssh/id_rsa.pub >> ~/.ssh/authorized_keys
chmod 600 ~/.ssh/authorized_keys
ssh localhost

二、安装 Hadoop

wget https://downloads.apache.org/hadoop/common/hadoop-3.3.6/hadoop-3.3.6.tar.gz
tar -xzf hadoop-3.3.6.tar.gz
sudo mv hadoop-3.3.6 /opt/hadoop

配置环境变量(~/.bashrc):

export HADOOP_HOME=/opt/hadoop
export PATH=$PATH:$HADOOP_HOME/bin:$HADOOP_HOME/sbin
export JAVA_HOME=/usr/lib/jvm/java-11-openjdk-amd64
source ~/.bashrc

三、伪分布式配置

1. core-site.xml

<configuration>
  <property>
    <name>fs.defaultFS</name>
    <value>hdfs://localhost:9000</value>
  </property>
</configuration>

2. hdfs-site.xml

<configuration>
  <property>
    <name>dfs.replication</name>
    <value>1</value>
  </property>
</configuration>

3. mapred-site.xml

<configuration>
  <property>
    <name>mapreduce.framework.name</name>
    <value>yarn</value>
  </property>
</configuration>

4. yarn-site.xml

<configuration>
  <property>
    <name>yarn.nodemanager.aux-services</name>
    <value>mapreduce_shuffle</value>
  </property>
</configuration>

四、启动 Hadoop

1. 格式化 HDFS(仅第一次)

hdfs namenode -format

2. 启动 HDFS

start-dfs.sh

3. 启动 YARN

start-yarn.sh

4. 查看进程

jps

应看到:

  • NameNode
  • DataNode
  • ResourceManager
  • NodeManager
  • SecondaryNameNode

五、验证

浏览器访问:

  • HDFS: http://localhost:9870
  • YARN: http://localhost:8088

测试命令:

hdfs dfs -mkdir /test
hdfs dfs -put ~/.bashrc /test
hdfs dfs -ls /test

六、停止 Hadoop

stop-yarn.sh
stop-dfs.sh

如果你是要 集群模式(多节点)Debian 12 + Hadoop 3.x 特殊问题,可以告诉我,我可以进一步说明。

0