温馨提示×

debian下hadoop怎配置

小樊
42
2026-09-05 14:46:14
栏目: 智能运维

下面给你一个**在 Debian 下配置 Hadoop(单机 / 伪分布式)**的实战步骤,适合学习和测试环境。生产集群(多节点)思路类似,但会更复杂。


一、环境准备

1. 系统要求

  • Debian 11 / 12
  • Java 8 或 Java 11(Hadoop 3.x 推荐 Java 8)
  • 一个普通用户(不要直接用 root 跑 Hadoop

2. 安装 Java

sudo apt update
sudo apt install openjdk-8-jdk -y

验证:

java -version

二、创建 Hadoop 用户(推荐)

sudo adduser hadoop
sudo usermod -aG sudo hadoop
su - hadoop

三、下载并安装 Hadoop

cd ~
wget https://downloads.apache.org/hadoop/common/hadoop-3.3.6/hadoop-3.3.6.tar.gz
tar -xzf hadoop-3.3.6.tar.gz
mv hadoop-3.3.6 hadoop

四、配置环境变量

编辑 ~/.bashrc

nano ~/.bashrc

添加:

export JAVA_HOME=/usr/lib/jvm/java-8-openjdk-amd64
export HADOOP_HOME=/home/hadoop/hadoop
export PATH=$PATH:$HADOOP_HOME/bin:$HADOOP_HOME/sbin

生效:

source ~/.bashrc

验证:

hadoop version

五、SSH 免密登录(必须)

ssh-keygen -t rsa
cat ~/.ssh/id_rsa.pub >> ~/.ssh/authorized_keys
chmod 600 ~/.ssh/authorized_keys

测试:

ssh localhost

六、Hadoop 伪分布式配置

1. core-site.xml

nano $HADOOP_HOME/etc/hadoop/core-site.xml
<configuration>
  <property>
    <name>fs.defaultFS</name>
    <value>hdfs://localhost:9000</value>
  </property>
</configuration>

2. hdfs-site.xml

nano $HADOOP_HOME/etc/hadoop/hdfs-site.xml
<configuration>
  <property>
    <name>dfs.replication</name>
    <value>1</value>
  </property>
</configuration>

3. mapred-site.xml

cp $HADOOP_HOME/etc/hadoop/mapred-site.xml.template $HADOOP_HOME/etc/hadoop/mapred-site.xml
nano $HADOOP_HOME/etc/hadoop/mapred-site.xml
<configuration>
  <property>
    <name>mapreduce.framework.name</name>
    <value>yarn</value>
  </property>
</configuration>

4. yarn-site.xml

nano $HADOOP_HOME/etc/hadoop/yarn-site.xml
<configuration>
  <property>
    <name>yarn.nodemanager.aux-services</name>
    <value>mapreduce_shuffle</value>
  </property>
</configuration>

七、格式化 HDFS

⚠️ 只执行一次

hdfs namenode -format

八、启动 Hadoop

start-dfs.sh
start-yarn.sh

查看进程:

jps

应看到:

  • NameNode
  • DataNode
  • ResourceManager
  • NodeManager

九、Web 界面

  • HDFS: http://localhost:9870
  • YARN: http://localhost:8088

十、测试 WordCount

hdfs dfs -mkdir /input
hdfs dfs -put $HADOOP_HOME/etc/hadoop/*.xml /input

hadoop jar $HADOOP_HOME/share/hadoop/mapreduce/hadoop-mapreduce-examples-3.3.6.jar wordcount /input /output

hdfs dfs -cat /output/part-r-00000

十一、关闭 Hadoop

stop-yarn.sh
stop-dfs.sh

如果你需要:

  • 完全分布式(多台 Debian 机器)
  • HA(高可用)
  • Hive / Spark 集成

告诉我你的使用场景,我可以继续帮你配。

0