在 CentOS 上安装 HDFS(Hadoop Distributed File System),通常是指 安装 Hadoop 并启动 HDFS。下面给你一个从零开始的完整流程(单机 / 伪分布式),适合学习和测试环境。如果你需要 完全分布式集群,我也可以再补充。
systemctl stop firewalld
systemctl disable firewalld
hostnamectl set-hostname hadoop1
vim /etc/hosts
添加:
127.0.0.1 hadoop1
java -version
yum install -y java-1.8.0-openjdk java-1.8.0-openjdk-devel
vim /etc/profile
添加:
export JAVA_HOME=/usr/lib/jvm/java-1.8.0-openjdk
export PATH=$JAVA_HOME/bin:$PATH
生效:
source /etc/profile
useradd hadoop
passwd hadoop
切换用户:
su - hadoop
cd ~
wget https://downloads.apache.org/hadoop/common/hadoop-3.3.6/hadoop-3.3.6.tar.gz
tar -zxvf hadoop-3.3.6.tar.gz
mv hadoop-3.3.6 hadoop
vim ~/.bashrc
添加:
export HADOOP_HOME=/home/hadoop/hadoop
export PATH=$HADOOP_HOME/bin:$HADOOP_HOME/sbin:$PATH
export HADOOP_CONF_DIR=$HADOOP_HOME/etc/hadoop
生效:
source ~/.bashrc
hadoop-env.shvim $HADOOP_HOME/etc/hadoop/hadoop-env.sh
设置:
export JAVA_HOME=/usr/lib/jvm/java-1.8.0-openjdk
core-site.xmlvim $HADOOP_HOME/etc/hadoop/core-site.xml
<configuration>
<property>
<name>fs.defaultFS</name>
<value>hdfs://hadoop1:9000</value>
</property>
</configuration>
hdfs-site.xmlvim $HADOOP_HOME/etc/hadoop/hdfs-site.xml
<configuration>
<property>
<name>dfs.replication</name>
<value>1</value>
</property>
<property>
<name>dfs.namenode.name.dir</name>
<value>/home/hadoop/hadoop/dfs/name</value>
</property>
<property>
<name>dfs.datanode.data.dir</name>
<value>/home/hadoop/hadoop/dfs/data</value>
</property>
</configuration>
hdfs namenode -format
✅ 出现 Storage directory ... has been successfully formatted 表示成功
start-dfs.sh
查看进程:
jps
应看到:
NameNode
DataNode
SecondaryNameNode
浏览器访问:
http://<CentOS_IP>:9870
hdfs dfs -mkdir /test
hdfs dfs -ls /
ssh-keygen -t rsa
cat ~/.ssh/id_rsa.pub >> ~/.ssh/authorized_keys
chmod 600 ~/.ssh/authorized_keys
如果你愿意,可以告诉我:
✅ 是 学习 / 生产
✅ 单机还是 多节点集群
✅ CentOS 具体版本
我可以给你 定制方案或自动化脚本。