在 CentOS 上配置 HDFS(Hadoop 分布式文件系统),通常的做法是 安装并配置 Apache Hadoop。下面给你一个完整、实用的配置思路,适合新手和常见生产环境。
systemctl stop firewalld
systemctl disable firewalld
setenforce 0
sed -i 's/SELINUX=enforcing/SELINUX=disabled/' /etc/selinux/config
Hadoop 依赖 Java
yum install -y java-1.8.0-openjdk java-1.8.0-openjdk-devel
java -version
useradd hadoop
passwd hadoop
su - hadoop
wget https://downloads.apache.org/hadoop/common/hadoop-3.3.6/hadoop-3.3.6.tar.gz
tar -zxvf hadoop-3.3.6.tar.gz
mv hadoop-3.3.6 /usr/local/hadoop
编辑 ~/.bashrc:
export HADOOP_HOME=/usr/local/hadoop
export PATH=$PATH:$HADOOP_HOME/bin:$HADOOP_HOME/sbin
export JAVA_HOME=/usr/lib/jvm/java-1.8.0-openjdk
生效:
source ~/.bashrc
Hadoop 配置文件路径:
$HADOOP_HOME/etc/hadoop/
<configuration>
<property>
<name>fs.defaultFS</name>
<value>hdfs://localhost:9000</value>
</property>
<property>
<name>hadoop.tmp.dir</name>
<value>/usr/local/hadoop/tmp</value>
</property>
</configuration>
<configuration>
<property>
<name>dfs.replication</name>
<value>1</value>
</property>
<property>
<name>dfs.namenode.name.dir</name>
<value>/usr/local/hadoop/dfs/name</value>
</property>
<property>
<name>dfs.datanode.data.dir</name>
<value>/usr/local/hadoop/dfs/data</value>
</property>
</configuration>
export JAVA_HOME=/usr/lib/jvm/java-1.8.0-openjdk
hdfs namenode -format
✅ 出现 Storage directory ... has been successfully formatted 表示成功
start-dfs.sh
查看进程:
jps
应看到:
NameNode
DataNode
SecondaryNameNode
hdfs dfs -ls /
hdfs dfs -mkdir /test
hdfs dfs -put file.txt /test
Web UI:
http://CentOS_IP:9870
dfs/name 和 dfs/data 重新格式化netstat -tunlp | grep 9000
chown -R hadoop:hadoop /usr/local/hadoop
CentOS 配置 HDFS 就是:装 Java → 装 Hadoop → 配 core-site.xml + hdfs-site.xml → 格式化 → 启动
如果你需要:
告诉我你的 使用场景,我可以直接给你一套完整配置。