温馨提示×

centos配置hdfs步骤是啥

小樊
33
2026-07-21 11:58:38
栏目: 智能运维

下面给你一份在 CentOS 上配置 HDFS(Hadoop 分布式文件系统)标准步骤,适用于 Hadoop 3.x(2.x 也类似)。假设你已经有一台或多台 CentOS 机器,这里先以单 NameNode + 多 DataNode 为例说明。


一、环境准备(所有节点)

1. 系统要求

  • CentOS 7 / 8(推荐 7)
  • Java 8 或以上
  • SSH 免密登录(集群必须)
  • 主机名和 IP 配置好

2. 安装 Java

yum install -y java-1.8.0-openjdk java-1.8.0-openjdk-devel
java -version

配置 JAVA_HOME

vi /etc/profile
export JAVA_HOME=/usr/lib/jvm/java-1.8.0-openjdk
export PATH=$JAVA_HOME/bin:$PATH
source /etc/profile

3. 创建 Hadoop 用户(可选但推荐)

useradd hadoop
passwd hadoop

4. 配置主机名和 hosts

hostnamectl set-hostname master
vi /etc/hosts
192.168.1.10 master
192.168.1.11 slave1
192.168.1.12 slave2

5. 配置 SSH 免密登录

su - hadoop
ssh-keygen -t rsa
ssh-copy-id master
ssh-copy-id slave1
ssh-copy-id slave2

测试:

ssh slave1

二、安装 Hadoop

1. 下载 Hadoop

cd /opt
wget https://downloads.apache.org/hadoop/common/hadoop-3.3.6/hadoop-3.3.6.tar.gz
tar -zxvf hadoop-3.3.6.tar.gz
mv hadoop-3.3.6 hadoop

2. 配置环境变量

vi /etc/profile
export HADOOP_HOME=/opt/hadoop
export PATH=$HADOOP_HOME/bin:$HADOOP_HOME/sbin:$PATH
source /etc/profile

三、HDFS 核心配置(重点)

以下配置文件都在:

cd $HADOOP_HOME/etc/hadoop

1. hadoop-env.sh

vi hadoop-env.sh
export JAVA_HOME=/usr/lib/jvm/java-1.8.0-openjdk

2. core-site.xml

vi core-site.xml
<configuration>
    <property>
        <name>fs.defaultFS</name>
        <value>hdfs://master:9000</value>
    </property>
</configuration>

3. hdfs-site.xml

vi hdfs-site.xml
<configuration>
    <property>
        <name>dfs.replication</name>
        <value>2</value>
    </property>

    <property>
        <name>dfs.namenode.name.dir</name>
        <value>/data/hadoop/namenode</value>
    </property>

    <property>
        <name>dfs.datanode.data.dir</name>
        <value>/data/hadoop/datanode</value>
    </property>
</configuration>

创建目录:

mkdir -p /data/hadoop/namenode
mkdir -p /data/hadoop/datanode
chown -R hadoop:hadoop /data/hadoop

4. workers(Hadoop 3.x)

vi workers
slave1
slave2

四、同步 Hadoop 到从节点

scp -r /opt/hadoop slave1:/opt/
scp -r /opt/hadoop slave2:/opt/

五、格式化 HDFS(只执行一次)

su - hadoop
hdfs namenode -format

⚠️ 只能执行一次,重复会丢数据


六、启动 HDFS

start-dfs.sh

查看进程:

jps
  • NameNode
  • DataNode
  • SecondaryNameNode

七、验证 HDFS

1. Web UI

浏览器访问:

http://master:9870

2. 命令行测试

hdfs dfs -mkdir /test
hdfs dfs -put /etc/hosts /test
hdfs dfs -ls /test

八、常见问题

1. 端口不通

firewall-cmd --add-port=9870/tcp --permanent
firewall-cmd --add-port=9000/tcp --permanent
firewall-cmd --reload

2. 权限问题

chown -R hadoop:hadoop /opt/hadoop

九、总结流程

安装 Java
配置 SSH
安装 Hadoop
配置 core-site.xml / hdfs-site.xml
格式化 NameNode
启动 HDFS

如果你需要:

  • 单机伪分布式 HDFS
  • HA(高可用)HDFS
  • CentOS 7 完整实战脚本

可以直接告诉我你的环境,我可以给你定制版步骤

0