下面以 Linux 环境下搭建 HDFS(Hadoop 分布式文件系统)基础配置 为例,说明从安装到最小可用配置的步骤。假设你使用的是 Hadoop 3.x。
java -version
若未安装:
# CentOS
yum install java-1.8.0-openjdk-devel -y
# Ubuntu
apt install openjdk-8-jdk -y
配置 JAVA_HOME:
export JAVA_HOME=/usr/lib/jvm/java-1.8.0-openjdk
wget https://archive.apache.org/dist/hadoop/common/hadoop-3.3.6/hadoop-3.3.6.tar.gz
tar -zxvf hadoop-3.3.6.tar.gz
mv hadoop-3.3.6 /opt/hadoop
配置环境变量:
vi ~/.bashrc
添加:
export HADOOP_HOME=/opt/hadoop
export PATH=$PATH:$HADOOP_HOME/bin:$HADOOP_HOME/sbin
生效:
source ~/.bashrc
hadoop-env.shvi $HADOOP_HOME/etc/hadoop/hadoop-env.sh
添加:
export JAVA_HOME=/usr/lib/jvm/java-1.8.0-openjdk
core-site.xmlvi $HADOOP_HOME/etc/hadoop/core-site.xml
<configuration>
<property>
<name>fs.defaultFS</name>
<value>hdfs://localhost:9000</value>
</property>
</configuration>
hdfs-site.xmlvi $HADOOP_HOME/etc/hadoop/hdfs-site.xml
<configuration>
<property>
<name>dfs.replication</name>
<value>1</value>
</property>
<property>
<name>dfs.namenode.name.dir</name>
<value>/opt/hadoop/data/namenode</value>
</property>
<property>
<name>dfs.datanode.data.dir</name>
<value>/opt/hadoop/data/datanode</value>
</property>
</configuration>
创建目录:
mkdir -p /opt/hadoop/data/namenode
mkdir -p /opt/hadoop/data/datanode
HDFS 需要通过 SSH 启动进程:
ssh-keygen -t rsa
cat ~/.ssh/id_rsa.pub >> ~/.ssh/authorized_keys
chmod 600 ~/.ssh/authorized_keys
测试:
ssh localhost
hdfs namenode -format
start-dfs.sh
jps
应看到:
hdfs dfs -mkdir /test
hdfs dfs -put /etc/hosts /test
hdfs dfs -ls /test
Web 界面:
http://localhost:9870
stop-dfs.sh
localhost,集群要配置 workers 文件$HADOOP_HOME/etc/hadoop/如果你需要:
可以继续告诉我你的使用场景。