学习在 Debian 系统上搭建和使用 Hadoop,可以按下面这套路线来,从基础到实战,循序渐进。
Hadoop 跑在 Linux 上,至少要会:
useradd, sudo, chmod, chown)/etc/hosts)apt)✅ 建议:
sudo apt update
sudo apt install -y ssh rsync openjdk-11-jdk
Hadoop 是 Java 写的:
JAVA_HOMEjava -version
echo $JAVA_HOME
不要一上来就敲命令,先搞清楚:
wget https://downloads.apache.org/hadoop/common/hadoop-3.3.6/hadoop-3.3.6.tar.gz
tar -xzf hadoop-3.3.6.tar.gz
sudo mv hadoop-3.3.6 /opt/hadoop
~/.bashrc:
export HADOOP_HOME=/opt/hadoop
export PATH=$PATH:$HADOOP_HOME/bin:$HADOOP_HOME/sbin
export JAVA_HOME=/usr/lib/jvm/java-11-openjdk-amd64
source ~/.bashrc
etc/hadoop/core-site.xml<configuration>
<property>
<name>fs.defaultFS</name>
<value>hdfs://localhost:9000</value>
</property>
</configuration>
etc/hadoop/hdfs-site.xml<configuration>
<property>
<name>dfs.replication</name>
<value>1</value>
</property>
</configuration>
ssh-keygen -t rsa
cat ~/.ssh/id_rsa.pub >> ~/.ssh/authorized_keys
hdfs namenode -format
start-dfs.sh
start-yarn.sh
浏览器访问:
http://localhost:9870http://localhost:8088hdfs dfs -mkdir /test
hdfs dfs -put file.txt /test
hdfs dfs -ls /
hadoop jar $HADOOP_HOME/share/hadoop/mapreduce/hadoop-mapreduce-examples-3.3.6.jar wordcount /test /out
hosts✅ 先单机,再集群
✅ 先会用,再懂原理
✅ 多敲命令,少复制粘贴
✅ 出错看日志(logs/ 目录)
如果你愿意,我可以: