有的!因为 Debian 属于 Linux 系统,而且和 Ubuntu 同属 Debian 系(命令几乎完全通用),所以网上绝大多数“Linux / Ubuntu 安装 Hadoop”的教程在 Debian 上都可以直接复用。
Apache 官方没有提供 apt 直接安装 Hadoop 的仓库,通常都是下载官方二进制包手动配置。以下为你整理了一份在 Debian 上搭建 伪分布式(Pseudo-Distributed)Hadoop 环境的简明教程和资源指引。
打开终端,更新系统并安装必要的工具(Java 和 SSH):
# 更新系统
sudo apt update && sudo apt upgrade -y
# 安装 Java (Hadoop 3.x 推荐 Java 8 或 11,不要盲目装 Java 17 除非你的 Hadoop 版本很新)
sudo apt install openjdk-11-jdk -y
# 安装 SSH 和 rsync(Hadoop 主从节点通信依赖 SSH)
sudo apt install ssh rsync -y
# 配置 SSH 无密码登录(Hadoop 启动脚本需要)
ssh-keygen -t rsa -P '' -f ~/.ssh/id_rsa
cat ~/.ssh/id_rsa.pub >> ~/.ssh/authorized_keys
ssh localhost # 测试能否无密码登录
去 Apache Hadoop 官网 复制最新稳定版的下载链接:
cd /opt
sudo wget https://downloads.apache.org/hadoop/common/hadoop-3.3.6/hadoop-3.3.6.tar.gz
sudo tar -xzvf hadoop-3.3.6.tar.gz
sudo mv hadoop-3.3.6 hadoop
sudo chown -R $USER:$USER /opt/hadoop
编辑你的 ~/.bashrc 文件:
nano ~/.bashrc
在文件末尾添加:
export JAVA_HOME=/usr/lib/jvm/java-11-openjdk-amd64
export HADOOP_HOME=/opt/hadoop
export PATH=$PATH:$HADOOP_HOME/bin:$HADOOP_HOME/sbin
export HADOOP_CONF_DIR=$HADOOP_HOME/etc/hadoop
保存后执行 source ~/.bashrc 使其生效,并用 java -version 和 hadoop version 验证。
进入配置目录:cd $HADOOP_HOME/etc/hadoop
JAVA_HOME 已设置。<configuration>
<property>
<name>fs.defaultFS</name>
<value>hdfs://localhost:9000</value>
</property>
</configuration>
<configuration>
<property>
<name>dfs.replication</name>
<value>1</value>
</property>
</configuration>
# 格式化 NameNode(仅第一次需要)
hdfs namenode -format
# 启动 HDFS
start-dfs.sh
# 启动 YARN(资源调度)
start-yarn.sh
打开浏览器访问 Debian 机器的以下端口:
http://localhost:9870http://localhost:8088
如果能看到管理页面,说明 Hadoop 已经在 Debian 上成功运行!root 用户跑 Hadoop,建议新建一个普通用户(如 hadoop 用户)来专门运行。ufw)或云厂商安全组中放行 9870、8088 等端口。workers 文件(旧版叫 slaves),并设置各机器间的 SSH 互信。如果你需要特定版本(如 Hadoop 2.x vs 3.x)或者完全分布式集群的详细配置,可以告诉我你的具体需求(比如 Debian 版本号、Hadoop 版本、单机还是集群),我可以给你更针对性的配置代码。