要卸载 Debian 上的 Hadoop,需根据安装方式选择对应的步骤。以下是常见场景的详细操作指南:
Hadoop 在 Debian 上的安装通常分为 3 种:
/usr/local/hadoop 等目录)。apt 安装的 hadoop 相关包,较少见但可能存在)。以下是针对最常见场景的处理方法:
如果是从官网下载二进制包解压安装的(比如放在 /usr/local/hadoop 或自定义目录),卸载步骤如下:
先确保 Hadoop 集群/服务已停止,避免残留进程:
# 进入 Hadoop 安装目录(替换为你的实际路径,比如 /opt/hadoop)
cd /path/to/hadoop
# 停止 HDFS 和 YARN 服务
sbin/stop-dfs.sh # 停止 HDFS(NameNode、DataNode 等)
sbin/stop-yarn.sh # 停止 YARN(ResourceManager、NodeManager 等)
# 如果用了 MapReduce 历史服务,也停止
sbin/stop-history-server.sh
直接删除整个 Hadoop 解压目录(比如 /usr/local/hadoop):
# 替换为你的 Hadoop 实际安装路径
sudo rm -rf /path/to/hadoop
如果之前在 ~/.bashrc、~/.profile 或 /etc/profile 中配置了 Hadoop 环境变量(如 HADOOP_HOME、PATH),需要删除这些配置:
# 编辑当前用户的 bash 配置(如果是 root 用户,可能需要编辑 /root/.bashrc)
nano ~/.bashrc
# 找到类似以下的行,删除或注释掉:
# export HADOOP_HOME=/path/to/hadoop
# export PATH=$HADOOP_HOME/bin:$HADOOP_HOME/sbin:$PATH
# 使配置生效
source ~/.bashrc
Hadoop 默认会在本地存储数据(如 HDFS 数据、日志),如果需要彻底清理,删除这些目录(替换为你的实际配置路径,默认可能在 hadoop.tmp.dir 中定义,比如 /tmp/hadoop):
# 查看 Hadoop 配置中的数据目录(可选,确认路径)
grep "hadoop.tmp.dir" /path/to/hadoop/etc/hadoop/core-site.xml
# 删除数据目录(比如默认 /tmp/hadoop 或自定义路径)
sudo rm -rf /tmp/hadoop # 示例,替换为你的实际数据目录
sudo rm -rf /path/to/hadoop/logs # 日志目录(可选)
apt 安装的 Hadoop(较少见)如果是通过 Debian 的 apt 包管理器安装的(比如 sudo apt install hadoop),卸载步骤如下:
# 停止 Hadoop 相关服务(如果有 systemd 服务)
sudo systemctl stop hadoop-*
# 卸载主包(可能包含 hadoop、hadoop-hdfs、hadoop-yarn 等)
sudo apt remove --purge hadoop*
# 清理依赖残留
sudo apt autoremove --purge
apt 卸载后可能残留配置文件(在 /etc/hadoop)和数据目录,手动删除:
sudo rm -rf /etc/hadoop # 配置文件
sudo rm -rf /var/lib/hadoop # 数据目录(如果有)
sudo rm -rf /var/log/hadoop # 日志目录(如果有)
如果是通过 Cloudera Manager 或 Ambari 安装的 Hadoop 发行版,卸载需使用对应工具:
卸载后,确认 Hadoop 已完全移除:
# 检查是否有残留进程
ps aux | grep hadoop
# 检查环境变量是否清除
echo $HADOOP_HOME # 应该为空
# 检查命令是否还存在
which hadoop # 应该提示 "not found"
hdfs dfs -get 下载到本地)。根据你的实际安装方式选择对应步骤即可,手动安装的场景按「场景 1」操作是最通用的。