温馨提示×

怎么卸载Debian的Hadoop

小樊
48
2026-07-07 07:38:59
栏目: 智能运维

要卸载 Debian 上的 Hadoop,需根据安装方式选择对应的步骤。以下是常见场景的详细操作指南:

一、先确认 Hadoop 的安装方式

Hadoop 在 Debian 上的安装通常分为 3 种:

  1. 源码/二进制包手动安装(如从 Apache 官网下载解压到 /usr/local/hadoop 等目录)。
  2. Debian 包管理器安装(通过 apt 安装的 hadoop 相关包,较少见但可能存在)。
  3. 第三方工具安装(如 Cloudera、Hortonworks 的发行版,或 Docker 容器)。

以下是针对最常见场景的处理方法:

二、场景 1:手动安装的 Hadoop(最常见)

如果是从官网下载二进制包解压安装的(比如放在 /usr/local/hadoop 或自定义目录),卸载步骤如下:

1. 停止 Hadoop 所有服务

先确保 Hadoop 集群/服务已停止,避免残留进程:

# 进入 Hadoop 安装目录(替换为你的实际路径,比如 /opt/hadoop)
cd /path/to/hadoop

# 停止 HDFS 和 YARN 服务
sbin/stop-dfs.sh    # 停止 HDFS(NameNode、DataNode 等)
sbin/stop-yarn.sh   # 停止 YARN(ResourceManager、NodeManager 等)

# 如果用了 MapReduce 历史服务,也停止
sbin/stop-history-server.sh

2. 删除 Hadoop 安装目录

直接删除整个 Hadoop 解压目录(比如 /usr/local/hadoop):

# 替换为你的 Hadoop 实际安装路径
sudo rm -rf /path/to/hadoop

3. 清理环境变量

如果之前在 ~/.bashrc~/.profile/etc/profile 中配置了 Hadoop 环境变量(如 HADOOP_HOMEPATH),需要删除这些配置:

# 编辑当前用户的 bash 配置(如果是 root 用户,可能需要编辑 /root/.bashrc)
nano ~/.bashrc

# 找到类似以下的行,删除或注释掉:
# export HADOOP_HOME=/path/to/hadoop
# export PATH=$HADOOP_HOME/bin:$HADOOP_HOME/sbin:$PATH

# 使配置生效
source ~/.bashrc

4. 清理数据目录(可选)

Hadoop 默认会在本地存储数据(如 HDFS 数据、日志),如果需要彻底清理,删除这些目录(替换为你的实际配置路径,默认可能在 hadoop.tmp.dir 中定义,比如 /tmp/hadoop):

# 查看 Hadoop 配置中的数据目录(可选,确认路径)
grep "hadoop.tmp.dir" /path/to/hadoop/etc/hadoop/core-site.xml

# 删除数据目录(比如默认 /tmp/hadoop 或自定义路径)
sudo rm -rf /tmp/hadoop  # 示例,替换为你的实际数据目录
sudo rm -rf /path/to/hadoop/logs  # 日志目录(可选)

三、场景 2:通过 apt 安装的 Hadoop(较少见)

如果是通过 Debian 的 apt 包管理器安装的(比如 sudo apt install hadoop),卸载步骤如下:

1. 停止服务(如果运行中)

# 停止 Hadoop 相关服务(如果有 systemd 服务)
sudo systemctl stop hadoop-*

2. 卸载 Hadoop 包

# 卸载主包(可能包含 hadoop、hadoop-hdfs、hadoop-yarn 等)
sudo apt remove --purge hadoop*

# 清理依赖残留
sudo apt autoremove --purge

3. 删除残留配置和数据

apt 卸载后可能残留配置文件(在 /etc/hadoop)和数据目录,手动删除:

sudo rm -rf /etc/hadoop    # 配置文件
sudo rm -rf /var/lib/hadoop # 数据目录(如果有)
sudo rm -rf /var/log/hadoop # 日志目录(如果有)

四、场景 3:第三方发行版(如 Cloudera、Hortonworks)

如果是通过 Cloudera Manager 或 Ambari 安装的 Hadoop 发行版,卸载需使用对应工具:

  • Cloudera:通过 Cloudera Manager 界面卸载集群,或运行官方卸载脚本(参考 Cloudera 文档)。
  • Ambari:通过 Ambari 界面停止并删除服务,再卸载 Ambari 自身(参考 Ambari 文档)。

五、验证卸载

卸载后,确认 Hadoop 已完全移除:

# 检查是否有残留进程
ps aux | grep hadoop

# 检查环境变量是否清除
echo $HADOOP_HOME  # 应该为空

# 检查命令是否还存在
which hadoop  # 应该提示 "not found"

注意事项

  • 如果是生产环境,卸载前请备份重要数据(如 HDFS 中的数据可通过 hdfs dfs -get 下载到本地)。
  • 如果是集群环境,需要在所有节点(NameNode、DataNode、ResourceManager 等)上重复上述步骤。

根据你的实际安装方式选择对应步骤即可,手动安装的场景按「场景 1」操作是最通用的。

0