Spark在Linux上的安装路径设置指南
一、核心原则
二、标准步骤
准备环境
java -version 正常。下载与解压
wget https://downloads.apache.org/spark/spark-3.3.2/spark-3.3.2-bin-hadoop3.tgz
sudo tar -xzf spark-3.3.2-bin-hadoop3.tgz -C /opt
sudo ln -sfn /opt/spark-3.3.2-bin-hadoop3 /opt/spark # 软链便于升级
sudo tar -xzf spark-3.3.2-bin-hadoop3.tgz -C /usr/local
sudo ln -sfn /usr/local/spark-3.3.2-bin-hadoop3 /usr/local/spark
sudo chown -R spark:spark /opt/spark*
配置环境变量
echo 'export SPARK_HOME=/opt/spark' >> ~/.bashrc
echo 'export PATH=$SPARK_HOME/bin:$SPARK_HOME/sbin:$PATH' >> ~/.bashrc
source ~/.bashrc
echo 'export SPARK_HOME=/opt/spark' | sudo tee /etc/profile.d/spark.sh
echo 'export PATH=$SPARK_HOME/bin:$SPARK_HOME/sbin:$PATH' | sudo tee -a /etc/profile.d/spark.sh
source /etc/profile.d/spark.sh
配置 spark-env.sh
cd $SPARK_HOME/conf
cp spark-env.sh.template spark-env.sh
export JAVA_HOME=/usr/lib/jvm/java-8-openjdk-amd64
# 如使用 HDFS/YARN
export HADOOP_CONF_DIR=/usr/local/hadoop/etc/hadoop
# 单机/伪分布式常用
export SPARK_MASTER_HOST=localhost
# 可按需设置内存
# export SPARK_WORKER_MEMORY=2g
集群相关(可选)
$SPARK_HOME/sbin/start-master.sh
$SPARK_HOME/sbin/start-workers.sh
# 访问 Master Web UI:http://<master-ip>:8080
三、验证与常见问题
验证安装
spark-submit --versionspark-shell(看到 Scala REPL 即正常)常见问题与处理
四、多版本与自动化建议
多版本共存
sudo ln -sfn /opt/spark-3.5.0 /opt/spark
# 重新登录或 source 使变更生效
自动化安装脚本(示例)
spark-submit --version 验证。参考脚本思路:设置版本与安装目录、下载解压、写入 ~/.bashrc、source 生效并验证。免责声明:本站发布的内容(图片、视频和文字)以原创、转载和分享为主,文章观点不代表本网站立场,如果涉及侵权请联系站长邮箱:is@yisu.com进行举报,并提供相关证据,一经查实,将立刻删除涉嫌侵权内容。