以下是在Linux系统中顺利安装Spark的步骤:
环境准备
sudo apt update && sudo apt install openjdk-11-jdk # Ubuntu/Debian
下载并解压Spark
wget https://downloads.apache.org/spark/spark-3.5.0/spark-3.5.0-bin-hadoop3.tgz
sudo tar -xzf spark-3.5.0-bin-hadoop3.tgz -C /opt/ # 解压至/opt目录
配置环境变量
~/.bashrc文件,添加:export SPARK_HOME=/opt/spark-3.5.0-bin-hadoop3
export PATH=$SPARK_HOME/bin:$PATH
source ~/.bashrc
验证安装
spark-shell
若出现Scala交互界面,则安装成功。(可选)集群模式配置
spark-env.sh(设置SPARK_MASTER_IP等)和slaves文件(添加从节点IP),并分发安装包到各节点,执行start-all.sh启动集群。注意事项:
HADOOP_CONF_DIR。参考来源:
免责声明:本站发布的内容(图片、视频和文字)以原创、转载和分享为主,文章观点不代表本网站立场,如果涉及侵权请联系站长邮箱:is@yisu.com进行举报,并提供相关证据,一经查实,将立刻删除涉嫌侵权内容。