在 Linux 上安装 Spark 失败常见原因很多,下面按最典型的安装方式 + 常见错误给你一个排查与解决指南,你可以对照执行。如果你愿意,也可以把具体报错信息贴出来,我可以精准定位。
Spark 必须依赖 Java。
java -version
✅ 正常示例:
openjdk version "1.8.0_xxx"
❌ 错误情况:
command not foundsudo apt update
sudo apt install openjdk-8-jdk # Ubuntu / Debian
或(CentOS):
sudo yum install java-1.8.0-openjdk
然后确认:
echo $JAVA_HOME
如未设置:
export JAVA_HOME=/usr/lib/jvm/java-8-openjdk-amd64
常见组合:
| Spark 版本 | 推荐 Hadoop | Java |
|---|---|---|
| Spark 3.x | Hadoop 3.x | Java 8 / 11 |
| Spark 2.x | Hadoop 2.x | Java 8 |
新手直接用:
spark-3.5.0-bin-hadoop3.tgz
解压后不能直接用 spark-shell
tar -zxvf spark-3.5.0-bin-hadoop3.tgz
mv spark-3.5.0-bin-hadoop3 ~/spark
export SPARK_HOME=~/spark
export PATH=$SPARK_HOME/bin:$PATH
永久生效:
echo 'export SPARK_HOME=~/spark' >> ~/.bashrc
echo 'export PATH=$SPARK_HOME/bin:$PATH' >> ~/.bashrc
source ~/.bashrc
Permission denied
chmod -R 755 ~/spark
不要用 root 启动 Spark,建议普通用户。
Spark 默认内存很高。
Java heap space
编辑:
$SPARK_HOME/conf/spark-defaults.conf
添加:
spark.driver.memory 512m
spark.executor.memory 512m
# 1. 安装 Java
sudo apt install openjdk-8-jdk
# 2. 下载 Spark
wget https://archive.apache.org/dist/spark/spark-3.5.0/spark-3.5.0-bin-hadoop3.tgz
# 3. 解压
tar -zxvf spark-3.5.0-bin-hadoop3.tgz
mv spark-3.5.0-bin-hadoop3 ~/spark
# 4. 环境变量
echo 'export SPARK_HOME=~/spark' >> ~/.bashrc
echo 'export PATH=$SPARK_HOME/bin:$PATH' >> ~/.bashrc
source ~/.bashrc
# 5. 测试
spark-shell
| 错误信息 | 原因 | 解决办法 |
|---|---|---|
| java: command not found | 没装 Java | 安装 JDK |
| JAVA_HOME is not set | 环境变量未配置 | 设置 JAVA_HOME |
| Unsupported major.minor | Java 版本不对 | 换 Java 8 |
| Permission denied | 权限不足 | chmod |
| No such file | 路径错误 | 检查 SPARK_HOME |
请直接贴出:
我可以一步一步帮你修 ✅
免责声明:本站发布的内容(图片、视频和文字)以原创、转载和分享为主,文章观点不代表本网站立场,如果涉及侵权请联系站长邮箱:is@yisu.com进行举报,并提供相关证据,一经查实,将立刻删除涉嫌侵权内容。