Spark集群搭建

news2026/2/15 10:16:57

系列文章目录

Ubuntu常见基本问题
Hadoop3.1.3安装（单机、伪分布）
Hadoop集群搭建
HBase2.2.2安装（单机、伪分布）
Zookeeper集群搭建
HBase集群搭建
Spark安装和编程实践（Spark2.4.0）
Spark集群搭建

文章目录

系列文章目录
前置条件
一、配置环境变量
二、Spark配置
- 1、slaves
- 2、spark-env.sh
三、启动Spark集群
- 1、启动Hadoop集群
- 2、启动Spark集群
- 3、关闭Spark集群

前置条件

Hadoop集群
jdk
Master和Slave1两台机器

一、配置环境变量

在Master节点主机的终端中执行如下命令：

vim ~/.bashrc

在.bashrc添加如下配置：

export SPARK_HOME=/usr/local/spark
export PATH=$PATH:$SPARK_HOME/bin:$SPARK_HOME/sbin

执行如下命令使得配置立即生效：

source ~/.bashrc

二、Spark配置

在Master节点主机上进行如下操作：

1、slaves

将 slaves.template 拷贝到 slaves

cd /usr/local/spark/
cp ./conf/slaves.template ./conf/slaves
sudo vim /usr/local/spark/conf/slaves

slaves文件设置Worker节点。编辑slaves内容,把默认内容localhost替换成如下内容：

slave1

2、spark-env.sh

将 spark-env.sh.template 拷贝到 spark-env.sh

cp ./conf/spark-env.sh.template ./conf/spark-env.sh
sudo vim /usr/local/spark/conf/spark-env.sh

修改为：

export SPARK_DIST_CLASSPATH=$(/usr/local/hadoop/bin/hadoop classpath)
export HADOOP_CONF_DIR=/usr/local/hadoop/etc/hadoop
export SPARK_MASTER_IP=192.168.1.104

SPARK_MASTER_IP 指定 Spark 集群 Master 节点的 IP 地址；

配置好后，将Master主机上的/usr/local/spark文件夹复制到各个节点上。在Master主机上执行如下命令：

cd /usr/local/
tar -zcf ~/spark.master.tar.gz ./spark
cd ~
scp ./spark.master.tar.gz slave1:/home/hadoop

在slave1节点上分别执行下面同样的操作：

sudo rm -rf /usr/local/spark/
sudo tar -zxf ~/spark.master.tar.gz -C /usr/local
sudo chown -R hadoop /usr/local/spark

三、启动Spark集群

1、启动Hadoop集群

cd /usr/local/hadoop
./sbin/start-dfs.sh
hadoop-daemon.sh start datanode

成功啦！！！
在这里插入图片描述

2、启动Spark集群

Master节点：

cd /usr/local/spark/
./sbin/start-master.sh

成功啦！！！
在这里插入图片描述

Slave1节点：

cd /usr/local/spark/
./sbin/start-slaves.sh

成功啦！！！

在这里插入图片描述

在master主机上打开浏览器，访问http://master:8080,如下图：

3、关闭Spark集群

关闭Master节点

cd /usr/local/spark/
./sbin/stop-master.sh

关闭Worker节点

cd /usr/local/spark/
./sbin/stop-slaves.sh

关闭Hadoop集群

cd /usr/local/hadoop/
./sbin/stop-all.sh

本文来自互联网用户投稿，该文观点仅代表作者本人，不代表本站立场。本站仅提供信息存储空间服务，不拥有所有权，不承担相关法律责任。如若转载，请注明出处：http://www.coloradmin.cn/o/613821.html

如若内容造成侵权/违法违规/事实不符，请联系多彩编程网进行投诉反馈，一经查实，立即删除！

Spark集群搭建

系列文章目录

文章目录

前置条件

一、配置环境变量

二、Spark配置

1、slaves

2、spark-env.sh

三、启动Spark集群

1、启动Hadoop集群

2、启动Spark集群

3、关闭Spark集群

相关文章

linux开发：linux最大线程数分析

家用儿童帆布床出口欧盟CE认证EN716测试

hacknet攻略(更新中)

Unity制作二次元卡通渲染角色材质——4 、内外描边和细节添加

MySQL数据库学习笔记（九）实验课六之触发器和存储过程

51智能小车-串口控制、循迹、避障

总结890

STM32开发——简介、开发环境（Keil5、CubeMX）、HAL库

kafka部分面试常见问题及其解答(接上)

vue 3 第三十二章：状态管理（Pinia状态持久化）

Linux - 文件操作和系统接口

永恒之黑漏洞复现

配置主机加入已有 tinc 集群简明过程

Python模块os 操作系统

KMeans+DBSCAN密度聚类+层次聚类的使用（附案例实战）

数据结构之栈、队列——算法与数据结构入门笔记（四）

虚幻5-编辑器扩展开发Editor-Slate的TabManager结构如下

检测到“_CRT_STDIO_ISO_WIDE_SPECIFIERS”的不匹配项

这AI二维码也太酷炫了！谷歌生成式AI学习路径；媒体的AI炒作套路报告；使用GPT-4自动化制作短视频 | ShowMeAI日报

smardaten简直是无代码软件开发的天花板