前往小程序,Get更优阅读体验!
立即前往
首页
学习
活动
专区
工具
TVP
发布
社区首页 >专栏 >在 K8S 部署一个 Spark History Server - 篇1

在 K8S 部署一个 Spark History Server - 篇1

作者头像
runzhliu
发布2020-08-06 09:50:34
6210
发布2020-08-06 09:50:34
举报
文章被收录于专栏:容器计算容器计算

1 Overview

要在 K8S 集群中部署一套 Spark History Server,首先要了解,怎么部署一个本地版本。然后就是了解一些基本的 K8S 相关的知识点。最后就是两部分知识结合起来,看看业界流行的方案是如何实现的。

Spark History Server 缩写成 HS

2 Spark History Server 本地试玩

其实 Spark 官网关于如何部署 Spark History Server 是有很详细的说明的。这里以 Spark 2.3.0 为例。

https://spark.apache.org/docs/2.3.0/monitoring.html

总体来说 start-history-server.sh,可以启动 HS 的进程。

image_1de22ln9p14511chi1atjc2u1at19.png-122.1kB
image_1de22ln9p14511chi1atjc2u1at19.png-122.1kB

默认通过访问 18080 端口,就可以将 job 的历史信息(注意还包括 on-going,也就是正在运行的 job)。

Spark Job 需要打开两个配置。

代码语言:javascript
复制
spark.eventLog.enabled true
spark.eventLog.dir hdfs://namenode/shared/spark-logs

为了在本地起一个 HS 的后台进程,我们可以下载 Spark 的发行包。

创建一个目录,来放 event log。

代码语言:javascript
复制
mkdir /tmp/spark-log

然后运行一个 SparkPi 程序,只要有配置 Java Home,正常 JDK8 都能跑起来的。

代码语言:javascript
复制
./bin/spark-submit \
  --class org.apache.spark.examples.SparkPi \
  --master local \
  --conf spark.eventLog.enabled=true \
  --conf spark.eventLog.dir=file:///tmp/spark-log \
  ./examples/jars/spark-examples_2.11-2.2.0-k8s-0.5.0.jar \

只要配置了 event log 的位置,日志就能看到以下信息。

image_1de2bfba11tgmcgq1pn010g7jnjm.png-902.1kB
image_1de2bfba11tgmcgq1pn010g7jnjm.png-902.1kB

因为启动 HS 的进程需要 event log,现在有了,所以就能启动了。查看 18080 默认端口的页面。

image_1de2cks3f1ooh16th12k5l3989q13.png-83.4kB
image_1de2cks3f1ooh16th12k5l3989q13.png-83.4kB

刚刚运行的 SparkPi 程序的 Job 在这里。

image_1de2cmcpc10s31meq18i719mu1mjm1g.png-103kB
image_1de2cmcpc10s31meq18i719mu1mjm1g.png-103kB

3 Docker 化

本地环境总是很蛋疼的。熟悉 Docker 之后,我想不会有人再在本地跑 Spark,HDFS 之类的测试程序的了。下一篇具体说说如何用 Docker 来跑 Spark。

本文参与 腾讯云自媒体分享计划,分享自作者个人站点/博客。
原始发表:2019-07-09 ,如有侵权请联系 cloudcommunity@tencent.com 删除

本文分享自 作者个人站点/博客 前往查看

如有侵权,请联系 cloudcommunity@tencent.com 删除。

本文参与 腾讯云自媒体分享计划  ,欢迎热爱写作的你一起参与!

评论
登录后参与评论
0 条评论
热度
最新
推荐阅读
目录
  • 1 Overview
  • 2 Spark History Server 本地试玩
  • 3 Docker 化
相关产品与服务
容器镜像服务
容器镜像服务(Tencent Container Registry,TCR)为您提供安全独享、高性能的容器镜像托管分发服务。您可同时在全球多个地域创建独享实例,以实现容器镜像的就近拉取,降低拉取时间,节约带宽成本。TCR 提供细颗粒度的权限管理及访问控制,保障您的数据安全。
领券
问题归档专栏文章快讯文章归档关键词归档开发者手册归档开发者手册 Section 归档