前往小程序,Get更优阅读体验!
立即前往
首页
学习
活动
专区
工具
TVP
发布
社区首页 >专栏 >spark必须知道的几个观点

spark必须知道的几个观点

作者头像
jiewuyou
发布2022-09-29 17:28:59
1670
发布2022-09-29 17:28:59
举报
文章被收录于专栏:数据人生数据人生

executor对应container内存

executor对应的内存由两部分组成:

  1. exuecutor-memory控制了堆的大小
  2. spark.yarn.executor.memoryOverhead 控制堆外内存,默认值(384MB, 0.07 * spark.executor.memory),该值一般偏小,需要调大
  3. spark.memory.fraction可以控制年轻代的大小

日志

凡是cluster模式启动的作业,日志都没有打印在本地。因为main()直接在driver上运行

节约内存的好处

  1. 减少GC
  2. persist后的rdd,如果选择将数据缓存到内存中,当executor内存不够,会基于LRU算法将部分分区数据移出去,复用时会重算,增加执行开销

参考

Where do ‘normal’ println go in a scala jar, under Spark Spark Architecture

本文参与 腾讯云自媒体分享计划,分享自作者个人站点/博客。
原始发表:2016-09-19,如有侵权请联系 cloudcommunity@tencent.com 删除

本文分享自 作者个人站点/博客 前往查看

如有侵权,请联系 cloudcommunity@tencent.com 删除。

本文参与 腾讯云自媒体分享计划  ,欢迎热爱写作的你一起参与!

评论
登录后参与评论
0 条评论
热度
最新
推荐阅读
目录
  • executor对应container内存
  • 日志
  • 节约内存的好处
  • 参考
领券
问题归档专栏文章快讯文章归档关键词归档开发者手册归档开发者手册 Section 归档