Spark性能如何调优?

Spark性能如何调优?,第1张

Spark性能如何调优?

参考回答:

避免创建重复的RDD,尽量复用同一RDD,尽量避免使用shuffle类算子,优化数据结构,使用Hive ETL预处理数据,过滤少数导致倾斜的key,提高shuffle *** 作的并行度,两阶段聚合,将reduce join转为map join。

欢迎分享,转载请注明来源:内存溢出

原文地址: http://outofmemory.cn/zaji/4880731.html

(0)
打赏 微信扫一扫 微信扫一扫 支付宝扫一扫 支付宝扫一扫
上一篇 2022-11-11
下一篇 2022-11-11

发表评论

登录后才能评论

评论列表(0条)

保存