文章 2024-11-04 来自:开发者社区

Apache Spark & Paimon Meetup · 北京站,助力 LakeHouse 架构生产落地

众所周知,LakeHouse 架构是当前大数据领域领先的技术架构之一。LakeHouse 由海外知名大数据公司 Databricks 提出,旨在融合数据湖的灵活性及成本效益与传统数据仓库的强大事务支持、高性能分析能力于一体,并且能够无缝集成机器学习等多种应用场景,为企业提供了更加全面的数据管理和分析平台。 Apache Spark 作为近十几年来大数据领域最优秀的开源项目之一,...

Apache Spark & Paimon Meetup · 北京站,助力 LakeHouse 架构生产落地
文章 2022-06-13 来自:开发者社区

spark在生产中是否要禁止掉BHJ(BroadcastHashJoin)

背景本文基于spark 3.2driver内存 2G问题描述在基于复杂的sql运行中,或者说是存在多个join操作的sql中,如果说driver内存不是很大的情况下,我们经常会遇到如下报错:Caused by: org.apache.spark.SparkException: Could not execute broadcast in 800 secs. You can increase th....

spark在生产中是否要禁止掉BHJ(BroadcastHashJoin)
文章 2022-02-15 来自:开发者社区

【Spark Summit East 2017】Spark中的容错:从生产实践中获取的经验

更多精彩内容参见云栖社区大数据频道https://yq.aliyun.com/big-data;此外,通过Maxcompute及其配套产品,低廉的大数据分析仅需几步,详情访问https://www.aliyun.com/product/odps。 本讲义出自Jose Soltren在Spark Summit East 2017上的演讲,主要介绍了Spark容错中的螺母和螺栓,他首先简述了Sp...

问答 2022-02-15 来自:开发者社区

spark.storage.memoryFraction参数是什么,实际生产中如何调优?

spark.storage.memoryFraction参数是什么,实际生产中如何调优?

问答 2022-02-15 来自:开发者社区

spark.default.parallelism是什么,实际生产中如何设置?

spark.default.parallelism是什么,实际生产中如何设置?

问答 2022-02-15 来自:开发者社区

spark.storage.memoryFraction参数的含义,实际生产中如何调优?

spark.storage.memoryFraction参数的含义,实际生产中如何调优?

问答 2022-02-15 来自:开发者社区

spark.default.parallelism这个参数有什么意义,实际生产中如何设置?

spark.default.parallelism这个参数有什么意义,实际生产中如何设置?

问答 2022-02-15 来自:开发者社区

请问Flink on Yarn的模式是否需要部署Flink 集群?个人理解下来,Flink on Yarn会从启动session的节点上传jar和配置文件,但是每次想到spark on yarn部署了集群心里总是不安。还请在生产中使用Flink的前辈确认一下,谢谢!

转自钉钉群21789141:Flink on Yarn的模式是否需要部署Flink 集群?个人理解下来,Flink on Yarn会从启动session的节点上传jar和配置文件,但是每次想到spark on yarn部署了集群心里总是不安。还请在生产中使用Flink的前辈确认一下,谢谢!

本页面内关键词为智能算法引擎基于机器学习所生成,如有任何问题,可在页面下方点击"联系我们"与我们沟通。

Apache Spark 中国技术社区

阿里巴巴开源大数据技术团队成立 Apache Spark 中国技术社区,定期推送精彩案例,问答区数个 Spark 技术同学每日在线答疑,只为营造 Spark 技术交流氛围,欢迎加入!

+关注