阿里云文档 2025-04-14

通过spark-submit提交任务

本文以ECS连接EMR Serverless Spark为例,介绍如何通过EMR Serverless spark-submit命令行工具进行Spark任务开发。

阿里云文档 2025-04-10

提交PySpark流任务

在大数据快速发展的时代,流式处理技术对于实时数据分析至关重要。EMR Serverless Spark提供了一个强大而可扩展的平台,它不仅简化了实时数据处理流程,还免去了服务器管理的烦恼,提升了效率。本文将指导您使用EMR Serverless Spark提交PySpark流式任务,展示其在流处理方面的易用性和可运维性。

阿里云文档 2025-04-09

快速上手Spark Submit开发

EMR Serverless Spark兼容spark-submit命令行参数,简化了任务执行流程。本文通过一个示例,为您演示如何进行Spark Submit开发,确保您能够快速上手。

阿里云文档 2025-04-09

PySpark批任务开发入门

您可以自行编写并构建包含业务逻辑的Python脚本,上传该脚本后,即可便捷地进行PySpark开发。本文通过一个示例,为您演示如何进行PySpark开发。

阿里云文档 2025-02-25

SparkSQL任务快速入门

EMR Serverless Spark支持通过SQL代码编辑和运行任务。本文带您快速体验SQL的创建、启动和运维等操作。

文章 2022-05-17 来自:开发者社区

Spark从入门到入土(二):任务提交(下)

1:用户程序启动(SparkLauncher,非驱动程序)时会在当前节点上启动一个SparkSubmit进程,并将驱动程序(即spark任务)发送到任意一个工作节点上,在工作节点上启动DriverWrapper进程2:驱动程序会从集群管理器(standalone模式下是master服务器)申请执行器资源3:集群管理器反馈执行器资源给驱动器4:驱动器Driver将任务发送到执行器节点执行spark....

Spark从入门到入土(二):任务提交(下)
文章 2022-05-17 来自:开发者社区

Spark从入门到入土(二):任务提交(上)

spark任务提交有三种方式1:通过local方式提交2:通过spark-submit脚本提交到集群3:通过spark提交的API SparkLauncher提交到集群,这种方式可以将提交过程集成到我们的spring工程中,更加灵活先来看一下spark架构,可以帮助理解任务的提交任务提交驱动程序:执行应用程序main方法的进程集群管理器:启动执行器节点,有Mesos、YARN(Hadoop)、独....

Spark从入门到入土(二):任务提交(上)

本页面内关键词为智能算法引擎基于机器学习所生成,如有任何问题,可在页面下方点击"联系我们"与我们沟通。

Apache Spark 中国技术社区

阿里巴巴开源大数据技术团队成立 Apache Spark 中国技术社区,定期推送精彩案例,问答区数个 Spark 技术同学每日在线答疑,只为营造 Spark 技术交流氛围,欢迎加入!

+关注