文章 2025-03-13 来自:开发者社区

Dataphin功能Tips系列(47)-支持通过Spark本地客户端提交Spark Batch任务

一、场景 原来的Spark Jar任务和PySpark任务提交,需要借助外部执行机器作为“跳板机”,这会产生以下问题: 单点故障风险,缺乏高可用性: 跳板机作为单一的连接点,一旦发生故障(如硬件故障、网络中断等),将导致整个Spark任务提交流程中断,无法实现高可用性。 资源分配集中,无法实现均衡负载: ...

Dataphin功能Tips系列(47)-支持通过Spark本地客户端提交Spark Batch任务
阿里云文档 2024-02-02

如何新建SparkBatch类型的公共节点

Spark Batch节点是离线节点,运行于Spark类型的云计算资源之上,可通过输入SQL语句处理Spark类型的数据源。本文介绍如何新建Spark Batch类型的公共节点。

阿里云文档 2023-11-21

如何新建SparkBatch类型的公共节点_云原生数据仓库 AnalyticDB PostgreSQL版(AnalyticDB for PostgreSQL)

Spark Batch节点是离线节点,运行于Spark类型的云计算资源之上,可通过输入SQL语句处理Spark类型的数据源。本文介绍如何新建Spark Batch类型的公共节点。

问答 2021-12-13 来自:开发者社区

处理 Spark Streaming 小文件的典型方法的增加 batch 大小是什么意思?

处理 Spark Streaming 小文件的典型方法的增加 batch 大小是什么意思?

问答 2019-01-15 来自:开发者社区

请教大家一个问题,spark stream连kafka,在web页面的stream标签,显示好多batch处于queued状态,这些batch是已经把数据从kafka读取进rdd,等待处理,还是还没有从kafka读取数进rdd?

请教大家一个问题,spark stream连kafka,在web页面的stream标签,显示好多batch处于queued状态,这些batch是已经把数据从kafka读取进rdd,等待处理,还是还没有从kafka读取数进rdd?

文章 2017-03-31 来自:开发者社区

Spark Streaming 不同Batch任务可以并行计算么?

关于Spark Streaming中的任务有如下几个概念: Batch Job Stage Task 其实Job,Stage,Task都是Spark Core里就有的概念,Batch则是Streaming特有的概念。同一Stage里的Task一般都是并行的。同一Job里的Stage可以并行,但是一般如果有依赖则是串行,可以参考我这篇文章Spark 多个Stage执行是串行执行的么?。 Job的.....

本页面内关键词为智能算法引擎基于机器学习所生成,如有任何问题,可在页面下方点击"联系我们"与我们沟通。

Apache Spark 中国技术社区

阿里巴巴开源大数据技术团队成立 Apache Spark 中国技术社区,定期推送精彩案例,问答区数个 Spark 技术同学每日在线答疑,只为营造 Spark 技术交流氛围,欢迎加入!

+关注