阿里云文档 2025-03-21

使用Hadoop命令操作OSS/OSS-HDFS

在使用阿里云EMR Serverless Spark的Notebook时,您可以通过Hadoop命令直接访问OSS或OSS-HDFS数据源。本文将详细介绍如何通过Hadoop命令操作OSS/OSS-HDFS。

阿里云文档 2025-03-14

2025-03-03版本说明

本文为您介绍2025年03月03日发布的EMR Serverless Spark的功能变更。

阿里云文档 2025-03-07

包年包月

包年包月是一种预付费计费方式,在购买时需根据所选时长预先支付费用,EMR Serverless Spark 会按照您购买的时长,严格计算计费周期的价格。

阿里云文档 2025-02-27

退订说明

计算资源抵扣包和工作空间的包年包月配额是根据购买时长预先支付的费用,如果不需要使用可以申请退款。本文将为您介绍退订相关的规则及操作流程。

阿里云文档 2025-02-27

续费说明

包年包月的配额到期后,工作空间内提交至包年包月付费类型队列的任务将停止运行。如需继续使用,请及时对包年包月配额进行续费操作。本文将为您介绍续费的具体步骤。

文章 2022-02-17 来自:开发者社区

EMR Spark Runtime Filter性能优化 | 7月5号云栖夜读

点击订阅云栖夜读日刊,专业的技术干货,不容错过! 阿里专家原创好文 1.EMR Spark Runtime Filter性能优化 Join是一个非常耗费资源耗费时间的操作,特别是数据量很大的情况下。一般流程上会涉及底层表的扫描/shuffle/Join等过程, 如果我们能够尽可能的在靠近源头上减少参与计算的数据,一方面可以提高查询性能,另一方面也可以减少资源的消耗(网络/IO/CPU等),在同样....

文章 2022-02-17 来自:开发者社区

使用EMR Spark Relational Cache跨集群同步数据 | 6月6号云栖夜读

点击订阅云栖夜读日刊,专业的技术干货,不容错过! 阿里专家原创好文 1.使用EMR Spark Relational Cache跨集群同步数据 Relational Cache是EMR Spark支持的一个重要特性,主要通过对数据进行预组织和预计算加速数据分析,提供了类似传统数据仓库物化视图的功能。除了用于提升数据处理速度,Relational Cache还可以应用于其他很多场景,本文主要介绍如....

本页面内关键词为智能算法引擎基于机器学习所生成,如有任何问题,可在页面下方点击"联系我们"与我们沟通。

Apache Spark 中国技术社区

阿里巴巴开源大数据技术团队成立 Apache Spark 中国技术社区,定期推送精彩案例,问答区数个 Spark 技术同学每日在线答疑,只为营造 Spark 技术交流氛围,欢迎加入!

+关注