文章 2023-09-13 来自:开发者社区

AnalyticDB MySQL — Spark 助力在OSS上构建低成本数据湖

【先打一波小广告】阿里云AnalyticDB MySQL升级为湖仓一体架构,支持高吞吐离线处理和高性能在线分析,可无缝替换CDH/TDH/Databricks/Presto/Spark/Hive等。1.目前湖仓版开放了线上训练营,参加实验免费赢耳机/充电宝/卫衣等好礼,报名链接:https://developer.aliyun.com/trainingcamp/e30b5d96a3e740f5a....

AnalyticDB MySQL — Spark 助力在OSS上构建低成本数据湖
文章 2023-08-24 来自:开发者社区

AnalyticDB MySQL Spark 助力在OSS上构建低成本数据湖

前言随着互联网的发展,数据量的爆炸式增长已经成为明显趋势。在这种情况下,企业、政府等各种机构都面临着如何存储,管理和分析庞大的数据量的问题。阿里云对象存储OSS(Object Storage Service)是阿里云提供的海量、安全、低成本、高可靠的云存储服务。OSS对象存储采用一系列的索引和存储技术,可以将数据存储在廉价的存储设备上,从而大大降低数据存储成本。对象存储扁平命名空间的特性也让数据....

AnalyticDB MySQL Spark 助力在OSS上构建低成本数据湖
问答 2023-07-17 来自:开发者社区

大数据计算MaxCompute中maxcompute spark如何读取 oss 上面的文件?

大数据计算MaxCompute中maxcompute spark如何读取 oss 上面的文件?

问答 2023-05-21 来自:开发者社区

dataworks里面执行spark sql, 报没有oss 403权限问题。 但是,配置的?

dataworks里面执行spark sql, 报没有oss 403权限问题。 但是,配置的oss数据源已经又对应bucket完全控制权限? bucket授权是完全控制

问答 2023-03-21 来自:开发者社区

请问下 spark怎么连oss,读取oss里的csv呢?

请问下 spark怎么连oss,读取oss里的csv呢?

问答 2023-02-06 来自:开发者社区

DMS按照文档,加了Spark SQL任务将数据同步到OSS,执行失败,但是没有任何报错,为什么?

DMS这边按照文档,加了Spark SQL任务将数据同步到OSS,最终是执行失败了,但是没有任何报错,麻烦帮看下是什么原因? 我的sql:CREATE TABLE oss.fulu_push_order ( service_order_id string COMMENT '订单', pid string COMMENT '父订单', root_pid string COMM...

问答 2023-02-06 来自:开发者社区

DMS任务编排跨库Spark SQL节点是否支持将数据导出到OSS单个文件?

DMS任务编排跨库Spark SQL节点是否支持将数据导出到OSS单个文件?

问答 2022-12-12 来自:开发者社区

如何在EMR Hive或Spark中访问OSS-HDFS

如何在EMR Hive或Spark中访问OSS-HDFS

文章 2022-09-16 来自:开发者社区

Spark读取阿里云OSS指定目录下文件名写入Maxcomputer

1.概述最近刚好有个需求,需要将阿里云对象存储OSS里的视频文件名称拿出来,以便数仓这边输出使用。其实方法有很多Java、Python都可以使用,因本人使用阿里云DataWorks+Maxcomputer,且Maxcomputer可以直接使用ODPS Spark,所以这里采用Spark读取2.实现1.通过IntelliJ IDEA工具首先先创建一个工程,这里就不详细展开怎么创建了;导入需要的依赖....

问答 2022-07-22 来自:开发者社区

我提交spark作业的时候,如果我不想每次都打spark镜像,而是我把jar包放到oss上,然后能在

我提交spark作业的时候,如果我不想每次都打spark镜像,而是我把jar包放到oss上,然后能在作业pod启动时,把jar包传到作业所在的pod里面的去,这个应该怎么做呢?

本页面内关键词为智能算法引擎基于机器学习所生成,如有任何问题,可在页面下方点击"联系我们"与我们沟通。

Apache Spark 中国技术社区

阿里巴巴开源大数据技术团队成立 Apache Spark 中国技术社区,定期推送精彩案例,问答区数个 Spark 技术同学每日在线答疑,只为营造 Spark 技术交流氛围,欢迎加入!

+关注