阿里云文档 2026-02-04

在PyODPS节点引用第三方包

当标准的PyODPS功能无法满足复杂的业务需求时,开发者需要复用已有的Python代码逻辑,或利用开源库来完成任务。为此,DataWorks 提供两种核心方案:通过资源引用灵活加载自定义脚本,或通过配置执行环境(如自定义镜像、运维助手)来集成功能强大的第三方包。本文介绍如何在DataWorks的PyODPS节点中调用自定义Python脚本或安装并使用开源第三方包,以扩展数据处理能力。

阿里云文档 2026-02-04

大模型数据处理节点

在传统的数据工作流中,处理像用户评论、产品描述、客服日志等非结构化文本数据一直是一项挑战。您现在可以直接在DataWorks的工作流中,利用强大的大语言模型(LLM)能力,通过自然语言指令,轻松完成文本摘要、情感分析、内容分类、信息提取等复杂的AI任务。这极大地简化数据处理流程,让数据工程师和分析师无需编写复杂的算法,即可将AI能力无缝集成到现有的ETL(数据抽取、转换、加载)链路中。

阿里云文档 2025-10-28

在节点、个人开发环境中使用数据集

在节点(Shell节点、Python节点、Notebook节点)中使用数据集,以便在数据开发过程中读写NAS或OSS存储中的数据。也可以在创建个人开发环境时,将数据集作为个人开发环境实例的存储。

问答 2025-09-10 来自:开发者社区

DataWorks 运行spark节点,程序logger日志无法展示

1.代码中没有创建sparksession时,可以在spark日志页面看到(也可以在控制台看到日志输出),但是会报错未初始化spark任务; 2.创建sparksession后,不展示前面的日志了,只可以在控制台中的日志链接中看,如下:不展示info级别日志,并且上面图1的warn和err日志也没有了(创建sparksession之前的日志输出没有了)

阿里云文档 2025-07-15

数据推送节点

数据推送节点可将Data Studio业务流程中其他节点产生的数据查询结果,通过新建数据推送目标,将数据推送至钉钉群、飞书群、企业微信群、Teams以及邮件,便于团队成员及时接收和关注最新数据情况。

阿里云文档 2025-06-13

PAI Flow的配置与运维

PAI Flow提供端到端机器学习流程开发能力,可实现与人工智能平台 PAI 的可视化建模 Desiger相同的工作流功能,并能周期性调度工作流。

文章 2025-05-27 来自:开发者社区

使用DataWorks PyODPS节点调用XGBoost算法

摘要 本文演示如何在DataWorks中通过PyODPS3类型节点调用XGBoost算法实现模型训练与测试,进而实现算法的周期离线调度。 操作步骤 1、ODPS SQL构建数据集 -- 创建表 CREATE TABLE IF NOT EXISTS xgboost_...

使用DataWorks PyODPS节点调用XGBoost算法
文章 2024-11-02 来自:开发者社区

"DataWorks高级技巧揭秘:手把手教你如何在PyODPS节点中将模型一键写入OSS,实现数据处理的完美闭环!"

DataWorks是一款面向企业的云数据开发管理平台,它提供了强大的数据处理和分析能力。在使用DataWorks进行数据处理时,PyODPS节点是一个常用的工具,它允许用户通过编写Python代码来执行ODPS(Open Data Processing Service)任务。而当我们在DataWorks中训练好模型后ÿ...

问答 2024-09-26 来自:开发者社区

Dataworks 里的 ODPS spark 节点访问不到 maxcompute 里的表

Dataworks 里的 ODPS spark 节点访问不到 maxcompute 里的表,show tables 结果是空的

文章 2024-09-18 来自:开发者社区

dataworks节点任务

DataWorks(又称为大数据开发套件或DatalDE)是阿里云提供的一款用于数据集成、数据处理、数据分析等操作的一站式开发工具。在DataWorks中,用户可以创建数据处理流程,并通过“节点”来表示这些流程中的各个步骤或任务。每个节点通常代表一个具体的操作,比如数据抽取、转换、加载(ETL)、脚...

本页面内关键词为智能算法引擎基于机器学习所生成,如有任何问题,可在页面下方点击"联系我们"与我们沟通。

大数据开发治理平台 DataWorks更多节点相关

产品推荐

DataWorks

DataWorks基于MaxCompute/Hologres/EMR/CDP等大数据引擎,为数据仓库/数据湖/湖仓一体等解决方案提供统一的全链路大数据开发治理平台。作为阿里巴巴数据中台的建设者,DataWorks从2009年起不断沉淀阿里巴巴大数据建设方法论,同时与数万名政务/金融/零售/互联网/能源/制造等客户携手,助力产业数字化升级。

+关注