阿里云文档 2025-01-09

部署DeepSeek-V3模型

DeepSeek-V3是由DeepSeek推出的一款拥有6710亿参数的专家混合(MoE)大语言模型。在多个评测中,该模型的表现优异,超越了众多开源竞品模型。本文为您介绍如何在Model Gallery中部署该模型。

阿里云文档 2025-01-08

PAI-Rec 模型部署到PAI-EAS

模型部署到PAI-EAS介绍完成补数据和模型训练以后,下一步是将模型部署到PAI-EAS,进行线上打分。操作指南在DataWorks中找到部署脚本点击解锁,进行修改脚本将最后一行代码注释,倒数第二行代码取消注释。倒数第二行是创建PAI-EAS服务的命令,最后一行是更新模型的命令。第一次执行需要执行创...

阿里云文档 2024-12-03

Llama-3模型部署与微调

Llama-3是Meta AI推出的开源大语言模型系列(接近GPT-4级别)。该系列模型利用超过15万亿Token的公开数据进行预训练,提供Base和Instruct等多版本、多规模的开源模型,从而满足不同的计算需求。PAI已对该系列模型进行全面支持,本文以Meta-Llama-3-8B-Instruct模型为例为您介绍如何在Model Gallery中部署和微调该系列模型。

阿里云文档 2024-11-20

通义千问1.5模型部署与微调

通义千问1.5(qwen1.5)是阿里云研发的通义千问系列开源大模型。该系列包括Base和Chat等多版本、多规模的开源模型,从而满足不同的计算需求。PAI已对该系列模型进行全面支持,本文以通义千问1.5-7B-Chat模型为例为您介绍如何在Model Gallery中部署和微调该系列模型。

阿里云文档 2024-11-15

大语言模型数据增强与模型蒸馏解决方案

大语言模型的训练和推理过程存在高能耗及长响应时间等问题,这些问题限制了其在资源有限场景中使用。为了解决这些问题,PAI提出了模型蒸馏功能。该功能支持将大模型知识迁移到较小模型,从而在保留大部分性能的同时,大幅降低模型的规模和对计算资源的需求,为更多的实际应用场景提供支持。本文将以通义千问2(Qwen2)大语言模型为基础,为您介绍大语言模型数据增强和蒸馏解决方案的完整开发流程。

问答 2024-06-03 来自:开发者社区

机器学习PAI有没有方法仅加载已知模型的embedding参数,上层再训练一个模型去更新参数啊?

机器学习PAI有没有方法仅加载已知模型的embedding参数,上层再训练一个模型去更新参数啊?然后底层embedding就不更新了。想通过这种方式迁移学习

问答 2023-12-10 来自:开发者社区

机器学习PAI 72b不是要a100么,pai难道有?

机器学习PAI中72b模型不是要a100么, 难道能直接给出不同参数的同义么?推理qps10,一个月的价格么

问答 2023-08-27 来自:开发者社区

机器学习PAI Ps训练出的模型,启动的时候需要在读取参数服务器配置么,这个又什么说明文档可以学习?

机器学习PAI Ps训练出的模型,启动的时候需要在读取参数服务器配置么,这个又什么说明文档可以学习一下么?

问答 2023-06-28 来自:开发者社区

机器学习PAI中batch模型的参数 需要与fine-tune 保持一致吗?

机器学习PAI中batch模型的lr、decay_steps、decay_factor等参数 需要与fine-tune 保持一致吗?

问答 2023-05-01 来自:开发者社区

你好,麻烦问下机器学习PAI-命令方式训练LR模型,在哪可以查询LR模型训练好的参数呢 PAI -n

你好,麻烦问下机器学习PAI-命令方式训练LR模型,在哪可以查询LR模型训练好的参数呢 PAI -name logisticregression_binary -project algo_public -DmodelName="xlab_m_logistic_regression_6096" -DregularizedLevel="1" -DmaxIter="100" -Dregularized....

本页面内关键词为智能算法引擎基于机器学习所生成,如有任何问题,可在页面下方点击"联系我们"与我们沟通。

产品推荐

人工智能平台PAI

人工智能平台 PAI(Platform for AI,原机器学习平台PAI)是面向开发者和企业的机器学习/深度学习工程平台,提供包含数据标注、模型构建、模型训练、模型部署、推理优化在内的AI开发全链路服务,内置140+种优化算法,具备丰富的行业场景插件,为用户提供低门槛、高性能的云原生AI工程化能力。

+关注