阿里云文档 2026-07-22

多模态大模型Pipeline构建:多模态数据处理与大模型训练实战指南

以LLaVa多模态数据集和Qwen2-VL-7B-Instruct模型为例,完成从数据准备、多模态模型预训练到服务部署的全流程。适用于图像描述、视觉问答等跨模态任务场景。

阿里云文档 2026-07-22

在Designer中将Pipeline部署为在线服务-人工智能平台 PAI-阿里云

Designer支持将一个包含数据预处理、特征工程、模型预测的离线数据处理pipeline,打包成一个Pipeline模型,并一键部署为EAS在线服务。

文章 2024-08-13 来自:开发者社区

【人工智能】Transformers之Pipeline(四):零样本音频分类(zero-shot-audio-classification)

一、引言 pipeline(管道)是huggingface transformers库中一种极简方式使用大模型推理的抽象,将所有大模型分为音频(Audio)、计算机视觉(Computer vision)、自然语言处理(NLP)、多模态(Multimodal)等4大类,28小类任务(tasks)。共计覆盖32万个模型 ...

【人工智能】Transformers之Pipeline(四):零样本音频分类(zero-shot-audio-classification)
文章 2024-08-13 来自:开发者社区

【人工智能】Transformers之Pipeline(三):文本转音频(text-to-audio/text-to-speech)

一、引言 pipeline(管道)是huggingface transformers库中一种极简方式使用大模型推理的抽象,将所有大模型分为音频(Audio)、计算机视觉(Computer vision)、自然语言处理(NLP)、多模态(Multimodal)等4大类,28小类任务(tasks),共计覆盖32万个模型。 ...

【人工智能】Transformers之Pipeline(三):文本转音频(text-to-audio/text-to-speech)
文章 2024-08-13 来自:开发者社区

【人工智能】Transformers之Pipeline(一):音频分类(audio-classification)

一、引言 pipeline(管道)是huggingface transformers库中一种极简方式使用大模型推理的抽象,将所有大模型分为音频(Audio)、计算机视觉(Computer vision)、自然语言处理(NLP)、多模态(Multimodal)等4大类,28小类任务(tasks)。共计覆盖32万个模型 ...

【人工智能】Transformers之Pipeline(一):音频分类(audio-classification)

本页面内关键词为智能算法引擎基于机器学习所生成,如有任何问题,可在页面下方点击"联系我们"与我们沟通。

产品推荐