阿里云文档 2026-03-26

文字识别模型qwen-vl-ocr如何使用

千问OCR 是专用于文字提取的视觉理解模型,可从各类图像(如扫描文档、表格、票据等)中提取文本或解析结构化数据,支持识别多种语言,并能通过特定任务指令实现信息抽取、表格解析、公式识别等高级功能。

阿里云文档 2025-12-23

使用CreateModelAsyncPredict API创建模型异步预测任务-文字识别-阿里云

文档自学习创建异步预测任务接口。

阿里云文档 2025-12-23

通过GetModelAsyncPredict获取模型异步预测结果-文字识别-阿里云

模型预测分为三种类型:长文档信息抽取、单票据信息抽取、表格信息抽取。

文章 2025-03-20 来自:开发者社区

SmolDocling:256M多模态小模型秒转文档!开源OCR效率提升10倍

❤️ 如果你也关注 AI 的发展现状,且对 AI 应用开发感兴趣,我会每日分享大模型与 AI 领域的开源项目和应用,提供运行实例和实用教程,帮助你快速上手AI技术! AI 在线答疑 -> 智能检索历史文章和开源项目 -> 丰富的 AI 工具库 -> 每日更新 -> 尽在微信公众号 -> 搜一搜:蚝油菜花 "学术狗集体泪目!这个AI把论文截图秒变Markdow...

SmolDocling:256M多模态小模型秒转文档!开源OCR效率提升10倍
文章 2025-01-21 来自:开发者社区

moonshot-v1-vision-preview:月之暗面Kimi推出多模态视觉理解模型,支持图像识别、OCR文字识别、数据提取

❤️ 如果你也关注 AI 的发展现状,且对 AI 应用开发非常感兴趣,我会每日分享大模型与 AI 领域的最新开源项目和应用,提供运行实例和实用教程,帮助你快速上手AI技术,欢迎关注我哦! 微信公众号|搜一搜:蚝油菜花 快速阅读 功能:支持图像识别、OCR文字识别、图像数据提取与分析。 技术:基于API调用,支持多轮对话、流式输出等特性。 应用:适用于内容审核、文档处理、医学影像分...

moonshot-v1-vision-preview:月之暗面Kimi推出多模态视觉理解模型,支持图像识别、OCR文字识别、数据提取

本页面内关键词为智能算法引擎基于机器学习所生成,如有任何问题,可在页面下方点击"联系我们"与我们沟通。

产品推荐