阿里自研 AI 模型有哪些?文本、图像视频、语音、向量全品类模型清单

简介: 阿里云自研AI模型涵盖文本、图像、视频、语音及全模态,核心为通义千问Qwen系列(如Qwen3.8-Max/Flash、Qwen-VL、Qwen-Image等),另有通义法睿、万相、CosyVoice等垂直模型,统一通过百炼平台提供API服务。

阿里云自研AI模型有哪些?最知名的就是通义千问Qwen系列大模型,阿里云是通过百炼AI模型平台对外提供API调用服务,阿里自研模型涉及文本、图像、视频、语音及全模态等多种类型。以下是阿小云根据现有资料整理的阿里云自研模型清单大全,更多模型及收费价格查询 💰 阿里云百炼AI模型平台 的模型广场中可以查询,如下图:


文本生成与理解

  • Qwen3.8-Max:旗舰文本模型,适用于智能体及复杂推理任务。
  • Qwen3.8-Flash:支持百万级上下文窗口,适用于超长文档和代码仓库处理。
  • Qwen3.7-Plus:通用文本生成模型。
  • Qwen-Long:专为超长文档或多文档的阅读理解、总结与信息提取设计。
  • 通义法睿:专注法律领域的行业模型,适用于法律咨询、案例分析及合同审查。


视觉理解与多模态

  • Qwen3-VL-Plus:视觉语言模型,支持视觉 Coding、空间感知及多模态思考。
  • Qwen3.8-Omni-Flash / Realtime:全模态模型,融合文本、图像、音频、视频的理解与生成能力,支持实时音视频对话。
  • Qwen-VL / QVQ / Qwen-OCR:适用于 OCR、图像内容描述、图像问答及视觉推理场景。


图像与视频生成

  • Qwen-Image-3.0-Pro:图像生成模型,注重细节真实性与知识准确性。
  • Wan3.0-Video / Wan2.7-Image-Pro:视频与图像生成模型,支持四模态全能参考及多种创作模式。
  • 通义万相:支持文生图、图生图、涂鸦作画、图像背景生成及AI试穿等功能。
  • HappyHorse 系列:包含 HappyHorse-1.1-T2V/I2V/R2V 及 1.0-Video-Edit,适用于文字生成视频、图生视频及视频编辑。
  • 悦动人像 EMO / 舞动人像 AnimateAnyone:分别用于基于肖像生成数字人视频和基于图像生成舞蹈视频。


语音与音频

  • Qwen3-TTS-Flash / Qwen-Audio-3.0-TTS-Plus:语音合成模型,支持多语言方言自适应及低延迟输出。
  • CosyVoice-V3-Flash:高表现力语音合成模型,支持语音克隆。
  • Fun-ASR / Qwen-Audio-3.1-ASR-Flash:语音识别模型,支持中英文自由切换及流式/文件转写。
  • Fun-Music-v1:根据提示词或歌词生成音乐。
  • Qwen-Audio-3.1-Realtime-Plus / Qwen3.5-Omni-Plus:端到端语音对话模型,无需分别调用 ASR 和 TTS。


向量、重排序与决策

  • Qwen3.7-Text-Embedding / Flash / VL-Embedding:文本及图文向量化模型。
  • Qwen3.7-Text-Rerank:文本重排序模型,配合向量检索提升精度。
  • Decision-Model-Preview:面向高频业务判断的结构化决策模型。


随着时间推移,以上模型会持续更新也可能会新增模型,请以阿里云百炼官网为准,目前在百炼官网还可以领取超7000万的Tokens免费额度,更多可用模型及最新版本请以百炼控制台模型广场实时显示为准。

相关文章
|
12天前
|
人工智能 JSON API
全网刷屏的 Jev 模型正式开放!一手实战测评 + 保姆级教程
全网爆火的 Jev 模型是什么?有什么用?怎么使用?怎么接入 AI 编程工具?效果真的好么?傻子可懂的 Jev 保姆级实战教程 + 项目实战测评来啦
7926 15
|
10天前
|
人工智能 测试技术 API
最近全网爆火的 Jev 到底是什么?适合干什么、怎么用,一篇讲透!
Jev是TypeSafe AI推出的“系统一模型”,不生成文本,专做毫秒级结构化决策:Choice(多选)、Score(打分)、Noul(是非概率)。响应快193倍、成本低444倍,适合工单路由、内容审核、测试定级等高频判断场景。
1737 4
最近全网爆火的 Jev 到底是什么?适合干什么、怎么用,一篇讲透!
|
11天前
|
人工智能 并行计算 PyTorch
秋叶 ComfyUI 2026 整合包 v3.2 完整部署教程:Python 3.13 + Torch 2.13 全栈升级
秋叶aaaki ComfyUI 2026年8月整合包v3.2正式发布!全面升级Python 3.13.11、PyTorch 2.13.0+cu130及ComfyUI v0.30.2,原生支持MiniMax H3、Wan 2.2、Qwen-Image-2.1等2026主流音视频/图像模型,解压即用,无需环境配置。
1734 11
|
9天前
|
人工智能 编解码 并行计算
MiniMax-H3 一键整合包技术文档:8G 显存运行 AI 漫剧制作 —— 角色替换 / 动作迁移 / 文图生视频部署与调参指南
MiniMax H3 是 MiniMax 开源的全模态视频生成模型,支持文/图/音/视多条件输入,输出最高2K、15秒带双声道音频视频。本文档详述其Int8量化版在8GB显存下的本地一键部署、三段式工作流(EDIT/REPLACE/CONTINUE)、参数调优及常见问题排查。(239字)
|
24天前
|
人工智能 自然语言处理 安全
阿里云千问办公 QwenWork详细介绍:产品核心能力、典型场景、价格及常见问题解答
千问办公是阿里云推出的一站式AI办公平台,主打"不止于对话,更注重交付",依托通义千问旗舰大模型,用户一句话即可完成数据分析、PPT生成、视频剪辑等复杂任务,直接输出可用成果。产品深度打通钉钉生态与企业OA,覆盖桌面端、网页端,提供企业标准版198元/人/月等多档订阅方案,新用户注册即赠2000积分,适配工程师、HR、财务等多职业办公场景,成为能动手干活的"全能AI同事"。
3789 10
|
19天前
|
缓存 IDE Java
【保姆级】Android Studio下载、安装和汉化教程(2026最新)
Android Studio 是 Google 官方推出的免费 Android 应用开发集成环境,基于 IntelliJ IDEA,内置模拟器、调试器、性能分析及 Compose 界面工具,功能全面,文档丰富,是安卓开发首选工具。(239字)
1990 1