阿里云百炼自研大模型手册:Qwen、万相、HappyHorse、CosyVoice 能力梳理

简介: 阿里云自研AI模型涵盖文本、视觉、语音、音视频及向量等全模态,以通义千问Qwen系列为核心,包括Qwen3.8-Max、Qwen-VL、通义万相、CosyVoice等,均通过百炼平台提供API服务。

阿里云自研AI模型有哪些?最知名的就是通义千问Qwen系列大模型,阿里云是通过百炼AI模型平台对外提供API调用服务,阿里自研模型涉及文本、图像、视频、语音及全模态等多种类型。以下是阿小云根据现有资料整理的阿里云自研模型清单大全,更多模型及收费价格查询 💰 阿里云百炼AI模型平台 的模型广场中可以查询,如下图:


文本生成与理解

  • Qwen3.8-Max:旗舰文本模型,适用于智能体及复杂推理任务。
  • Qwen3.8-Flash:支持百万级上下文窗口,适用于超长文档和代码仓库处理。
  • Qwen3.7-Plus:通用文本生成模型。
  • Qwen-Long:专为超长文档或多文档的阅读理解、总结与信息提取设计。
  • 通义法睿:专注法律领域的行业模型,适用于法律咨询、案例分析及合同审查。


视觉理解与多模态

  • Qwen3-VL-Plus:视觉语言模型,支持视觉 Coding、空间感知及多模态思考。
  • Qwen3.8-Omni-Flash / Realtime:全模态模型,融合文本、图像、音频、视频的理解与生成能力,支持实时音视频对话。
  • Qwen-VL / QVQ / Qwen-OCR:适用于 OCR、图像内容描述、图像问答及视觉推理场景。


图像与视频生成

  • Qwen-Image-3.0-Pro:图像生成模型,注重细节真实性与知识准确性。
  • Wan3.0-Video / Wan2.7-Image-Pro:视频与图像生成模型,支持四模态全能参考及多种创作模式。
  • 通义万相:支持文生图、图生图、涂鸦作画、图像背景生成及AI试穿等功能。
  • HappyHorse 系列:包含 HappyHorse-1.1-T2V/I2V/R2V 及 1.0-Video-Edit,适用于文字生成视频、图生视频及视频编辑。
  • 悦动人像 EMO / 舞动人像 AnimateAnyone:分别用于基于肖像生成数字人视频和基于图像生成舞蹈视频。


语音与音频

  • Qwen3-TTS-Flash / Qwen-Audio-3.0-TTS-Plus:语音合成模型,支持多语言方言自适应及低延迟输出。
  • CosyVoice-V3-Flash:高表现力语音合成模型,支持语音克隆。
  • Fun-ASR / Qwen-Audio-3.1-ASR-Flash:语音识别模型,支持中英文自由切换及流式/文件转写。
  • Fun-Music-v1:根据提示词或歌词生成音乐。
  • Qwen-Audio-3.1-Realtime-Plus / Qwen3.5-Omni-Plus:端到端语音对话模型,无需分别调用 ASR 和 TTS。


向量、重排序与决策

  • Qwen3.7-Text-Embedding / Flash / VL-Embedding:文本及图文向量化模型。
  • Qwen3.7-Text-Rerank:文本重排序模型,配合向量检索提升精度。
  • Decision-Model-Preview:面向高频业务判断的结构化决策模型。


随着时间推移,以上模型会持续更新也可能会新增模型,请以阿里云百炼官网为准,目前在百炼官网还可以领取超7000万的Tokens免费额度,更多可用模型及最新版本请以百炼控制台模型广场实时显示为准。

相关文章
|
9月前
|
弹性计算 运维 安全
轻量 vs ECS:阿里云轻量应用服务器与ECS云服务器有什么区别?2026最新手动整理
阿里云轻量应用服务器适合个人开发者、学生搭建博客、测试环境等轻量场景,操作简单、成本低;ECS功能全面、弹性强,支持高并发、集群部署,适合企业级应用。选型关键看业务规模与技术需求。
470 4
|
1天前
|
人工智能 开发者
阿里云Token Plan个人版:四个版本区别对比、费用价格、Credits计费用量及问题解答FAQ
阿里云Token Plan个人版含Lite/ Essential/Standard/Pro四档:Lite(¥39,1.15万Credits)适合轻量使用;Essential(¥79)用量翻倍;Standard(¥139,推荐)起赠Harness权益;Pro(¥499)适配高并发与海量调用。权益、额度、并发数逐级提升,详见官网。
|
1天前
|
弹性计算 固态存储
阿里云服务器8核16G配置ECS实例规格族、收费标准及2026最新价格参考
本文详解阿里云8核16G云服务器ECS的2026年最新价格,涵盖经济型e、计算型c9i、通用型u2a等多规格族的按小时/月/年/3年/5年计费标准,并说明公网带宽与系统盘(ESSD等)费用组成。阿里云服务器ECS官网:https://t.aliyun.com/U/AZBUsA
|
1天前
|
运维 Kubernetes 数据安全/隐私保护
K8s 劝退?那是你打开方式不对
本文用大白话讲透K8s核心逻辑:从“手动运维”到“声明式自治”的思维跃迁,结合Pod、Deployment、Service等概念,直击传统运维痛点。通过真实故障对比,展现K8s如何自动恢复服务——你只定义目标,它负责执行与兜底。(239字)
26 1
|
7月前
|
人工智能 API
OpenClaw 必看:阿里云AI节省计划和Coding Plan哪个更省钱?有啥区别?
OpenClaw用户必看:阿里云AI入门型节省计划(预付每小时最低消费,折扣抵扣,不可退订)与百炼Coding Plan(月付固定额度,按Token/调用计费,超量停用,限指定模型)核心差异在于计费逻辑、适用范围与成本控制方式。轻量部署推荐Coding Plan,更省钱可控。
1121 2
|
1天前
|
人工智能 弹性计算 自然语言处理
阿里云万小智 AI 建站标准版与高级版有什么区别?版本选购对比分析
阿里云万小智标准版(980元/年)与高级版(1980元/年)均支持AI建站、多语言、源码下载及安全防护;差异在于:高级版提供10G数据库(标准版1G)、100G创意存储(标准版10G)、明确2核2G+50M带宽ECS、3个备案码、不限邮件+自接短信、三倍AI灵感值,适合中高负载业务。
|
1天前
|
存储 缓存 C++
0.8MB 跑通 Qwen|第 9-1 篇:推理引擎的 KV 也量化——q8 KV 把缓存与 decode 带宽压到一半
本系列手搓零依赖纯C推理引擎,仅0.8MB即可在RK3588上跑通Qwen3-VL多模型。本文详解q8 KV量化:将f16 KV压至INT8,按token每头独立定标,缓存与decode带宽降低约48%,兼顾精度与效率,f32仅作调试探针。
|
1天前
|
C++
0.8MB 跑通 Qwen|第 10-3 篇:推理引擎里诚实的坑——哪些场景稀疏无收益,甚至负优化
本篇实测揭示稀疏注意力的真相:短上下文(<1K)开`--sparse-attn`反成负优化!RK3588板端验证,详列8条“禁用清单”,每条附源码行号与实测数据。明确边界:q4 KV、推测解码、L3驱逐等均与稀疏互斥,并坦承`test-sparse`自检崩溃缺陷。(239字)
|
1天前
|
API 调度 C++
0.8MB 跑通 Qwen|第 14-1 篇:大模型推理的连续批处理——iteration-level 调度思想
本系列《0.8MB跑通Qwen》聚焦ARM端零依赖纯C推理引擎,适配Qwen3-VL多模态模型,在RK3588上实测落地。本文详解iteration-level连续批处理:动态聚合多请求的decode步,单次前向服务多人,兼顾并发与确定性。(239字)
|
1天前
|
人工智能 JSON API
从零打通 MCP 访问创世虚拟世界CRM的 3D 数据,我搭了一个可直接调用的演示站
作者把创世虚拟世界CRM(创世Genesis,自部署 3D 虚拟世界)的 AI Agent 通道(HTTP + WebSocket + JSON 约定)封装成 8 个 MCP 工具(discover/enter/observe/say/walk_to/follow/chat_history/leave),stdio 版已上 npm 与官方 MCP Registry,随后为零安装补了 Streamable HTTP 远端点。本文实录打通过程:stdout 纯净性、initialize 必填字段、Mixed Content 协议陷阱、官方 SDK 拖入 34 包后的零依赖重写、GET 400 被目

热门文章

最新文章