ModelScope

2024-05-15

FunASR 语音大模型在 Arm Neoverse 平台上的优化实践

Arm 架构的服务器通常具备低功耗的特性，能带来更优异的能效比。相比于传统的 x86 架构服务器，Arm 服务器在相同功耗下能够提供更高的性能。这对于大模型推理任务来说尤为重要，因为大模型通常需要大量的计算资源，而能效比高的 Arm 架构服务器可以提供更好的性能和效率。

ModelScope

108,856

ModelScope

2024-05-15

362

vLLM部署Yuan2.0：高吞吐、更便捷

vLLM是UC Berkeley开源的大语言模型高速推理框架，其内存管理核心——PagedAttention、内置的加速算法如Continues Batching等，一方面可以提升Yuan2.0模型推理部署时的内存使用效率，另一方面可以大幅提升在实时应用场景下Yuan2.0的吞吐量。

ModelScope

362

刘佳旭

2023-09-26

138050

云原生场景下高可用架构的最佳实践

刘佳旭

138,050

吴昆

2024-05-15

145467

弹性调度助力企业灵活应对业务变化，高效管理云上资源

本文主要介绍了弹性调企业灵活应对企业业务变化，并高效管理云上资源。

吴昆

145,467

木烟

2024-06-24

45718

多环境镜像晋级/复用最佳实践

本文介绍了在应用研发场景中，如何通过阿里云服务实现镜像构建部署的高效和安全。主要关注两个实践方法来确保“所发即所测”。

木烟

45,718

阿里云大数据Al技术

2024-05-15

144804

一键生成视频，用 PAI-EAS 部署 AI 视频生成模型 SVD 工作流

本教程将带领大家免费领取阿里云PAI-EAS的免费试用资源，并且带领大家在 ComfyUI 环境下使用 SVD的模型，根据任何图片生成一个小短视频。

阿里云大数据Al技术

144,804

阿里云云原生

2024-05-15

70450

流水线 YAML 高级用法来了，大幅降低重复代码、灵活编排多任务

云效 Flow 流水线 YAML 引入了 template 语法，支持使用模板语言来动态渲染流水线 YAML，满足多个相同或类似逻辑的 Job 批量配置场景，满足多 Job 按需动态生成场景，帮助降低流水线 YAML 重复代码，灵活编排多任务。

阿里云云原生

70,450

阿里云云原生

2024-06-13

55520

基于云效 AppStack，5 分钟搞定一个 AI 应用的开发和部署

区别于传统的流水线工具，本实验将带你体验云效应用交付平台 AppStack，从应用视角，完成一个 AI 聊天应用的高效交付。

阿里云云原生

55,520

阿里云大数据Al技术

2024-05-15

77684

【AAAI 2024】MuLTI：高效视频与语言理解

多模态理解模型具有广泛的应用，比如多标签分类、视频问答（videoQA）和文本视频检索等。现有的方法已经在视频和语言理解方面取得了重大进展，然而，他们仍然面临两个巨大的挑战：无法充分的利用现有的特征；训练时巨大的GPU内存消耗。我们提出了MuLTI，这是一种高度准确高效的视频和语言理解模型，可以实现高效有效的特征融合和对下游任务的快速适应。本文详细介绍基于MuLTI实现高效视频与语言理解。

阿里云大数据Al技术

77,684

类目筛选

内容类型

FunASR 语音大模型在 Arm Neoverse 平台上的优化实践

vLLM部署Yuan2.0：高吞吐、更便捷

云原生场景下高可用架构的最佳实践

弹性调度助力企业灵活应对业务变化，高效管理云上资源

多环境镜像晋级/复用最佳实践

一键生成视频，用 PAI-EAS 部署 AI 视频生成模型 SVD 工作流

流水线 YAML 高级用法来了，大幅降低重复代码、灵活编排多任务

基于云效 AppStack，5 分钟搞定一个 AI 应用的开发和部署

【AAAI 2024】MuLTI：高效视频与语言理解