阿里云大数据Al技术

2024-05-15

【AAAI 2024】MuLTI：高效视频与语言理解

多模态理解模型具有广泛的应用，比如多标签分类、视频问答（videoQA）和文本视频检索等。现有的方法已经在视频和语言理解方面取得了重大进展，然而，他们仍然面临两个巨大的挑战：无法充分的利用现有的特征；训练时巨大的GPU内存消耗。我们提出了MuLTI，这是一种高度准确高效的视频和语言理解模型，可以实现高效有效的特征融合和对下游任务的快速适应。本文详细介绍基于MuLTI实现高效视频与语言理解。

阿里云大数据Al技术

77,682

ModelScope

2024-05-15

103435

手把手教你捏一个自己的Agent

Modelscope AgentFabric是一个基于ModelScope-Agent的交互式智能体应用，用于方便地创建针对各种现实应用量身定制智能体，目前已经在生产级别落地。

ModelScope

103,435

ModelScope

2024-05-15

108847

FunASR 语音大模型在 Arm Neoverse 平台上的优化实践

Arm 架构的服务器通常具备低功耗的特性，能带来更优异的能效比。相比于传统的 x86 架构服务器，Arm 服务器在相同功耗下能够提供更高的性能。这对于大模型推理任务来说尤为重要，因为大模型通常需要大量的计算资源，而能效比高的 Arm 架构服务器可以提供更好的性能和效率。

ModelScope

108,847

ModelScope

2024-05-15

388

元象大模型开源30款量化版本加速低成本部署丨附教程

元象大模型一次性发布30款量化版本，全开源，无条件免费商用。

ModelScope

388

山泽

2024-05-15

303

从零构建现代深度学习框架(TinyDL-0.01)

本文主要以一个Java工程师视角，阐述如何从零(无任何二三方依赖)构建一个极简(麻雀虽小五脏俱全)现代深度学习框架（类比AI的操作系统）。

山泽

303

周宇睿

2023-09-08

465

MaxCompute半结构化数据思考与创新

本文将介绍MaxCompute在半结构化数据方面的一些思考与创新，围绕半结构化数据简析、传统方案优劣对比、MaxCompute半结构化数据解决方案、收益分析。

周宇睿

465

林以琳

2024-05-15

743

基于PAI-DSW快速启动Stable Diffusion WebUI

基于PAI-DSW快速启动Stable Diffusion WebUI，创作你的专属冬日主题AI画作！

林以琳

743

探索云世界

2024-05-15

2367

阿里云大降价后，再谈“降本增效”

2024年2月29日，阿里云宣布史上最大力度降价，引发行业对用云成本的热议。

探索云世界

2,367

ModelScope

2024-05-15

208

Yuan2.0大模型，联合向量数据库和Llama-index，助力检索增强生成技术

本文将以Yuan2.0最新发布的Februa模型为例进行测试验证，用更小规模的模型达到更好的效果。

ModelScope

208

类目筛选

内容类型

【AAAI 2024】MuLTI：高效视频与语言理解

手把手教你捏一个自己的Agent

FunASR 语音大模型在 Arm Neoverse 平台上的优化实践

元象大模型开源30款量化版本加速低成本部署丨附教程

从零构建现代深度学习框架(TinyDL-0.01)

MaxCompute半结构化数据思考与创新

基于PAI-DSW快速启动Stable Diffusion WebUI

阿里云大降价后，再谈“降本增效”

Yuan2.0大模型，联合向量数据库和Llama-index，助力检索增强生成技术

类目筛选

内容类型

【AAAI 2024】MuLTI：高效视频与语言理解

手把手教你捏一个自己的Agent

FunASR 语音大模型在 Arm Neoverse 平台上的优化实践

元象大模型开源30款量化版本 加速低成本部署丨附教程

从零构建现代深度学习框架(TinyDL-0.01)

MaxCompute半结构化数据思考与创新

基于PAI-DSW快速启动Stable Diffusion WebUI

阿里云大降价后，再谈“降本增效”

Yuan2.0大模型，联合向量数据库和Llama-index，助力检索增强生成技术

元象大模型开源30款量化版本加速低成本部署丨附教程