阿里云大数据Al技术

2024-05-15

【AAAI 2024】MuLTI：高效视频与语言理解

多模态理解模型具有广泛的应用，比如多标签分类、视频问答（videoQA）和文本视频检索等。现有的方法已经在视频和语言理解方面取得了重大进展，然而，他们仍然面临两个巨大的挑战：无法充分的利用现有的特征；训练时巨大的GPU内存消耗。我们提出了MuLTI，这是一种高度准确高效的视频和语言理解模型，可以实现高效有效的特征融合和对下游任务的快速适应。本文详细介绍基于MuLTI实现高效视频与语言理解。

阿里云大数据Al技术

77,684

奶司

2024-05-15

367

人人都是AI大师 - Prompt工程

prompt工程不需要复杂的编程知识，人人都可以使用prompt工程成为AI大师。本文只探讨prompt工程，不涉及模型训练等内容。只讨论文本生成，不涉及图像等领域。

奶司

367

探索云世界

2024-05-15

243

准确率100%，阿里商旅账单系统架构设计实践

阿里商旅作为飞猪旅行旗下面向企业客户的数字化差旅解决方案产品，依托飞猪旅行机票、酒店供应链为企业客户提供一站式的机票、酒店、火车票、用车等预订管控及结算票据服务。阿里商旅不仅是集团欢行的供应商，而且近几年在商业化差旅市场上崭露头角，服务了2万+中大型客户，43万+小微企业。

探索云世界

243

资源编排ROS

2024-06-25

767

ROS CDK魔法书：点亮博客上云新技能（Java篇）

在阿里云资源编排服务ROS的Cloud Development Kit（ROS CDK）中，开发者可以使用编程语言（如TypeScript、Java等）定义云资源，简化了基础设施即代码（IaC）的管理。ROS CDK的Asset模块是用于处理本地文件到云端对象存储（如OSS）的工具，它通过元数据封装本地资源，然后配合ROS CDK的部署工具将文件上传至云端。通过一个将本地博客网站部署到OSS的案例，文章展示了如何使用ROS CDK的Asset模块和BucketDeployment来实现这一过程。

资源编排ROS

767

ModelScope

2024-05-15

362

vLLM部署Yuan2.0：高吞吐、更便捷

vLLM是UC Berkeley开源的大语言模型高速推理框架，其内存管理核心——PagedAttention、内置的加速算法如Continues Batching等，一方面可以提升Yuan2.0模型推理部署时的内存使用效率，另一方面可以大幅提升在实时应用场景下Yuan2.0的吞吐量。

ModelScope

362

阿里云大数据Al技术

2024-05-15

144804

一键生成视频，用 PAI-EAS 部署 AI 视频生成模型 SVD 工作流

本教程将带领大家免费领取阿里云PAI-EAS的免费试用资源，并且带领大家在 ComfyUI 环境下使用 SVD的模型，根据任何图片生成一个小短视频。

阿里云大数据Al技术

144,804

周宇睿

2023-09-08

470

MaxCompute半结构化数据思考与创新

本文将介绍MaxCompute在半结构化数据方面的一些思考与创新，围绕半结构化数据简析、传统方案优劣对比、MaxCompute半结构化数据解决方案、收益分析。

周宇睿

470

林以琳

2024-05-15

746

基于PAI-DSW快速启动Stable Diffusion WebUI

基于PAI-DSW快速启动Stable Diffusion WebUI，创作你的专属冬日主题AI画作！

林以琳

746

ModelScope

2024-05-15

388

Multi-Agent实践第6期：面向智能体编程：狼人杀在AgentScope

本期文章，我们会介绍一下AgentScope的一个设计哲学（Agent-oriented programming）

ModelScope

388

类目筛选

内容类型

【AAAI 2024】MuLTI：高效视频与语言理解

人人都是AI大师 - Prompt工程

准确率100%，阿里商旅账单系统架构设计实践

ROS CDK魔法书：点亮博客上云新技能（Java篇）

vLLM部署Yuan2.0：高吞吐、更便捷

一键生成视频，用 PAI-EAS 部署 AI 视频生成模型 SVD 工作流

MaxCompute半结构化数据思考与创新

基于PAI-DSW快速启动Stable Diffusion WebUI

Multi-Agent实践第6期：面向智能体编程：狼人杀在AgentScope