ModelScope

2024-05-15

FunASR 语音大模型在 Arm Neoverse 平台上的优化实践

Arm 架构的服务器通常具备低功耗的特性，能带来更优异的能效比。相比于传统的 x86 架构服务器，Arm 服务器在相同功耗下能够提供更高的性能。这对于大模型推理任务来说尤为重要，因为大模型通常需要大量的计算资源，而能效比高的 Arm 架构服务器可以提供更好的性能和效率。

ModelScope

108,859

奶司

2024-05-15

372

人人都是AI大师 - Prompt工程

prompt工程不需要复杂的编程知识，人人都可以使用prompt工程成为AI大师。本文只探讨prompt工程，不涉及模型训练等内容。只讨论文本生成，不涉及图像等领域。

奶司

372

子丑

2024-06-13

64953

基于 Nginx Ingress + 云效 AppStack 实现灰度发布

本文将演示结合云效 AppStack，来看下如何在阿里云 ACK 集群上进行应用的 Ingress 灰度发布。

子丑

64,953

喻奎

2023-06-25

10073

MaxCompute湖仓一体近实时增量处理技术架构揭秘

本文将介绍阿里云云原生大数据计算服务MaxCompute湖仓一体近实时增量处理技术架构的核心设计和应用场景。

喻奎

10,073

扬流

2024-05-15

118021

Paimon 与 Spark 的集成（二）：查询优化

通过一系列优化，我们将 Paimon x Spark 在 TpcDS 上的性能提高了37+%，已基本和 Parquet x Spark 持平，本文对其中的关键优化点进行了详细介绍。

扬流

118,021

ModelScope

2024-05-15

399

元象大模型开源30款量化版本加速低成本部署丨附教程

元象大模型一次性发布30款量化版本，全开源，无条件免费商用。

ModelScope

399

阿里云大数据Al技术

2024-05-15

144811

一键生成视频，用 PAI-EAS 部署 AI 视频生成模型 SVD 工作流

本教程将带领大家免费领取阿里云PAI-EAS的免费试用资源，并且带领大家在 ComfyUI 环境下使用 SVD的模型，根据任何图片生成一个小短视频。

阿里云大数据Al技术

144,811

ModelScope

2024-05-15

369

vLLM部署Yuan2.0：高吞吐、更便捷

vLLM是UC Berkeley开源的大语言模型高速推理框架，其内存管理核心——PagedAttention、内置的加速算法如Continues Batching等，一方面可以提升Yuan2.0模型推理部署时的内存使用效率，另一方面可以大幅提升在实时应用场景下Yuan2.0的吞吐量。

ModelScope

369

ModelScope

2024-05-15

326

Modelscope结合α-UMi：基于Modelscope的多模型协作Agent

基于单个开源小模型的工具调用Agent，由于模型容量和预训练能力获取的限制，无法在推理和规划、工具调用、回复生成等任务上同时获得比肩大模型等性能。

ModelScope

326

类目筛选

内容类型

FunASR 语音大模型在 Arm Neoverse 平台上的优化实践

人人都是AI大师 - Prompt工程

基于 Nginx Ingress + 云效 AppStack 实现灰度发布

MaxCompute湖仓一体近实时增量处理技术架构揭秘

Paimon 与 Spark 的集成（二）：查询优化

元象大模型开源30款量化版本加速低成本部署丨附教程

一键生成视频，用 PAI-EAS 部署 AI 视频生成模型 SVD 工作流

vLLM部署Yuan2.0：高吞吐、更便捷

Modelscope结合α-UMi：基于Modelscope的多模型协作Agent

类目筛选

内容类型

FunASR 语音大模型在 Arm Neoverse 平台上的优化实践

人人都是AI大师 - Prompt工程

基于 Nginx Ingress + 云效 AppStack 实现灰度发布

MaxCompute湖仓一体近实时增量处理技术架构揭秘

Paimon 与 Spark 的集成（二）：查询优化

元象大模型开源30款量化版本 加速低成本部署丨附教程

一键生成视频，用 PAI-EAS 部署 AI 视频生成模型 SVD 工作流

vLLM部署Yuan2.0：高吞吐、更便捷

Modelscope结合α-UMi：基于Modelscope的多模型协作Agent

元象大模型开源30款量化版本加速低成本部署丨附教程