ModelScope

2024-05-15

vLLM部署Yuan2.0：高吞吐、更便捷

vLLM是UC Berkeley开源的大语言模型高速推理框架，其内存管理核心——PagedAttention、内置的加速算法如Continues Batching等，一方面可以提升Yuan2.0模型推理部署时的内存使用效率，另一方面可以大幅提升在实时应用场景下Yuan2.0的吞吐量。

ModelScope

356

涯海

2024-06-03

61035

一站式链路追踪：阿里云的端到端解决方案

端到端链路追踪是覆盖全部关联 IT 系统，能够完整记录用户行为在系统间调用路径与状态的最佳实践方案。而真正实现端到端链路追踪，需要解决三个难题：链路插桩、链路采集与加工、链路上下文透传。阿里云 ARMS 目前已支持全链路端到端追踪，快来查看转发吧~

涯海

61,035

骆天

2024-05-15

841

高并发架构设计三大利器：缓存、限流和降级

软件系统有三个追求：高性能、高并发、高可用，俗称三高。本篇讨论高并发，从高并发是什么到高并发应对的策略、缓存、限流、降级等。

骆天

841

ModelScope

2024-05-15

103431

手把手教你捏一个自己的Agent

Modelscope AgentFabric是一个基于ModelScope-Agent的交互式智能体应用，用于方便地创建针对各种现实应用量身定制智能体，目前已经在生产级别落地。

ModelScope

103,431

欧叔

2024-05-15

208

使用智能媒体生产ICE剪辑OSS视频文件

本篇介绍智能媒体生产ICE一些常见场景，如裁剪、拼接、字幕、ASR等，通过一些时间线示例，介绍如何快速剪辑OSS上的视频文件。

欧叔

208

刘军

2024-06-18

16535

Dubbo3 服务原生支持 http 访问，兼具高性能与易用性

本文展示了 Dubbo3 triple 协议是如何简化从协议规范与实现上简化开发测试、入口流量接入成本的，同时提供高性能通信、面向接口的易用性编码。

刘军

16,535

ModelScope

2024-05-15

108843

FunASR 语音大模型在 Arm Neoverse 平台上的优化实践

Arm 架构的服务器通常具备低功耗的特性，能带来更优异的能效比。相比于传统的 x86 架构服务器，Arm 服务器在相同功耗下能够提供更高的性能。这对于大模型推理任务来说尤为重要，因为大模型通常需要大量的计算资源，而能效比高的 Arm 架构服务器可以提供更好的性能和效率。

ModelScope

108,843

ModelScope

2024-05-15

388

元象大模型开源30款量化版本加速低成本部署丨附教程

元象大模型一次性发布30款量化版本，全开源，无条件免费商用。

ModelScope

388

山泽

2024-05-15

302

从零构建现代深度学习框架(TinyDL-0.01)

本文主要以一个Java工程师视角，阐述如何从零(无任何二三方依赖)构建一个极简(麻雀虽小五脏俱全)现代深度学习框架（类比AI的操作系统）。

山泽

302

类目筛选

内容类型

vLLM部署Yuan2.0：高吞吐、更便捷

一站式链路追踪：阿里云的端到端解决方案

高并发架构设计三大利器：缓存、限流和降级

手把手教你捏一个自己的Agent

使用智能媒体生产ICE剪辑OSS视频文件

Dubbo3 服务原生支持 http 访问，兼具高性能与易用性

FunASR 语音大模型在 Arm Neoverse 平台上的优化实践

元象大模型开源30款量化版本加速低成本部署丨附教程

从零构建现代深度学习框架(TinyDL-0.01)

类目筛选

内容类型

vLLM部署Yuan2.0：高吞吐、更便捷

一站式链路追踪：阿里云的端到端解决方案

高并发架构设计三大利器：缓存、限流和降级

手把手教你捏一个自己的Agent

使用智能媒体生产ICE剪辑OSS视频文件

Dubbo3 服务原生支持 http 访问，兼具高性能与易用性

FunASR 语音大模型在 Arm Neoverse 平台上的优化实践

元象大模型开源30款量化版本 加速低成本部署丨附教程

从零构建现代深度学习框架(TinyDL-0.01)

元象大模型开源30款量化版本加速低成本部署丨附教程