ModelScope

2024-05-15

vLLM部署Yuan2.0：高吞吐、更便捷

vLLM是UC Berkeley开源的大语言模型高速推理框架，其内存管理核心——PagedAttention、内置的加速算法如Continues Batching等，一方面可以提升Yuan2.0模型推理部署时的内存使用效率，另一方面可以大幅提升在实时应用场景下Yuan2.0的吞吐量。

ModelScope

354

阿里云云原生

2024-05-22

60057

基于 Prometheus 的超算弹性计算场景下主机监控最佳实践

超算快速弹性伸缩场景下，如何构建一套准确、快速、可靠的监控体系成为关键点。阿里云在超算场景的主机监控落地实践，解决超算场景面临的挑战，交付一套可靠和全面的主机监控体系。

阿里云云原生

60,057

喻奎

2023-06-25

9995

MaxCompute湖仓一体近实时增量处理技术架构揭秘

本文将介绍阿里云云原生大数据计算服务MaxCompute湖仓一体近实时增量处理技术架构的核心设计和应用场景。

喻奎

9,995

ModelScope

2024-05-15

103430

手把手教你捏一个自己的Agent

Modelscope AgentFabric是一个基于ModelScope-Agent的交互式智能体应用，用于方便地创建针对各种现实应用量身定制智能体，目前已经在生产级别落地。

ModelScope

103,430

澄潭

2024-06-03

41107

计算机英文教材太难啃，Higress 和通义千问帮你

英文技术内容翻译难于理解，如何跨语言学习？通义千问结合 Higress 的多模型协议转换能力，可以通过配置插件获得推理模型基于内容理解后的精准翻译，点击本文手把手教你如何配置。

澄潭

41,107

豁朗

2021-08-13

1708

用SLS配置日志关键字告警的N种方法

本文主要介绍一种免运维，高性能，支持灵活配置的方案，使用SLS接入日志和告警。

豁朗

1,708

恶来

2023-05-15

6980

消息队列之 MetaQ 和 Kafka 区别和优势详解

本篇文章介绍MetaQ和Kafka这两个消息队列的区别和优势。

恶来

6,980

刘军

2024-06-18

16533

Dubbo3 服务原生支持 http 访问，兼具高性能与易用性

本文展示了 Dubbo3 triple 协议是如何简化从协议规范与实现上简化开发测试、入口流量接入成本的，同时提供高性能通信、面向接口的易用性编码。

刘军

16,533

ModelScope

2024-05-15

108842

FunASR 语音大模型在 Arm Neoverse 平台上的优化实践

Arm 架构的服务器通常具备低功耗的特性，能带来更优异的能效比。相比于传统的 x86 架构服务器，Arm 服务器在相同功耗下能够提供更高的性能。这对于大模型推理任务来说尤为重要，因为大模型通常需要大量的计算资源，而能效比高的 Arm 架构服务器可以提供更好的性能和效率。

ModelScope

108,842

类目筛选

内容类型

vLLM部署Yuan2.0：高吞吐、更便捷

基于 Prometheus 的超算弹性计算场景下主机监控最佳实践

MaxCompute湖仓一体近实时增量处理技术架构揭秘

手把手教你捏一个自己的Agent

计算机英文教材太难啃，Higress 和通义千问帮你

用SLS配置日志关键字告警的N种方法

消息队列之 MetaQ 和 Kafka 区别和优势详解

Dubbo3 服务原生支持 http 访问，兼具高性能与易用性

FunASR 语音大模型在 Arm Neoverse 平台上的优化实践