ModelScope

2024-05-15

vLLM部署Yuan2.0：高吞吐、更便捷

vLLM是UC Berkeley开源的大语言模型高速推理框架，其内存管理核心——PagedAttention、内置的加速算法如Continues Batching等，一方面可以提升Yuan2.0模型推理部署时的内存使用效率，另一方面可以大幅提升在实时应用场景下Yuan2.0的吞吐量。

ModelScope

364

恶来

2023-05-15

6990

消息队列之 MetaQ 和 Kafka 区别和优势详解

本篇文章介绍MetaQ和Kafka这两个消息队列的区别和优势。

恶来

6,990

隆基

2024-05-15

90954

深度剖析 RocketMQ 5.0，IoT 消息：物联网需要什么样的消息技术？

本文来学习一个典型的物联网技术架构，以及在这个技术架构里面，消息队列所发挥的作用。在物联网的场景里面，对消息技术的要求和面向服务端应用的消息技术有什么区别？学习 RocketMQ 5.0 的子产品 MQTT，是如何解决这些物联网技术难题的。

隆基

90,954

ModelScope

2024-05-15

394

元象大模型开源30款量化版本加速低成本部署丨附教程

元象大模型一次性发布30款量化版本，全开源，无条件免费商用。

ModelScope

394

荆磊

2024-05-15

55646

更优性能与性价比，从自建 ELK 迁移到 SLS 开始

本文介绍了 SLS 基本能力，并和开源自建 ELK 做了对比，可以看到 SLS 相比开源 ELK 有较大优势。

荆磊

55,646

阿里云云原生

2024-05-16

56180

容器内存可观测性新视角：WorkingSet 与 PageCache 监控

本文介绍了 Kubernetes 中的容器工作内存（WorkingSet）概念，它用于表示容器内存的实时使用量，尤其是活跃内存。

阿里云云原生

56,180

阿里云云原生

2024-05-24

49855

AIOps 智能运维：比专家经验更优雅的错/慢调用分析工具

本文主要介绍ARMS 错/慢 Trace 分析功能基本原理；该功能能够覆盖哪些异常 Trace 根因；最后会介绍一些最佳实践案例。

阿里云云原生

49,855

王奇

2023-06-26

8566

Hologres弹性计算在OLAP分析上的实践和探索

本文介绍了OLAP分析在大数据分析中的位置，分析并介绍目前大数据OLAP遇到的分析性能、资源隔离、高可用、弹性扩缩容等核心问题，解析阿里云Hologres是如何解决极致性能、弹性、业务永续、性价比等核心刚需的最佳实践，介绍阿里云Hologres弹性计算组在弹性计算、资源隔离上的探索和创新。

王奇

8,566

周宇睿

2023-09-08

470

MaxCompute半结构化数据思考与创新

本文将介绍MaxCompute在半结构化数据方面的一些思考与创新，围绕半结构化数据简析、传统方案优劣对比、MaxCompute半结构化数据解决方案、收益分析。

周宇睿

470

类目筛选

内容类型

vLLM部署Yuan2.0：高吞吐、更便捷

消息队列之 MetaQ 和 Kafka 区别和优势详解

深度剖析 RocketMQ 5.0，IoT 消息：物联网需要什么样的消息技术？

元象大模型开源30款量化版本加速低成本部署丨附教程

更优性能与性价比，从自建 ELK 迁移到 SLS 开始

容器内存可观测性新视角：WorkingSet 与 PageCache 监控

AIOps 智能运维：比专家经验更优雅的错/慢调用分析工具

Hologres弹性计算在OLAP分析上的实践和探索

MaxCompute半结构化数据思考与创新

类目筛选

内容类型

vLLM部署Yuan2.0：高吞吐、更便捷

消息队列之 MetaQ 和 Kafka 区别和优势详解

深度剖析 RocketMQ 5.0，IoT 消息：物联网需要什么样的消息技术？

元象大模型开源30款量化版本 加速低成本部署丨附教程

更优性能与性价比，从自建 ELK 迁移到 SLS 开始

容器内存可观测性新视角：WorkingSet 与 PageCache 监控

AIOps 智能运维：比专家经验更优雅的错/慢调用分析工具

Hologres弹性计算在OLAP分析上的实践和探索

MaxCompute半结构化数据思考与创新

元象大模型开源30款量化版本加速低成本部署丨附教程