昕羽

2024-05-15

阿里云 EMR 基于 Paimon 和 Hudi 构建 Streaming Lakehouse

Apache Paimon 和 Apache Hudi 作为数据湖存储格式，有着高吞吐的写入和低延迟的查询性能，是构建数据湖的常用组件。本文在阿里云EMR上，针对数据实时入湖场景，对 Paimon 和 Hudi 的性能进行比对，并分别以 Paimon 和 Hudi 作为统一存储搭建准实时数仓。

昕羽

65,156

扬流

2024-05-15

118027

Paimon 与 Spark 的集成（二）：查询优化

通过一系列优化，我们将 Paimon x Spark 在 TpcDS 上的性能提高了37+%，已基本和 Parquet x Spark 持平，本文对其中的关键优化点进行了详细介绍。

扬流

118,027

奶司

2024-05-15

376

人人都是AI大师 - Prompt工程

prompt工程不需要复杂的编程知识，人人都可以使用prompt工程成为AI大师。本文只探讨prompt工程，不涉及模型训练等内容。只讨论文本生成，不涉及图像等领域。

奶司

376

李鹏

2024-05-15

183

Serverless Kubernetes 开发实践：异构资源，按需使用

Kubernetes 作为当今云原生业界标准，具备良好的生态以及跨云厂商能力。Kubernetes 很好的抽象了 IaaS 资源交付标准，使得云资源交付变的越来越简单，与此同时用户期望更多的聚焦于业务自身，做到面向应用交付，Serverless 理念也因此而生。那么如何通过原生 k8s 提供Serverless 能力？如何实现GPU等异构资源按需使用？这里给大家介绍一下我们在Serverless Kubernetes 开发实践：异构资源，按需使用。

李鹏

183

云服务器ECS

2023-10-17

712

使用ECS部署并使用Docker

本文介绍如何在云服务ECS实例上，部署并使用Docker。

云服务器ECS

712

ModelScope

2024-05-15

404

元象大模型开源30款量化版本加速低成本部署丨附教程

元象大模型一次性发布30款量化版本，全开源，无条件免费商用。

ModelScope

404

霖玉

2023-06-15

13301

大数据SQL数据倾斜与数据膨胀的优化与经验总结

目前市面上大数据查询分析引擎层出不穷，但在业务使用过程中，大多含有性能瓶颈的SQL，主要集中在数据倾斜与数据膨胀问题中。本文结合业界对大数据SQL的使用与优化，尝试给出相对系统性的解决方案。

霖玉

13,301

喻奎

2023-06-25

10076

MaxCompute湖仓一体近实时增量处理技术架构揭秘

本文将介绍阿里云云原生大数据计算服务MaxCompute湖仓一体近实时增量处理技术架构的核心设计和应用场景。

喻奎

10,076

刘佳旭

2023-09-26

138063

云原生场景下高可用架构的最佳实践

刘佳旭

138,063

类目筛选

内容类型

阿里云 EMR 基于 Paimon 和 Hudi 构建 Streaming Lakehouse

Paimon 与 Spark 的集成（二）：查询优化

人人都是AI大师 - Prompt工程

Serverless Kubernetes 开发实践：异构资源，按需使用

使用ECS部署并使用Docker

元象大模型开源30款量化版本加速低成本部署丨附教程

大数据SQL数据倾斜与数据膨胀的优化与经验总结

MaxCompute湖仓一体近实时增量处理技术架构揭秘

云原生场景下高可用架构的最佳实践

类目筛选

内容类型

阿里云 EMR 基于 Paimon 和 Hudi 构建 Streaming Lakehouse

Paimon 与 Spark 的集成（二）：查询优化

人人都是AI大师 - Prompt工程

Serverless Kubernetes 开发实践：异构资源，按需使用

使用ECS部署并使用Docker

元象大模型开源30款量化版本 加速低成本部署丨附教程

大数据SQL数据倾斜与数据膨胀的优化与经验总结

MaxCompute湖仓一体近实时增量处理技术架构揭秘

云原生场景下高可用架构的最佳实践

元象大模型开源30款量化版本加速低成本部署丨附教程