ModelScope

2024-05-15

vLLM部署Yuan2.0：高吞吐、更便捷

vLLM是UC Berkeley开源的大语言模型高速推理框架，其内存管理核心——PagedAttention、内置的加速算法如Continues Batching等，一方面可以提升Yuan2.0模型推理部署时的内存使用效率，另一方面可以大幅提升在实时应用场景下Yuan2.0的吞吐量。

ModelScope

357

刘佳旭

2023-09-26

138045

云原生场景下高可用架构的最佳实践

刘佳旭

138,045

阿里云大数据Al技术

2024-05-15

144801

一键生成视频，用 PAI-EAS 部署 AI 视频生成模型 SVD 工作流

本教程将带领大家免费领取阿里云PAI-EAS的免费试用资源，并且带领大家在 ComfyUI 环境下使用 SVD的模型，根据任何图片生成一个小短视频。

阿里云大数据Al技术

144,801

恶来

2023-05-15

6984

消息队列之 MetaQ 和 Kafka 区别和优势详解

本篇文章介绍MetaQ和Kafka这两个消息队列的区别和优势。

恶来

6,984

阿里云云原生

2024-05-15

62642

All in One：Prometheus 多实例数据统一管理最佳实践

当管理多个Prometheus实例时，阿里云Prometheus托管版相比社区版提供了更可靠的数据采集和便捷的管理。本文比较了全局聚合实例与数据投递方案，两者在不同场景下各有优劣。

阿里云云原生

62,642

阿里云云原生

2024-05-22

60062

基于 Prometheus 的超算弹性计算场景下主机监控最佳实践

超算快速弹性伸缩场景下，如何构建一套准确、快速、可靠的监控体系成为关键点。阿里云在超算场景的主机监控落地实践，解决超算场景面临的挑战，交付一套可靠和全面的主机监控体系。

阿里云云原生

60,062

泮圣伟

2024-05-15

156

阿里巴巴服务框架三位一体的选择与实践

服务框架就像铁路的铁轨一样，是互通的基础，只有解决了服务框架的互通，才有可能完成更高层的业务互通，所以用相同的标准统一，合二为一并共建新一代的服务框架是必然趋势。Dubbo3 是Dubbo2 与 HSF 融合而来，是阿里经济体面向内部业务、商业化、开源的唯一标准服务框架。

泮圣伟

156

ModelScope

2024-05-15

103435

手把手教你捏一个自己的Agent

Modelscope AgentFabric是一个基于ModelScope-Agent的交互式智能体应用，用于方便地创建针对各种现实应用量身定制智能体，目前已经在生产级别落地。

ModelScope

103,435

澄潭

2024-06-03

41111

计算机英文教材太难啃，Higress 和通义千问帮你

英文技术内容翻译难于理解，如何跨语言学习？通义千问结合 Higress 的多模型协议转换能力，可以通过配置插件获得推理模型基于内容理解后的精准翻译，点击本文手把手教你如何配置。

澄潭

41,111

类目筛选

内容类型

vLLM部署Yuan2.0：高吞吐、更便捷

云原生场景下高可用架构的最佳实践

一键生成视频，用 PAI-EAS 部署 AI 视频生成模型 SVD 工作流

消息队列之 MetaQ 和 Kafka 区别和优势详解

All in One：Prometheus 多实例数据统一管理最佳实践

基于 Prometheus 的超算弹性计算场景下主机监控最佳实践

阿里巴巴服务框架三位一体的选择与实践

手把手教你捏一个自己的Agent

计算机英文教材太难啃，Higress 和通义千问帮你