刘佳旭

2023-09-26

云原生场景下高可用架构的最佳实践

刘佳旭

138,045

ModelScope

2024-05-15

356

vLLM部署Yuan2.0：高吞吐、更便捷

vLLM是UC Berkeley开源的大语言模型高速推理框架，其内存管理核心——PagedAttention、内置的加速算法如Continues Batching等，一方面可以提升Yuan2.0模型推理部署时的内存使用效率，另一方面可以大幅提升在实时应用场景下Yuan2.0的吞吐量。

ModelScope

356

隆基

2024-05-15

108399

深度剖析 RocketMQ 5.0，消息进阶：如何支撑复杂业务消息场景？

本文主要学习 RocketMQ 的一致性特性，一致性对于交易、金融都是刚需。从大规模复杂业务出发，学习 RocketMQ 的 SQL 订阅、定时消息等特性。再从高可用的角度来看，这里更多的是大型公司对于高阶可用性的要求，如同城容灾、异地多活等。

隆基

108,399

阿里云云原生

2024-05-15

193

从自建DevOps部署微服务再到云效

以Jenkins+Gitlab基于k8s集群实现自建DevOps系统的方式部署开源微服务PiggyMetrics，与云效DevOps对比，介绍真正的免运维，实现高效的业务开发流程。

阿里云云原生

193

ModelScope

2024-05-15

103433

手把手教你捏一个自己的Agent

Modelscope AgentFabric是一个基于ModelScope-Agent的交互式智能体应用，用于方便地创建针对各种现实应用量身定制智能体，目前已经在生产级别落地。

ModelScope

103,433

阿里云云原生

2024-05-22

60061

基于 Prometheus 的超算弹性计算场景下主机监控最佳实践

超算快速弹性伸缩场景下，如何构建一套准确、快速、可靠的监控体系成为关键点。阿里云在超算场景的主机监控落地实践，解决超算场景面临的挑战，交付一套可靠和全面的主机监控体系。

阿里云云原生

60,061

澄潭

2024-06-03

41110

计算机英文教材太难啃，Higress 和通义千问帮你

英文技术内容翻译难于理解，如何跨语言学习？通义千问结合 Higress 的多模型协议转换能力，可以通过配置插件获得推理模型基于内容理解后的精准翻译，点击本文手把手教你如何配置。

澄潭

41,110

吴昆

2024-05-15

145460

弹性调度助力企业灵活应对业务变化，高效管理云上资源

本文主要介绍了弹性调企业灵活应对企业业务变化，并高效管理云上资源。

吴昆

145,460

怀虎

2024-07-08

46670

私网环境下使用云效流水线进行 CI/CD的方法

云效流水线可以托管用户的私网环境内的机器，并将构建任务调度到这些机器上，从而确保整个构建过程，和代码库和制品库的交互在私网环境下进行。

怀虎

46,670

类目筛选

内容类型

云原生场景下高可用架构的最佳实践

vLLM部署Yuan2.0：高吞吐、更便捷

深度剖析 RocketMQ 5.0，消息进阶：如何支撑复杂业务消息场景？

从自建DevOps部署微服务再到云效

手把手教你捏一个自己的Agent

基于 Prometheus 的超算弹性计算场景下主机监控最佳实践

计算机英文教材太难啃，Higress 和通义千问帮你

弹性调度助力企业灵活应对业务变化，高效管理云上资源

私网环境下使用云效流水线进行 CI/CD的方法