ModelScope

2024-05-15

vLLM部署Yuan2.0：高吞吐、更便捷

vLLM是UC Berkeley开源的大语言模型高速推理框架，其内存管理核心——PagedAttention、内置的加速算法如Continues Batching等，一方面可以提升Yuan2.0模型推理部署时的内存使用效率，另一方面可以大幅提升在实时应用场景下Yuan2.0的吞吐量。

ModelScope

360

ModelScope

2024-05-15

103443

手把手教你捏一个自己的Agent

Modelscope AgentFabric是一个基于ModelScope-Agent的交互式智能体应用，用于方便地创建针对各种现实应用量身定制智能体，目前已经在生产级别落地。

ModelScope

103,443

阿里云云原生

2024-05-15

66743

无需重新学习，使用 Kibana 查询/可视化 SLS 数据

本文演示了使用 Kibana 连接 SLS ES 兼容接口进行查询和分析的方法。

阿里云云原生

66,743

阿里云云原生

2024-05-22

60069

基于 Prometheus 的超算弹性计算场景下主机监控最佳实践

超算快速弹性伸缩场景下，如何构建一套准确、快速、可靠的监控体系成为关键点。阿里云在超算场景的主机监控落地实践，解决超算场景面临的挑战，交付一套可靠和全面的主机监控体系。

阿里云云原生

60,069

阿里云云原生

2023-07-27

43393

一文详解Spring Bean循环依赖

本文主要梳理了Spring解决bean循环依赖的思路。

阿里云云原生

43,393

吴昆

2024-05-15

145465

弹性调度助力企业灵活应对业务变化，高效管理云上资源

本文主要介绍了弹性调企业灵活应对企业业务变化，并高效管理云上资源。

吴昆

145,465

ModelScope

2024-05-15

108853

FunASR 语音大模型在 Arm Neoverse 平台上的优化实践

Arm 架构的服务器通常具备低功耗的特性，能带来更优异的能效比。相比于传统的 x86 架构服务器，Arm 服务器在相同功耗下能够提供更高的性能。这对于大模型推理任务来说尤为重要，因为大模型通常需要大量的计算资源，而能效比高的 Arm 架构服务器可以提供更好的性能和效率。

ModelScope

108,853

胡刀

2024-05-15

141

泛娱乐直播平台的数据库选型和场景解决方案

直播平台的数据库选型要考虑流量波动、数据规模和实时性需求，如使用Redis的Sorted Set处理实时排行榜，List处理用户关注列表，使用分布式数据库PolarDB-X处理核心业务数据，AnalyticDB进行大数据分析。通过这些技术和策略，直播平台能够应对复杂的业务需求和流量挑战。

胡刀

141

如葑

2024-05-15

154

统一观测丨使用 Prometheus 监控云原生网关，我们该关注哪些指标？

MSE 云原生网关默认提供了丰富的 Metrics 指标大盘，配合阿里云 Prometheus 监控提供开箱即用的完整可观测性能力，能够帮助用户快捷、高效的搭建自身的微服务网关与对应的可观测体系。

如葑

154

类目筛选

内容类型

vLLM部署Yuan2.0：高吞吐、更便捷

手把手教你捏一个自己的Agent

无需重新学习，使用 Kibana 查询/可视化 SLS 数据

基于 Prometheus 的超算弹性计算场景下主机监控最佳实践

一文详解Spring Bean循环依赖

弹性调度助力企业灵活应对业务变化，高效管理云上资源

FunASR 语音大模型在 Arm Neoverse 平台上的优化实践

泛娱乐直播平台的数据库选型和场景解决方案

统一观测丨使用 Prometheus 监控云原生网关，我们该关注哪些指标？