ModelScope

2024-05-15

vLLM部署Yuan2.0：高吞吐、更便捷

vLLM是UC Berkeley开源的大语言模型高速推理框架，其内存管理核心——PagedAttention、内置的加速算法如Continues Batching等，一方面可以提升Yuan2.0模型推理部署时的内存使用效率，另一方面可以大幅提升在实时应用场景下Yuan2.0的吞吐量。

ModelScope

356

涯海

2024-06-03

61035

一站式链路追踪：阿里云的端到端解决方案

端到端链路追踪是覆盖全部关联 IT 系统，能够完整记录用户行为在系统间调用路径与状态的最佳实践方案。而真正实现端到端链路追踪，需要解决三个难题：链路插桩、链路采集与加工、链路上下文透传。阿里云 ARMS 目前已支持全链路端到端追踪，快来查看转发吧~

涯海

61,035

泮圣伟

2024-05-15

226

线上故障突突突？如何紧急诊断、排查与恢复

本文简单介绍了阿里云上关于故障恢复、诊断的一些最佳实践。

泮圣伟

226

ModelScope

2024-05-15

103433

手把手教你捏一个自己的Agent

Modelscope AgentFabric是一个基于ModelScope-Agent的交互式智能体应用，用于方便地创建针对各种现实应用量身定制智能体，目前已经在生产级别落地。

ModelScope

103,433

阿里云云原生

2024-05-22

60061

基于 Prometheus 的超算弹性计算场景下主机监控最佳实践

超算快速弹性伸缩场景下，如何构建一套准确、快速、可靠的监控体系成为关键点。阿里云在超算场景的主机监控落地实践，解决超算场景面临的挑战，交付一套可靠和全面的主机监控体系。

阿里云云原生

60,061

澄潭

2024-06-03

41110

计算机英文教材太难啃，Higress 和通义千问帮你

英文技术内容翻译难于理解，如何跨语言学习？通义千问结合 Higress 的多模型协议转换能力，可以通过配置插件获得推理模型基于内容理解后的精准翻译，点击本文手把手教你如何配置。

澄潭

41,110

阿里云云原生

2023-07-27

43384

一文详解Spring Bean循环依赖

本文主要梳理了Spring解决bean循环依赖的思路。

阿里云云原生

43,384

刘军

2024-06-18

16537

Dubbo3 服务原生支持 http 访问，兼具高性能与易用性

本文展示了 Dubbo3 triple 协议是如何简化从协议规范与实现上简化开发测试、入口流量接入成本的，同时提供高性能通信、面向接口的易用性编码。

刘军

16,537

怀虎

2024-07-08

46670

私网环境下使用云效流水线进行 CI/CD的方法

云效流水线可以托管用户的私网环境内的机器，并将构建任务调度到这些机器上，从而确保整个构建过程，和代码库和制品库的交互在私网环境下进行。

怀虎

46,670

类目筛选

内容类型

vLLM部署Yuan2.0：高吞吐、更便捷

一站式链路追踪：阿里云的端到端解决方案

线上故障突突突？如何紧急诊断、排查与恢复

手把手教你捏一个自己的Agent

基于 Prometheus 的超算弹性计算场景下主机监控最佳实践

计算机英文教材太难啃，Higress 和通义千问帮你

一文详解Spring Bean循环依赖

Dubbo3 服务原生支持 http 访问，兼具高性能与易用性

私网环境下使用云效流水线进行 CI/CD的方法