ModelScope

2024-05-15

vLLM部署Yuan2.0：高吞吐、更便捷

vLLM是UC Berkeley开源的大语言模型高速推理框架，其内存管理核心——PagedAttention、内置的加速算法如Continues Batching等，一方面可以提升Yuan2.0模型推理部署时的内存使用效率，另一方面可以大幅提升在实时应用场景下Yuan2.0的吞吐量。

ModelScope

408

升正

2024-05-15

98

请删掉99%的useMemo

你的useMemo真正为你的项目带来了多少性能上的优化？由于useMemo和useCallback类似，所以本文全文会在大部分地方以useMemo为例，部分例子使用useCallback帮助大家更好的理解两个hooks。

升正

98

ModelScope

2024-05-15

194

联合XTuner，魔搭社区全面支持数据集的长文本训练

XTuner和魔搭社区（SWIFT）合作引入了一项长序列文本训练技术，该技术能够在多GPU环境中将长序列文本数据分割并分配给不同GPU，从而减少每个GPU上的显存占用。通过这种方式，训练超大规模模型时可以处理更长的序列，提高训练效率。魔搭社区的SWIFT框架已经集成了这一技术，支持多种大模型和数据集的训练。此外，SWIFT还提供了一个用户友好的界面，方便用户进行训练和部署，并且支持评估功能。

ModelScope

194

澄潭董艺荃

2024-05-16

87960

通义千问 2.5 “客串” ChatGPT4，看这篇让你分清楚

这篇文章介绍了使用开源工具NextChat和Higress搭建的一个模拟ChatGPT和通义千问对话PK的测试场景。

澄潭董艺荃

87,960

刘军

2024-06-18

16589

Dubbo3 服务原生支持 http 访问，兼具高性能与易用性

本文展示了 Dubbo3 triple 协议是如何简化从协议规范与实现上简化开发测试、入口流量接入成本的，同时提供高性能通信、面向接口的易用性编码。

刘军

16,589

怀虎

2024-07-08

46689

私网环境下使用云效流水线进行 CI/CD的方法

云效流水线可以托管用户的私网环境内的机器，并将构建任务调度到这些机器上，从而确保整个构建过程，和代码库和制品库的交互在私网环境下进行。

怀虎

46,689

灵圣

2024-07-22

18080

SLS 数据加工全面升级，集成 SPL 语法

在系统开发、运维过程中，日志是最重要的信息之一，其最大的优点是简单直接。SLS 数据加工功能旨在解决非结构化的日志数据处理，当前全面升级，集成 SPL 语言、更强的数据处理性能、更优的使用成本。

灵圣

18,080

阿里云云原生

2024-07-29

158

从供应商深度绑定，到走向真正的云原生，他们是这样做的

没有 K8s 的运维权限，开发者也能排查和定位问题。

阿里云云原生

158

阿里云MaxCompute

2023-09-27

1187

深入MaxCompute，人力家借助Information Schema合理治理费用

本文将为大家带来MaxCompute与人力家客户案例深度解读。

阿里云MaxCompute

1,187

类目筛选

内容类型

vLLM部署Yuan2.0：高吞吐、更便捷

请删掉99%的useMemo

联合XTuner，魔搭社区全面支持数据集的长文本训练

通义千问 2.5 “客串” ChatGPT4，看这篇让你分清楚

Dubbo3 服务原生支持 http 访问，兼具高性能与易用性

私网环境下使用云效流水线进行 CI/CD的方法

SLS 数据加工全面升级，集成 SPL 语法

从供应商深度绑定，到走向真正的云原生，他们是这样做的

深入MaxCompute，人力家借助Information Schema合理治理费用