ModelScope

2024-05-15

vLLM部署Yuan2.0：高吞吐、更便捷

vLLM是UC Berkeley开源的大语言模型高速推理框架，其内存管理核心——PagedAttention、内置的加速算法如Continues Batching等，一方面可以提升Yuan2.0模型推理部署时的内存使用效率，另一方面可以大幅提升在实时应用场景下Yuan2.0的吞吐量。

ModelScope

408

龙蜥社区OpenAnolis

2024-05-15

112

从故障演练到运维工具产品力评测的探索 | 龙蜥技术

随着AI和云原生技术的发展，业界运维工具百花齐放，该如何让优秀的工具脱颖而出？

龙蜥社区OpenAnolis

112

ModelScope

2024-05-15

193

联合XTuner，魔搭社区全面支持数据集的长文本训练

XTuner和魔搭社区（SWIFT）合作引入了一项长序列文本训练技术，该技术能够在多GPU环境中将长序列文本数据分割并分配给不同GPU，从而减少每个GPU上的显存占用。通过这种方式，训练超大规模模型时可以处理更长的序列，提高训练效率。魔搭社区的SWIFT框架已经集成了这一技术，支持多种大模型和数据集的训练。此外，SWIFT还提供了一个用户友好的界面，方便用户进行训练和部署，并且支持评估功能。

ModelScope

193

史泽寰

2023-09-19

832

全网最细，深度解析 Istio Ambient Mesh 流量路径

本文旨在对 Istio Ambient Mesh 的流量路径进行详细解读，力求尽可能清晰地呈现细节，以帮助读者完全理解 Istio Ambient Mesh 中最为关键的部分。

史泽寰

832

尹航

2023-10-09

29856

基于阿里云服务网格流量泳道的全链路流量管理（一）严格模式流量泳道

灰度发布是一种常见的对新版本应用服务的发布手段，其特点在于能够将流量在服务的稳定版本和灰度版本之间时刻切换，以帮助我们用更加可靠的方式实现服务的升级。

尹航

29,856

豁朗

2024-05-15

56091

使用 SPL 高效实现 Flink SLS Connector 下推

SLS 推出了 SPL 语言，可以高效的对日志数据的清洗，加工。对 SPL 及 SPL 在阿里云 Flink SLS Connector 中应用进行介绍及举例。

豁朗

56,091

离澈

2024-05-15

108

万字长文：一文详解单元测试干了什么

好的单元测试不仅可以验证代码结构设计的是否合理，而且可以提前发现代码中的漏洞，将线上风险扼杀在摇篮中。本文从常用的单元测试框架出发，对Mockito框架深入浅出的讲解，希望能帮到每一位同学。

离澈

108

升正

2024-05-15

98

请删掉99%的useMemo

你的useMemo真正为你的项目带来了多少性能上的优化？由于useMemo和useCallback类似，所以本文全文会在大部分地方以useMemo为例，部分例子使用useCallback帮助大家更好的理解两个hooks。

升正

98

龙蜥社区OpenAnolis

2024-07-05

118

重新定义 AI 部署效率与性能，ZOLOZ 借助 AC2 实现低成本高性能的提优的方式｜ AI 案例推荐

ZOLOZ，视觉 AI 推理的算力和成本问题求解。

龙蜥社区OpenAnolis

118

类目筛选

内容类型

vLLM部署Yuan2.0：高吞吐、更便捷

从故障演练到运维工具产品力评测的探索 | 龙蜥技术

联合XTuner，魔搭社区全面支持数据集的长文本训练

全网最细，深度解析 Istio Ambient Mesh 流量路径

基于阿里云服务网格流量泳道的全链路流量管理（一）严格模式流量泳道

使用 SPL 高效实现 Flink SLS Connector 下推

万字长文：一文详解单元测试干了什么

请删掉99%的useMemo

重新定义 AI 部署效率与性能，ZOLOZ 借助 AC2 实现低成本高性能的提优的方式｜ AI 案例推荐