ModelScope

2024-05-15

vLLM部署Yuan2.0：高吞吐、更便捷

vLLM是UC Berkeley开源的大语言模型高速推理框架，其内存管理核心——PagedAttention、内置的加速算法如Continues Batching等，一方面可以提升Yuan2.0模型推理部署时的内存使用效率，另一方面可以大幅提升在实时应用场景下Yuan2.0的吞吐量。

ModelScope

408

刘军

2024-06-18

16589

Dubbo3 服务原生支持 http 访问，兼具高性能与易用性

本文展示了 Dubbo3 triple 协议是如何简化从协议规范与实现上简化开发测试、入口流量接入成本的，同时提供高性能通信、面向接口的易用性编码。

刘军

16,589

阿里云实时数仓Hologres

2022-12-06

1232

升级JSONB列式存储，Hologres助力淘宝搜索2022双11降本增效

升级JSONB列式存储，Hologres助力淘宝搜索2022双11降本增效。

阿里云实时数仓Hologres

1,232

CloudImagine

2024-05-15

121

AIGC下一步：用AI再度重构或优化媒体处理

LiveVideoStackCon2023深圳站，阿里云视频云演讲分享

CloudImagine

121

阿里云云原生

2024-05-15

70

实践总结｜前端架构设计的一点考究（中）

本文总结了作者在日常/大促业务的“敏捷”开发过程中产生的疑惑，并尝试做出思考得到一些解决思路和方案。在前端开发和实践过程中，梳理了一些简单设计方案可以缓解当时 “头疼” 的几个敏捷迭代问题，并实践在项目迭代中。

阿里云云原生

70

离澈

2024-05-15

108

万字长文：一文详解单元测试干了什么

好的单元测试不仅可以验证代码结构设计的是否合理，而且可以提前发现代码中的漏洞，将线上风险扼杀在摇篮中。本文从常用的单元测试框架出发，对Mockito框架深入浅出的讲解，希望能帮到每一位同学。

离澈

108

升正

2024-05-15

98

请删掉99%的useMemo

你的useMemo真正为你的项目带来了多少性能上的优化？由于useMemo和useCallback类似，所以本文全文会在大部分地方以useMemo为例，部分例子使用useCallback帮助大家更好的理解两个hooks。

升正

98

阿里云实时计算Flink

2023-04-13

868

海量数据实时分析引擎 Apache Flink

当系统出现大量或者重大的错误却不被人感知，将会对业务产生影响，从而导致资产损失。当竞争对手实施了新战术，却无法及时感知，跟不上竞争对手的节奏，总是追着对方尾巴走。当要做决策的时候，海量的业务数据增长却无法实时看到聚合结果，决策总是凭借过往经验或者过时的数据分析之上。

阿里云实时计算Flink

868

阿里云实时数仓Hologres

2023-07-17

20676

基于Hologres向量计算与大模型免费定制专属聊天机器人

本文为您介绍如何基于Hologres向量计算能力，结合大模型的阅读理解和信息整合能力，对该垂直行业的问题提供更贴切的回答，即费、快速定制专属聊天机器人。

阿里云实时数仓Hologres

20,676

类目筛选

内容类型

vLLM部署Yuan2.0：高吞吐、更便捷

Dubbo3 服务原生支持 http 访问，兼具高性能与易用性

升级JSONB列式存储，Hologres助力淘宝搜索2022双11降本增效

AIGC下一步：用AI再度重构或优化媒体处理

实践总结｜前端架构设计的一点考究（中）

万字长文：一文详解单元测试干了什么

请删掉99%的useMemo

海量数据实时分析引擎 Apache Flink

基于Hologres向量计算与大模型免费定制专属聊天机器人