官方博客-第8页-阿里云开发者社区

子白

2024-05-15

102475

大语言模型推理提速，TensorRT-LLM 高性能推理实践

大型语言模型（Large language models,LLM）是基于大量数据进行预训练的超大型深度学习模型，本文主要讲述TensorRT-LLM利用量化、In-Flight Batching、Attention、Graph Rewriting提升 LLM 模型推理效率。

子白

102,475

阿里云云原生

2024-05-15

55732

Higress 全新 Wasm 运行时，性能大幅提升

本文介绍 Higress 将 Wasm 插件的运行时从 V8 切换到 WebAssembly Micro Runtime (WAMR) 的最新进展。

阿里云云原生

55,732

穿杨

2024-08-21

429

谈谈优雅的钩子--bpftrace

bpftrace是一个内核跟踪工具，简单来说就是在函数上挂个钩子，挂上钩子后就可以将函数的入参和返回值取出来再放入程序进行二次编程，最终能让程序按照我们的意图来对函数进行观测。

穿杨

429

阿里云瑶池数据库

2024-11-14

1066

拥抱Data+AI｜解码Data+AI助力游戏日志智能分析

「拥抱Data+AI」系列第2篇：阿里云DMS+AnalyticDB助力游戏日志数据分析与预测

阿里云瑶池数据库

1,066

寒斜

2024-11-19

783

基于事件驱动构建 AI 原生应用

AI 应用在商业化服务的阶段会面临诸多挑战，比如更快的服务交付速度，更实时、精准的结果以及更人性化的体验等，传统架构限制于同步交互，无法满足上述需求，本篇文章给大家分享一下如何基于事件驱动架构应对上述挑战。

寒斜

783

勉成

2024-12-12

600

如何找出Java进程占用CPU高的元凶

本文记录了一次Java进程CPU占用率过高的问题和排查思路。

勉成

600

日休

2025-03-06

1391

一招解决数据库中报表查询慢的痛点

本文旨在解决传统数据库系统如PostgreSQL在处理复杂分析查询时面临的性能瓶颈问题。

日休

1,391

丕天

2025-03-21

1160

AI 推理场景的痛点和解决方案

一个典型的推理场景面临的问题可以概括为限流、负载均衡、异步化、数据管理、索引增强 5 个场景。通过云数据库 Tair 丰富的数据结构可以支撑这些场景，解决相关问题，本文我们会针对每个场景逐一说明。

丕天

1,160

张佐玮

2023-12-01

1563

Koordinator 助力云原生应用性能提升，小红书混部技术实践

本文基于 2023 云栖大会上关于 Koordinator 分享的实录，介绍小红书通过规模化落地混部技术来大幅提升集群资源效能，降低业务资源成本。

张佐玮

1,563

官方博客-第8页-阿里云开发者社区

类目筛选

内容类型

大语言模型推理提速，TensorRT-LLM 高性能推理实践

Higress 全新 Wasm 运行时，性能大幅提升

谈谈优雅的钩子--bpftrace

拥抱Data+AI｜解码Data+AI助力游戏日志智能分析

基于事件驱动构建 AI 原生应用

如何找出Java进程占用CPU高的元凶

一招解决数据库中报表查询慢的痛点

AI 推理场景的痛点和解决方案

Koordinator 助力云原生应用性能提升，小红书混部技术实践

官方博客-第8页-阿里云开发者社区

探索云世界

热门

云计算

大数据

云原生

人工智能

数据库

开发与运维

活动广场

任务中心

训练营

直播

乘风者计划

下载

镜像站

技术资料

类目筛选

内容类型

大语言模型推理提速，TensorRT-LLM 高性能推理实践

Higress 全新 Wasm 运行时，性能大幅提升

谈谈优雅的钩子--bpftrace

拥抱Data+AI｜解码Data+AI助力游戏日志智能分析

基于事件驱动构建 AI 原生应用

如何找出Java进程占用CPU高的元凶

一招解决数据库中报表查询慢的痛点

AI 推理场景的痛点和解决方案

Koordinator 助力云原生应用性能提升，小红书混部技术实践