官方博客-第6页-阿里云开发者社区

阿里云云原生

2025-04-29

680

剑指大规模 AI 可观测，阿里云 Prometheus 2.0 应运而生

本文介绍了阿里云Prometheus 2.0方案，针对大规模AI系统的可观测性挑战进行全面升级。内容涵盖数据采集、存储、计算、查询及生态整合等维度。 Prometheus 2.0引入自研LoongCollector实现多模态数据采集，采用全新时序存储引擎提升性能，并支持RecordingRule与ScheduleSQL预聚合计算。查询阶段提供跨区域、跨账号的统一查询能力，结合PromQL与SPL语言增强分析功能。此外，该方案已成功应用于阿里云内部AI系统，如百炼、通义千问等大模型全链路监控。未来，阿里云将发布云监控2.0产品，进一步完善智能观测技术栈。

阿里云云原生

680

任庆盛

2023-02-22

23172

Flink CDC+Kafka 加速业务实时化

阿里巴巴开发工程师，Apache Flink Committer 任庆盛，在 9 月 24 日 Apache Flink Meetup 的分享。

任庆盛

23,172

张佐玮

2023-12-01

1546

Koordinator 助力云原生应用性能提升，小红书混部技术实践

本文基于 2023 云栖大会上关于 Koordinator 分享的实录，介绍小红书通过规模化落地混部技术来大幅提升集群资源效能，降低业务资源成本。

张佐玮

1,546

赫曦

2024-05-15

93192

阿里云云原生弹性方案，用弹性解决集群资源利用率难题

本文主要介绍了通过弹性，实现成本优化，解决集群资源利用率难题。

赫曦

93,192

古琦

2024-07-04

109501

全链路追踪 & 性能监控，GO 应用可观测全面升级

当前，大多数面向 Golang 应用的监控能力主要是通过 SDK 方式接入，需要开放人员手动进行埋点，会存在一定问题。对此，可观测 Go Agent 应运而生。本文介绍的阿里云可观测 Go Agent 方案，能通过无侵入的方式实现应用监控能力。

古琦

109,501

阿里云云原生

2025-01-24

797

智能理解 PPT 内容，快速生成讲解视频

本方案利用函数计算 FC 部署 Web 应用，调用百炼模型服务实现 PPT 到视频的自动转换。视觉模型智能理解 PPT 图文内容，快速生成相匹配的解说词；文本模型对解说词进行优化，提高其可读性和吸引力；语音模型则根据解说词生成生动流畅的旁白音频。整个过程高度集成，只需一键操作，系统即可自动整合图片、文本和音频素材，快速生成对应讲解视频。

阿里云云原生

797

子白

2024-05-15

102450

大语言模型推理提速，TensorRT-LLM 高性能推理实践

大型语言模型（Large language models,LLM）是基于大量数据进行预训练的超大型深度学习模型，本文主要讲述TensorRT-LLM利用量化、In-Flight Batching、Attention、Graph Rewriting提升 LLM 模型推理效率。

子白

102,450

烨陌

2024-05-15

705

基于SLS平台与日志审计构建Cloud SIEM方案

安全事件和事件管理（security information and event management，SIEM）通过对来自各种数据源安全事件的收集和分析，来实现威胁检测、安全事件管理和合规性检测。SIEM是在安全信息管理(SIM)——收集、分析并报告日志数据，与安全事件管理(SEM)——实时分析日志和事件数据以提供威胁监视、事件关联和事件响应的基础上发展而来的。本文为您介绍如何基于SLS平台与日志审计构建Cloud SIEM方案。

烨陌

705

坤硕

2024-07-29

20096

LLM 应用可观测性：从 Trace 视角展开的探索与实践之旅

基于大语言模型的应用在性能、成本、效果等方面存在一系列实际痛点，本文通过分析 LLM 应用模式以及关注点差异来阐明可观测技术挑战，近期阿里云可观测推出了面向 LLM 应用的可观测解决方案以及最佳实践，一起来了解下吧。

坤硕

20,096

官方博客-第6页-阿里云开发者社区

类目筛选

内容类型

剑指大规模 AI 可观测，阿里云 Prometheus 2.0 应运而生

Flink CDC+Kafka 加速业务实时化

Koordinator 助力云原生应用性能提升，小红书混部技术实践

阿里云云原生弹性方案，用弹性解决集群资源利用率难题

全链路追踪 & 性能监控，GO 应用可观测全面升级

智能理解 PPT 内容，快速生成讲解视频

大语言模型推理提速，TensorRT-LLM 高性能推理实践

基于SLS平台与日志审计构建Cloud SIEM方案

LLM 应用可观测性：从 Trace 视角展开的探索与实践之旅

官方博客-第6页-阿里云开发者社区

探索云世界

热门

云计算

大数据

云原生

人工智能

数据库

开发与运维

活动广场

任务中心

训练营

直播

乘风者计划

下载

镜像站

技术资料

类目筛选

内容类型

剑指大规模 AI 可观测，阿里云 Prometheus 2.0 应运而生

Flink CDC+Kafka 加速业务实时化

Koordinator 助力云原生应用性能提升，小红书混部技术实践

阿里云云原生弹性方案，用弹性解决集群资源利用率难题

全链路追踪 & 性能监控，GO 应用可观测全面升级

智能理解 PPT 内容，快速生成讲解视频

大语言模型推理提速，TensorRT-LLM 高性能推理实践

基于SLS平台与日志审计构建Cloud SIEM方案

LLM 应用可观测性：从 Trace 视角展开的探索与实践之旅