官方博客-第14页-阿里云开发者社区

ModelScope

2024-05-15

1155

vLLM部署Yuan2.0：高吞吐、更便捷

vLLM是UC Berkeley开源的大语言模型高速推理框架，其内存管理核心——PagedAttention、内置的加速算法如Continues Batching等，一方面可以提升Yuan2.0模型推理部署时的内存使用效率，另一方面可以大幅提升在实时应用场景下Yuan2.0的吞吐量。

ModelScope

1,155

欧叔

2024-05-15

729

使用智能媒体生产ICE剪辑OSS视频文件

本篇介绍智能媒体生产ICE一些常见场景，如裁剪、拼接、字幕、ASR等，通过一些时间线示例，介绍如何快速剪辑OSS上的视频文件。

欧叔

729

古琦

2024-07-04

109501

全链路追踪 & 性能监控，GO 应用可观测全面升级

当前，大多数面向 Golang 应用的监控能力主要是通过 SDK 方式接入，需要开放人员手动进行埋点，会存在一定问题。对此，可观测 Go Agent 应运而生。本文介绍的阿里云可观测 Go Agent 方案，能通过无侵入的方式实现应用监控能力。

古琦

109,501

阿里云云原生

2025-01-24

797

智能理解 PPT 内容，快速生成讲解视频

本方案利用函数计算 FC 部署 Web 应用，调用百炼模型服务实现 PPT 到视频的自动转换。视觉模型智能理解 PPT 图文内容，快速生成相匹配的解说词；文本模型对解说词进行优化，提高其可读性和吸引力；语音模型则根据解说词生成生动流畅的旁白音频。整个过程高度集成，只需一键操作，系统即可自动整合图片、文本和音频素材，快速生成对应讲解视频。

阿里云云原生

797

ModelScope

2025-06-16

544

告别‘人海战术’！基于EvalScope 的文生图模型智能评测新方案

生成式模型在文本生成图片等领域的快速发展，为社区带来了日新月异的诸多文生图模型。

ModelScope

544

阿里云PolarDB

2023-08-22

3677

深度优化 | PolarDB-X 基于向量化SIMD指令的探索

本文将介绍PolarDB-X对于向量化SIMD指令的探索和实践，包括基本用法及实现原理，以及在具体算子实现中的思考和沉淀。

阿里云PolarDB

3,677

子白

2024-05-15

102450

大语言模型推理提速，TensorRT-LLM 高性能推理实践

大型语言模型（Large language models,LLM）是基于大量数据进行预训练的超大型深度学习模型，本文主要讲述TensorRT-LLM利用量化、In-Flight Batching、Attention、Graph Rewriting提升 LLM 模型推理效率。

子白

102,450

阿里云云原生

2024-05-24

47966

“黏土风格”轻松拿捏，基于函数计算部署 ComfyUI实现AI生图

使用阿里云函数计算FC，快速部署AI绘画工具ComfyUI，体验高质量图像生成。新用户可享180元试用额度，包括GPU、vCPU、内存和调用次数。开通FC和文件存储NAS，通过应用中心选择ComfyUI模板创建应用。

阿里云云原生

47,966

坤硕

2024-07-29

20096

LLM 应用可观测性：从 Trace 视角展开的探索与实践之旅

基于大语言模型的应用在性能、成本、效果等方面存在一系列实际痛点，本文通过分析 LLM 应用模式以及关注点差异来阐明可观测技术挑战，近期阿里云可观测推出了面向 LLM 应用的可观测解决方案以及最佳实践，一起来了解下吧。

坤硕

20,096

官方博客-第14页-阿里云开发者社区

类目筛选

内容类型

vLLM部署Yuan2.0：高吞吐、更便捷

使用智能媒体生产ICE剪辑OSS视频文件

全链路追踪 & 性能监控，GO 应用可观测全面升级

智能理解 PPT 内容，快速生成讲解视频

告别‘人海战术’！基于EvalScope 的文生图模型智能评测新方案

深度优化 | PolarDB-X 基于向量化SIMD指令的探索

大语言模型推理提速，TensorRT-LLM 高性能推理实践

“黏土风格”轻松拿捏，基于函数计算部署 ComfyUI实现AI生图

LLM 应用可观测性：从 Trace 视角展开的探索与实践之旅

官方博客-第14页-阿里云开发者社区

探索云世界

热门

云计算

大数据

云原生

人工智能

数据库

开发与运维

活动广场

任务中心

训练营

直播

乘风者计划

下载

镜像站

技术资料

类目筛选

内容类型

vLLM部署Yuan2.0：高吞吐、更便捷

使用智能媒体生产ICE剪辑OSS视频文件

全链路追踪 & 性能监控，GO 应用可观测全面升级

智能理解 PPT 内容，快速生成讲解视频

告别‘人海战术’！基于EvalScope 的文生图模型智能评测新方案

深度优化 | PolarDB-X 基于向量化SIMD指令的探索

大语言模型推理提速，TensorRT-LLM 高性能推理实践

“黏土风格”轻松拿捏，基于函数计算部署 ComfyUI实现AI生图

LLM 应用可观测性：从 Trace 视角展开的探索与实践之旅