官方博客-第10页-阿里云开发者社区

ModelScope

2024-05-15

1155

vLLM部署Yuan2.0：高吞吐、更便捷

vLLM是UC Berkeley开源的大语言模型高速推理框架，其内存管理核心——PagedAttention、内置的加速算法如Continues Batching等，一方面可以提升Yuan2.0模型推理部署时的内存使用效率，另一方面可以大幅提升在实时应用场景下Yuan2.0的吞吐量。

ModelScope

1,155

欧叔

2024-05-15

729

使用智能媒体生产ICE剪辑OSS视频文件

本篇介绍智能媒体生产ICE一些常见场景，如裁剪、拼接、字幕、ASR等，通过一些时间线示例，介绍如何快速剪辑OSS上的视频文件。

欧叔

729

龙蜥社区OpenAnolis

2024-11-06

2921

AI 场景下确保模型数据安全，Confidential AI 技术最佳实践解读

机密计算软硬结合技术保障数据安全。

龙蜥社区OpenAnolis

2,921

ModelScope

2025-06-16

544

告别‘人海战术’！基于EvalScope 的文生图模型智能评测新方案

生成式模型在文本生成图片等领域的快速发展，为社区带来了日新月异的诸多文生图模型。

ModelScope

544

子白

2024-05-15

102450

大语言模型推理提速，TensorRT-LLM 高性能推理实践

大型语言模型（Large language models,LLM）是基于大量数据进行预训练的超大型深度学习模型，本文主要讲述TensorRT-LLM利用量化、In-Flight Batching、Attention、Graph Rewriting提升 LLM 模型推理效率。

子白

102,450

虎仔

2024-10-22

1181

最佳实践：通义灵码生成单元测试，让单测更简单

本文首先讲述了什么是单元测试、单元测试的价值、一个好的单元测试所具备的原则，进而引入如何去编写一个好的单元测试，通义灵码是如何快速生成单元测试的。

虎仔

1,181

昱临

2024-11-14

1049

万字干货｜复杂表格多Agent方案：从LLM洞察、系统性思考到实践经验总结

笔者结合实践经验以近期在负责的复杂表格智能问答为切入点，结合大模型的哲学三问（“是谁、从哪里来、到哪里去”），穿插阐述自己对大模型的一些理解与判断，以及面向公共云LLM的建设模式思考，并分享软件设计+模型算法结合的一些研发实践经验。

昱临

1,049

澄潭

2025-04-03

1843

开源 Remote MCP Server 一站式托管来啦！

MCP Server 的实施存在着诸多挑战，特别是在认证授权、服务可靠性和可观测性方面，Higress 作为 AI 原生的 API 网关，提供了完整的开源 MCP Server 托管解决方案，实现存量 API 到 MCP 的协议转换。即将上线的 MCP 市场，将大幅降低开发者构建 MCP Server 的时间和人力成本。

澄潭

1,843

阿里云云原生

2025-05-16

648

日志采集 Agent 性能大比拼——LoongCollector 性能深度测评

为了展现 LoongCollector 的卓越性能，本文通过纵向（LoongCollector 与 iLogtail 产品升级对比）和横向（LoongCollector 与其他开源日志采集 Agent 对比）两方面对比，深度测评不同采集 Agent 在常见的日志采集场景下的性能。

阿里云云原生

648

官方博客-第10页-阿里云开发者社区

类目筛选

内容类型

vLLM部署Yuan2.0：高吞吐、更便捷

使用智能媒体生产ICE剪辑OSS视频文件

AI 场景下确保模型数据安全，Confidential AI 技术最佳实践解读

告别‘人海战术’！基于EvalScope 的文生图模型智能评测新方案

大语言模型推理提速，TensorRT-LLM 高性能推理实践

最佳实践：通义灵码生成单元测试，让单测更简单

万字干货｜复杂表格多Agent方案：从LLM洞察、系统性思考到实践经验总结

开源 Remote MCP Server 一站式托管来啦！

日志采集 Agent 性能大比拼——LoongCollector 性能深度测评

官方博客-第10页-阿里云开发者社区

探索云世界

热门

云计算

大数据

云原生

人工智能

数据库

开发与运维

活动广场

任务中心

训练营

直播

乘风者计划

下载

镜像站

技术资料

类目筛选

内容类型

vLLM部署Yuan2.0：高吞吐、更便捷

使用智能媒体生产ICE剪辑OSS视频文件

AI 场景下确保模型数据安全，Confidential AI 技术最佳实践解读

告别‘人海战术’！基于EvalScope 的文生图模型智能评测新方案

大语言模型推理提速，TensorRT-LLM 高性能推理实践

最佳实践：通义灵码生成单元测试，让单测更简单

万字干货｜复杂表格多Agent方案：从LLM洞察、系统性 思考到实践经验总结

开源 Remote MCP Server 一站式托管来啦！

日志采集 Agent 性能大比拼——LoongCollector 性能深度测评

万字干货｜复杂表格多Agent方案：从LLM洞察、系统性思考到实践经验总结