官方博客-第17页-阿里云开发者社区

子白

2024-05-15

102475

大语言模型推理提速，TensorRT-LLM 高性能推理实践

大型语言模型（Large language models,LLM）是基于大量数据进行预训练的超大型深度学习模型，本文主要讲述TensorRT-LLM利用量化、In-Flight Batching、Attention、Graph Rewriting提升 LLM 模型推理效率。

子白

102,475

阿里云云原生

2024-05-15

55732

Higress 全新 Wasm 运行时，性能大幅提升

本文介绍 Higress 将 Wasm 插件的运行时从 V8 切换到 WebAssembly Micro Runtime (WAMR) 的最新进展。

阿里云云原生

55,732

阿里云实时数仓Hologres

2024-06-18

2332

森马基于MaxCompute+Hologres+DataWorks构建数据中台

本次案例主要分享森马集团面对多年自建的多套数仓产品体系，通过阿里云MaxCompute+Hologres+DataWorks统一数仓平台，保障数据生产稳定性与数据质量，减少ETL链路及计算时间，每年数仓整体费用从300多万降到180万。

阿里云实时数仓Hologres

2,332

新念

2025-02-14

1450

DeepSeek-V3 高效训练关键技术分析

本文从模型架构、并行策略、通信优化和显存优化四个方面展开，深入分析了DeepSeek-V3高效训练的关键技术，探讨其如何以仅5%的算力实现对标GPT-4o的性能。

新念

1,450

丕天

2025-03-21

1160

AI 推理场景的痛点和解决方案

一个典型的推理场景面临的问题可以概括为限流、负载均衡、异步化、数据管理、索引增强 5 个场景。通过云数据库 Tair 丰富的数据结构可以支撑这些场景，解决相关问题，本文我们会针对每个场景逐一说明。

丕天

1,160

李德

2025-03-27

1163

大模型联网搜索的短板与突破之路

本文作者详细分析了当前大模型在联网搜索功能中存在的几个主要问题，并提供了具体的案例和解决方案。

李德

1,163

阿里云云原生

2025-06-20

627

Function AI 工作流发布：以 AI 重塑企业流程自动化

本文介绍了基于函数计算 FC 打造的全新 Function AI 工作流服务，该服务结合 AI 技术与流程自动化，实现从传统流程自动化到智能流程自动化的跨越。文章通过内容营销素材生成、内容安全审核和泛企业 VOC 挖掘三个具体场景，展示了 Function AI 工作流的设计、配置及调试过程，并对比了其与传统流程的优势。Function AI 工作流具备可视化、智能性和可扩展性，成为企业智能化转型的重要基础设施，助力企业提升效率、降低成本并增强敏捷响应能力。

阿里云云原生

627

阿里云云原生

2025-08-01

1041

Vibecoding 新体验：实测 Qwen3 Coder 代码生成效果

Qwen3 Coder 是全球领先的开源编程大模型，具备强大的代码生成能力与1M超长上下文支持，适用于构建复杂应用。本文通过实际案例展示其在电商网站开发中的应用，并详解提示词设计、技术拆解与部署方案，探讨Agentic AI落地的挑战与经验。

阿里云云原生

1,041

张佐玮

2023-12-01

1563

Koordinator 助力云原生应用性能提升，小红书混部技术实践

本文基于 2023 云栖大会上关于 Koordinator 分享的实录，介绍小红书通过规模化落地混部技术来大幅提升集群资源效能，降低业务资源成本。

张佐玮

1,563

官方博客-第17页-阿里云开发者社区

类目筛选

内容类型

大语言模型推理提速，TensorRT-LLM 高性能推理实践

Higress 全新 Wasm 运行时，性能大幅提升

森马基于MaxCompute+Hologres+DataWorks构建数据中台

DeepSeek-V3 高效训练关键技术分析

AI 推理场景的痛点和解决方案

大模型联网搜索的短板与突破之路

Function AI 工作流发布：以 AI 重塑企业流程自动化

Vibecoding 新体验：实测 Qwen3 Coder 代码生成效果

Koordinator 助力云原生应用性能提升，小红书混部技术实践

官方博客-第17页-阿里云开发者社区

探索云世界

热门

云计算

大数据

云原生

人工智能

数据库

开发与运维

活动广场

任务中心

训练营

直播

乘风者计划

下载

镜像站

技术资料

类目筛选

内容类型

大语言模型推理提速，TensorRT-LLM 高性能推理实践

Higress 全新 Wasm 运行时，性能大幅提升

森马基于MaxCompute+Hologres+DataWorks构建数据中台

DeepSeek-V3 高效训练关键技术分析

AI 推理场景的痛点和解决方案

大模型联网搜索的短板与突破之路

Function AI 工作流发布：以 AI 重塑企业流程自动化

Vibecoding 新体验：实测 Qwen3 Coder 代码生成效果

Koordinator 助力云原生应用性能提升，小红书混部技术实践