官方博客-第12页-阿里云开发者社区

子白

2024-05-15

102599

大语言模型推理提速，TensorRT-LLM 高性能推理实践

大型语言模型（Large language models,LLM）是基于大量数据进行预训练的超大型深度学习模型，本文主要讲述TensorRT-LLM利用量化、In-Flight Batching、Attention、Graph Rewriting提升 LLM 模型推理效率。

子白

102,599

虎仔

2024-10-22

1385

最佳实践：通义灵码生成单元测试，让单测更简单

本文首先讲述了什么是单元测试、单元测试的价值、一个好的单元测试所具备的原则，进而引入如何去编写一个好的单元测试，通义灵码是如何快速生成单元测试的。

虎仔

1,385

ModelScope

2024-05-15

1087

Modelscope结合α-UMi：基于Modelscope的多模型协作Agent

基于单个开源小模型的工具调用Agent，由于模型容量和预训练能力获取的限制，无法在推理和规划、工具调用、回复生成等任务上同时获得比肩大模型等性能。

ModelScope

1,087

ModelScope

2024-05-15

110137

FunASR 语音大模型在 Arm Neoverse 平台上的优化实践

Arm 架构的服务器通常具备低功耗的特性，能带来更优异的能效比。相比于传统的 x86 架构服务器，Arm 服务器在相同功耗下能够提供更高的性能。这对于大模型推理任务来说尤为重要，因为大模型通常需要大量的计算资源，而能效比高的 Arm 架构服务器可以提供更好的性能和效率。

ModelScope

110,137

ModelScope

2024-05-15

677

适合假期自学一战成名的必看秘籍-五板斧打造AgentScope应用

本文写给有一定编程基础的学习者，得以入门源码级开发Agentscope应用，并上线创空间，参加AgentScope的应用开发挑战赛。

ModelScope

677

ModelScope

2024-05-15

104812

手把手教你捏一个自己的Agent

Modelscope AgentFabric是一个基于ModelScope-Agent的交互式智能体应用，用于方便地创建针对各种现实应用量身定制智能体，目前已经在生产级别落地。

ModelScope

104,812

丕天

2025-03-21

1296

AI 推理场景的痛点和解决方案

一个典型的推理场景面临的问题可以概括为限流、负载均衡、异步化、数据管理、索引增强 5 个场景。通过云数据库 Tair 丰富的数据结构可以支撑这些场景，解决相关问题，本文我们会针对每个场景逐一说明。

丕天

1,296

吴昆

2024-05-15

222169

Kube Queue：Kubernetes 任务排队的利器

吴昆

222,169

ModelScope

2024-05-15

893

联合XTuner，魔搭社区全面支持数据集的长文本训练

XTuner和魔搭社区（SWIFT）合作引入了一项长序列文本训练技术，该技术能够在多GPU环境中将长序列文本数据分割并分配给不同GPU，从而减少每个GPU上的显存占用。通过这种方式，训练超大规模模型时可以处理更长的序列，提高训练效率。魔搭社区的SWIFT框架已经集成了这一技术，支持多种大模型和数据集的训练。此外，SWIFT还提供了一个用户友好的界面，方便用户进行训练和部署，并且支持评估功能。

ModelScope

893

官方博客-第12页-阿里云开发者社区

类目筛选

内容类型

大语言模型推理提速，TensorRT-LLM 高性能推理实践

最佳实践：通义灵码生成单元测试，让单测更简单

Modelscope结合α-UMi：基于Modelscope的多模型协作Agent

FunASR 语音大模型在 Arm Neoverse 平台上的优化实践

适合假期自学一战成名的必看秘籍-五板斧打造AgentScope应用

手把手教你捏一个自己的Agent

AI 推理场景的痛点和解决方案

Kube Queue：Kubernetes 任务排队的利器

联合XTuner，魔搭社区全面支持数据集的长文本训练

官方博客-第12页-阿里云开发者社区

探索云世界

热门

云计算

大数据

云原生

人工智能

数据库

开发与运维

活动广场

任务中心

训练营

直播

乘风者计划

下载

镜像站

技术资料

类目筛选

内容类型

大语言模型推理提速，TensorRT-LLM 高性能推理实践

最佳实践：通义灵码生成单元测试，让单测更简单

Modelscope结合α-UMi：基于Modelscope的多模型协作Agent

FunASR 语音大模型在 Arm Neoverse 平台上的优化实践

适合假期自学一战成名的必看秘籍-五板斧打造AgentScope应用

手把手教你捏一个自己的Agent

AI 推理场景的痛点和解决方案

Kube Queue：Kubernetes 任务排队的利器

联合XTuner，魔搭社区全面支持数据集的长文本训练